Interroger un ensemble de données public avec la bibliothèque cliente BigQuery Node.js

Bibliothèque cliente BigQuery Node.js : interroger des données publiques

Découvrez comment :

  1. Activer Cloud Shell dans un projet Google Cloud
  2. Ouvrir l'éditeur Cloud Shell
  3. Préparer les fichiers pour les requêtes
  4. Interroger un ensemble de données public dans BigQuery
  5. effectuer un nettoyage.

Durée estimée :

Pour commencer, cliquez sur Démarrer.

Activer Cloud Shell dans un projet Google Cloud

  1. Si vous n'activez pas la facturation pour un projet, vous travaillez automatiquement dans le bac à sable BigQuery. Ce bac à sable vous permet d'apprendre à utiliser BigQuery avec un ensemble limité de fonctionnalités sans frais. Si vous ne prévoyez pas d'utiliser votre projet au-delà de ce document, nous vous recommandons d'utiliser le bac à sable BigQuery.

  2. Cliquez sur Activer Cloud Shell . Démonstration

Pour découvrir comment ouvrir l'éditeur Cloud Shell, cliquez sur Suivant.

Ouvrir l'éditeur Cloud Shell

  1. Dans Cloud Shell, créez un projet Node.js et le fichier associé :

    mkdir bigquery-node-quickstart \
        && touch \
        bigquery-node-quickstart/app.js
    

    Cette commande crée un projet Node.js nommé bigquery-node-quickstart et un fichier intitulé app.js.

  2. Ouvrez l'éditeur Cloud Shell :

    cloudshell workspace bigquery-node-quickstart
    

Pour apprendre à préparer les fichiers pour les requêtes, cliquez sur Suivant.

Préparer les fichiers pour les requêtes

  1. Pour ouvrir un terminal dans l'éditeur Cloud Shell, cliquez sur Ouvrir le terminal.

  2. Ouvrez le répertoire de votre projet :

    cd bigquery-node-quickstart
    
  3. Installez la bibliothèque cliente BigQuery pour Node.js :

    npm install @google-cloud/bigquery
    

    Le résultat ressemble à ce qui suit :

    added 63 packages in 2s
    

Pour apprendre à interroger un ensemble de données public dans BigQuery, cliquez sur Suivant.

Interroger un ensemble de données public dans BigQuery

  1. Cliquez sur Ouvrir l'éditeur.

  2. Dans le volet Explorateur, localisez votre projet BIGQUERY-NODE-QUICKSTART.

  3. Cliquez sur le fichier app.js pour l'ouvrir.

  4. Pour créer une requête sur l'ensemble de données bigquery-public-data.stackoverflow qui renvoie les 10 pages Stack Overflow les plus consultées et leur nombre de vues, copiez le code suivant dans le fichier app.js :

    // Import the Google Cloud client library
    const {BigQuery} = require('@google-cloud/bigquery');
    
    async function queryStackOverflow() {
      // Queries a public Stack Overflow dataset.
    
      // Create a client
      const bigqueryClient = new BigQuery();
    
      // The SQL query to run
      const sqlQuery = `SELECT
        CONCAT(
          'https://stackoverflow.com/questions/',
          CAST(id as STRING)) as url,
        view_count
        FROM \`bigquery-public-data.stackoverflow.posts_questions\`
        WHERE tags like '%google-bigquery%'
        ORDER BY view_count DESC
        LIMIT 10`;
    
      const options = {
        query: sqlQuery,
        // Location must match that of the dataset(s) referenced in the query.
        location: 'US',
      };
    
      // Run the query
      const [rows] = await bigqueryClient.query(options);
    
      console.log('Query Results:');
      rows.forEach(row => {
        const url = row['url'];
        const viewCount = row['view_count'];
        console.log(`url: ${url}, ${viewCount} views`);
      });
    }
    queryStackOverflow();

  5. Cliquez sur Ouvrir le terminal.

  6. Dans le terminal, exécutez le script app.js. Si vous êtes invité à autoriser Cloud Shell et à accepter les conditions, cliquez sur Autoriser.

    node app.js
    

    Le résultat ressemble à ce qui suit :

    Query Results:
    url: https://stackoverflow.com/questions/35159967, 170023 views
    url: https://stackoverflow.com/questions/22879669, 142581 views
    url: https://stackoverflow.com/questions/10604135, 132406 views
    url: https://stackoverflow.com/questions/44564887, 128781 views
    url: https://stackoverflow.com/questions/27060396, 127008 views
    url: https://stackoverflow.com/questions/12482637, 120766 views
    url: https://stackoverflow.com/questions/20673986, 115720 views
    url: https://stackoverflow.com/questions/39109817, 108368 views
    url: https://stackoverflow.com/questions/11057219, 105175 views
    url: https://stackoverflow.com/questions/43195143, 101878 views
    

Vous venez d'interroger un ensemble de données public avec la bibliothèque cliente BigQuery pour Node.js.

Pour éviter que des frais ne soient facturés sur votre compte et pour découvrir les étapes suivantes, cliquez sur Suivant.

Étapes suivantes

Conservez les ressources que vous avez créées et exploitez tout le potentiel de BigQuery, ou effectuez un nettoyage pour éviter que des frais ne vous soient facturés.

Exploiter tout le potentiel de BigQuery

Effectuer un nettoyage

Pour éviter que des frais ne soient facturés sur votre compte Google Cloud , supprimez votre projet Google Cloud ou les ressources que vous avez créées dans ce tutoriel.

Supprimer le projet

Si vous avez créé un projet pour apprendre à utiliser BigQuery et que vous n'en avez plus besoin, supprimez-le. Sachez que la suppression d'un projet entraîne la suppression de tout son contenu, y compris des ID de projets personnalisés.

Supprimer les ressources

Si vous avez utilisé un projet existant, supprimez le dossier bigquery-node-quickstart que vous avez créé :

  1. Dans Cloud Shell, remontez dans le répertoire parent de celui actuellement sélectionné :

    cd ..
    
  2. Supprimez les ressources que vous avez créées :

    rm -R bigquery-node-quickstart
    

    Le flag -R supprime tous les éléments d'un dossier.