Loading
CRM Analytics
Google BigQuery para conexión SQL heredada

Google BigQuery para conexión SQL heredada

Cree una conexión remota utilizando el conector Google BigQuery para sincronizar datos desde Google BigQuery con CRM Analytics.

Importante
Importante Utilice la Conexión SQL estándar de Google BigQuery en vez de este conector si utiliza SQL estándar o cuando consulte tablas particionadas. Para obtener más información sobre las limitaciones con tablas particionadas y SQL heredada, consulte Introducción a tablas particionadas de Google.

Requisitos de conexión

La cuenta de servicio que utiliza para conectar con Google Big Query debe tener la función estándar "Visor de datos de BigQuery" y una función personalizada con estos permisos.

  • bigquery.jobs.create
  • bigquery.jobs.get
  • bigquery.jobs.list
  • bigquery.jobs.listAll
  • bigquery.jobs.update
  • bigquery.tables.create
  • bigquery.tables.delete
  • bigquery.tables.update
  • bigquery.tables.updateData
  • storage.buckets.list

La creación de cuentas genera un archivo JSON de propiedades de cuenta. La mayoría de los parámetros de conexión necesarios están en este archivo. Para obtener más información sobre cómo ver y descargar detalles de cuenta de servicio, consulte la documentación de Google Creación y gestión de claves de cuentas de servicio.

Crear conexión

  1. En la ficha Conexiones del Gestor de datos, haga clic en Nueva conexión.
  2. Haga clic en el nombre del conector y haga clic en Siguiente.
  3. Ingrese los parámetros del conector.
  4. Haga clic en Guardar y probar para validar sus parámetros e intentar conectar con el origen. Si la conexión falla, CRM Analytics muestra posibles motivos.

Todas las configuraciones requieren un valor, a menos que se indique lo contrario.

Configuración de conexión Descripción
Nombre de conexión Identifica las conexiones. Use una convención que le permita distinguir fácilmente entre diferentes conexiones.
Nombre del desarrollador Nombre de la API para la conexión. Este nombre no puede incluir ningún espacio. El nombre de API se usa en sus recetas para hacer referencia a los datos extraídos con esta conexión. No puede cambiar el nombre del desarrollador tras crear la conexión.
Descripción Descripción
Esquema Nombre del Id. del conjunto de datos de Google BigQuery al que se va a conectar.
Clave privada

Ingrese el valor de private_key desde el archivo JSON.

No incluya "private_key": "-----BEGIN PRIVATE KEY-----" al inicio de la clave y \n-----END PRIVATE KEY-----\n" al final.

Email de cliente Ingrese el valor de client_email desde el archivo JSON.
Id. de Proyecto

Ingrese el valor de project_id desde el archivo JSON.

Si tiene múltiples proyectos con la misma cuenta de servicio, ingrese el Id. del proyecto que contiene el conjunto de datos al que desea conectarse.

Id. de proyecto de facturación El Id. de la cuenta de Cloud Billing en la que desea que se cargue la actividad de esta conexión.
Modo de extracción

Configuración opcional. Ingrese uno de los siguientes modos para extraer datos desde Google BigQuery. Directo es el valor predeterminado si no se especifica ningún modo.

Directo: Utilice este modo para extraer pequeños volúmenes de datos. El conector extrae los datos directamente desde Google BigQuery.

Ensayo: Utilice este modo para extraer grandes volúmenes de datos, como 10 millones de registros. Para aumentar el desempeño al gestionar grandes volúmenes de datos, el conector realiza primero una organización de los datos en la ruta de almacenamiento de Google Cloud especificada y luego extrae los datos desde la ruta de almacenamiento. Si una extracción directa falla, pruebe a utilizar este modo de extracción.

Utilizar API de almacenamiento

Configuración opcional.

True: Utiliza la API de lectura de Google BigQuery Storage. Consulte la documentación de API de lectura de almacenamiento de BigQuery de Google para comprender su consumo previsto y el precio de extracción de datos de Google para obtener información sobre costo adicional.

Falso: Utiliza el modo Extracción directa. Este modo tiene un límite de datos de 10MB.

Filtrar datos sincronizados con CRM Analytics

Excluya datos confidenciales o innecesarios de la sincronización en CRM Analytics con filtros de sincronización de datos. Los filtros se ejecutan en el objeto de origen y aceleran la sincronización de datos extrayendo solo los datos que necesita en CRM Analytics.

Nota
Nota Si puede utilizar datos excluidos en el futuro, utilice un filtro de receta para limitar los datos escritos en un conjunto de datos en vez de un filtro de sincronización de datos.
  1. Desde el Gestor de datos, haga clic en la ficha Conexiones.
  2. Seleccione la conexión asociada con el objeto para filtrar.
  3. Haga clic en el nombre del objeto para filtrar.
  4. Haga clic en Filtro de sincronización de datos.
  5. Ingrese el filtro.
  6. Haga clic en Guardar.

Para el conector Google BigQuery, ingrese un filtro en la sintaxis descrita en Ayuda de BigQuery de Google.

Consideraciones del conector Google BigQuery

Tenga en cuenta estos comportamientos cuando trabaje con el conector Google BigQuery.

  • Los nombres de objetos conectados deben comenzar por una letra e incluir solo letras, dígitos y guiones bajos. Los nombres de objeto no puede terminar con un guion bajo.
  • Solo se admiten los nombres de campo con combinaciones de caracteres alfanuméricos, puntos, guiones bajos o guiones. Si un conector incluye nombres de campo que contienen otros caracteres, como espacios o corchetes, la sincronización falla.
  • El conector puede sincronizar hasta 100 millones de filas o 50 GB por objeto, cualquiera que sea el límite que se alcance primero.
  • La tablas de BigQuery que utilizan datos integrados desde Google Drive no son compatibles. Los datos de Google Drive deben pasar a BigQuery.
Campos anidados y repetidos
El conector reduce los campos anidados y los sincroniza como campos independientes. Además, el conector genera nuevas filas para los campos repetidos. Observemos un ejemplo. Los datos de contacto de este archivo JSON contienen la dirección actual y la anterior de cada contacto. El campo direcciones tiene anidados los campos estado, calle, ciudad y país. Estos campos anidados aparecen dos veces para cada contacto: primero para la dirección actual y luego para la dirección anterior.
{"id":"1","name":"James Park","addresses":[{"status":"current","street":"1 Harper Alley","city":"Toledo","state":"OH"},{"status":"previous","street":"392 Parkside Street","city":"Seattle","state":"WA"}]}
{"id":"2","name":"Lori Carr","addresses":[{"status":"current","street":"7501 Talisman Court","city":"Fort Worth","state":"TX"},{"status":"previous","street":"3368 Anderson Lane","city":"Moreno Valley","state":"CA"}]}

Si incluye el campo direcciones para sincronización, cada campo anidado aparecerá como un campo separado en cada fila del objeto conectado que sincronizó. Los campos de dirección repetidos dan como resultado dos filas para cada contacto: una fila para la dirección actual y una fila para la dirección anterior.

Id.nombredirecciones.estadodirecciones.calledirecciones.ciudaddirecciones.estado
1 James Park actual 1 Harper Alley Toledo OH
1 James Park anterior 392 Parkside Street Seattle WA
2 Lori Carr actual 7501 Talisman Court Fort Worth TX
2 Lori Carr anterior 3368 Anderson Lane Moreno Valley CA
Tablas de destino temporales
El conector crea tablas de destino temporales en BigQuery para crear etapas para los datos antes de servirlas al cliente. El conector denomina estas tablas con el formato EA_TEMP_<5-character random string>_<objectName>. Normalmente, las tablas se eliminan de forma automática. Para evitar que se generen costos de almacenamiento de datos adicionales en Google BigQuery, verifique que todas las tablas temporales se hayan eliminado y elimine manualmente las tablas que no se eliminaron.
Compatibilidad de tabla
El conector Google BigQuery para SQL heredado admite Tablas SQL estándar, Tablas SQL heredadas y Vistas SQL heredadas, pero no admite Vistas SQL estándar.
Nota
Nota Este conector utiliza la API de lectura de Google BigQuery Storage para un mayor rendimiento y puede afectar a su facturación de Google. Es posible que vea un aumento del costo por TB si no tiene un plan de tarifa plana. Consulte la documentación de API de lectura de almacenamiento de BigQuery de Google para comprender su consumo previsto y el precio de extracción de datos de Google para obtener información sobre costo adicional.
Configuración adicional requerida para conector heredado
Configuración Descripción
Ruta de almacenamiento

Solo aplicable a la versión de conector heredada. Se requiere al utilizar el modo de extracción por organización. Ruta en Almacenamiento de Google Cloud, donde se crea un archivo de etapa local para almacenar los datos temporalmente. Ingrese el nombre de depósito o el nombre de depósito y nombre de carpeta. Por ejemplo, ingrese <bucket_name> o <bucket_name>/<folder_name>.

Para escribir archivos en este área de organización, el usuario especificado en Email de cliente debe tener permisos para listar, leer y escribir en el depósito.

 
Cargando
Salesforce Help | Article