Vous êtes ici :
Connexion Databricks
Synchronisez Databricks vers CRM Analytics en créant une connexion distante.
Créer la connexion
- Sous l'onglet Connexions du Gestionnaire de données, cliquez sur Nouvelle connexion.
- Cliquez sur le nom du connecteur, puis sur Suivant.
- Saisissez les paramètres du connecteur.
- Pour valider vos paramètres et tenter une connexion à la source, cliquez sur Enregistrer et tester. Si la connexion échoue, CRM Analytics indique les raisons possibles.
Connexion à Databricks avec OAuth
Pour utiliser le connecteur Databricks avec l'authentification OAuth, vous devez configurer votre principal de service Databricks et générer un ID de client et un secret. Pour plus d'informations, consultez Aide sur Databricks Autoriser l'accès sans surveillance aux ressources Databricks avec un principal de service utilisant OAuth.
Databricks utilise l'authentification OAuth machine à machine (M2M), qui offre une sécurité supplémentaire, et permet de spécifier, à des granularités plus fines, les objets accessibles et les privilèges d'accès spécifiques accordés pour ces objets. Avec M2M OAuth, aucun fournisseur d'authentification externe n'est requis.
Vous spécifiez l'ID client et un secret client à utiliser pour l'authentification dans les paramètres de connexion. Databricks définit des données d'expiration sur ces valeurs, qui doivent être gérées. Lorsque vous générez le secret OAuth dans Databricks, vous pouvez définir la durée de vie du secret en jours, avec un maximum de 730 jours (2 ans). Lorsque les valeurs d'ID client et de secret expirent, vous devez mettre à jour votre connexion Databricks avec les valeurs mises à jour.
Paramètres de connexion
Tous les paramètres sont requis.
| Paramètre | Description |
|---|---|
| Nom de connexion | Le nom de la connexion. Utilisez un nom permettant de différencier aisément les connexions. |
| Nom du développeur | Le nom du développeur est utilisé dans vos recettes pour référencer les données extraites via cette connexion. Le nom ne peut pas inclure d'espaces. Une fois la connexion créée, vous ne pouvez pas changer le nom du développeur. |
| Description | La description de la connexion. |
| Type d'authentification | Le type d'authentification. Les valeurs valides sont OAuth ou Token. |
| Jeton | Obligatoire uniquement pour l'authentification Token. Le jeton d'accès personnel pour Databricks. Vous trouverez la valeur dans votre page Paramètres utilisateur Databricks sous l'onglet Jetons d'accès. |
| ID de client | Obligatoire uniquement pour l'authentification OAuth. L'ID client généré par Databricks. Vous trouverez la valeur dans votre page Databricks Service Prinipal sous l'onglet Secrets. Cette valeur expire et doit être mise à jour lorsqu'un nouveau secret est généré. |
| Secret client | Obligatoire uniquement pour l'authentification OAuth. Les Databricks ont généré un secret client. Vous trouverez la valeur dans votre page Databricks Service Prinipal sous l'onglet Secrets. Cette valeur expire et doit être mise à jour lorsqu'un nouveau secret est généré. |
| Serveur | Le nom d'hôte du serveur du cluster Databricks. |
| HTTPPath | Le chemin HTTP du cluster Databricks. |
| Base de données | Le nom de la base de données Databricks. |
| Schéma | Le nom de la base de données Databricks. |
| Catalogue | Le nom du catalogue Databricks. Par défaut hive_metastore. |
Pour plus d'informations, consultez Établissement d'une connexion.
Considérations relatives aux connexions
Lors de l'utilisation du connecteur Databricks, tenez compte des comportements ci-dessous.
- Les noms d'objets connectés doivent commencer par une lettre, et contenir uniquement des lettres, des chiffres ou des traits de soulignement. Les noms d'objet ne peuvent pas se terminer par un trait de soulignement.
- Seuls les noms de champ qui combinent des caractères alphanumériques, point, trait de soulignement ou tiret sont pris en charge. Si un connecteur contient des noms de champ avec d'autres caractères spéciaux, par exemple des espaces ou des crochets, la synchronisation échoue.
- Ce connecteur peut synchroniser jusqu’à 10 millions de lignes ou 5 Go par tâche, selon la limite atteinte en premier.

