Azure Cosmos DB
Cette documentation a été retirée et pourrait ne pas être mise à jour. Consultez le référentiel GitHub officiel du connecteur Spark Cosmos DB.
Azure Cosmos DB est la base de données multimodèle distribuée mondialement de Microsoft. Azure Cosmos DB vous permet de monter en charge le throughput et le stockage de manière élastique et indépendante à travers un nombre illimité de régions géographiques Azure. Il offre des garanties complètes de throughput, de latence, de disponibilité et de cohérence avec des accords de niveau de service (SLA) complets. Azure Cosmos DB fournit des APIs pour les modèles de données suivants, avec des SDK disponibles dans plusieurs langues :
- API SQL
- API MongoDB
- API Cassandra
- Graphe (Gremlin) API
- API de table
Cet article explique comment lire et écrire des données dans Azure Cosmos DB à l'aide de Databricks. Pour les détails les plus récents concernant Azure Cosmos DB, consultez Accélérez l'analytique Big Data en utilisant le connecteur Apache Spark vers Azure Cosmos DB.
Ressources:
Ce connecteur prend en charge l'API principale (SQL) d'Azure Cosmos DB. Pour l'API Cosmos DB pour MongoDB, utilisez le connecteur MongoDB Spark. Pour l'API Cosmos DB Cassandra, utilisez le connecteur Cassandra Spark.
Créer et joindre les bibliothèques requises
- Téléchargez la dernière bibliothèque azure-cosmosdb-spark pour la version d'Apache Spark que vous exécutez.
- Upload les fichiers JAR downloaded vers Databricks. Consultez Installer les bibliothèques.
- Installez les bibliothèques upload dans votre cluster Databricks.