Aller au contenu principal

Index de filtre de Bloom (Obsolète)

important

N'utilisez pas d'index de filtre Bloom. Databricks a déprécié cette fonctionnalité et recommande de supprimer tous les index de filtre Bloom existants de vos tables.

Les index de filtre Bloom sont un mécanisme d'omission de données hérité que Databricks ne recommande plus pour aucune charge de travail. Ils ajoutent une surcharge d'écriture, sont difficiles à optimiser et sont remplacés par des alternatives plus efficaces.

Alternatives recommandées

Utilisez plutôt les fonctionnalités suivantes :

  • E/S prédictives : Sur un compute compatible Photon avec Databricks Runtime 12.2 et versions ultérieures, les E/S prédictives effectuent l'omission de fichiers sur toutes les colonnes automatiquement. Il remplace entièrement les index de filtre de Bloom, qui n'ajoutent une surcharge d'écriture que lorsque Photon est activé.
  • Liquid clustering : Dans Databricks Runtime 13.3 et versions ultérieures, le liquid clustering améliore le saut de données en organisant les données en fonction des colonnes fréquemment filtrées.

Supprimer les index de filtre Bloom existants

Si vous avez des index de filtre Bloom existants sur vos tables, supprimez-les afin d'éliminer la surcharge d'écriture inutile :

SQL
DROP BLOOMFILTER INDEX ON TABLE table_name

Pour plus de détails sur la syntaxe, consultez DROP BLOOM FILTER INDEX.

Après avoir supprimé tous les index de filtre de Bloom, exécutez VACUUM pour nettoyer les fichiers d'index sous-jacents dans le répertoire _delta_index.