Core
Whoosh-NG s'appuie sur les fondations éprouvées de la bibliothèque Whoosh d'origine. Cette section documente les fonctionnalités classiques de recherche full-text qui propulsent Whoosh depuis plus d'une décennie — le moteur, le schéma, les analyseurs, le scoring, et tous les concepts nécessaires pour construire une recherche fiable.
Ces fonctionnalités sont stables, compatibles avec Whoosh 1.x/2.x, et résident dans le package
whoosh. Les nouvelles extensions optionnelles (recherche vectorielle, plugins, middleware, providers de stockage) sont documentées sous Modern.
Ce que vous trouverez ici
| Guide | Description |
|---|---|
| Démarrage rapide | Indexez vos premiers documents en cinq minutes |
| Installation | Installez Whoosh-NG et ses extras optionnels |
| Introduction à Whoosh | Ce qu'est Whoosh et ce qu'il peut faire pour vous |
| Concepts fondamentaux | Index, Schema, Writer, Searcher et flux de données |
| À propos des analyseurs | Tokenizers, filtres et pipeline d'analyse |
| Conception de schéma | Types de champs et modélisation de vos documents |
| Indexation | Ajout, mise à jour et suppression de documents |
| Recherche | Exécution de requêtes, résultats, tri et filtres |
| Langage de requête | Syntaxe de requête Whoosh et QueryParser |
| Stemming & Mots Vides | Réduction des mots à leur racine et filtrage du bruit |
| N-grammes | Correspondance de sous-chaînes, préfixes et autocomplétion |
| Dates & Plages Numériques | Requêtes et facettes sur nombres/dates |
| Tri | Facettes et clés de tri pour ordonner les résultats |
| Surlignage | Construire des extraits de résultats surlignés |
| Voulez-vous dire... | Correction des fautes de frappe dans les requêtes |
| Expansion de requête & Mots-clés | Extraction de mots-clés et « more like this » |
| Documents Imbriqués | Hiérarchies de documents parent-enfant |
| Concurrence & Verrouillage | Threads, verrous d'écriture et versionnage |
| Indexation par Lot | Astuces pour accélérer les gros indexages |
| Caches de Champs | Comportement de cache pour tri et facettes |
| Recettes Whoosh | Extraits de code utiles pour les tâches courantes |
Pipeline d'analyse classique
Whoosh transforme du texte brut en tokens recherchables via un pipeline composable :
Texte → Tokenizer → Filtres (minuscules, mots vides, stemming) → Termes indexés
Les guides Stemming & Mots Vides et N-grammes montrent comment personnaliser ce pipeline selon votre langue et votre cas d'usage.
Référence
- Glossaire — Termes clés utilisés dans toute la documentation
- Guide de Migration — Passage depuis Whoosh ou Whoosh-Reloaded
- Stratégie de Nettoyage Legacy — Évolution de la surface typée moderne
Prochaines étapes
Prêt pour les nouveautés ? Rendez-vous dans Modern pour découvrir la recherche vectorielle, le système de plugins, le pipeline de middleware et le stockage enfichable.