Aller au contenu principal

Core

Whoosh-NG s'appuie sur les fondations éprouvées de la bibliothèque Whoosh d'origine. Cette section documente les fonctionnalités classiques de recherche full-text qui propulsent Whoosh depuis plus d'une décennie — le moteur, le schéma, les analyseurs, le scoring, et tous les concepts nécessaires pour construire une recherche fiable.

Ces fonctionnalités sont stables, compatibles avec Whoosh 1.x/2.x, et résident dans le package whoosh. Les nouvelles extensions optionnelles (recherche vectorielle, plugins, middleware, providers de stockage) sont documentées sous Modern.

Ce que vous trouverez ici​

GuideDescription
Démarrage rapideIndexez vos premiers documents en cinq minutes
InstallationInstallez Whoosh-NG et ses extras optionnels
Introduction à WhooshCe qu'est Whoosh et ce qu'il peut faire pour vous
Concepts fondamentauxIndex, Schema, Writer, Searcher et flux de données
À propos des analyseursTokenizers, filtres et pipeline d'analyse
Conception de schémaTypes de champs et modélisation de vos documents
IndexationAjout, mise à jour et suppression de documents
RechercheExécution de requêtes, résultats, tri et filtres
Langage de requêteSyntaxe de requête Whoosh et QueryParser
Stemming & Mots VidesRéduction des mots à leur racine et filtrage du bruit
N-grammesCorrespondance de sous-chaînes, préfixes et autocomplétion
Dates & Plages NumériquesRequêtes et facettes sur nombres/dates
TriFacettes et clés de tri pour ordonner les résultats
SurlignageConstruire des extraits de résultats surlignés
Voulez-vous dire...Correction des fautes de frappe dans les requêtes
Expansion de requête & Mots-clésExtraction de mots-clés et « more like this »
Documents ImbriquésHiérarchies de documents parent-enfant
Concurrence & VerrouillageThreads, verrous d'écriture et versionnage
Indexation par LotAstuces pour accélérer les gros indexages
Caches de ChampsComportement de cache pour tri et facettes
Recettes WhooshExtraits de code utiles pour les tâches courantes

Pipeline d'analyse classique​

Whoosh transforme du texte brut en tokens recherchables via un pipeline composable :

Texte → Tokenizer → Filtres (minuscules, mots vides, stemming) → Termes indexés

Les guides Stemming & Mots Vides et N-grammes montrent comment personnaliser ce pipeline selon votre langue et votre cas d'usage.

Référence​

Prochaines étapes​

Prêt pour les nouveautés ? Rendez-vous dans Modern pour découvrir la recherche vectorielle, le système de plugins, le pipeline de middleware et le stockage enfichable.