Une recherche plus rapide dans Paperless-ngx 3.0
La recherche dans Paperless-ngx 3.0 : plus rapide, plus intelligente, avec surlignage des résultats
Paperless-ngx 3.0 remplace son moteur de recherche par Tantivy, ajoute le surlignage des résultats, améliore la correspondance CJK et insensible aux accents, et rend toute l'archive plus réactive.
La recherche plein texte a toujours été le cœur de Paperless-ngx — c’est la différence entre une archive et une boîte pleine de documents. Dans la version 3.0, elle a été sérieusement repensée, et vous le sentirez dès les premières frappes.
Un tout nouveau moteur de recherche : Tantivy
Le plus grand changement est invisible mais spectaculaire : Paperless-ngx a remplacé Whoosh par Tantivy comme moteur de recherche. Whoosh est du pur Python et, à mesure que les archives grandissent, il devient ce sur quoi on attend. Tantivy est un moteur de recherche plein texte écrit en Rust — rapide, économe en mémoire, conçu exactement pour cet usage.
Toute la recherche textuelle passe désormais par Tantivy, et l’indexation a été réglée en conséquence. Pour les utilisateurs, cela se traduit par des requêtes plus vives, une indexation plus rapide après un gros import, et une recherche qui tient la distance à mesure que votre bibliothèque atteint des dizaines de milliers de documents.
Voyez vos correspondances : le surlignage
Chercher n’est que la moitié du travail ; l’autre moitié, c’est repérer pourquoi un résultat correspondait. La 3.0 surligne désormais les termes recherchés dans les titres et les contenus, pour les repérer du premier coup d’œil dans la liste de résultats. Fini les cinq documents ouverts pour trouver celui qui mentionne vraiment « lave-vaisselle ».
Des correspondances plus accueillantes pour plus de langues
Un moteur de recherche n’est pas meilleur que sa correspondance, et la 3.0 corrige plusieurs aspérités :
- Filtrage insensible aux diacritiques. La recherche et le filtrage ignorent désormais les accents, donc
cafetrouvecaféetMullerpeut trouverMüller. Le filtrage à la volée dans l’interface en profite aussi : insensible aux accents, il accepte désormais plusieurs termes à la fois. - Meilleure prise en charge CJK. La recherche dans les titres, contenus et métadonnées en chinois, japonais et coréen a été refondue pour que ces langues s’indexent et correspondent correctement — une amélioration appréciable pour les archives multilingues.
- Gestion des dates plus souple. Les requêtes par plage de dates et les recherches par année seule se comportent de façon plus prévisible.
« More like this », en mieux
« More like this » est l’une des fonctionnalités les plus sous-estimées de Paperless-ngx — trouver un document pertinent et sauter vers des similaires. Avec le nouveau moteur, la recherche de similarité est plus rapide et plus fiable, et quelques panics et cas limites dans ce chemin ont été lissés au fil du cycle 3.0.
La partie ennuyeuse qui compte
Rien de tout cela n’exige de configuration. Que vous fassiez tourner Paperless vous-même ou via une instance hébergée, la mise à niveau de la recherche se fait automatiquement lors du passage à la 3.0 — vos requêtes existantes continuent de fonctionner, juste plus vite. Si vous aviez écrit des requêtes avancées façon Whoosh, la 3.0 rétablit la compatibilité pour les plus courantes.
La recherche est la fonction que vous utilisez chaque jour — c’est précisément pourquoi une version plus rapide, plus claire et plus indulgente en est le héros discret de cette version. Pour les fonctions phares de l’IA, voyez ce qu’apporte Paperless AI, et pour tout le reste les améliorations du quotidien.
Prêt à passer au sans-papier ?
Lancez votre propre Paperless en quelques minutes — sans serveur, sans configuration, sans maintenance. On s'en occupe pour vous.