Technologies de recherche et Retrieval Engineering pour les systèmes Search et IA en production
Expérience sur des systèmes de recherche et de retrieval en production
“The Vespa audit was thorough, clearly structured, and addressed exactly what we needed—performance, scalability, and cost optimization. Their depth of search expertise and clear communication stood out throughout the engagement.”
“Searchplex delivered a hybrid, multilingual search solution that elevated our document retrieval system, resulting in faster & more precise searches across multiple languages. This capability was crucial for our legal tech needs.”
“Excited about this partnership. Many of the customers we speak to are held back by not having the development capacity in-house to build the solutions they want on Vespa. Searchplex can help with that.”
Comprendre le problème avant de choisir l’architecture
Tous les problèmes de recherche ne nécessitent pas une nouvelle plateforme. Parfois, les gains viennent d’un meilleur retrieval, d’un meilleur ranking ou d’une meilleure évaluation sur la stack existante. Dans d’autres cas, c’est l’architecture elle-même qui devient la contrainte. Nous partons des usages, des requêtes et des contraintes de charge pour déterminer ce qui doit réellement changer sur le plan technique.
Pour l’utilisateur, la recherche est l’expérience visible : une barre de recherche, des filtres, des recommandations ou la réponse d’un assistant. Le retrieval est la couche d’ingénierie située en dessous : comment les données sont modélisées et indexées, quels documents ou produits sont récupérés comme candidats, comment ils sont classés et à quelle vitesse. Le Retrieval Engineering consiste à concevoir, construire et mesurer cette couche.
Les technologies de recherche modernes vont au-delà de la simple recherche par mots-clés. La recherche hybride (Hybrid Search) combine recherche lexicale (full-text) et recherche sémantique ou vectorielle. En production s’ajoutent le filtrage, le ranking et le reranking, les mises à jour en temps réel et l’évaluation continue. La bonne combinaison dépend des requêtes, des données et de ce que le système doit réellement fournir en production.
Moderniser Elasticsearch, OpenSearch et Solr
De nombreuses organisations font fonctionner leur plateforme de recherche sur Elasticsearch, OpenSearch ou Apache Solr. Ce sont des technologies matures, qui restent adaptées à de nombreux cas d’usage et profils de charge. La vraie question n’est pas de savoir si ces plateformes sont bonnes, mais si elles correspondent encore à ce que votre produit ou votre organisation attend aujourd’hui de la recherche.
Une stack devient une contrainte lorsque les améliorations de pertinence se heurtent à l’architecture, lorsque la recherche hybride ou vectorielle doit être greffée après coup sur l’existant, lorsque le ranking et le filtrage deviennent lents ou coûteux à grande échelle, ou lorsque les mises à jour en temps réel et la personnalisation exigent de plus en plus de contournements.
Modèle de données, architecture de retrieval, ranking et infrastructure
Nous identifions où se situe réellement la contrainte.
Configuration, pertinence ou évaluation
Si la contrainte vient de là, nous améliorons la stack existante.
Architecture comme goulet d’étranglement
Si elle est architecturale, nous étayons la décision de migrer par des éléments mesurables.
Lors d’une migration, nous vérifions la query parity : la nouvelle stack doit atteindre une qualité de recherche équivalente ou meilleure sur les requêtes qui comptent réellement pour le système. Nous comparons de façon contrôlée les résultats de recherche, le schéma, le ranking, les performances et les coûts. Le replatforming devient ainsi une étape d’ingénierie mesurée plutôt qu’un changement fondé sur des hypothèses.
Vespa.ai : conseil, migration et implémentation
Searchplex part du problème de retrieval avant de choisir l’architecture. Pour les systèmes en production, Vespa.ai est souvent notre plateforme privilégiée parce qu’elle réunit retrieval lexical, recherche vectorielle, ranking, inférence de modèles ML et mises à jour en temps réel dans une même plateforme de serving.
Cela en fait une base solide pour la recherche hybride, le RAG, les recommandations, la personnalisation et les agents IA en production. Searchplex est partenaire officiel de Vespa.ai et certifié Vespa Project & Implementation Partner. Vespa.ai peut fonctionner sur Vespa Cloud ou en self-hosted. Nous conseillons l’option la mieux adaptée aux contraintes techniques et opérationnelles de votre organisation.
Évaluation et Proof of Concept
Migration
Implémentation
Optimisation et support
Pertinence de la recherche, ranking et Query Understanding
La pertinence de la recherche décrit dans quelle mesure les résultats récupérés et classés correspondent au besoin d’information de l’utilisateur. Nous identifions où la qualité se perd : dans la compréhension de la requête (Query Understanding), le retrieval, le filtrage ou le ranking. Nous le mesurons à l’aide d’évaluations offline, de métriques adaptées et, lorsque c’est possible, d’expérimentations online.
Distinguer les classes de requêtes
Recherche en français
Un processus d’ingénierie mesurable
AI Search, RAG et agents IA
La couche de retrieval détermine en grande partie quelles informations un système RAG ou un agent IA peut réellement utiliser. La chaîne va du LLM ou de l’agent au retrieval et au ranking, puis au contexte fourni au modèle et enfin à la réponse. Une information absente ou classée trop bas au début de cette chaîne est souvent difficile à récupérer de manière fiable plus tard.
Au-delà des embeddings et de la recherche vectorielle
Plusieurs recherches, une même base de retrieval
Trouvez le bon point de départ.
Certaines équipes ont besoin d’un Search Stack Audit. D’autres d’un Proof of Concept ciblé, d’un greenfield build, de Relevance Engineering ou d’un accompagnement sur Vespa.ai.
Search Stack Audit
Migration & Modernisation
Relevance Engineering & Optimisation
Proof of Concept & Build
Quand la recherche devient critique pour le produit
E-commerce et Product Discovery
Enterprise Search et plateformes de connaissances
Recherche juridique, fiscale et réglementaire
Expérience sur des systèmes de recherche complexes en Europe
Recherche fiscale
Pour Nextens, nous avons audité puis repensé le système de recherche en production derrière des produits de recherche fiscale. Le travail portait notamment sur la pertinence, la gestion de contenus versionnés et un meilleur contrôle du retrieval.
De la recherche sémantique au retrieval hybride et multilingue
Nous avons accompagné CuratedAI dans le passage d’une recherche purement sémantique à un retrieval hybride et multilingue sur Vespa.ai. Le droit de l’Union européenne et le droit national belge sont ainsi consultables en français, en néerlandais et en anglais.
Audit d’architecture Vespa.ai pour la recherche de brevets
Pour IPRally, nous avons audité l’architecture d’une plateforme de recherche de brevets en production sur Vespa.ai, en étudiant le comportement de recherche, la représentation des données, l’infrastructure et les performances.
Expérience de la recherche multilingue et des systèmes de recherche globaux
Searchplex possède une expérience pratique des systèmes de recherche multilingues et des plateformes de recherche internationales, notamment en français, néerlandais, allemand, espagnol, portugais et dans d’autres langues utilisées par des produits globaux.
La recherche multilingue ne se limite pas à la traduction. Tokenisation, analyse linguistique, normalisation, synonymes, morphologie, compréhension des requêtes, ranking et évaluation peuvent varier selon la langue et le domaine. La bonne approche dépend des requêtes réelles, des contenus et des exigences de retrieval.
Cette expérience provient également de travaux sur des systèmes de recherche à grande échelle pour des entreprises internationales et nourrit aujourd’hui nos projets de modernisation de la recherche, Relevance Engineering, retrieval multilingue et implémentation de Vespa.ai.
La communication écrite du projet, les spécifications et la documentation peuvent être réalisées en français. Les réunions et les échanges techniques à l’oral se déroulent en anglais.
Searchplex aux Pays-Bas
Searchplex B.V. est une société néerlandaise spécialisée en Search et Retrieval Engineering, basée à Amsterdam et immatriculée au registre du commerce néerlandais (KVK 89631315).
Nous travaillons avec des équipes produit, engineering et search en Europe et à l’international, sur des systèmes où la qualité de recherche, la capacité à passer à l’échelle et la fiabilité sont des exigences importantes du produit.
Questions fréquentes
Commencez là où se trouve la contrainte
Certaines équipes ont besoin d’un Search Stack Audit. D’autres d’un Proof of Concept ciblé, d’un greenfield build, de Relevance Engineering ou d’un accompagnement sur Vespa.ai. Commencez là où se trouve réellement la contrainte.