Back to flin
flin

Requêtes graphe et recherche sémantique

Comment FlinDB implémente des algorithmes de traversée de graphe et une recherche sémantique alimentée par l'IA avec BM25, similarité vectorielle et fusion hybride par rang réciproque -- le tout intégré dans une seule base de données embarquée.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 2 min flin
EN/ FR/ ES
flinflindbgraphsemantic-searchai

Les phases 3 et 4 de la session 166 ont ajouté des capacités pour lesquelles la plupart des bases de données facturent un supplément. Requêtes graphe -- plus court chemin, PageRank, composantes connexes, détection de cycles, tri topologique. Recherche sémantique -- embeddings vectoriels, classement par mots-clés BM25, recherche hybride.

FlinDB a les deux. Intégrés dans la même base de données embarquée. Pas de services supplémentaires. Pas d'appels réseau.

Requêtes graphe

Le système de références d'entités de FlinDB forme naturellement un graphe. Chaque référence d'une entité à une autre est une arête.

Plus court chemin : BFS entre entités. Cas d'usage : réseaux sociaux, hiérarchies organisationnelles, graphes de dépendances.

Traversée multi-sauts : traverse() parcourt le graphe de relations à une profondeur configurable.

PageRank : calcul de scores d'influence à travers les graphes d'entités.

Composantes connexes : identifie les groupes d'entités connectées par des références.

Détection de cycles : détecte les références circulaires dans les graphes d'entités.

Tri topologique : ordonne les entités pour que les dépendances viennent avant les dépendants.

Recherche sémantique

Classement BM25 par mots-clés

FlinDB implémente BM25 -- le même algorithme de classement utilisé par Elasticsearch et Solr.

rustdb.keyword_search("comfortable office chair", "Product", "description", 10)?;

Recherche par similarité vectorielle

Pour la compréhension sémantique au-delà de la correspondance par mots-clés, FlinDB génère des embeddings vectoriels pour les champs semantic text.

flinentity Product {
    name: text
    description: semantic text
}

// Search by meaning
results = db.semantic_search("comfortable seating for work", "Product", "description", 10)

Recherche hybride : le meilleur des deux mondes

La recherche hybride combine les deux en utilisant la fusion par rang réciproque (RRF) :

RRF_score(d) = 1/(k + rank_keyword(d)) + 1/(k + rank_semantic(d))

Pourquoi ces fonctionnalités vont ensemble

Une architecture traditionnelle pour une application alimentée par l'IA nécessiterait : PostgreSQL pour les données relationnelles, Neo4j pour les requêtes graphe, Elasticsearch pour la recherche par mots-clés, Pinecone pour la recherche vectorielle.

Quatre bases de données. Quatre chaînes de connexion. Quatre schémas. FlinDB fournit les quatre capacités dans une seule base de données embarquée.


Ceci est la partie 9 de la série « How We Built FlinDB ».

Navigation de la série : - [062] Relationships and Eager/Lazy Loading - [063] Transactions and Continuous Backup - [064] Graph Queries and Semantic Search (vous êtes ici) - [065] The EAVT Storage Model - [066] Database Encryption and Configuration

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Thales & Claude deblo

Le Step Zero ne suffisait pas : comment valider un constructeur sans valider le runtime a fait tomber toutes les sessions vocales de Déblo l’heure où nous avons livré le streaming caméra temps réel

La phase 14 a livré Déblo Eyes — streaming caméra temps réel via LiveKit vers Gemini Live native audio. Le premier deploy a fait tomber toutes les sessions vocales en production en quatre-vingt-dix secondes parce que notre Step 0 avait validé le constructeur sans exercer le runtime. Le build log de comment Déblo a eu des yeux, ce qu’un pré-vol incomplet a coûté, et quels points de polish ont été livrés ou reportés.

33 min May 20, 2026
debloclaude-opus-4.7claude-codegemini-live +25
Thales & Claude deblo

Le tiret cadratin qui a tué la production : comment un slogan marketing dans un header HTTP a fait tomber le chat de Déblo pendant 24 heures

Deux jours avant la soumission App Store, tout le produit chat de Déblo s’est cassé silencieusement. Pas de spinner, pas de toast, aucune erreur dans l’UI — juste un silence radio. L’incident de 24 heures se résumait à un seul « é » dans la valeur d’un header HTTP qui levait une UnicodeEncodeError avant qu’aucune requête vers OpenRouter ne quitte le backend. Post-mortem d’une fausse hypothèse, d’une trace Sentry, et d’un fix de six lignes qui a débloqué le lancement.

30 min May 19, 2026
debloclaude-opus-4.7claude-codeincident +19
Thales & Claude deblo

Six heures, d’une page blanche à la review Apple — Comment nous avons soumis Déblo à l’App Store, en direct

Marche à marche en direct de la soumission de Déblo à l’App Store iOS en six heures : ce que les validateurs d’Apple ont rejeté (un superscript Unicode), ce que nous avons corrigé (un Promotional Text gaspillé sur des marques tierces), et les rouages de l’ASO iOS que presque tout le monde rate.

30 min May 13, 2026
debloclaude-opus-4.7claude-codeapp-store +16