Back to flin
flin

La crise du choix du modèle d'embeddings

Comment le choix du modèle d'embeddings de FLIN était contraint par la disponibilité des bibliothèques -- et l'architecture que nous avons construite pour changer de modèle sans casser les applications.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 2 min flin
EN/ FR/ ES
flinbugembeddingsmodel-selectionaivectors

Quand vous construisez un langage de programmation avec des capacités IA intégrées, vous héritez des dépendances de l'écosystème IA. Le 17 janvier 2026, nous avons découvert que le modèle d'embeddings que nous avions prévu d'utiliser (BGE-M3) n'existait pas dans la bibliothèque dont nous dépendions (fastembed Rust crate v4.9.1).

Nous avons choisi multilingual-e5-large comme alternative et construit une architecture qui permet aux utilisateurs de sélectionner leur modèle d'embeddings via la configuration :

flinai {
    embeddings: "local"
    model: "multilingual-e5-large"
}

L'architecture utilise des singletons doubles pour un cache efficace, un parsing de configuration qui accepte les noms complets et abrégés, et un enum EmbeddingModelChoice extensible. Le principe de conception : construisez l'abstraction même quand vous n'avez que deux implémentations. L'abstraction ne coûte presque rien aujourd'hui et économise un refactoring significatif demain.

Les deux choix de modèles sont multilingues -- c'était non négociable. FLIN est construit à Abidjan et utilisé à travers l'Afrique francophone, anglophone et au-delà. Un système de recherche qui ne comprend que l'anglais serait inutile pour la majorité des utilisateurs de FLIN.


Ceci est la partie 169 de la série « Comment nous avons construit FLIN », documentant comment un CEO à Abidjan et un CTO IA ont conçu et construit un langage de programmation à partir de zéro.

Navigation de la série : - [168] Valeurs par défaut des entités et correction du toggle - [169] La crise du choix du modèle d'embeddings (vous êtes ici) - [170] 15 bugs qui ont façonné le langage FLIN

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Thales & Claude deblo

Le segfault qui n'était pas le nôtre : livrer le tracking du jour de lancement de Déblo la nuit du lancement — analytics conditionnées par l'environnement, attribution native des stores, trois bugs que le compilateur ne pouvait pas voir, et un build à court de mémoire que nous avons diagnostiqué au lieu de le rétablir

Le 1er juillet 2026 — jour de lancement — le risque n'a jamais été le texte. C'était les campagnes payantes qui partaient à l'aveugle. Voici le build-log de la livraison des analytics et de l'attribution d'installation de Déblo sous forme de code, la nuit du lancement : des tags GA4, Meta et LinkedIn conditionnés par l'environnement, qui se déploient sans risque avant même que les comptes publicitaires existent ; une attribution routée par les canaux natifs des stores plutôt que par le pixel web ; un audit adverse qui a attrapé trois bugs que le typecheck et le build passaient tous les deux ; et un déploiement Easypanel qui a segfaulté au premier build — que nous avons prouvé ne pas venir de notre code avant d'en changer une seule ligne.

18 min Jul 1, 2026
deblolaunch-dayclaude-opus-4.8claude-code +26
Thales & Claude thales

Treize agents, quarante-trois minutes : la première session Workflow de Claude Fable 5, et ce qu'un script d'orchestration déterministe change aux builds multi-agents

Un prompt, treize agents, quarante-trois minutes : la première session de production avec Claude Fable 5 et l'outil Workflow de Claude Code a livré un site web de production complet de sept pages plus un endpoint backend de capture de leads, en un seul commit. Le carnet de bord : le script d'orchestration déterministe, le patron d'injection de contrat entre les phases, l'économie par agent du fan-out parallèle, et le suspense de la limite de session que le journal de reprise a transformé en non-événement.

23 min Jun 12, 2026
claude-fable-5claude-codeworkflow-toolmulti-agent +10
Thales & Claude casp

La porte a détecté sa propre dérive : une journée dans CASP avec Claude Fable 5

Nous avons confié au modèle Claude le plus autonome à ce jour les clés de CASP — le CLI open source qui garde les agents de code IA honnêtes face à git — avec l'autorité de rejeter notre propre roadmap. Il a rejeté cinq choses, trouvé deux vrais bugs dans le validateur en le dogfoodant, les a corrigés sous une porte à deux auditeurs, et a laissé casp check entièrement vert sur son propre dépôt pour la première fois. CASP 0.3.0 en est le résultat.

16 min Jun 10, 2026
caspzerosuiteworkflowai-cto +9