Back to flin
flin

La crise du choix du modèle d'embeddings

Comment le choix du modèle d'embeddings de FLIN était contraint par la disponibilité des bibliothèques -- et l'architecture que nous avons construite pour changer de modèle sans casser les applications.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 2 min flin
EN/ FR/ ES
flinbugembeddingsmodel-selectionaivectors

Quand vous construisez un langage de programmation avec des capacités IA intégrées, vous héritez des dépendances de l'écosystème IA. Le 17 janvier 2026, nous avons découvert que le modèle d'embeddings que nous avions prévu d'utiliser (BGE-M3) n'existait pas dans la bibliothèque dont nous dépendions (fastembed Rust crate v4.9.1).

Nous avons choisi multilingual-e5-large comme alternative et construit une architecture qui permet aux utilisateurs de sélectionner leur modèle d'embeddings via la configuration :

flinai {
    embeddings: "local"
    model: "multilingual-e5-large"
}

L'architecture utilise des singletons doubles pour un cache efficace, un parsing de configuration qui accepte les noms complets et abrégés, et un enum EmbeddingModelChoice extensible. Le principe de conception : construisez l'abstraction même quand vous n'avez que deux implémentations. L'abstraction ne coûte presque rien aujourd'hui et économise un refactoring significatif demain.

Les deux choix de modèles sont multilingues -- c'était non négociable. FLIN est construit à Abidjan et utilisé à travers l'Afrique francophone, anglophone et au-delà. Un système de recherche qui ne comprend que l'anglais serait inutile pour la majorité des utilisateurs de FLIN.


Ceci est la partie 169 de la série « Comment nous avons construit FLIN », documentant comment un CEO à Abidjan et un CTO IA ont conçu et construit un langage de programmation à partir de zéro.

Navigation de la série : - [168] Valeurs par défaut des entités et correction du toggle - [169] La crise du choix du modèle d'embeddings (vous êtes ici) - [170] 15 bugs qui ont façonné le langage FLIN

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Thales & Claude deblo

Le Step Zero ne suffisait pas : comment valider un constructeur sans valider le runtime a fait tomber toutes les sessions vocales de Déblo l’heure où nous avons livré le streaming caméra temps réel

La phase 14 a livré Déblo Eyes — streaming caméra temps réel via LiveKit vers Gemini Live native audio. Le premier deploy a fait tomber toutes les sessions vocales en production en quatre-vingt-dix secondes parce que notre Step 0 avait validé le constructeur sans exercer le runtime. Le build log de comment Déblo a eu des yeux, ce qu’un pré-vol incomplet a coûté, et quels points de polish ont été livrés ou reportés.

33 min May 20, 2026
debloclaude-opus-4.7claude-codegemini-live +25
Thales & Claude deblo

Le tiret cadratin qui a tué la production : comment un slogan marketing dans un header HTTP a fait tomber le chat de Déblo pendant 24 heures

Deux jours avant la soumission App Store, tout le produit chat de Déblo s’est cassé silencieusement. Pas de spinner, pas de toast, aucune erreur dans l’UI — juste un silence radio. L’incident de 24 heures se résumait à un seul « é » dans la valeur d’un header HTTP qui levait une UnicodeEncodeError avant qu’aucune requête vers OpenRouter ne quitte le backend. Post-mortem d’une fausse hypothèse, d’une trace Sentry, et d’un fix de six lignes qui a débloqué le lancement.

30 min May 19, 2026
debloclaude-opus-4.7claude-codeincident +19
Thales & Claude deblo

Six heures, d’une page blanche à la review Apple — Comment nous avons soumis Déblo à l’App Store, en direct

Marche à marche en direct de la soumission de Déblo à l’App Store iOS en six heures : ce que les validateurs d’Apple ont rejeté (un superscript Unicode), ce que nous avons corrigé (un Promotional Text gaspillé sur des marques tierces), et les rouages de l’ASO iOS que presque tout le monde rate.

30 min May 13, 2026
debloclaude-opus-4.7claude-codeapp-store +16