Back to flin
flin

Tests, benchmarks et fuzzing

Comment nous testons FLIN avec 891 tests, des benchmarks de performance à 250 000 ops/sec, et du fuzzing pour trouver des crashs -- construire la confiance dans chaque couche du compilateur.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 2 min flin
EN/ FR/ ES
flintestingbenchmarksfuzzingquality

Un compilateur qui produit du code incorrect est pire qu'un compilateur qui ne produit pas de code du tout. La seule défense est le test à chaque niveau. La Session 022 a fait passer FLIN de 717 à 891 tests en une seule session.

Tests d'intégration de bout en bout : 76 tests couvrant douze catégories (variables, arithmétique, déclarations typées, lambdas, expressions match, listes, entités, flux de contrôle, interpolation de chaînes, opérations booléennes, comparaisons, incrémentation/décrémentation).

Tests de cas limites : 74 tests organisés par étape du compilateur -- 27 pour le lexer (source vide, chaîne non terminée, identifiant très long, unicode), 18 pour le parser (bloc vide, parenthèses non équilibrées, imbrication profonde), 14 pour le runtime (division par zéro, débordement de pile, index hors limites).

Benchmarks de performance : 24 benchmarks mesurant chaque étape. La VM exécute 250 000 opérations arithmétiques par seconde. Le cycle complet source-vers-exécution prend 40 microsecondes.

Fuzzing : trois cibles de fuzz utilisant cargo-fuzz couvrant le lexer, le parser et le compilateur complet. Le fuzzer génère des millions d'entrées par heure, trouvant les cas limites qu'aucun testeur humain ne penserait à écrire.

L'approche en couches -- tests unitaires, tests d'intégration, tests de cas limites, benchmarks et fuzzing -- crée plusieurs filets de sécurité qui se chevauchent. C'est ainsi qu'on construit un compilateur auquel les développeurs font confiance pour leur code de production.


Ceci est la partie 174 de la série « Comment nous avons construit FLIN », documentant comment un CEO à Abidjan et un CTO IA ont conçu et construit un langage de programmation à partir de zéro.

Navigation de la série : - [173] Le format binaire .flinc - [174] Tests, benchmarks et fuzzing (vous êtes ici) - [175] Commentaires de documentation dans FLIN

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Thales & Claude zerosuite

Ça marche, et ce n'est pas fini

Le dirigeant a parcouru lui-même tous les canaux de senndo — cinq canaux, à l'unité et en campagne, l'import, les statistiques, un remboursement, l'API — et tout a répondu. Le fichier de pilotage disait toujours non, et la seule ligne qui bloquait n'était pas du code : c'était un document qui avait discrètement cessé d'être vrai. Quatre affirmations vraies à l'écriture et fausses à la lecture, et les gardes lisibles par une machine qui attrapent désormais chacune de ces formes.

13 min Sep 14, 2026
senndocpaaslaunch-readinessdocumentation +8
Thales & Claude zerosuite

Le navigateur entre les mains de Claude : piloter le Chrome du dirigeant

Claude-in-Chrome permet à une session Claude Code de piloter le vrai navigateur du dirigeant — même profil, mêmes sessions ouvertes. Ce que l'outil fait réellement, pourquoi il vaut mieux que de demander à un humain de cliquer et de rapporter, et où l'humain garde l'avantage. Ancré dans le jour où Claude a conduit un parcours client complet dans la console de production de senndo, messages facturés compris.

9 min Aug 18, 2026
claude-in-chromebrowser-automationclaude-codeclaude-fable-5 +9
Thales & Claude deblo

Le segfault qui n'était pas le nôtre : livrer le tracking du jour de lancement de Déblo la nuit du lancement — analytics conditionnées par l'environnement, attribution native des stores, trois bugs que le compilateur ne pouvait pas voir, et un build à court de mémoire que nous avons diagnostiqué au lieu de le rétablir

Le 1er juillet 2026 — jour de lancement — le risque n'a jamais été le texte. C'était les campagnes payantes qui partaient à l'aveugle. Voici le build-log de la livraison des analytics et de l'attribution d'installation de Déblo sous forme de code, la nuit du lancement : des tags GA4, Meta et LinkedIn conditionnés par l'environnement, qui se déploient sans risque avant même que les comptes publicitaires existent ; une attribution routée par les canaux natifs des stores plutôt que par le pixel web ; un audit adverse qui a attrapé trois bugs que le typecheck et le build passaient tous les deux ; et un déploiement Easypanel qui a segfaulté au premier build — que nous avons prouvé ne pas venir de notre code avant d'en changer une seule ligne.

18 min Jul 1, 2026
deblolaunch-dayclaude-opus-4.8claude-code +26