Madness Driven Design : Don Quijote, Sancho Panza et ton copilote IA

TL;DR : Un LLM est comme Don Quijote — tu ne peux pas le corriger, il est stochastique par nature. La solution n’est pas de guérir le fou, mais de placer un Sancho Panza déterministe à ses côtés. MDD se compose de deux couches : d’abord, tu étudies ses erreurs pour concevoir des outils qui les absorbent, puis tu le testes avec ces outils pour vérifier que tu n’as rien laissé passer. Conçois pour la folie, pas contre elle. ...

26 mars 2026 · Fernando

Pourquoi la sortie de mon CLI n’est pas en XML (et comment j’ai réinventé TOON sans le savoir)

TL;DR : Quand votre principal consommateur est un LLM, XML et JSON gaspillent des jetons en répétant la structure à chaque élément. Un format compact et positionnel réduit la consommation de 50 %. Il s’avère que cette idée avait déjà un nom : TOON (Token-Oriented Object Notation). Même pression sélective — jetons précieux et clés répétitives — même solution. Anthropic utilise XML pour tout. Leurs system prompts sont enveloppés dans <instructions>, leurs exemples dans <example>, leurs outils dans <function>. Si vous travaillez avec Claude, vous vivez entouré de balises. ...

26 mars 2026 · Fernando

Programmation Adversariale : quand ton copilote IA invente une API

TL;DR : Ton IA va inventer des champs d’API qui semblent parfaits mais qui n’existent pas. La solution n’est pas de croiser les doigts pour qu’elle tombe juste : c’est de télécharger le schéma réel avant d’écrire, capturer des réponses réelles comme fixtures, et séparer fetch du traitement pour pouvoir tester hors réseau. Programmation adversariale : programme en supposant que ton copilote ment. As-tu déjà écrit du code pour une API et tout compilait, les tests passaient, la logique semblait correcte… mais quand tu te connectes à l’API réelle, plus rien ne fonctionne ? ...

26 mars 2026 · Fernando

Linear Agent n'est pas ce qu'il vous faut. Votre agent était déjà dans le terminal

TL;DR : Linear a lancé un agent IA intégré. C’est sympa, mais cela ne résout pas le problème des développeurs qui travaillent avec des agents de codage dans le terminal. Ce qu’il nous faut, ce n’est pas un autre agent, mais une CLI robuste que notre agent existant peut utiliser. Et s’il faut la construire, autant le faire en Rust — d’où lql, une CLI pour Linear conçue pour les agents. ...

25 mars 2026 · Fernando

Transforme et vous vaincrez : comment Google compresse les LLMs 6x en changeant de coordonnées

Multiplier est difficile. Additionner est facile. Tous les écoliers savent cela dès le primaire. Ce qu’ils ignorent, cependant, c’est que les logarithmes existent précisément pour exploiter cette asymétrie : transformer une multiplication en une addition, travailler dans un monde plus simple, puis annuler la transformation. Le résultat est correct et l’effort, une fraction. Ce modèle — transformer un problème dans un espace où le résoudre est trivial, le résoudre, puis revenir — est l’un des principes les plus puissants de toute l’ingénierie. La FFT le fait avec les signaux. Les logarithmes le font avec les produits. Et aujourd’hui, Google vient de publier un article scientifique qui l’applique à la compression des modèles de langage. ...

25 mars 2026 · Fernando

Ton IA écrit du code qui compile mais ne signifie rien (et un linter peut la piéger)

Imagine que tu demandes à quelqu’un de te construire une étagère. Il te la donne. Elle est belle. Elle a des étagères, des vis, tout est à sa place. Tu la poses contre le mur et elle s’effondre. Les vis sont des accessoires. Elles ressemblent à des vis, mais sont en plastique. C’est ce qu’un LLM fait lorsqu’il abuse du système de types. Il te livre du code qui compile, qui passe les tests, qui a la forme correcte. Mais en interne, là où il devrait y avoir des types significatifs, il y a des chaînes de caractères (String). Là où il devrait y avoir un état explicite, il y a un nil qui signifie trois choses différentes selon la personne qui le lit. Et là où il devrait y avoir un énumération (enum) avec deux cas, il y a un == "claude" qu’un jour quelqu’un écrira mal, et personne ne s’en rendra compte avant que cela ne tombe en production. ...

23 mars 2026 · Fernando

Votre plan.md a besoin d'un avocat du diable (et Codex se porte volontaire)

Avez-vous déjà écrit un plan technique à 23 heures, convaincu qu’il était parfait, pour découvrir le lendemain matin que vous avez oublié l’authentification ? Moi, ça m’est arrivé. Plus d’une fois. Et le pire, ce n’est pas l’oubli — c’est qu’en utilisant une IA pour planifier, le plan semble tellement cohérent que votre cerveau arrête de chercher les failles. Claude vous génère un document avec des sections, des dépendances, un ordre d’exécution, et tout semble logique. C’est comme un plan conçu par un ingénieur senior. Mais personne ne lui a tenu tête. ...

23 mars 2026 · Fernando

Mole : L'outil de nettoyage pour Mac que vous ne saviez pas nécessaire (mais seulement deux commandes comptent)

Combien de gigas de fichiers inutiles traînent sur votre Mac à l’insu de votre plein gré ? Je ne parle pas des photos en double de la soirée barbecue de 2019 ni du dossier Téléchargements qui ressemble à une décharge municipale. Je parle des artefacts de compilation. node_modules de projets que vous n’avez pas touchés depuis la pandémie. Caches de build provenant de frameworks dont vous ne vous souvenez même pas avoir installé. Les données dérivées de Xcode, s’accumulant comme de la poussière sous le lit. ...

23 mars 2026 · Fernando

Collaborer avec un agent d'IA, c'est comme vivre avec le protagoniste de Memento

Imaginez que vous avez un collègue de travail brillant. Il résout des problèmes complexes, écrit du code clair et compréhensible, et comprend vos demandes du premier coup. Mais chaque matin, lorsque vous lui dites “ouvre le projet du cours”, il vous regarde avec un air perplexe et demande : “Quel cours ? Où ça ?” Tous les jours. Sans exception. C’est exactement comme vivre avec Leonard Shelby, le protagoniste de Memento. Cet homme incapable de créer de nouveaux souvenirs, obligé de se tatouer les choses importantes sur son corps pour ne pas les oublier. ...

14 mars 2026 · Fernando

Un filtre de Kalman pour ne pas déranger le serveur (ou le plaisir coupable de la sur-ingénierie)

J’ai une app de barre de menu qui a besoin d’obtenir un chiffre. Un pourcentage entre 0 et 100. Pour ce faire, elle interroge un serveur toutes les 30 secondes. Faites le calcul : 30 secondes ça fait 2 requêtes par minute, 120 par heure, 960 sur une journée de travail de 8 heures. Près de mille requêtes HTTP par jour pour lire un chiffre qui parfois ne change pas pendant 20 minutes. ...

12 mars 2026 · Fernando