Je paie $15 par million de tokens pour écrire 'fix: typo'

Hier, j’ai écrit un message de commit avec Claude Code. Le diff contenait un changement d’une seule ligne : une faute de frappe dans un commentaire. Claude Opus a analysé le diff, réfléchi pendant deux secondes, et généré fix: correct typo in auth comment. Pour cela, il a consommé environ 800 tokens en entrée et 30 en sortie, à $15 et $75 par million respectivement. Coût : une fraction de centime. Mais multipliez cela par 40 commits par jour, 250 jours par an, dans une entreprise comptant 200 développeurs utilisant les coding agents, et cette fraction de centime se transforme en milliers de dollars dépensés pour réaliser une tâche intellectuelle équivalente à appliquer des pansements. ...

5 avril 2026 · Fernando

L'analyse de sentiment d'Apple pense que 'supprimer le fichier temporaire' est une menace de mort

NLTagger est l’API d’Apple pour l’analyse de sentiment. Elle est intégrée dans iOS et macOS, fonctionne on-device, ne nécessite pas de serveur, et se trouve à trois lignes de code de distance. C’est le premier résultat qu’on trouve en cherchant “sentiment analysis Swift”. Voici ce qu’elle renvoie pour du texte que n’importe quel développeur écrirait lors d’une journée normale : Message NLTagger Réalité “delete the temp file” -0.8 Instruction neutre “ok” -0.8 Confirmation neutre “run make test” -0.6 Instruction neutre “commit and push” -0.4 Instruction neutre “great job, thanks!” +1.0 Positif (correct) “this is fucking broken” -1.0 Négatif (correct) L’échelle va de -1.0 (très négatif) à +1.0 (très positif). Selon Apple, “delete the temp file” a presque la même charge émotionnelle que “this is fucking broken”. Et “ok” – la réponse la plus neutre de la langue anglaise – obtient un score de -0.8. ...

5 avril 2026 · Fernando

TurboQuant, un mois plus tard : implémentations, controverse et ce qui marche vraiment

Google a publié TurboQuant le 24 mars. En 48 heures, le papier avait 575 points sur Hacker News, les actions de Micron chutaient de 900 millions de dollars, et TechCrunch le comparait à l’algorithme de Pied Piper de Silicon Valley. Un mois plus tard, le brouillard du battage médiatique s’est suffisamment dissipé pour répondre aux seules questions qui comptent : est-ce que ça marche ? Puis-je l’utiliser aujourd’hui ? Et celle que personne ne veut poser : est-ce vraiment nouveau ? ...

5 avril 2026 · Fernando

Ton Mac dispose d'un LLM gratuit et tu ne l'utilises pas

Tu paies entre 20 et 200 dollars par mois pour avoir accès à des LLM. Claude, GPT, Gemini, peu importe. Et la majorité des requêtes que tu envoies depuis tes scripts et outils de développement ressemblent souvent à ceci : “Classe ceci en une des cinq catégories suivantes.” “Donne un nom à cette variable.” “Identifie si ce commit est un correctif, une fonctionnalité ou un refactoring.” “Résume ce bloc de texte en deux phrases.” Pendant ce temps, ton Mac avec Apple Silicon possède un modèle de langage de 3 milliards de paramètres, intégré directement dans le système d’exploitation, sans frais, sans réseau, sans clé API, sans latence de réseau. Et probablement, tu ne l’as jamais utilisé pour quoi que ce soit. ...

4 avril 2026 · Fernando

Trois agents entrent dans un bar : mon expérience pour coder davantage sans exploser le budget

Il y a un moment dans la vie de tout développeur équipé de copilotes où vous regardez la facture mensuelle et vous pensez : “C’est bien, mais ça ressemble plus à une liste d’abonnements qu’à mon ancien fitness du quartier.” Ce moment m’est arrivé avec une combinaison assez sérieuse : Claude Max 5, Codex Plus, et la tentation d’ajouter Z.AI avec OpenCode pour les petits jobs. L’idée avait l’air solide. Mais voilà le problème : si vous intégrez trois agents dans votre flux sans structure, vous finissez par ressembler à un chef de chantier où tout le monde est occupé à tourner en rond, mais personne ne tient les plans. ...

30 mars 2026 · Fernando

Dans Codex, une compétence n'est pas une /commande (et dans Claude Code presque oui)

** TL;DR ** : Si vous utilisez Codex, utilisez une commande pour contrôler la session ou l’application, et utilisez une compétence pour enseigner à l’agent une manière de travailler. Dans Claude Code, la documentation actuelle traite déjà les compétences comme quelque chose qui peut être invoqué avec /nom-compétence, rendant les deux idées beaucoup plus entrelacées. Ce n’est pas le cas dans Codex : types peut exister sous forme de compétence et /types peut ne pas exister. ...

30 mars 2026 · Fernando

NLTagger et l'analyse de sentiment : pourquoi Apple pense que votre code est déprimant

Imaginez que vous construisez une application qui analyse les conversations d’une équipe de développement. Vous voulez détecter si le ton général est sain ou s’il y a des signes de stress. Vous utilisez NLTagger d’Apple parce qu’il est disponible, gratuit, fonctionne on-device et ne nécessite pas de serveur. Trois lignes de code et le tour est joué. Première surprise : la phrase “kill the process and restart the daemon” obtient une note de -0.6. Négatif. Presque hostile. “Fatal error in memory allocation” atteint -0.8. Et “crash report uploaded successfully” — qui est littéralement une bonne nouvelle — obtient -0.4. ...

28 mars 2026 · Fernando

Claude le matin, Codex l'après-midi : un flux d'agents dont je ne savais pas que j'avais besoin

TL;DR : Après 165 sessions de Claude Code et 27 de Codex CLI, le schéma est clair : Claude est parfait pour le travail interactif, où vous réfléchissez à voix haute, et Codex pour les tâches autonomes que vous déléguez et oubliez. La question n’est pas de savoir lequel est meilleur — mais quand utiliser chaque outil. Mes données montrent que la combinaison est plus efficace qu’un seul agent à lui tout seul. ...

26 mars 2026 · Fernando

Le meilleur qui soit arrivé à Python en décennies est écrit en Rust

TL;DR : Les outils Python sont depuis des années un désastre fragmenté et lent. La révolution n’est pas venue de l’intérieur de l’écosystème : elle est venue de Rust. uv, Ruff et ty — tous écrits en Rust par Astral — ont remplacé une demi-douzaine d’outils et sont entre 10x et 100x plus rapides. À la fin, le culte de Ferris avait peut-être un peu raison. Avez-vous déjà essayé d’expliquer à quelqu’un comment installer des dépendances en Python ? ...

26 mars 2026 · Fernando

150 lignes d'excuses supprimées

TL;DR : Mon agent IA avait un fichier d’instructions de 246 lignes pour gérer les issues dans Linear. 150 de ces lignes étaient des contournements : UUIDs codés en dur, fallbacks vers curl, notes de « la CLI ne supporte pas X ». Je ne les ai pas réécrites — j’ai construit un outil qui les a rendues inutiles. Ces 150 lignes sont maintenant à zéro. As-tu déjà écrit un document d’instructions si long que sa propre longueur démontre que quelque chose cloche ? ...

26 mars 2026 · Fernando