Le modèle on-device d'Apple est terrible pour le chat mais étonnamment bon en structured output et tool calling

Je teste intensivement depuis plusieurs semaines le modèle on-device d’Apple — celui de ~3B paramètres qui tourne sur le Neural Engine de n’importe quel Mac avec Apple Silicon. Pour l’évaluer en profondeur, j’ai construit Think Local, une app macOS qui exerce chaque capacité du modèle : chat, génération d’images, structured output, tool calling et comparaison de paramètres. Ma conclusion : comme chatbot, le modèle est décevant. Mais comme moteur de structured output et tool calling, il est étonnamment efficace. ...

7 avril 2026 · Fernando

Bridge Async Swift vers Sync C : quatre fonctions pour utiliser le LLM d'Apple depuis n'importe quel langage

Le framework Foundation Models d’Apple (macOS 26) expose un LLM d’environ 3 milliards de paramètres qui fonctionne directement sur l’appareil, gratuitement, sans clé API. Voici le problème : il ne parle que Swift. Et pas n’importe quel Swift — Swift async. Votre outil tourne avec Python ? Aucun binding. Avec Rust ? Rien non plus. Avec un script shell ? Pas possible. Le LLM le moins cher du marché (gratos, littéralement) est enfermé derrière deux barrières : le langage et le modèle de concurrence. ...

5 avril 2026 · Fernando

Je paie $15 par million de tokens pour écrire 'fix: typo'

Hier, j’ai écrit un message de commit avec Claude Code. Le diff contenait un changement d’une seule ligne : une faute de frappe dans un commentaire. Claude Opus a analysé le diff, réfléchi pendant deux secondes, et généré fix: correct typo in auth comment. Pour cela, il a consommé environ 800 tokens en entrée et 30 en sortie, à $15 et $75 par million respectivement. Coût : une fraction de centime. Mais multipliez cela par 40 commits par jour, 250 jours par an, dans une entreprise comptant 200 développeurs utilisant les coding agents, et cette fraction de centime se transforme en milliers de dollars dépensés pour réaliser une tâche intellectuelle équivalente à appliquer des pansements. ...

5 avril 2026 · Fernando

Ton Mac dispose d'un LLM gratuit et tu ne l'utilises pas

Tu paies entre 20 et 200 dollars par mois pour avoir accès à des LLM. Claude, GPT, Gemini, peu importe. Et la majorité des requêtes que tu envoies depuis tes scripts et outils de développement ressemblent souvent à ceci : “Classe ceci en une des cinq catégories suivantes.” “Donne un nom à cette variable.” “Identifie si ce commit est un correctif, une fonctionnalité ou un refactoring.” “Résume ce bloc de texte en deux phrases.” Pendant ce temps, ton Mac avec Apple Silicon possède un modèle de langage de 3 milliards de paramètres, intégré directement dans le système d’exploitation, sans frais, sans réseau, sans clé API, sans latence de réseau. Et probablement, tu ne l’as jamais utilisé pour quoi que ce soit. ...

4 avril 2026 · Fernando