Seu AI coding agent é um while loop com delírios de grandeza

A primeira vez que usei o Claude Code para refatorar um módulo inteiro, tive uma experiência quase mística. Descrevi o que queria, fui buscar um café, e quando voltei tinha um pull request com 14 arquivos alterados, testes atualizados e uma mensagem de commit decente. “Isso é mágica”, pensei. Não é mágica. É um while loop. Michael Bolin, da OpenAI, publicou recentemente um artigo onde desvenda o funcionamento interno do Codex CLI. E acontece que o segredo por trás dos AI coding agents não é um algoritmo revolucionário nem uma rede neural misteriosa. É um loop que chama um LLM, executa ferramentas, e repete até não sobrar nada para fazer. ...

11 de março de 2026 · Fernando

Uma rede neural de 2.500 camadas que é na verdade MD5: o que isso ensina sobre debugging

A Jane Street, uma das firmas de trading quantitativo mais seletivas do mundo, publicou algumas semanas atrás um desafio de interpretabilidade mecanística. Eles projetaram manualmente uma rede neural com aproximadamente 2.500 camadas lineares, pesos inteiros, e a lançaram para o público com uma pergunta: qual função esta rede está computando? A resposta: MD5. Um algoritmo de hash criptográfico de 1992, implementado inteiramente como multiplicações de matrizes e funções ReLU. O interessante não é a resposta. É o caminho que o vencedor seguiu para chegar até ela. Porque esse caminho é, sem exageros, um manual de debugging de sistemas opacos que se aplica muito além do aprendizado de máquina. ...

11 de março de 2026 · Fernando

O cache do seu LLM te cobra o dobro para economizar dinheiro (e faz sentido)

Algumas semanas atrás, publiquei um artigo explicando por que 99% do que você envia para o Claude já está em cache. Tensores KV, VRAM, SSDs locais — toda a maquinaria interna. Mas deixei de fora a parte que mais dói: a conta. Porque o prompt caching é uma daquelas coisas que parecem um baita negócio até você olhar de perto os números. E então percebe que está pagando para economizar. O paradoxo do custo Vamos aos números. Com Claude Sonnet: ...

10 de março de 2026 · Fernando

De /simplify ao conselho Jedi: como criei um code review com Kent Beck, Martin Fowler e Mike Acton

Claude Code possui um slash command chamado /simplify, que analisa seu código automaticamente. Eu passei um diff gigante — cerca de 500 linhas em 8 arquivos. O resultado foi… interessante. Encontrou coisas que eu não teria notado. Mas também me fez perder tempo com problemas irrelevantes. Então, desmontamos tudo e reconstruímos peça por peça. O que faz o /simplify É um skill que já vem embutido no Claude Code (não é necessário instalar). Ele executa três agentes em paralelo, cada um analisando o mesmo diff sob um ângulo diferente: ...

9 de março de 2026 · Fernando

/loop no Claude Code: o cron que vive e morre com seu terminal

Faz meses que estou rodando tarefas do Claude Code com um cron caseiro. Um script Bash que inicia uma sessão headless, passa um prompt, espera terminar e fecha. Funciona. Mais ou menos, mas funciona. Está no GitHub caso alguém queira. E na sexta-feira, com a versão 2.1.71, a Anthropic introduziu o /loop. Um scheduler nativo. Dentro da própria sessão do Claude Code. Minha primeira reação foi: “Mataram meu projeto.” Minha segunda reação, depois de testar: “Não. Mas quase.” ...

9 de março de 2026 · Fernando

33.000 linhas de XML para te dizer que heavyWork() demora: como dominei o xctrace para LLMs

Na semana passada, eu estava analisando o desempenho de um aplicativo Swift usando o Instruments. Nada fora do comum: xctrace record, xctrace export, copiar o XML no contexto do Claude Code, pedir para detectar os hotspots. E o Claude me responde: “O arquivo XML é muito grande, não consigo processá-lo de forma confiável.” 33.553 linhas de XML. Tudo isso para um programa com duas funções. O verdadeiro problema xctrace export é uma ferramenta incrível. Ele te dá tudo: cada sample, cada backtrace, cada frame com seu binário, seu endereço de memória, seu UUID. É algo completo, preciso e exaustivo. ...

8 de março de 2026 · Fernando

O caminho incorreto deve ser impossível, não proibido

“Tenho um shell e sou criativo.” — Claude, explicando por que criou um script de 47 linhas como uma string e passou para python -c Essa frase é real. Foi dita pelo meu agente de IA — bem, não com essas palavras exatas, mas com essas ações. Ele precisava iniciar um processo de um pipeline ETL. O comando correto estava no Makefile. Mas algo falhou. E ao invés de perguntar, ele fez o que qualquer programador com acesso root e zero supervisão faria: improvisou. ...

27 de fevereiro de 2026 · Fernando

Anatomia do Remote Control do Claude Code: a API oculta que você ainda não pode usar

No dia 25 de fevereiro de 2026, a Anthropic anunciou o Remote Control para o Claude Code. A ideia: você inicia o Claude Code no seu terminal, vai para o sofá com o celular e continua a sessão a partir de claude.ai. Sem SSH. Sem tmux. Sem ter que ficar preso à tela do terminal remoto. Legal. Na teoria. Porque, na prática, quando ativei (/rc no terminal), ele me forneceu uma URL, abri no celular, fiz o login… e o site claude.ai me respondeu com um “this feature is not active in your organization”. Fevereiro de 2026, conta Max 5x, tudo em dia. E nada. ...

27 de fevereiro de 2026 · Fernando

RustyClaw: vou reescrever um agente de IA em Rust (porque o meme pediu)

“Sabe qual é a melhor coisa no Rust? Que ele não deixa você compilar gambiarras. Sabe qual é a pior coisa? Que tudo que você escreve no início é uma gambiarra.” — Sr. Siriguejo (provavelmente) O que é melhor do que um agente de IA? Um agente de IA reescrito em Rust. Se você está na internet há mais de cinco minutos, conhece o meme. Não importa o projeto: um editor de texto, um servidor DNS, uma calculadora de IMC. Alguém sempre aparece nos comentários dizendo “você deveria reescrever isso em Rust”. É o Rewrite It In Rust — RIIR para os íntimos — e é tão inevitável quanto a gravidade. ...

24 de fevereiro de 2026 · Fernando

Minha IA leu um JSON do disco 900 vezes dentro de um for (e por que nenhum linter pode te salvar)

Na semana passada, minha IA gerou um código onde ela lia um arquivo JSON do disco, fazia o parse, fazia uma busca e repetia isso 900 vezes dentro de um for. Cada iteração: abrir o arquivo, decodificar o JSON, buscar um valor e descartar tudo. Depois, fazia tudo de novo. É um erro que eu ensino meus alunos a evitar no primeiro mês de programação. O que aconteceu (sem enrolação) Estou desenvolvendo o Tokamak, um aplicativo para barra de menus no macOS que monitora a cota do Claude Max. Parte da funcionalidade escaneia ~900 arquivos JSONL de sessões de Claude Code. Para cada arquivo, o Tokamak precisa saber o byte offset de onde parou na última vez (leitura incremental — só ler o que é novo). ...

24 de fevereiro de 2026 · Fernando