Blog
Desenvolvimento com IA, LLMO, engenharia de contexto e harness engineering.
2026 95 artigos
- CLAUDE.md pede, hook impõe: os 3 níveis de contrato que separam 90% de 100% 17 min
- Troquei Sonnet por Qwen 7B local em 3 tarefas: bill de US$ 47 virou R$ 0 (e 2 tarefas ficaram melhores) 13 min
- Meu BATNA de dev freela: recusei 3 propostas e fechei em R$15k 20 min
- Few-shot: testei 2/4/8/16/32 exemplos em 3 tarefas e a qualidade caiu depois de N 14 min
- Padrão autoFixable: como separei 41% dos comentários de review antes da IA olhar 11 min
- Ataque Shai-Hulud no Claude Code: 3 defesas contra o autopiloto 'Yes' 14 min
- Haiku 3 + RAG (11,8) venceu Sonnet 4 puro (5,3): o experimento que provou que contexto vale mais que modelo 15 min
- 52,8% para 66,5%: como Generator-Evaluator inspirado em GAN eleva accuracy do RAG 13 min
- Camada 1 → 2 → 3: o funil de code review com IA que corta 70% do trabalho humano 12 min
- O resumo de IA diz que "não é golpe". O trampolim é a caixa de busca do seu site 15 min
- Haiku e Qwen 4B ganharam do Opus em 30% dos meus 47 casos reais 9 min
- Dark Patterns em Entrevista Tech: 7 Armadilhas que Identifiquei em 12 Processos 16 min
- Agente 24h e o 2º incidente: 3 falhas que o postmortem inicial escondeu 15 min
- 3 vieses cognitivos que estragam sua estimativa de sprint — e como o Claude Code corta 2 deles 14 min
- TDD com Playwright MCP e CI: pipeline Claude Code em 47 min 13 min
- Escrevi 'testes antes do PR' no AGENTS.md por 3 Meses. Só 12% Seguiram. 12 min
- 40% dos projetos de agentes de IA falharam em 2026: peguei 12 post-mortems e classifiquei em prompt, context ou harness 17 min
- Trocamos o Harness (Não o Modelo) e o Benchmark Subiu +13,7 Pontos 13 min
- Harness Engineering: os 6 componentes que auditam seu CLAUDE.md em 10 min 15 min
- IA escreve monótono em 70 de 70 células, em 3 línguas. E o corpus humano em português veio do TabNews 8 min
- 5 mentiras que todo LLM te conta — e como o Context Engineering corrige cada uma 14 min
- Prompt morreu, Context está morrendo: Harness Engineering é a próxima onda 15 min
- Harness Engineering: 5 empresas, 5 definições — o mapa dos termos em conflito (2026) 18 min
- Trabalho híbrido sabota promoção: viés de proximidade (2026) 14 min
- Adicionando um servidor MCP a um OSS: do YAML à imagem PNG 9 min
- Knowledge Graph pessoal: o segundo cérebro que o Notion nunca vai conseguir ser 13 min
- Meu agente Claude não percebeu que o cliente estava furioso — a camada de senso comum emocional que Meta descobriu antes de mim 16 min
- Camada 1 do harness de code review: por que 3 hooks pre-commit cortam 40% do trabalho da IA 13 min
- historymap: um arquivo YAML vira uma linha do tempo estilo site corporativo 11 min
- Padrão autoFixable: 0 revisões humanas de lint em 3 meses 14 min
- Dissequei os perfis do GitHub de 10 engenheiros famosos. Tudo coube em 7 estilos 13 min
- 80% dos POCs de GraphRAG na empresa morrem: os 3 padrões que sobrevivem (dados de 12 projetos) 20 min
- 7 passos para construir um Knowledge Graph do seu código e cortar 90% das sugestões fantasma do Cursor 15 min
- Eu estava lançando meu plugin às 3 da manhã quando ele me avisou: 67% de contexto. Vinte minutos depois, ele mesmo quebrou 13 min
- GraphRAG vs RAG clássico: quando o grafo vale 7x o custo (medi em 4 projetos) 17 min
- Confiei no Claude Code no piloto automático e o Shai-Hulud quase entrou: 5 permissões que reduzi hoje 16 min
- autoFixable: transformei 30 min de bate-e-volta em revisão de código em 47 segundos 16 min
- GraphRAG vs RAG: o teste de 7 passos que me fez trocar depois de 3 meses errando 18 min
- A conta de US$ 47.000 de um fim de semana virou a definição de 'Agent = Model + Harness'. Um componente por vez. 19 min
- O criador do CLAUDE.md escreve 2 linhas. A comunidade escreve 100. Quem está errado? 14 min
- Pare de pagar pelo modelo grande: Haiku + RAG fez 11,8 contra 5,3 do Sonnet sozinho 12 min
- Codex rodou em 1 milhão de linhas de código: e provou que trocar de modelo nunca conserta seu agente 14 min
- Os 6 componentes de um harness de IA: o checklist de auditoria que cabe em uma página 15 min
- US$ 47.000 num fim de semana: a tempestade de 2,3 milhões de retries que o harness teria parado em 4 linhas 15 min
- Agent = Model + Harness: Por Que Trocar GPT por Claude Nunca Resolve o Bug do Seu Agente 16 min
- MCP me custou 27 mil tokens só pra dizer oi. Knowledge Graph cortou 150 mil pra 18 mil no code review (8,3x). Qual ferramenta ganha qual batalha 17 min
- Construir ficou trivial com Claude Code — o gargalo agora é vender, e quase nenhum engenheiro percebeu 18 min
- Pare de mandar o Claude Code codar direto: desenhei o dia no Plan Mode e o retrabalho despencou 11 min
- 40% dos projetos de agente de IA vão ser cancelados até 2027. A culpa quase nunca é do modelo. 14 min
- 95% do conhecimento da sua empresa mora na cabeça de um veterano: como a Meta transformou o tácito em grafo 14 min
- Anotar conhecimento à mão não escala: montei um pipeline que registrou 300 fontes sozinho em 3 meses 14 min
- Seu cérebro reconhece o bug antes de você ler o log (e erra mais do que você imagina) 18 min
- Seu site em React é invisível pra IA: os crawlers não rodam o seu JavaScript 13 min
- Deixei a IA escrever 100 testes verdes. Mutation testing diz que pegaram só 58% dos bugs. 13 min
- O System Prompt que todo mundo escreve é o que faz a IA mentir 11 min
- 796 pacotes npm comprometidos por gente que apertou 'Sim' no automático — a anatomia do Shai-Hulud 12 min
- Disseram que 'inglês é a nova linguagem de programação'. Passei 3 meses programando assim, e ainda preciso saber programar. 11 min
- O cargo de 'engenheiro' não vai sumir — vira 80% decisão, 20% código 12 min
- Eu rodava geração de conteúdo e checagem de pedidos no mesmo cron. Uma API lenta travou tudo por 5 horas 19 min
- RAG só busca. GraphRAG raciocina. Como o LinkedIn cortou 28,6% do tempo de suporte 17 min
- Estimei 47 tarefas em 6 meses: a regra do x2 que eu parei de negar 13 min
- Uma escritora publicou um app inteiro escrevendo quase zero linha de código: 9.000 linhas, 20 horas 11 min
- Construí tudo no Claude Code. Aí o preço dobrou da noite pro dia 9 min
- O passo mais valioso da revisão de código por IA não usa IA nenhuma 11 min
- Não automatize tudo: os 4 níveis de delegação que decidem se o Claude Code te ajuda ou atrapalha 14 min
- Construí o RAG que mandaram fazer (Voyage + vector DB + busca semântica). Depois deletei tudo: o grep venceu. 12 min
- O modelo maior mente melhor: por que o Sonnet inventa com mais confiança que o Haiku 19 min
- Confiei que a IA me deixava mais rápido. Os dados dizem que fiquei mais lento 12 min
- O modelo barato + RAG bateu o caro em 223% nos meus testes. Refiz a conta com os preços de 2026. 13 min
- Skills do Claude Code consomem tokens mesmo sem disparar. Medi 5 Skills em 7 horas — os 3 que nunca rodaram comeram 11% da conta. 16 min
- Coloquei 7 agentes de IA no cron diário. 2 ficaram em silêncio por 18 dias. Tracing não pegou. Um contrato de exit code pegou. 21 min
- Rodei 3 sessões do Claude Code em paralelo por 8 horas. Elas se sobrescreveram 2 vezes. R$ 280 em retrabalho. 21 min
- Pedi a 5 IAs que citassem meu próprio blog. 31 artigos publicados, só 3 apareceram. 17 min
- Coloquei 11 schemas JSON-LD. Em 3 meses, só 3 foram citados por IA 21 min
- Reuniões de tech selection levavam 90 min no meu time. 5 min de silêncio cortaram pra 35. 18 min
- Por que toda code review vira briga: 5 vieses psicológicos que sabotam seu PR 19 min
- Adicionei um 4º agente que audita meus outros agentes. Ele pegou meu Strategist enrolando há 3 semanas. 10 min
- Medi quanto o time gasta apontando indentação no PR. R$ 3.600 por mês. 17 min
- Traduzi o blog pra 4 idiomas. O português pegou quase 4× o tráfego do inglês. 17 min
- Conectei o Claude Code a 4 servidores MCP. Só o handshake queimou 27.000 tokens — e nem foi o pior. 11 min
- Contei quantas vezes o Claude me disse 'Você está absolutamente certo!' na semana passada. 47 vezes. Em 11 delas, eu não estava. Nas outras 36, o Claude também não. 14 min
- Plugei o mesmo site em 7 rastreadores de citação por IA. Nenhum bateu com o outro. 18 min
- Os 5 crawlers de IA que mais bateram nos meus sites em 30 dias - o que os logs revelaram sobre LLMO 17 min
- Pluguei o Claude num MCP de Chaos. Matou staging 4 vezes pra achar um bug que ignorávamos há 6 meses. 33 min
- Peguei o Claude escondendo meu bug 3 vezes seguidas. Aí virei 10 hábitos de debug em prompts. 21 min
- Dei WebSearch ao meu Strategist. 5 temas levaram 20 minutos. Separar em 3 agentes baixou pra 3. 20 min
- Testei 5 stacks de Voice AI. Apenas 2 ficaram abaixo de 300ms. 20 min
- Coloquei 3 sub-agentes do Claude Code para revisar o mesmo PR. Discordaram em 41% dos comentários. 21 min
- Auditei 30 arquivos llms.txt em produção. 5 anti-padrões já estão se formando. 20 min
- Eu troquei Claude Code por OpenClaw por 24 horas. Veja o que quebrou — e o que melhorou 19 min
- Eu me recusei a escrever spec até o Claude gerar o código errado 3 vezes 17 min
- Deixei meu agente Claude Code rodar 24 horas sozinho. A conta de R$ 2.000 nem foi o pior. 19 min
- Por que o ChatGPT ignora o seu site (mesmo se você for #1 no Google) 11 min
- Por que troquei prompt engineering por context engineering 13 min
- Por que parei de usar Cursor e voltei para o terminal 10 min