Blog
Desarrollo con IA, LLMO, ingeniería de contexto y harness engineering.
2026 78 artículos
- Cuando tu agente de IA se atasca en un bucle: 4 síntomas y el fix para cada uno 14 min
- Few-shot en LLMs: cuántos ejemplos son el punto óptimo antes de que la calidad caiga (por tarea) 16 min
- GraphRAG vs RAG clásico: 3 métricas que cambian cuando el grafo entra en juego 14 min
- Medí las 346 réplicas de un M7.1 en Japón. Después lo comparé con el 19S y con Chile. 11 min
- GraphRAG vs RAG tradicional: cuándo el costo extra vale (y cuándo no) 16 min
- Entrenar un GPT-2 costaba $43,000 en 2019: cuánto cuesta hoy con nanochat de Karpathy (precios GPU 2026) 16 min
- Auditar 30 blogs de devs con llmoframework: 4 de 5 mejores fallan las mismas 3 comprobaciones 20 min
- Prompt, Contexto, Harness: las 3 etapas de evolución que casi nadie termina 15 min
- Qwen 35B en una RTX 4070: 2 Flags para Pasar de 12 a 34 tok/s (2.8x) 14 min
- GraphRAG vs RAG clásico: guía práctica para elegir en 5 preguntas 17 min
- Sponsorware desde LatAm: 90 días hasta $1000/mes en GitHub Sponsors partiendo de cero 17 min
- Cuantización KV cache: 8x más contexto en RTX 4070 con dos flags 12 min
- System 1 vs System 2 al Depurar: Bugs de Madrugada Cuestan 3× Más 13 min
- Nanochat de Karpathy: cuánto cuesta hoy entrenar un modelo tipo GPT-2 (era $43,000 en 2019) 17 min
- GraphRAG vs RAG: 7 pasos para tu primer knowledge graph de código en 30 min 14 min
- Prompt Caching de Anthropic: el 90% de descuento y 3 casos donde NO conviene 13 min
- MCP + USB Serial: Claude Code controla hardware (2026) 13 min
- Harness Engineering: la tercera era después de Prompt y Context, en 3 señales 13 min
- Monté un grafo de conocimiento personal en Neo4j y cancelé Notion — 3 meses, 300 notas, cero mensualidad 20 min
- Los 7 archivos que Claude Code lee antes de escribir código — checklist de context engineering en 5 minutos 12 min
- Cuando el agente borró producción y cómo el harness lo detuvo en 3 capas 13 min
- historymap: un archivo YAML se convierte en una línea de tiempo estilo sitio corporativo 11 min
- Dejé un agente de IA corriendo 24 horas: 3 incidentes de seguridad y los 7 permisos que hoy bloqueo antes de arrancar 18 min
- Fatiga de decisiones con 3 IDEs de IA abiertos: el experimento de Vohs traducido a nuestro trabajo 19 min
- Agente = Modelo + Harness: la matriz de 6 decisiones para elegir donde invertir tu tiempo 17 min
- Construí mi base de conocimiento personal: 300 fuentes en 3 meses (lo que sirvió y lo que perdió tiempo) 16 min
- RAG vs GraphRAG: cuándo los grafos de conocimiento ganan (y cuándo son sobreingeniería) 18 min
- Los 6 componentes de un harness de agente IA: audita tu CLAUDE.md en 10 minutos 15 min
- Modelo pequeño + buen contexto le gana al modelo grande solo (y cuesta 70% menos) 12 min
- Las 5 preguntas que separan Prompt Engineering de Context Engineering (con ejemplos en Claude Code) 22 min
- Context Engineering vs Prompt Engineering: Por Qué Reescribir el Prompt No Sirve y Qué Sí (Benchmark 4.6x) 18 min
- MCP no soporta subir archivos: probé 7 servidores y cada uno se inventó un workaround. 5 de los 7 abren un hueco de seguridad medible 19 min
- Plan Mode de Claude Code: aprueba el plan antes de ejecutar (guía práctica) 11 min
- Simular una red mala en tus pruebas E2E de WebRTC: pérdida de paquetes con tc/netem, sin infraestructura cara 14 min
- Tu backend dice p99=50ms y el usuario ve 3 segundos: la asimetría que solo el trace_id resuelve 15 min
- Por qué tu sistema multi-agente no escala: la arquitectura de memoria decide el techo (25 agentes contra 1.000.000) 14 min
- El modelo no cambió, pero la precisión subió de 52.8% a 66.5%: qué es la ingeniería de harness y por qué invertir en el andamiaje le gana a cambiar de modelo 14 min
- Cómo darle memoria persistente a tu agente de IA: la arquitectura de 7 archivos (y por qué cargar todo es un error) 19 min
- Por qué los crawlers de IA no ven tu sitio en JavaScript (y cómo arreglarlo con SSR o prerender) 13 min
- Le escribí tests a mi LLMO: verificar con Playwright que los crawlers de IA leen cada página 12 min
- ‘Casi siempre’ y ‘siempre sin excepción’ no son lo mismo: cómo hacer que tu code review con IA corra al 100% 13 min
- LLMO en 15 minutos: llms.txt + JSON-LD para que la IA pueda encontrar tu sitio 11 min
- Por qué tu agente de IA no tiene 'sentido común' (y cómo se lo das con un knowledge graph) 12 min
- Anatomía de la latencia en agentes de voz: dónde se te van los 300ms (STT → LLM → TTS) 13 min
- Etiquetar nit vs must en cada PR: cómo bajé el merge de 48h a 24h 17 min
- Brave Search LLM Context API: integración paso a paso para tu agente de IA 19 min
- Corrí un LLM local en mi GPU sin pagar API: la regla VRAM-a-modelo que evita el OOM 13 min
- Few-shot no le enseña conocimiento a tu LLM: le enseña a decir "no lo sé" 11 min
- Cómo blindar los permisos de Claude Code para que tu agente no filtre secretos 8 min
- Por qué Claude ignora tu CLAUDE.md 1 de cada 20 veces (y cómo lo arreglé con exit code 2) 10 min
- Dejé de agregar contexto a mi agente: podar las salidas de herramientas recuperó la precisión 12 min
- "99,5% de disponibilidad" y "5.000 pagos fallidos" son el mismo hecho: el framing del reporte cambia la urgencia 13 min
- A las 3 de la tarde tu tasa de aprobación en code review cae casi a 0%: la ciencia de la fatiga de decisión 18 min
- El ranking de tu página no le importa a la IA — solo cita pasajes 18 min
- Context rot en agentes: 7 pasos para mantener limpia la ventana de contexto (empieza antes de lo que crees) 13 min
- Los Claude Code Skills consumen tokens aunque no se activen. Medí 5 Skills durante 7 horas — los 3 que nunca dispararon se llevaron el 11%. 17 min
- Programé 7 agentes de IA con cron diario. 2 fallaron en silencio durante 18 días. El tracing no los detectó. Un contrato de exit code sí. 23 min
- Ejecuté 3 sesiones de Claude Code en paralelo durante 8 horas. Se sobrescribieron 2 veces. Guía LatAm de orquestación segura. 22 min
- Le pedí a 5 IAs que citaran mi propio blog. 31 artículos publicados, solo 3 aparecieron. 16 min
- Agregué 11 schemas JSON-LD a mi blog. Tres meses después, solo 3 aparecieron en las citas de IA. 21 min
- Le pedí a Claude que refactorizara 100 funciones. 7 quedaron más lentas en producción 19 min
- Le dije a Claude Code que hiciera TDD. Escribió el test DESPUÉS del código 6 de 10 veces 21 min
- Agregué un 4to agente que audita a mis otros agentes. Detectó que mi Strategist llevaba 3 semanas postergando. 23 min
- Traduje mi blog a 4 idiomas. El portugués recibió casi 4× más tráfico que el inglés. 17 min
- ¿Cuánto cuesta realmente un agente de IA al mes? API vs suscripción vs local — el punto de equilibrio en USD 12 min
- Conté cuántas veces Claude me dijo '¡Tienes toda la razón!' la semana pasada. 47 veces. En 11 de ellas, yo no la tenía. En las otras 36, Claude tampoco. 13 min
- Conecté el mismo sitio a 7 rastreadores de citas de IA. Ninguno coincidió con otro. 18 min
- Los 5 crawlers de IA que más golpearon mis sitios en 30 días - lo que los logs me dijeron sobre LLMO 16 min
- Conecté Claude a un MCP server de Chaos Engineering. Mató el staging 4 veces antes de encontrar el bug que llevábamos 6 meses ignorando. 34 min
- Pillé a Claude escondiendo mi bug 3 veces seguidas. Después convertí 10 hábitos de debug en prompts. 21 min
- Dividí mi agente en 3 roles y elegir 5 temas pasó de 20 a 3 minutos 20 min
- Medí 5 stacks de Voice AI. Solo 2 se mantuvieron bajo los 300ms. 22 min
- Pedí a 3 sub-agentes de Claude Code que revisaran el mismo PR. Estuvieron en desacuerdo en el 41% de los comentarios. 20 min
- Audité 30 archivos llms.txt en producción. 5 anti-patrones ya se están formando. 22 min
- OpenClaw, Claude Code y Cursor: la guía LatAm para elegir tu primer agente autónomo en 2026 18 min
- Spec-Driven Development con asistentes de IA: la guía LatAm para escribir specs antes del primer prompt 18 min
- Dejé a mi agente Claude Code corriendo 24 horas. La cuenta de USD 400 fue lo de menos. 16 min
- Por qué dejé el prompt engineering por la ingeniería de contexto 13 min