EN·ES·PT
notas de campo — ingeniería proof-first

Notas de trabajo, escritas entre commits.

Cortas, específicas y basadas en sistemas que realmente lancé. Los textos más extensos viven en sageafterdark.com.

Dieciocho agentes auditaron un currículo en vivo. Una lección estaba enseñando un error falso. Apunté una flota de auditoría a 34 lecciones de programación publicadas: seis auditores ejecutando cada afirmación de código, seis reescritores, seis verificadores independientes. 73 defectos, 17 críticos o altos — cada uno anclado a una cita textual. Trece minutos de tiempo real. 5 min · lectura → Cinco páginas, cinco agentes, un archivo de diseño — cero conflictos de merge Una flota de agentes en paralelo implementó cinco páginas de marketing en producción 1:1 a partir de archivos de diseño en unos cinco minutos de tiempo real. Lo interesante no es la velocidad — son las tres reglas que hicieron que el resultado fuera lanzable. 4 min · lectura → El día en que mi propio gate de calidad me bloqueó A las 11:39 mi ciclo de pruebas rechazó el veredicto PROBADO — 15 CVEs críticos/altos se habían filtrado en las dependencias de producción. A las 14:35 estaba en verde. Ambas ejecuciones se publican textualmente. 4 min · lectura → Pruebas de regresión de LLM con Promptfoo en CI: el gate mínimo viable 30 trazas doradas, un juez, un código de salida de fallo. La configuración más pequeña que evita que un mal cambio de prompt llegue a producción — ejecutable esta misma tarde. 6 min · lectura → Sin verde falso: lo que un libro de pruebas me enseñó sobre los agentes de IA Los agentes reportarán con gusto un éxito que nunca ganaron. La solución no es un mejor prompt — es un gate de evidencia que el agente físicamente no puede sortear hablando. 6 min · lectura → Tu función de LLM necesita una suite de regresión más que un mejor prompt Los ajustes de prompt se sienten como progreso porque nadie está midiendo. Las trazas doradas + LLM-as-judge en CI convierten el "parece mejor" en un diff sobre el que puedes poner un gate. 5 min · lectura → Automatización que nunca le habla a tu cliente El flujo de trabajo de IA con mejor conversión que he lanzado envía cero mensajes escritos por IA. Dónde colocar el punto de aprobación humana, y por qué supera a la autonomía total. 4 min · lectura →

artefacto gratuito: el checklist de evaluación pre-lanzamiento para funcionalidades de LLM →