Cuando un agente falla, rara vez es porque no sepa escribir código
Cuando un agente falla, rara vez es porque no sepa escribir código. Falla porque se ha saltado pasos.
agent-skills, el repositorio de Addy Osmani, ha superado las 100.000 estrellas en GitHub. Contiene 25 skills con licencia MIT que trasladan el proceso de trabajo de un ingeniero senior a algo que tu agente puede seguir paso a paso. Compatible con Claude Code, Cursor, Codex, Copilot, Gemini CLI y varios más.
Lo valioso no es cada skill por separado, sino la secuencia. El flujo se divide en seis fases, cada una con su propio comando:
/spec: define qué se va a hacer y por qué, antes de escribir una sola línea.
/plan: descompone el trabajo en tareas pequeñas y verificables.
/build: implementación incremental, tarea a tarea.
/test: enfoque TDD, empezando siempre por el test que falla.
/review: revisión de calidad, seguridad y rendimiento.
/ship: git, CI/CD, observabilidad y despliegue.
Hay dos decisiones de diseño que destacan especialmente. La primera son las tablas anti-excusas: cada skill recoge por escrito las justificaciones habituales que se usan para saltarse pasos («los tests los pongo después», «esto es demasiado sencillo para necesitar un spec») junto con los argumentos que las rebaten. Un modelo se convence con razonamientos igual que nosotros, así que dárselos de antemano tiene su efecto. La segunda es la evidencia obligatoria: ninguna fase se da por cerrada con un «parece que funciona», sino que hay que demostrar que funciona.
En mi caso trabajo con una lógica similar en Claude Code: un orquestador que redacta el plan y agentes independientes para specs, tests y código, sin que ninguno invada el trabajo del otro. La conclusión es la misma que propone el repo: cuando un agente comete errores, casi nunca es por ignorancia técnica. Es porque se ha saltado el spec o la revisión para ir más rápido, y ese atajo termina costando mucho más adelante.
¿Estructuras el trabajo de tu agente en fases o directamente le pides que construya? Puedes ver el repositorio aquí: agent-skills en GitHub (visto a través de un post de midudev).agent-skills supera 100.000 estrellas: 25 skills MIT para estructurar agentes de código en seis fases
Resumen técnico
agent-skills, repositorio de Addy Osmani, ha superado las 100.000 estrellas en GitHub con licencia MIT. Ofrece 25 skills compatibles con Claude Code, Cursor, Codex, GitHub Copilot y Gemini CLI. El ciclo de trabajo se divide en seis comandos secuenciales: /spec (requisitos), /plan (descomposición en tareas), /build (implementación incremental), /test (TDD con test en rojo primero), /review (calidad, seguridad y rendimiento) y /ship (git, CI/CD y observabilidad). Cada fase exige evidencia verificable para cerrarse. Incluye tablas de racionalizaciones comunes con argumentos de refutación integrados para condicionar el comportamiento del modelo.
Análisis de implicaciones
El problema central que resuelve agent-skills no es la capacidad de generación de código, sino la tendencia de los agentes a saltarse fases intermedias para llegar antes al /build. Las tablas anti-excusas funcionan como system prompt estructurado: anticipan los atajos que toma el modelo y los bloquean con argumentos explícitos. Esto implica un cambio de paradigma en el diseño de agentes: el control de calidad no se añade al final, se codifica como restricción de flujo desde el inicio. La evidencia obligatoria por fase elimina el cierre por inferencia, que es la principal fuente de deuda técnica en pipelines agénticos.
Aplicación práctica
Un patrón de implementación directo en Claude Code: un agente orquestador genera el plan completo con /spec y /plan, y delega en subagentes especializados y aislados para /test, /build y /review, sin acceso compartido entre ellos. Cada subagente recibe únicamente el contexto de su fase. Esto evita que el agente de build consulte el estado del test antes de escribir código, eliminando el sesgo de confirmación. El comando /ship solo se ejecuta si los artefactos de /review están presentes y verificados. Compatible con pipelines existentes de CI/CD sin modificaciones estructurales.
Contexto del sector
La adopción masiva de agentes de código ha evidenciado un patrón repetido: los fallos no son de competencia técnica sino de proceso. agent-skills responde a esto con una formalización del flujo de ingeniería senior transferible al modelo. Frente a soluciones como Devin o SWE-agent, que gestionan el flujo internamente, este repositorio lo hace explícito y auditable. La tendencia apunta hacia agentes con guardrails de proceso integrados en lugar de libertad de planificación total, especialmente en entornos de producción con requisitos de trazabilidad.
Artículo relacionado
