Cómo Domar el Caos en el Desarrollo de IA con Comet
Una historia conocida: lanzas un agente de IA, comienza a escribir código con entusiasmo, y diez minutos después descubres que está "alucinando", sobrescribiendo archivos funcionales, o simplemente atrapado en un bucle infinito en el mismo error. Estamos acostumbrados a trabajar con LLMs en programación ya sea en sesiones de chat cortas o como agentes autónomos impredecibles que requieren supervisión constante.
Hace poco me encontré con un proyecto interesante llamado Comet. No es solo otro wrapper alrededor de la API de OpenAI o Claude. Los desarrolladores lo posicionan como un "flujo de trabajo reanudable de larga duración". En términos simples: es un framework que hace que la red neuronal trabaje según un protocolo estricto, no pierde contexto cuando se detiene, y atraviesa todas las etapas de un ciclo de desarrollo normal — desde el diseño hasta la verificación.
¿Por qué molestarse cuando tienes Cursor o Claude Code
Parece lógico preguntarse por qué construir algo complejo cuando los IDEs modernos y las herramientas CLI manejan las cosas bastante bien. El problema es la disciplina. Un agente regular a menudo salta directamente al código, saltándose la fase de diseño adecuada. Comet impone un enfoque arquitectónico.
El proyecto combina dos metodologías: OpenSpec (qué estamos haciendo) y Superpowers (cómo lo estamos haciendo). Todo el proceso se divide en cinco fases:
- Open — preparando la propuesta y desglosando las tareas.
- Deep Design — diseño detallado y creación del Design Doc.
- Plan & Build — creando el plan de implementación y los commits reales.
- Verify & Finish — pruebas e informe de verificación.
- Archive — sincronizando especificaciones y archivando cambios.
Curiosamente, el agente físicamente no puede pasar a la siguiente etapa hasta que el "guard" (script de verificación) se active. Por ejemplo, no te dejará cerrar una tarea si no hay un informe de pruebas o si se viola la estructura .comet.yaml.
Cómo funciona en la práctica
La instalación es estándar para herramientas Node:
npm install -g @rpamis/comet
cd your-project
comet init
Después de la inicialización, aparecerán en tu proyecto las configuraciones y un conjunto de skills para la plataforma seleccionada (se admiten más de 30 plataformas, incluyendo Claude Code, Cursor, Windsurf e incluso GitHub Copilot).
La característica principal que me gustó es el comando /comet. Funciona como un punto de entrada con memoria. Si pausaste el trabajo, fuiste por café o reiniciaste tu computadora, /comet determinará en qué fase se detuvo el proceso y te ofrecerá reanudar exactamente desde ese punto. No necesitas volver a alimentar el contexto al agente ni recordarle qué estabas planeando hacer.

Por cierto, para los aprendices visuales existe comet dashboard. Es un servidor local que abre un panel ordenado en tu navegador mostrando todos los cambios activos, el progreso de las tareas y el historial del archivo. Se ve mucho mejor que un registro interminable en la terminal.
Los Tres Pilares de Comet
En la versión 0.4.0, los desarrolladores resaltaron tres escenarios principales que cubren el 90% de las necesidades:
- Codificación vía
/comet: El flujo de trabajo principal donde el agente te guía paso a paso a través de las etapas. - Creación de skills vía
/comet-any: Te permite construir tus propias cadenas de acciones (skills) y empaquetarlas en distribuciones. - Evaluación vía
comet eval: Esta es probablemente la parte más técnicamente poderosa. En lugar de adivinar "¿mi agente se volvió más inteligente?", lo ejecutas a través de pruebas con métricas Pass@k y Pass^k. Incluso puedes integrar esto con LangSmith para monitoreo serio en producción.

Detalles Técnicos
El proyecto está escrito en JavaScript/TypeScript y se ejecuta como un runtime Node.js puro. Esto es una gran ventaja porque anteriormente herramientas similares a menudo requerían Bash o WSL en Windows, lo cual creaba dolores de cabeza adicionales durante la configuración.
La arquitectura de Comet está construida sobre gestión de estado a través de archivos YAML. En la carpeta openspec/changes/<name>/ se crea un archivo .comet.yaml que almacena todo: desde la fase actual y el modo de construcción seleccionado hasta las rutas de documentación y los resultados de verificación.
Un detalle interesante para quienes son conscientes de los tokens: Comet tiene un modo context_compression. Durante la transición de diseño a construcción, el script comet-handoff.mjs comprime el contexto, eliminando el exceso. Según las pruebas del autor, esto ahorra aproximadamente un 25-30% de tokens de entrada sin perder calidad del código. Para proyectos grandes en Claude 3.5 Sonnet, esto puede ahorrar una buena cantidad en tu saldo.
¿Vale la pena probar?
Comet es una herramienta para quienes han superado la etapa de "escríbeme una función Python" y quieren construir algo complejo y mantenible con IA. Es adecuada para ti si:
- Estás cansado de las ediciones caóticas de agentes que rompen el proyecto en lugares inesperados.
- Necesitas transparencia: qué exactamente está haciendo el agente en este momento y por qué.
- Quieres automatizar tareas rutinarias como actualizar el Design Doc después de hacer cambios en el código.
De las desventajas, puedo señalar que la curva de aprendizaje sigue siendo más alta que un chat regular. Necesitas acostumbrarte a la estructura de carpetas openspec/ y docs/superpowers/. Pero si estás trabajando en un proyecto a largo plazo, esta disciplina se pagará con la ausencia de deuda técnica, que las redes neuronales generan muy rápidamente.
Puedes consultar el código fuente y la documentación en el repositorio rpamis/comet. El proyecto se está desarrollando activamente, y a juzgar por los commits, los autores se toman en serio hacerlo un "framework" confiable para ingenieros autónomos.
Proyectos relacionados