☑️ Antiagree [Plugin para Claude Code - Agent Skill - Evals]

Ivan Luna 07 Oct, 2026 05 min de lectura
☑️ Antiagree [Plugin para Claude Code - Agent Skill - Evals]

Antiagree revisa una idea, un plan, una arquitectura, un benchmark o una decisión como lo haría un revisor externo que no tiene nada en juego. Contrasta las afirmaciones con el código y los datos, busca lo que ya existe, intenta derribar la propuesta con el argumento más fuerte que encuentre y se queda solo con lo que sobrevive. Cada revisión termina en una sola decisión: GO, ITERATE, RETHINK o KILL. No finge dureza: cuando el plan es sólido, dice GO. Se distribuye a la vez como plugin para Claude Code y como Agent Skill. Solo instrucciones, sin telemetría, MIT.

Ver en GitHub Documentación

Estar de acuerdo es lo habitual:


Los modelos de lenguaje tienden a darle la razón a quien tienen enfrente. Preguntas “¿es un buen plan?” y muchas veces recibes un sí prolijo, un par de retoques menores y una estimación que nadie midió. La falla opuesta es igual de común: pides honestidad brutal y recibes problemas inventados, porque eso parece pedir el rol. Las dos respuestas te dicen lo que pediste escuchar en lugar de lo que es cierto.

La lealtad de Antiagree es con tu objetivo, no con tu propuesta, con tus decisiones anteriores ni con lo que dijo antes en la conversación. Dureza intelectual, no de tono.

Cómo funciona una revisión:


  • Revisa el registro. Si existe ANTIAGREE.md, lo lee primero: un criterio de descarte que se cumplió, o un plazo que venció, encabeza la revisión.
  • Investiga antes de juzgar. Verifica las tres a cinco afirmaciones de las que depende la decisión, en el código, los datos, los benchmarks y el historial de git. Sin artefactos, aclara que la revisión es solo de razonamiento.
  • Comprueba si ya existe. Para cualquier cosa que planees construir, busca antecedentes y pregunta qué es realmente distinto.
  • Encuentra el objetivo real. Qué resultado se busca, qué variable importa y si la pregunta misma está mal planteada.
  • Ataca y luego intenta derribarla. Supuestos, actividad frente a impacto, causalidad, la medición, costos ocultos, efectos de segundo orden, personas e incentivos, costo hundido y caminos más simples. Después, el caso más fuerte en contra de la propuesta, no un hombre de paja.
  • Reconstruye. El cuello de botella, los pocos movimientos con palanca real y experimentos con umbrales de GO y KILL.

Cada afirmación que importa lleva una etiqueta, en el idioma del usuario: HECHO (con su fuente), FUERTEMENTE SOPORTADO, HIPÓTESIS o ESPECULACIÓN. Sin porcentajes inventados: si nadie lo sabe, la respuesta es “todavía no lo sabemos”.

El veredicto:


Cada revisión abre con una tarjeta: qué se está revisando, el veredicto, el mayor riesgo, el próximo paso más barato que resuelve la duda y el único dato que le haría cambiar de opinión.

  • GO: sólido; adelante. Es lo predeterminado cuando el diagnóstico está respaldado y el plan se puede verificar y revertir con poco costo.
  • ITERATE: objetivo y enfoque correctos, con algo que hay que corregir y que el plan todavía no cubre.
  • RETHINK: objetivo correcto, enfoque equivocado.
  • KILL: abandonarlo.

Cierra con la verdad incómoda, qué conservar, qué cambiar, qué no construir y qué sigue sin saberse.

Revisar la sesión, y hacerte cumplir lo que decidiste:


  • Revisión de la sesión. Ejecuta /antiagree sin nada después y audita lo que tú y Claude ya decidieron en la conversación, desde el primer mensaje. Aclara de entrada que participó en esas decisiones, y abre con una tabla de cada número y afirmación que la sesión aceptó: quién lo introdujo, si se verificó y qué depende de eso.
  • Criterios de descarte. Cuando una revisión propone experimentos con umbrales, ofrece registrarlos en ANTIAGREE.md. La próxima revisión los lee primero, así que la vara no se puede mover después de ver el resultado.
  • Calibrado. Nombra lo que el plan hace bien antes de atacarlo, reconoce las salvaguardas que ya tiene y cambia de posición ante hechos nuevos o mejores argumentos, no ante el disgusto.

Instalación:


# Claude Code
/plugin marketplace add antiagree/antiagree
/plugin install antiagree@antiagree

# Uso
/antiagree                                # revisa las decisiones de esta sesión
/antiagree nuestro plan de dividir el monolito # revisa cualquier cosa
/antiagree quick bench/RESULTS.md         # tarjeta de veredicto + tres hallazgos principales

Otros agentes con Agent Skills (Codex, Cursor, Gemini CLI) la instalan copiando skills/antiagree/ en su carpeta de skills. También se activa con pedidos simples como “ataca mi plan” o “no me des la razón”.

Comprobado, no supuesto:


El repositorio incluye cinco casos de evaluación para claude plugin eval: un benchmark con fallas plantadas, un plan sólido con “sé brutal” en el prompt, un caso en español donde el intervalo de confianza incluye el cero, un criterio de descarte que los últimos resultados cumplieron y una sesión que llegó a un plan a fuerza de estar de acuerdo. Cuatro de ellos se corren con y sin el plugin.

En esos casos, con tres corridas cada uno y Opus 5.5 como juez, Sonnet 5.5 y Opus 5.5 aprobaron las 15 corridas con Antiagree, frente a 0 de 12 y 3 de 12 sin él. Sin el plugin, los dos encontraron igual las fallas plantadas, pero inventaron problemas en el plan sólido y no dieron una regla de decisión para el benchmark. Los casos se escribieron para este proyecto, así que los números son una señal, no una prueba.

Stack técnico:


  • Formato: una sola Agent Skill, un SKILL.md, sin hooks, sin servidores MCP y sin scripts. Las herramientas que preaprueba son de solo lectura (Read, Grep, Glob); las búsquedas web de antecedentes piden permiso.
  • Distribución: un marketplace de plugins de Claude Code y el estándar Agent Skills.
  • Evals: claude plugin eval con ablación con y sin el plugin, evaluadores LLM con criterios de aprobación escritos, un historial de sesión reproducido y espacios de trabajo generados por script.
  • CI: validación estricta del plugin, chequeos de manifiestos y casos de evaluación, y reglas del directorio de plugins (tamaños, nombres de archivo, redacción), sin API key y sin costo.
  • Privacidad: sin código de red y sin telemetría. Lee archivos de tu proyecto, escribe ANTIAGREE.md solo si estás de acuerdo, y sus búsquedas pasan por la propia herramienta WebSearch de Claude.

Conclusión:


Antiagree nació de mis propios prompts largos pidiéndole a Claude que dejara de darme la razón, convertidos en una skill que cualquiera puede instalar. El proyecto demuestra:

  • Moldear el comportamiento de un modelo solo con instrucciones: una skill que cambia cómo revisa Claude, sin código corriendo en la máquina del usuario.
  • Tratar la calibración como una funcionalidad: decir GO ante un plan sólido se prueba con el mismo rigor que detectar uno con fallas.
  • Medir un prompt como un producto: evals de ablación con y sin el plugin, evaluadores en el repositorio y resultados publicados con sus límites.
  • Hacer que las decisiones perduren: un registro de criterios de descarte que la siguiente revisión hace cumplir.


Etiquetas

Compartir


Proyectos relacionados

Todos los proyectos