Fable ha vuelto: por qué el harness de Claude Code supera a los modelos de código abierto
Toby explica por qué Fable sigue siendo superior a los modelos abiertos, cómo el harness de Claude Code crea un bucle recursivo, y por qué comparar LLMs sin herramientas es un error.
Tras una breve desaparición de la cima de la clasificación, Fable ha vuelto, y en mi experiencia, sigue siendo el estándar de oro absoluto para el desarrollo asistido por IA. Pero mientras los debates arrecian en Twitter y Reddit, he notado un malentendido fundamental en cómo la gente evalúa estas herramientas. ¿Es Fable mejor que Cursor o los últimos modelos de código abierto? La respuesta directa es sí, pero no solo por los pesos del modelo. Fable gana gracias al arnés Claude Code.
He visto innumerables publicaciones que afirman que modelos de código abierto como MiniMax M3 son «igual de buenos» que Fable. Tras meses de uso diario con múltiples modelos, configuraciones locales y agentes en la nube, puedo decirte de forma definitiva: no lo son. La diferencia no es solo la inteligencia central; es todo el sistema que rodea esa inteligencia. Si estás comparando un modelo sin comparar su arnés, estás llegando a conclusiones erróneas.
El veredicto directo: Fable sigue dominando
Déjame ser completamente claro sobre dónde me sitúo tras usar Fable extensamente tanto antes de su ausencia como desde su regreso: este modelo es increíblemente revolucionario. Cuando le hago una sola petición, entrega conjuntos de funciones completos basados en ese único prompt. Escribe pruebas con alta calidad y sorprendentemente pocos errores. Es el salto más impresionante en el desarrollo asistido por IA que he visto hasta la fecha.
Para predicar con el ejemplo: desde el regreso de Fable, ya he consumido 52% de mi uso disponible, lo que representa la mitad de mi uso total del modelo en todas las plataformas. Eso debería decirte todo lo que necesitas saber sobre dónde reside mi confianza cuando tengo trabajo real que sacar adelante.
La diferencia del arnés: LLM frente a sistema
El concepto crítico que sigue siendo ignorado en el debate «Modelo A frente a Modelo B» es la distinción entre un LLM y un arnés. Un Large Language Model (LLM) es el motor central de inteligencia. El arnés es el sistema agéntico que lo rodea, permitiendo llamadas a herramientas, gestionando bucles recursivos y coordinando operaciones complejas de archivos.
Cuando alguien compara MiniMax M3 dentro de una herramienta como Hermes contra Fable dentro de Cursor, no está haciendo una prueba justa. Está comparando dos enfoques arquitectónicos completamente diferentes:
- MiniMax M3 + Hermes: Hermes utiliza un bucle recursivo de aprendizaje. A medida que realiza solicitudes, aprende y se adapta sobre lo que el propio LLM puede hacer. Hermes ha estado más avanzado en su desarrollo agéntico que muchas extensiones IDE estándar.
- Fable + Cursor: Aunque Cursor es un excelente IDE, originalmente fue construido como una herramienta de programación más tradicional.
A menudo carece de las capacidades avanzadas de integración profunda del harness que hacen que Fable realmente destaque en un entorno de línea de comandos.
Esta no es una comparación A/B de modelos; es una comparación de sistemas. Y ahora mismo, el harness de Claude Code es el sistema superior.
El secreto de Fable: el bucle recursivo de Claude Code
Lo que hace que Fable opere a un nivel superior dentro del harness de Claude Code es su capacidad recursiva. Esto es exactamente lo que sucede cuando pulsas 'Enter' en mi flujo de trabajo actual:
- Recopilación de información: proporcionas un prompt y Fable comienza inmediatamente a recopilar toda la información disponible localmente desde tu base de código.
- Ejecución local de herramientas: ejecuta numerosas llamadas a herramientas localmente, sacando a la luz datos que una ventana de chat estándar nunca vería.
- Contexto denso en tokens: envía toda esta información sintetizada de vuelta a la nube utilizando un número significativo de tokens para garantizar que el contexto sea perfecto.
- Generación de resultados: devuelve un resultado de alta calidad basado en ese contexto profundo.
- Validación: comprueba y valida el resultado con la base de código existente antes de finalizar.
Si utilizas Fable dentro de Cursor, te estás perdiendo este bucle recursivo completo. Estás perdiendo los pasos de validación específicos que hacen que Fable se sienta "mágico". Por eso, los usuarios que solo usan el modelo a través de una interfaz básica suelen quejarse de la degradación, mientras que los que usan el agente CLI ven una excelencia constante.
Por qué los modelos locales no han alcanzado el nivel
Soy un gran defensor del hardware local. Mi entorno de desarrollo actual es robusto, con un M3 Ultra con 96GB de RAM y un DGX Spark (GX10 de ASOS G) cargado en mi configuración Exo. Ejecuto Qu3 Coder a través de estos sistemas con una comunicación increíblemente rápida. Me encanta MiniMax M3 y he sido vocal sobre sus fortalezas; incluso lo ejecuto dentro de mis agentes Hermes.
Sin embargo, incluso con 96GB de memoria local e interconexiones de alta velocidad, los modelos locales no reemplazan la potencia en la nube y el sofisticado harness de Fable. Incluso cuando los pesos de MiniMax M3 estén completamente disponibles para ejecución local, una extensión estándar de VS Code no igualará la estrecha integración de Claude Code. Las horas de ingeniería que Anthropic ha invertido en la interacción entre Fable y sus herramientas es el foso invisible.
¿Quién debería elegir qué herramienta?
Decidir dónde gastar tus dólares de suscripción depende por completo de tu flujo de trabajo y nivel de comodidad técnica.
Elige Fable + Claude Code si:
- Eres un desarrollador profesional que necesita enviar funciones completas a partir de un solo prompt.
- Te sientes cómodo trabajando en un entorno de agente basado en terminal.
- Valoras la precisión y la autocorrección recursiva por encima de una GUI tradicional.
- Estás dispuesto a pagar los $200 de premium por la mayor "tasa de éxito" disponible en generación de código.
Elige Cursor + Modelos de Código Abierto/Estándar si:
- Prefieres una experiencia centrada en GUI con la sensación de un IDE tradicional.
- Trabajas en scripts más pequeños o ajustes de front-end donde un agente recursivo completo es excesivo.
- Necesitas mantener los costos más bajos y prefieres la flexibilidad de cambiar entre GPT-4o, Claude 3.5 Sonnet y modelos locales.
El Veredicto Final
Fable sigue siendo el mejor modelo que he usado jamás. Su rendimiento no ha mostrado ninguna de las degradaciones que otros han reportado en la comunidad, en gran parte porque me niego a usarlo sin su arnés previsto. Si estás pagando por múltiples suscripciones de IA y te preguntas dónde consolidar, mi respuesta es clara: Fable dentro de Claude Code vale la inversión.
Dejaría casi cualquier otra herramienta en mi kit—incluidos mis propios proyectos de enrutamiento multimodelo—para usar esta combinación en exclusiva si el precio se mantiene estable. La diferencia entre leer sobre la calidad de un modelo y experimentar la eficiencia de un arnés de alta gama es la diferencia entre jugar con un juguete y usar una herramienta profesional. Deja de comparar los pesos y empieza a comparar los resultados del sistema completo.