Acaba de lanzarse Claude Fable 5.1: el modelo más potente del mundo ya está aquí
chaincatcherOriginal Follow AI's Machine Heart
Acaba de, Anthropic lanzó los modelos de nueva generación Claude Fable 5.1 y Claude Mythos 5.1.
Anthropic afirma que Claude Fable 5.1 es uno de los modelos disponibles públicamente más potentes, diseñado para razonamiento complejo, tareas de larga duración y flujos de trabajo de agentes. Claude Mythos 5.1 representa su exploración de límites de capacidad superiores.
Es importante señalar que, aunque ambos comparten las mismas capacidades del modelo base, se han adoptado medidas de seguridad diferentes para distintos escenarios de uso.
Fable 5.1 está abierto a usuarios generales, desarrolladores y empresas, mientras que Mythos 5.1 está dirigido a socios verificados en dominios de alto riesgo, manteniendo controles de acceso más estrictos.
En otras palabras, uno se encarga de entrar en las tareas del mundo real, mientras que el otro se mantiene en un entorno controlado de forma más estricta. Esto también puede ser la exploración de Anthropic de las formas futuras de los productos de IA: los modelos más potentes pueden no ofrecerse necesariamente a todos de la misma forma.
La declaración oficial indica que estos dos modelos representan avances significativos en las capacidades de la serie Claude y demuestran cómo continúan avanzando en el despliegue seguro a la vez que mejoran las capacidades del modelo. 
Como modelo "más potente en apariencia", Fable 5.1 sigue rindiendo de forma impresionante. Los datos oficiales muestran que Fable 5.1 supera al anterior buque insignia Fable 5 en múltiples pruebas de referencia. 
Sin embargo, con mayores capacidades, el precio ha disminuido. Anthropic afirma que Fable 5.1 mantiene el mismo precio base, mientras que el coste de las lecturas de caché ha disminuido un 75% en comparación con Fable 5. En el uso práctico, esto reduce el coste total del modelo para cargas de trabajo típicas en aproximadamente un 25%; para cargas de trabajo altamente automatizadas, los costes pueden reducirse hasta un 45%. 
Parece que incluso los modelos más potentes se centran en la relación coste-eficacia.
Veámoslo más de cerca.
Los niveles inferiores alcanzan a la generación anterior, Fable 5.1 se centra en la "relación coste-eficacia"
En lugar de simplemente actualizar la tabla de clasificación, Anthropic quiere enfatizar esta vez: Fable 5.1 puede completar tareas que antes requerían los niveles altos de Fable 5 con menores costes de inferencia.
Según las pruebas oficiales, Fable 5.1 ya ha logrado un rendimiento cercano o incluso superior al de Fable 5 en intensidades de inferencia bajas a medias. Claude Code utiliza por defecto una intensidad de inferencia alta, mientras que Claude Cowork y Claude .ai utilizan por defecto una intensidad media, lo que permite a los usuarios ajustar entre velocidad, coste y eficacia según la complejidad de la tarea.
En concreto, Fable 5.1 logró una puntuación del 52,6% en la prueba de referencia de agente de investigación científica Terminal - Bench - Science 0.1, más del doble del 24,7% de Fable 5; en Terminal - Bench 4.0, Fable 5.1 alcanzó el 55,8%, y el más capaz Mythos 5.1 logró además un 60,9%.
En pruebas de trabajo del conocimiento, operaciones informáticas y procesos empresariales, el nuevo modelo también mostró mejoras. Las puntuaciones de AutomationBench aumentaron del 17,1% de Fable 5 al 31,4%, y CursorBench 3.2.0 mejoró del 70,5% al 73,4%. 
En múltiples pruebas de referencia, las puntuaciones de Fable 5.1 superaron a las de Fable 5, con las mejoras más significativas en agentes de investigación científica y capacidades de flujo de trabajo empresarial. 
En la prueba Terminal - Bench 4.0, tanto Fable 5.1 como Mythos 5.1 superaron a la generación anterior de Mythos 5 en diferentes intensidades de inferencia. 
En la prueba Terminal - Bench - Science 0.1, Fable 5.1 logró una puntuación máxima del 52,6%, más del doble que Fable 5.
Anthropic cree que un cambio importante en Fable 5.1 es su mayor disposición a rastrear las causas raíz de los problemas, lo que lo hace más adecuado para ejecutar tareas complejas que duran horas o incluso decenas de horas.
La empresa de inversión Millennium descubrió en pruebas que un fragmento de código interno falla aproximadamente una vez cada millón de ejecuciones. Este problema había preocupado al equipo de ingeniería durante cuatro o cinco años, y otros modelos no habían identificado la causa. Fable 5.1 localizó el problema en un error de una biblioteca de programas de terceros desensamblando la biblioteca del proveedor externo y comparando archivos de volcado de núcleo.
Ramp también hizo que Fable 5.1 se ejecutara continuamente durante 38 horas. Tras descubrir que los resultados originales de aprendizaje automático se veían afectados por errores de etiquetado, el modelo corrigió el problema de forma autónoma e inició simultáneamente seis conjuntos de experimentos, compilando finalmente nuevos resultados y recomendaciones posteriores.
De escribir código a realizar investigación científica
En este lanzamiento, Anthropic dedicó una parte significativa a analizar el rendimiento de Fable 5.1 y Mythos 5.1 en investigación científica.
En experimentos de diseño de proteínas, los investigadores pidieron a Mythos 5.1 que utilizara herramientas de código abierto de diseño y plegamiento de proteínas, y luego enviaron los diseños generados a dos instituciones externas para su validación experimental.
Para tres proteínas objetivo, la afinidad de unión de los ligandos diseñados por Mythos 5.1 alcanzó diez veces la de las mejores soluciones en la competición de diseño de proteínas relacionada con Adaptyv Bio. Ante doce proteínas objetivo, la tasa de aciertos de ligandos efectivos del modelo se aproximó al 50%, mientras que el nivel común de la industria proporcionado por Anthropic es del 10% al 15%.
Fable 5.1 también utilizó imágenes de radar recopiladas por la nave espacial Magellan de la NASA hace más de 30 años para generar un nuevo mapa de elevación de alta resolución de aproximadamente un tercio de la superficie de Venus. 
Imágenes de radar de Venus tomadas por la nave espacial Magellan de la NASA, con un pequeño volcán de escudo de aproximadamente 15 kilómetros de diámetro en el centro.
El mapa original solo podía presentar detalles a una escala de 10 a 20 kilómetros, mientras que el nuevo mapa mejora la resolución a 2-3 kilómetros, con una precisión de medición de altura mejorada hasta en un 25%. Anthropic planea publicar este mapa bajo una licencia de intercambio de conocimientos para futuras misiones como VERITAS de la NASA y EnVision de la Agencia Espacial Europea.
En el campo de la biología computacional, Mythos 5.1 mejoró la velocidad de ejecución de siete modelos de aprendizaje profundo de código abierto de proteínas y genómica hasta 2,5 veces escribiendo kernels de GPU personalizados y almacenando en caché resultados intermedios, manteniendo resultados de salida consistentes. En algunas tareas de análisis del genoma completo, se espera reducir los costes de GPU entre un 30% y un 60%. 
Tras optimizar siete modelos de código abierto de proteínas y genómica, la velocidad de inferencia de Mythos 5.1 aumentó entre 1,4 y 2,5 veces.
Anthropic busca utilizar estos casos para demostrar que el modelo está evolucionando de organizar información y escribir código a proponer soluciones, ejecutar herramientas y ofrecer resultados de investigación que pueden validarse experimentalmente.
Los precios de caché cayeron un 75%, y las tareas de agentes se abarataron hasta un 45%.
Más allá del rendimiento, el precio es el cambio más directo en Fable 5.1.
Los precios de entrada y salida de Fable 5.1 no se han ajustado, y se mantienen en 10 dólares por millón de tokens y 50 dólares respectivamente, pero el precio de lectura de caché se ha reducido un 75%, hasta 0,25 dólares por millón de tokens.
La lectura de caché se refiere a la reutilización por parte del modelo de contexto ya procesado. Su proporción puede ser limitada en preguntas y respuestas ordinarias, pero en tareas de agentes que requieren lectura repetida de bases de código, diálogos históricos y resultados de herramientas, el almacenamiento en caché suele constituir un coste importante.
Según los cálculos de Anthropic basados en datos de uso reales de agosto de 2026, el coste total de ejecutar tareas típicas con Fable 5.1 es aproximadamente un 25% menor que con Fable 5; para tareas de agentes complejas con contextos más largos y llamadas frecuentes a herramientas, la reducción de costes puede alcanzar hasta aproximadamente un 45%. 
Tras la reducción de los precios de lectura de caché, el coste de las tareas típicas con Fable 5.1 se reduce en aproximadamente un 25%, mientras que el coste de las tareas altamente automatizadas se reduce hasta en aproximadamente un 45%.
Fable 5.1 ya está disponible en Claude .ai, Claude Code y Claude API, y también se ofrece a través de AWS, Google Cloud y Microsoft Azure. Los desarrolladores pueden llamar al nuevo modelo mediante claude - fable -5-1.
Mecanismo antidestilación reforzado
Fable 5.1 y Mythos 5.1 utilizan en realidad el mismo modelo subyacente, con la principal diferencia en las restricciones de seguridad.
Fable 5.1 está totalmente abierto a usuarios generales y empresas; Mythos 5.1 tiene restricciones de ciberseguridad y ciencias de la vida más relajadas y actualmente solo está disponible para personas e instituciones verificadas.
En el campo de la ciberseguridad, Fable 5.1 ya puede ayudar a los usuarios a descubrir vulnerabilidades de software, pero aún no puede generar directamente programas de explotación. Las tareas de doble uso, como pruebas de penetración, generación de exploits y escaneo de vulnerabilidades basado en archivos binarios, pueden seguir remitiéndose a modelos con restricciones más estrictas.
Tras los ajustes, la nueva versión del mecanismo de protección de ciberseguridad ha reducido los falsos positivos en aproximadamente un 60% en comparación con Fable 5. La tasa de falsos positivos de los mecanismos de bioseguridad en cuestiones básicas de biología y medicina también ha disminuido un 85%, mientras que las capacidades avanzadas relacionadas con la investigación en ciencias de la vida se abren principalmente a través del programa de revisión Mythos 5.1.
Anthropic también ha lanzado Enterprise Frontier Safeguards. Las empresas pueden almacenar datos en su infraestructura de nube controlada, siendo la empresa responsable de las revisiones manuales por defecto, logrando así efectos de privacidad de "retención de datos casi nula" manteniendo las capacidades de supervisión de seguridad. Está previsto que este mecanismo se implante por fases a partir de este otoño.
Para la destilación de modelos a gran escala, Fable 5.1 también ha añadido nuevas restricciones. Las cuentas de API creadas después de ese día no podrán modificar manualmente el contexto anterior en diálogos de varios turnos conservando los registros de pensamiento histórico de Claude. Anthropic afirma que este cambio pretende bloquear principalmente un método de extracción de capacidades conocido públicamente.
Además, para cumplir los requisitos de la Ley de Inteligencia Artificial de la UE, la salida de texto de Fable 5.1 incluirá marcas de agua invisibles. Anthropic también ha comenzado a probar a pequeña escala API de detección, inicialmente abiertas a organismos reguladores, medios de comunicación, organizaciones de verificación de hechos e instituciones de investigación.
Por último, los internautas tienen razón; el que madruga usa antes 5.1. 
Este contenido se proporciona únicamente con fines informativos y educativos y no constituye asesoramiento de inversión relacionado con BTCC. BTCC realiza todos los esfuerzos posibles, pero no puede garantizar la veracidad, exactitud u originalidad del contenido anterior.