Goatify IA

Noticias, guías y análisis

Anthropic lanza Claude Fable 5.1 y Mythos 5.1 con foco en trabajo agentic, ciencia y controles empresariales

Anthropic presentó Fable 5.1 y Mythos 5.1, una actualización orientada a coding, conocimiento, investigación y tareas de larga duración.

Anthropic lanza Claude Fable 5.1 y Mythos 5.1 con foco en trabajo agentic, ciencia y controles empresariales

Dos nombres, un mismo modelo base. Anthropic presentó Claude Fable 5.1 y Claude Mythos 5.1 el 1 de septiembre. Según la compañía, ambos comparten el mismo modelo subyacente, pero operan con niveles de salvaguardas diferentes. Fable 5.1 se ofrece de forma general, mientras Mythos 5.1 queda restringido a programas de acceso confiable para trabajos donde las capacidades avanzadas de ciberseguridad y ciencias de la vida requieren controles adicionales. Esa separación es importante porque introduce una idea cada vez más visible en el mercado: una capacidad puede existir técnicamente y, aun así, distribuirse de forma distinta según riesgo y contexto.

Economía diseñada para trabajo largo. Anthropic afirma que Fable 5.1 costará aproximadamente un 25% menos que Fable 5 en cargas típicas donde el uso se factura por tokens. La compañía atribuye el cambio principalmente a una reducción en el precio de las lecturas de caché, y sostiene que en tareas altamente agentic el ahorro puede llegar aproximadamente al 45%. Más que una rebaja aislada, esto apunta a un problema real de los agentes: cuando una ejecución dura horas, lee mucho contexto y repite información estable, el costo de mantener ese contexto puede ser tan importante como el precio nominal de entrada y salida.

La privacidad se vuelve arquitectura. Otro anuncio relevante es Enterprise Frontier Safeguards, o EFS. Anthropic dice que el sistema permitirá a clientes empresariales conservar sus datos en infraestructura cloud controlada por ellos mismos, mientras se mantienen mecanismos automatizados contra uso adversarial. El despliegue será por fases a partir del otoño y, mientras llega, clientes elegibles podrán usar Fable 5.1 con zero data retention. La compañía afirma que desarrolló EFS con más de cien clientes de sectores como servicios financieros, salud, manufactura, telecomunicaciones, derecho, retail y sector público, además de sus socios cloud.

Menos falsos positivos en ciberseguridad. Anthropic también dice haber refinado sus salvaguardas para que bloqueen menos trabajo benigno. Con Fable 5.1, la empresa permite identificar vulnerabilidades de software como actividad defensiva, aunque mantiene restricciones para tareas de doble uso más sensibles. Según el anuncio, los usuarios de Claude Code pueden esperar en promedio alrededor de un 60% menos de intervenciones por sesión de las salvaguardas de ciberseguridad frente a las de Fable 5. Ese dato muestra la dificultad de gobernar modelos capaces: un filtro demasiado agresivo puede inutilizar la herramienta, pero uno demasiado laxo puede elevar el riesgo.

La investigación científica entra al argumento comercial. Anthropic publicó resultados de pruebas en investigación científica, coding agentic, razonamiento multidisciplinario y uso de computadora. También mostró ejemplos de trabajo en diseño de proteínas, cartografía de Venus y optimización de modelos de biología computacional. Como siempre con benchmarks y demostraciones publicadas por un proveedor, conviene tratarlos como evidencia del propio fabricante y no como una comparación neutral definitiva. Aun así, el mensaje estratégico es claro: la empresa quiere que estos modelos sean evaluados por la calidad del trabajo largo que terminan, no únicamente por respuestas breves o pruebas académicas aisladas.

Qué observar desde Goatify. Para construir y vender agentes, esta versión refuerza cuatro criterios que deberían estar en cualquier evaluación seria: capacidad real de completar tareas, costo total de una ejecución, comportamiento bajo permisos y salvaguardas, y posibilidad de trabajar con datos empresariales sin perder control. Elegir un modelo por una tabla de benchmark puede ser insuficiente si luego el workflow cuesta demasiado, se detiene por falsos positivos o exige una política de datos incompatible con el cliente. El modelo frontier gana valor cuando encaja en un sistema operativo de negocio, no cuando solo gana una captura de pantalla.

Abrir artículo en Goatify

Abriendo Goatify...