Anthropic lanza Claude Fable 5.1 y Mythos 5.1 para ciencia y software

Anthropic presentó oficialmente dos nuevas versiones de sus sistemas de inteligencia artificial: Claude Fable 5.1 y Claude Mythos 5.1. Estos modelos representan el estado más avanzado de la compañía hasta ahora, con mejoras pensadas para desarrollo de software, investigación científica y tareas especializadas.

El modelo Fable 5.1 ya se encuentra disponible en plataformas como Amazon Web Services, Google Cloud y Microsoft Azure, además de la API de Claude. Por su parte, Mythos 5.1 —que es esencialmente el mismo modelo pero con protocolos de seguridad más estrictos— se entrega únicamente mediante el programa de acceso seguro de Anthropic, restringido a expertos en ciberseguridad, organizaciones autorizadas y científicos acreditados.

Tanto Fable 5.1 como Mythos 5.1 incorporan avances significativos frente a sus versiones anteriores. Según la compañía, estos modelos representan

«un primer vistazo de cómo los modelos de IA contribuirán al progreso científico»

, haciendo referencia a sus mejoras en programación e investigación.

Fable 5.1 se destaca por evitar los atajos que suelen producir resultados de baja calidad, y es capaz de identificar y resolver las causas raíz de los problemas de software. Además, sobresale en el uso de agentes de IA para tareas de investigación científica, programación y razonamiento multidisciplinario.

Gracias a estas capacidades, Mythos 5.1 logró diseñar aglutinantes de proteínas con afinidades hasta diez veces superiores y una tasa de éxito de casi el 50% en pruebas de laboratorio. Por otro lado, Fable 5.1 entrenó una red neuronal que produjo un nuevo mapa de elevación en alta resolución de Venus, utilizando datos históricos de la NASA.

Sin embargo, estas capacidades también implican riesgos si se utilizan con intenciones maliciosas. Para mitigarlos, Anthropic asegura haber mejorado en alineación y seguridad, con refuerzos específicos enfocados en privacidad de datos para empresas, biología y ciberseguridad.

En concreto, Anthropic limitó el acceso de Mythos 5.1 a las capacidades de investigación biológica, y lo entrenó para rechazar solicitudes maliciosas relacionadas con codificación de agentes e inyecciones de mensajes. Según la empresa, el modelo muestra un rendimiento superior al de su predecesor, un comportamiento más alineado y una menor tendencia a usar razonamiento motivado para justificar sus acciones.

No obstante, Mythos 5.1 aún presenta intentos de obtener recompensas mediante trampas o manipulación del sistema. Aunque logra hacerlo en algunos casos, su tasa general de éxito es menor que la de Mythos 5.

En términos generales, Anthropic sostiene que las salvaguardas aplicadas reducen en un 60% los bloqueos por falsos positivos en ciberseguridad. Esto permite que el modelo analice y descubra vulnerabilidades sin generar ‘exploits’ dañinos.

Las mejoras también se reflejan en el costo. Anthropic ha indicado que Fable 5.1 cuesta aproximadamente un 25% menos que Fable 5 en cargas de trabajo típicas, gracias a una reducción en la lectura de caché. En tareas que involucran agentes autónomos, el ahorro puede llegar hasta un 45%.

Además, Fable 5.1 es más eficiente que su predecesor. La compañía afirma que logra resultados iguales o superiores a los de Fable 5 pero a una fracción del costo, consumiendo menos tokens.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK