Interes General

Anthropic lanza Claude Opus 5, más barato y eficiente

El nuevo modelo iguala casi el rendimiento de la versión más avanzada de la compañía, pero cuesta la mitad, y ya es el predeterminado en los planes pagos de Claude.

Por Administrador 2 min de lectura25 visualizaciones
Anthropic lanza Claude Opus 5, más barato y eficiente

Anthropic presentó Claude Opus 5, su nuevo modelo de inteligencia artificial que queda disponible desde hoy en todas las plataformas. La compañía lo define como un sistema "reflexivo y proactivo" que se acerca al nivel de su modelo más potente, Claude Fable 5, a la mitad del costo.

El nuevo modelo pasa a ser el predeterminado en Claude Max y el más potente disponible en Claude Pro. Según la empresa, Opus 5 mejora sustancialmente el rendimiento respecto de su antecesor, Opus 4.8, manteniendo el mismo precio: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.

Rendimiento en programación y ciencia

En pruebas de programación y trabajo de conocimiento, como Frontier-Bench y GDPval-AA, Opus 5 se ubica como el modelo de referencia del mercado, aunque sigue por detrás de Mythos 5 en tareas de ciberseguridad.

En la evaluación CursorBench 3.2, con el máximo nivel de esfuerzo, el modelo alcanza un rendimiento a apenas 0,5% del pico de Fable 5, pero con la mitad del costo por tarea. En Frontier-Bench v0.1 supera a todos los modelos disponibles y más que duplica el desempeño de Opus 4.8 con un costo menor por tarea.

El modelo también muestra avances en investigación científica. Anthropic señala mejoras respecto de Opus 4.8 en todas sus evaluaciones de ciencias de la vida:

  • Biología estructural
  • Química orgánica
  • Bioinformática

Los saltos más marcados aparecen en química orgánica, con 10,2 puntos porcentuales más que Opus 4.8 al inferir estructuras moleculares a partir de datos de espectroscopía, y en tareas relacionadas con proteínas, donde mejora 7,7 puntos al predecir cómo afectan las variaciones de secuencia a su funcionamiento.

Seguridad y restricciones de uso

Según auditorías internas previas al lanzamiento, Opus 5 es, hasta ahora, el modelo más alineado que desarrolló la compañía: muestra las tasas más bajas de comportamiento engañoso y es el menos susceptible a ser inducido a usos indebidos.

En materia de riesgos, Anthropic aclara que el modelo no amplía las capacidades de doble uso más sensibles. En evaluaciones realizadas junto con socios del sector privado y organismos gubernamentales, Opus 5 continúa por detrás de Mythos 5 tanto en investigación biológica como en ciberseguridad ofensiva.

La compañía precisó que el modelo no fue entrenado específicamente en tareas cibernéticas, pero mejoró en ese terreno como consecuencia de su mayor capacidad general. Puede identificar vulnerabilidades de seguridad con una efectividad cercana a la de Mythos 5, aunque queda muy por detrás a la hora de explotarlas para convertirlas en amenazas concretas.

Para tareas de ciberseguridad y biología, Opus 5 mantiene salvaguardas similares a las de Opus 4.8, con controles algo más estrictos en un grupo acotado de tareas cibernéticas. Anthropic estima que estos filtros intervendrán un 85% menos que en Fable 5. Las solicitudes bloqueadas se redirigen por defecto a Opus 4.8, tanto en Claude.ai como en Claude Code y Claude Cowork.

El modelo también está disponible en modo rápido, con un funcionamiento hasta 2,5 veces más veloz que el estándar, al doble de precio. Opus 5 no requiere retención de datos para el acceso general, en línea con versiones anteriores de la familia Opus.

Publicidad

Comentarios

Ingresá para comentar — leer es gratis, comentar también.

Todavía no hay comentarios. Sé el primero en opinar.

Notas relacionadas