Anthropic anunció el jueves que ha agregado Claude Opus 5 a su creciente cartera de modelos de inteligencia artificial, destacando el sistema como el más capaz y alineado que ha lanzado hasta la fecha. La empresa afirma que Opus 5 iguala o supera el rendimiento de su modelo insignia Fable 5 en la mayoría de los benchmarks de codificación y trabajo de conocimiento, mientras cobra aproximadamente la mitad del precio por token.
Opus 5 llega solo unas semanas después del lanzamiento de Sonnet 5, lo que marca el cuarto modelo importante que Anthropic ha lanzado en menos de dos meses. La presentación sigue a Fable 5 a principios de junio, Sonnet 5 a finales de junio y ahora Opus 5 el 24 de julio. Cada modelo tiene como objetivo un slot de precio-rendimiento distinto, y Opus 5 se sitúa entre la costosa gama Fable y la gama Sonnet de presupuesto.
En Frontier-Bench, una evaluación de codificación que pide a los modelos que creen software funcional desde dibujos de ingeniería, Opus 5 más que duplicó la puntuación publicada por su predecesor y superó a todos los sistemas competidores, incluido Fable 5. El modelo también destacó en ARC-AGI 3, una prueba de resolución de problemas novedosos, donde publicó una puntuación aproximadamente tres veces mayor que el siguiente mejor modelo. En Zapier's AutomationBench, que mide la finalización de tareas comerciales reales de extremo a extremo, Opus 5 aprobó más tareas que cualquier rival, incluso cuando se ejecutó en su configuración de esfuerzo más baja.
Más allá del rendimiento bruto, Anthropic enfatiza las ganancias de alineación de Opus 5. La auditoría de seguridad automatizada registró la tasa más baja de comportamiento engañoso jamás vista en un modelo de Anthropic. Si bien el sistema todavía sigue a Mythos 5 en tareas de ciberseguridad ofensiva, por diseño, porque Anthropic evitó entrenar a Opus 5 en trabajo cibernético, las métricas generales de honestidad establecieron un nuevo estándar para la empresa.
Los desarrolladores pueden acceder a Opus 5 hoy como el modelo predeterminado en Claude Max y la opción más fuerte en Claude Pro. El modelo también está disponible a través de la API de Anthropic, Amazon Bedrock, Google Cloud y Microsoft Foundry. Un modo "Rápido" se ejecuta a dos veces y media la velocidad predeterminada por el doble del precio base, lo que da a los usuarios un atajo de rendimiento cuando la latencia es importante.
Se lanzan dos nuevas características de API junto con el modelo. Primero, los cambios de herramientas en mitad de conversación permiten a los desarrolladores cambiar herramientas sin romper la caché de la solicitud, preservando el contexto y reduciendo la latencia. Segundo, las devoluciones automáticas enrutan las solicitudes marcadas a un modelo diferente en lugar de bloquearlas, lo que mejora la confiabilidad para aplicaciones sensibles a la seguridad.
El ritmo de lanzamiento rápido señala un cambio en el mercado de modelos de inteligencia artificial. Anthropic ha pasado de entregar un modelo insignia por trimestre a entregar cuatro modelos en aproximadamente ocho semanas, cada uno calibrado para un caso de uso y punto de precio específicos. Opus 5 llena un nicho para los desarrolladores que necesitan inteligencia cercana a la frontera para la codificación y el trabajo de conocimiento diarios, pero no requieren las restricciones de ciberseguridad que limitan a Fable o el acceso restringido que mantiene a Mythos detrás de puertas cerradas.
Los observadores de la industria ven el movimiento como una respuesta a la creciente competencia de otros proveedores de inteligencia artificial que están expandiendo sus familias de modelos y niveles de precio. Al ofrecer una opción de alto rendimiento y costo-efectiva, Anthropic busca capturar un segmento más amplio del mercado empresarial y de desarrolladores, mientras mantiene su enfoque en la seguridad y la alineación.
Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.