Anthropic revela el modelo interno 2: capacidades generales ligeramente superiores a Claude Mythos 5

Anthropic reveló silenciosamente un modelo de IA interno no publicado, llamado Modelo 2, en su informe de riesgos de agosto de 2026. Este modelo no es una versión pública de Claude, y Anthropic no ha anunciado...

发布于 2026年8月19日generalGEO 评分: 04 次阅读
Anthropic revela el modelo interno 2: capacidades generales ligeramente superiores a Claude Mythos 5

Anthropic revela el modelo interno 2: capacidad general ligeramente superior a Claude Mythos 5

Introducción

Anthropic reveló discretamente un modelo interno no publicado llamado Model 2 en su informe de riesgos de agosto de 2026.

Este modelo no es una versión pública de Claude, y Anthropic no lo ha lanzado como producto. Aparece en el informe porque la compañía incluyó sistemas internos de frontera y cercanos a la frontera al evaluar los riesgos de la IA avanzada.

Según Anthropic, el Model 2 tiene capacidad general ligeramente superior a Claude Mythos 5.

La mejora es real, pero la compañía evitó cuidadosamente describirla como un salto generacional significativo.

El propio resumen de Anthropic señala que el Model 2 es claramente superior a Mythos 5 en muchas tareas relacionadas con el uso interno, pero sigue estando lejos del salto de capacidad que la compañía observó al pasar de Claude Opus 4.6 a Claude Mythos Preview.

Esto hace que el Model 2 sea significativo desde una perspectiva diferente.

Más que marcar la llegada de una nueva generación, se parece más a la mejora continua de Anthropic de las capacidades de los modelos de frontera.

El informe también proporciona un dato concreto: en la evaluación interna CoBench de Anthropic, el Model 2 obtuvo 62,8%, superando el 50,3% de Claude Mythos 5 y el 54,8% de Claude Mythos Preview.

El mismo informe también menciona otro sistema interno, Model 1, lo que ha generado especulaciones externas sobre si Anthropic está desarrollando una serie de modelos internos antes de asignar nombres públicos de productos Claude.

El informe oficial solo respalda parcialmente esta interpretación.

Anthropic confirma que Model 1 y Model 2 son modelos internos, pero no indica que Model 2 sea el sucesor formal de Model 1, ni que ninguno de los dos se convierta en una futura versión de Claude.

El Model 2 es ligeramente superior en general a Claude Mythos 5

El punto central del informe de AIBase es preciso: Anthropic afirma que el Model 2 es superior en general a Claude Mythos 5.

El informe de riesgos de agosto de la compañía describe al Model 2 como:

  • Superior a Mythos 5 en capacidad en ciertas áreas.
  • Inferior a Mythos 5 en capacidad en otras áreas.
  • Ligeramente superior en capacidad general.

Anthropic también afirma que su evaluación cualitativa aproximada es que el Model 2 proporciona mejoras claras en muchas tareas relacionadas con el uso interno.

Este lenguaje es importante.

El Model 2 no debe describirse como superior a Mythos 5 en todos los benchmarks o en todos los ámbitos relacionados con riesgos.

El propio informe muestra que los resultados comparativos varían según la tarea.

Por ejemplo, en ciertas evaluaciones de riesgo químico y biológico, Anthropic indica que los resultados limitados del Model 2 son comparables o inferiores a los de Claude Mythos 5.

En otra evaluación de comportamiento encubierto, el Model 2 es ligeramente superior a Mythos 5, pero sigue siendo claramente inferior a Mythos Preview.

Por lo tanto, el resumen más justo es:

Model 2
= capacidad general ligeramente superior
≠ superior en todas las evaluaciones

La mejora no es un salto generacional significativo

El texto original enfatiza que esta mejora es relativamente limitada.

Anthropic afirma que, en comparación con...,

lo mismo.

La compañía compara específicamente al Model 2 con la transición anterior, es decir, el salto de Claude Opus 4.6 a Claude Mythos Preview.

Esa actualización representó un aumento de capacidad mucho mayor.

El Model 2, no.

Anthropic indica que este modelo interno más reciente muestra mejoras claras en muchas tareas internas, pero no es un cambio disruptivo de la misma escala.

Esto también se refleja en otro indicador de capacidad interna.

Anthropic mantiene una versión interna del Índice de Capacidad de Epoch llamado AECI, que combina el rendimiento de múltiples benchmarks internos.

Según datos limitados, la puntuación del Model 2 es aproximadamente:

1,5 puntos AECI

por encima de Claude Mythos 5.

Anthropic señala explícitamente que esta estimación tiene un amplio margen de error.

También indica que este aumento es menor que la mejora observada de Mythos Preview a Mythos 5.

Esto respalda la principal caracterización del artículo: el Model 2 parece una mejora incremental de los modelos de frontera, no una fase claramente nueva de capacidad.

CoBench ofrece la comparación pública más clara

La evidencia más concreta del informe proviene de CoBench.

Anthropic describe CoBench como una evaluación interna diseñada para probar la capacidad de los modelos para resolver problemas reales de I+D de la empresa, en lugar de utilizar benchmarks genéricos como indicador sustituto.

La evaluación sitúa al modelo en un punto temporal de la historia de la infraestructura de Anthropic.

El modelo recibe una instantánea de recursos, que incluye:

  • Código.
  • Registros.
  • Documentación interna.
  • Mensajes internos históricos.

Luego debe diagnosticar la causa raíz de problemas técnicos que los ingenieros de Anthropic resolvieron anteriormente.

La versión actual descrita en el informe de agosto incluye:

449 problemas

procedentes principalmente de problemas resueltos entre febrero y abril de 2026.

Estos problemas provienen de departamentos de la organización técnica de Anthropic que abarcan:

  • Entrenamiento de modelos.
  • Operación de infraestructura de modelos.
  • Depuración de sistemas técnicos.
  • Ingeniería de investigación.

Esto hace que CoBench sea especialmente relevante para el enfoque de Anthropic en la automatización de la I+D de IA mediante IA.

El Model 2 obtiene un 62,8% en CoBench

Las puntuaciones comparativas presentadas en el informe son las siguientes:

Modelo Puntuación CoBench
Claude Sonnet 4.6 12,0%
Claude Opus 4.6 15,6%
Claude Opus 4.7 27,4%
Claude Mythos 5 50,3%
Claude Mythos Preview 54,8%
Model 2 62,8%

Por lo tanto, el Model 2 lidera entre los modelos mostrados en el gráfico.

Su ventaja sobre Mythos 5 es:

62,8% - 50,3% = 12,5 puntos porcentuales

En este benchmark interno específico, es una diferencia significativa.

Pero sigue estando muy por debajo de la puntuación que Anthropic considera suficiente para reemplazar completamente a su personal técnico.

Anthropic estima que se necesitaría aproximadamente un 85% para reemplazar completamente a los investigadores

Anthropic indica que, según una revisión manual de las tareas y del proceso de puntuación, un sistema que realmente pudiera reemplazar por completo a los científicos e ingenieros de investigación de Anthropic debería obtener al menos aproximadamente:

85%

en CoBench.

El 62,8% del Model 2, por tanto, sigue teniendo una brecha considerable.

Anthropic también advierte que este benchmark no mide perfectamente la equivalencia con los humanos.

El conjunto de datos está

deliberadamente filtrado para incluir problemas difíciles.

La mayoría de las tareas se seleccionaron porque Mythos Preview falló al menos una vez en tres intentos.

Anthropic indica que, sin este filtrado, el tamaño del conjunto de datos aproximadamente se duplicaría.

Existen otras limitaciones:

  • Algunas conclusiones humanas históricas pueden no ser óptimas.
  • Algunas respuestas pueden ser ambiguas.
  • La puntuación automática puede cometer errores.

El modelo no obtiene realmente todos los permisos o el soporte de infraestructura que podría tener un ingeniero real de Anthropic.

Por lo tanto, CoBench es mejor considerado como una señal interna útil, no como un estándar universal para medir si los modelos de IA pueden reemplazar a los investigadores.

Dar más tokens a Mythos 5 no cierra completamente la brecha

Anthropic también probó si los resultados de CoBench simplemente reflejaban un presupuesto de razonamiento insuficiente.

El presupuesto de tokens utilizado en el gráfico es de aproximadamente:

300,000 tokens

para las configuraciones evaluadas.

Cuando Anthropic aumentó el presupuesto de Mythos 5 a:

900,000 tokens

su puntuación solo mejoró aproximadamente:

3 puntos porcentuales

Esto sugiere que al menos parte de la ventaja del Modelo 2 no puede explicarse simplemente dando más tokens a Mythos 5.

Anthropic aún considera que un mejor andamiaje y marcos de evaluación podrían mejorar los resultados, por lo que este punto de referencia no mide puramente los pesos del modelo en sí.

La arquitectura de los agentes es importante.

El Modelo 2 ya se usa ampliamente dentro de Anthropic

El Modelo 2 aún no se ha lanzado, pero no es solo un checkpoint de laboratorio sin uso.

Anthropic afirma que el Modelo 2 y Claude Mythos 5 son algunos de los modelos internos más capaces y más utilizados.

Se usan ampliamente para:

  • Programación.
  • Generación de datos.
  • Otros flujos de trabajo de agentes.
  • Investigación.
  • Ingeniería.

Anthropic también indica que ambos modelos se utilizan mediante despliegues de agentes persistentes, no solo en sesiones de chat interactivas.

Esto es importante porque la sección de riesgos del informe se centra en parte en cómo los sistemas de IA podrían automatizar cada vez más partes del propio trabajo de I+D de Anthropic.

El informe afirma que Claude ahora escribe la gran mayoría del código que se fusiona en el repositorio de código de producción de Anthropic.

Sin embargo, Anthropic no concluye que sus modelos puedan reemplazar completamente a sus investigadores en la actualidad.

La compañía cree que la IA está acelerando sustancialmente el trabajo interno, pero su evaluación de agosto aún está por debajo de los umbrales de la Política de Escalado Responsable para una aceleración significativa de la I+D impulsada por IA.

El Modelo 2 aún no ha completado la suite completa de evaluaciones previas al despliegue de Anthropic

El informe también incluye otra advertencia importante.

El Modelo 2 ha pasado el proceso interno de revisión de despliegue de Anthropic, pero aún no ha pasado la suite completa de evaluaciones que la compañía normalmente ejecuta antes del despliegue externo.

Por lo tanto, Anthropic afirma que su nivel de confianza en la comprensión del Modelo 2 es ligeramente menor que el de los modelos lanzados que han pasado evaluaciones completas.

Esto es importante al interpretar las comparaciones de puntos de referencia.

Un solo resultado de CoBench puede indicar que el Modelo 2 se desempeña bien en tareas internas de I+D.

Pero no establece un perfil de rendimiento completo que abarque:

  • Razonamiento general.
  • Programación.
  • Ciberseguridad.
  • Biología.
  • Seguridad.
  • Alineación.
  • Autonomía de ciclo largo.
  • Uso del consumidor.
  • Entornos empresariales.

Carga de trabajo.

La conclusión actual de Anthropic es deliberadamente amplia: el Modelo 2 parece ser ligeramente superior a Mythos 5 en general.

Anthropic actualmente no tiene planes de lanzar públicamente el Modelo 2

En el breve artículo de AIBase, el detalle práctico más importante es fácil de pasar por alto.

Anthropic afirma explícitamente:

Actualmente no tenemos planes
de lanzar este modelo públicamente.

Por lo tanto, el Modelo 2 no debe considerarse como un próximo producto de Claude con una fecha de lanzamiento implícita.

Actualmente no hay:

  • Fecha de lanzamiento.
  • Nombre público del modelo.
  • ID de modelo de Claude API.
  • Precios.
  • Especificaciones de ventana de contexto.
  • Planes de disponibilidad para consumidores.
  • Planes de despliegue empresarial.

Cualquier afirmación de que el Modelo 2 se convertirá en "Claude Mythos 6", "Claude Opus 6" u otro producto con nombre es solo especulación.

Anthropic divulga este modelo porque sus modelos internos son relevantes para la evaluación de riesgos de la compañía.

Esto es diferente a lanzar un producto.

Claude Mythos 5 en realidad no es un modelo público ampliamente disponible

El título original de AIBase afirma que Claude Mythos 5 es el modelo público más fuerte de Anthropic.

Esto necesita una pequeña corrección.

Claude Mythos 5 no está ampliamente disponible.

Anthropic actualmente ofrece este modelo solo a un grupo limitado de clientes aprobados a través del Proyecto Glasswing y programas relacionados de acceso confiable.

La versión ampliamente disponible es Claude Fable 5.

Anthropic afirma que Fable 5 y Mythos 5 utilizan el mismo modelo subyacente.

La diferencia es que Fable 5 incluye salvaguardas más fuertes en áreas sensibles como ciberseguridad y biología, mientras que Mythos 5 se ofrece a usuarios examinados que necesitan menos restricciones en trabajos autorizados.

La relación actual de productos es:

Claude Mythos 5
= Acceso confiable restringido

Claude Fable 5
= Mismo modelo subyacente
  + Salvaguardas más fuertes
  + Disponibilidad amplia

Por lo tanto, para el lector promedio, una descripción más precisa sería: Mythos 5 es el modelo frontera de acceso restringido más fuerte de Anthropic, mientras que Fable 5 es su modelo de mayor capacidad lanzado ampliamente.

El Modelo 1 es real, pero la historia de producto "Modelo 1 → Modelo 2" es pura especulación

El informe también menciona al Modelo 1.

Esto es suficiente para generar especulación:

Modelo 1
→ Modelo 2
→ ¿Futuras versiones de Claude?

Pero Anthropic no hace tal afirmación.

De hecho, su descripción del Modelo 1 es bastante moderada.

La compañía dice que el Modelo 1 es aproximadamente equivalente en capacidades a:

  • Claude Mythos Preview.
  • Claude Mythos 5.

Su despliegue interno fue relativamente limitado.

Anthropic afirma que la gran mayoría de los usuarios internos prefirieron Mythos 5, y el uso del Modelo 1 ya era bajo y estaba disminuyendo en la fecha de cobertura del informe, hasta el 15 de julio.

La compañía también afirma:

Espera que el Modelo 1 no sea
desplegado externamente
ni utilizado ampliamente en el futuro

Por lo tanto, el Modelo 1 parece más una rama de desarrollo interna o un checkpoint que un producto predecesor claramente definido esperando un lanzamiento público.

El Modelo 2 difiere del Modelo 1 en un aspecto importante

El enfoque de Anthropic hacia el Modelo 2 es notablemente más cauteloso.

El Modelo 1 se discute brevemente y luego se excluye en gran medida del análisis de riesgos porque Anthropic

considera que Mythos 5 es un límite superior razonable de su riesgo.

En contraste, el Modelo 2 se utiliza en gran parte del informe porque:

  • Es más capaz en general.
  • Se usa con más frecuencia internamente.
  • Es relevante para el análisis de riesgos frontera de Anthropic.

El informe afirma que el uso interno del Modelo 2 es similar al de Mythos 5.

Esto no prueba un lanzamiento público inminente.

Pero sí indica que el Modelo 2 tiene una posición operativa importante dentro de Anthropic.

El informe de riesgos es la razón por la que el público conoce el Modelo 2

El Modelo 2 no se presentó mediante una publicación tradicional de blog de lanzamiento.

Surgió porque la Política de Escalado Responsable de Anthropic exige que la compañía realice análisis de riesgos sobre los sistemas que realmente se están desarrollando y desplegando internamente.

El informe de riesgos de agosto de 2026 cubre las actividades de Anthropic hasta el 15 de julio de 2026.

Anthropic lista los modelos internos cuando son relevantes para:

  • Problemas de desalineación en entornos de alto riesgo.
  • Automatización de la I+D de IA.
  • Riesgos biológicos y químicos.
  • Seguridad del modelo.
  • Monitoreo interno.

Es por eso que el Modelo 2 aparece en el informe.

La información es más de la que un modelo no publicado normalmente obtendría.

Esta divulgación es ante todo un producto de la gobernanza de seguridad, y solo en segundo lugar una filtración de producto.

Qué nos dice el informe y qué no nos dice

Afirmación Estado
Anthropic tiene un modelo interno llamado Modelo 2 Confirmado
El Modelo 2 aún no ha sido publicado Confirmado
El Modelo 2 es en general ligeramente superior a Mythos 5 Confirmado por Anthropic
El Modelo 2 es mejor que Mythos 5 en todos los ámbitos No
El Modelo 2 obtuvo un 62,8 % en la comparación de CoBench mostrada en el informe Confirmado en los datos del informe
Mythos 5 obtuvo un 50,3 % en la misma comparación Confirmado en los datos del informe
Anthropic estima que el reemplazo total del personal técnico en CoBench se logra en torno al 85 % Confirmado
El Modelo 2 se utiliza ampliamente internamente Confirmado
El Modelo 2 ha completado el conjunto completo de evaluaciones de lanzamiento externo estándar No
Anthropic planea actualmente lanzar públicamente el Modelo 2 No
El Modelo 2 tiene un nombre de producto oficial de Claude No
El Modelo 1 es un modelo interno real Confirmado
El Modelo 1 es definitivamente el predecesor directo del Modelo 2 Aún no determinado
Se espera que el Modelo 1 se lance públicamente No
Claude Mythos 5 está disponible para todos No
Claude Fable 5 es la versión de lanzamiento amplio correspondiente a Mythos 5 Confirmado

Preguntas frecuentes

¿Qué es el Modelo 2 de Anthropic?

El Modelo 2 es un modelo frontera interno no publicado divulgado en el informe de riesgos de agosto de 2026 de Anthropic. Anthropic afirma que es ligeramente superior en general a Claude Mythos 5 y que se ha utilizado ampliamente internamente para codificación, generación de datos, investigación, ingeniería y otros trabajos de agentes.

¿Es el Modelo 2 mejor que Claude Mythos 5?

En términos generales, Anthropic dice que sí, pero solo ligeramente. La compañía también afirma que el Modelo 2 es más fuerte en ciertas áreas y más débil en otras, por lo que no debería describirse como una superioridad integral.

¿Cuál es la puntuación de CoBench del Modelo 2?

La comparación mostrada en el informe indica que el Modelo 2 obtuvo un 62,8 %, superando al 54,8 % de Mythos Preview y al 50,3 % de Mythos 5. Anthropic estima que un modelo con capacidad total de reemplazo de personal técnico

debe alcanzar al menos aproximadamente el 85 % en las evaluaciones actuales.

¿Qué evalúa CoBench?

CoBench es una evaluación interna diseñada por Anthropic basada en problemas históricos de investigación e ingeniería que su personal técnico ha resuelto anteriormente. El modelo recibe instantáneas históricas, incluidos código, registros, mensajes internos y documentación, y debe diagnosticar el problema técnico subyacente.

¿Publicará Anthropic el Modelo 2?

Anthropic afirma que actualmente no tiene planes de lanzar públicamente el Modelo 2. La compañía aún no ha revelado nombre de producto, fecha de lanzamiento, identificadores de API, precios ni planes de acceso público.

¿Es el Modelo 2 el próximo modelo Claude Mythos?

Anthropic no lo ha afirmado. El Modelo 2 es un identificador interno utilizado en el informe de riesgos; asociarlo con un futuro nombre de producto de Claude es puramente especulativo.

¿Qué es el Modelo 1 de Anthropic?

El Modelo 1 es otro modelo interno divulgado en el mismo informe. Anthropic afirma que es aproximadamente similar a Mythos Preview y Mythos 5, con un uso interno relativamente bajo y en disminución, y no se espera que se despliegue externamente.

¿Se ha lanzado públicamente Claude Mythos 5?

No está disponible de forma general. Mythos 5 se ofrece a través de programas de acceso confiable restringido como Project Glasswing, mientras que Claude Fable 5 utiliza el mismo modelo base, pero con salvaguardias de seguridad más sólidas y está ampliamente disponible.

Herramientas relacionadas

  • Claude: El asistente general de IA de Anthropic para consumidores y profesionales.
  • API de Claude: La plataforma de desarrolladores de Anthropic para los modelos Claude de disponibilidad general.
  • Consola de Anthropic: El espacio de trabajo oficial para probar los modelos de la API de Claude y gestionar el acceso de desarrolladores.
  • Project Glasswing: El programa de acceso confiable de Anthropic para capacidades avanzadas de ciberseguridad de nivel Mythos.
  • Centro de Transparencia de Anthropic: Recurso central para evaluaciones de seguridad de modelos, fichas técnicas y información de riesgos.

Enlaces relacionados

Resumen

El informe de riesgos de agosto de 2026 de Anthropic revela un modelo interno llamado Modelo 2, que se utiliza

actualmente de manera intensiva en investigación, ingeniería, codificación, generación de datos y flujos de trabajo de agentes persistentes.

El modelo es más fuerte que Claude Mythos 5 en la evaluación interna CoBench de Anthropic, con puntuaciones del 62,8 % y el 50,3 %, respectivamente. Anthropic también afirma que el Modelo 2 parece ser ligeramente superior en general, aunque es más débil que Mythos 5 en ciertas áreas, y la mejora es mucho menor que los saltos de capacidad significativos anteriores.

El informe también menciona el Modelo 1, pero la evidencia no es suficiente para considerar al Modelo 1 y al Modelo 2 como una secuencia de productos públicos confirmada. El uso interno del Modelo 1 está disminuyendo, y Anthropic afirma explícitamente que actualmente no tiene planes de lanzar públicamente el Modelo 2.

La conclusión más clara es que la frontera interna de Anthropic ya ha superado ligeramente a Mythos 5, pero el Modelo 2 es un sistema de investigación interno, no el próximo producto Claude de próxima generación publicado.