MODELOS
Anthropic prueba internamente Model 2, más potente que Mythos 5, y aplaza su lanzamiento
Anthropic ha finalizado un nuevo modelo, “Model 2”, que sus pruebas internas consideran más capaz que Mythos 5. La empresa lo usa para programación, generación de datos y agentes persistentes, pero no planea publicarlo por cautela. Mantienen el riesgo global en nivel bajo, aunque admiten incertidumbre y benchmarks saturados.
Qué ha ocurrido
Anthropic afirma haber desarrollado “Model 2”, con resultados internos superiores a Mythos 5. Lo utilizan de forma intensiva para ingeniería de software, programación, generación de datos y agentes de IA persistentes en sus flujos empresariales; su propio informe señala que Claude ya escribe la mayor parte del código que acaban fusionando en producción. Aunque la evaluación global de riesgo sigue siendo baja y su alineamiento no es peor que el de Mythos 5, han elevado la estimación de desalineamiento en escenarios de alto impacto de “muy baja” a “baja”, en parte por la incertidumbre tras incidentes recientes de ciberseguridad. Varias pruebas están “saturadas”, así que confían menos en los benchmarks y ni siquiera han pasado toda su batería de tests porque no planean un lanzamiento público. En paralelo, citan que los modelos aceleran investigación y desarrollo —y que podrían ayudar a entrenar a sus sucesores—, y recuerdan la tendencia del sector: OpenAI también ha retrasado Astra por dudas de capacidad en ciberseguridad.
Qué significa para creadores
Se abre una brecha entre lo que las empresas pueden hacer internamente y lo que el público puede usar. Para creadores y equipos en España, conviene planificar con herramientas disponibles hoy y suponer que los modelos punteros pueden quedar restringidos. Prioriza: 1) Diseñar flujos “agnósticos al modelo” para poder cambiar de proveedor sin reescrituras; 2) Implementar evaluaciones propias y ligeras para tus casos (calidad de contenido, ayuda al código, seguridad), dado que los benchmarks generales pierden poder discriminatorio; 3) Adoptar patrones de agentes y orquestación con las soluciones actuales, empezando por tareas repetitivas y memoria de proyecto; 4) Si usas IA para programar, mantén revisión humana y análisis de seguridad por las preocupaciones de ciberseguridad; 5) Refuerza mensajes de cumplimiento y seguridad al trabajar con clientes, anticipando políticas más estrictas de acceso a modelos.
Fuente y contexto
Información de Xataka (17 de agosto de 2026): Anthropic usa internamente Model 2, al que considera más capaz que Mythos 5, pero no prevé lanzarlo. Reporta riesgo global bajo, leve aumento de la estimación de desalineamiento por incertidumbre y saturación de pruebas; no completó todos los tests. Su informe destaca que Claude genera la mayor parte del código en producción. Como contexto sectorial, Xataka señala que OpenAI ha retrasado Astra por dudas en ciberseguridad. Más detalles: https://www.xataka.com/robotica-e-ia/anthropic-ha-construido-modelo-mejor-que-mythos-tambien-ha-decidido-que-mundo-no-pueda-usarlo
