IA en la recta final de septiembre: la carrera de la ciberseguridad, Opus 5.5 y Claude construyendo a Claude
Septiembre empezó con Anthropic, OpenAI y Google lanzando en cuestión de días sus respectivos modelos de ciberseguridad, y termina con un ritmo que no ha bajado: Anthropic ha estrenado Opus 5.5 como su nuevo buque insignia más barato y rápido, ha revelado que Claude ya lidera una cuarta parte de la investigación y desarrollo interno de la propia Anthropic, los tres grandes laboratorios avanzan hacia un organismo conjunto de autorregulación de seguridad, y xAI ha cerrado por fin el lanzamiento de Grok 4.7 tras varios días de retraso. Este es el resumen de lo que ha marcado la segunda mitad del mes.
La semana en la que los tres grandes lanzaron modelos de ciberseguridad
Entre el 1 y el 3 de septiembre, Anthropic, Google y OpenAI publicaron por separado modelos orientados específicamente a tareas de ciberseguridad, en lo que terminó leyéndose como una carrera coordinada por casualidad más que por acuerdo.
Google abrió el turno el 2 de septiembre con Gemini 3.8 Flash Cyber, una variante pensada para defensores: descubrimiento autónomo de vulnerabilidades, remediación, investigación de seguridad y parcheo automatizado. El equipo de Vulnerability Research de Google Cloud lo usó para encontrar una vulnerabilidad fundacional crítica en menos de dos horas, un trabajo que normalmente toma meses, y el equipo de seguridad de Chrome reportó que el modelo produjo 2,6 veces más parches correctos que los mejores modelos comerciales de mayor tamaño. El acceso está limitado al nuevo Fairwind Program, reservado a autoridades gubernamentales, operadores de infraestructura crítica y mantenedores de software.
OpenAI siguió el 3 de septiembre con GPT-6 Astra, el primer modelo de la compañía en cruzar el umbral "Crítico" de capacidad cibernética bajo su Preparedness Framework: con las herramientas y el acceso adecuados, es capaz de encontrar fallos de seguridad desconocidos y desarrollar nuevas formas de explotarlos en sistemas bien protegidos, sin que una persona guíe cada paso. OpenAI reconoció haber retrasado partes del desarrollo del modelo para reforzar y probar las protecciones antes del lanzamiento. Astra llegó a los planes de pago de ChatGPT con salvaguardas que impiden a la mayoría de usuarios acceder a sus capacidades ofensivas más avanzadas, y a la API a $10 de entrada y $50 de salida por millón de tokens.
Anthropic, por su parte, ya había abierto el mes el 1 de septiembre con Claude Fable 5.1 y Mythos 5.1, con un recorte del 75% en el precio de cache reads, como se cubrió en el arranque de septiembre de este blog.
El patrón es difícil de ignorar: en 72 horas, los tres laboratorios de frontera lanzaron modelos que ellos mismos clasifican en niveles de riesgo cibernético nunca vistos, cada uno con su propio programa de acceso restringido. La ciberseguridad ofensiva y defensiva se ha convertido, de facto, en la frontera de capacidades más vigilada de la industria.
Claude Opus 5.5: el mismo nivel de Fable 5.1, un 40% más barato
El 22 de septiembre Anthropic lanzó Claude Opus 5.5, el primer modelo de la nueva familia 5.5 y, según la compañía, su modelo más potente hasta la fecha, con un rendimiento equiparable al de Fable 5.1 en la mayoría de tareas.
Los números de precio y velocidad son el titular: el coste típico de una carga de trabajo cae un 40% frente a Opus 5, la velocidad de salida sube más de un 30%, y el precio por millón de tokens pasa a $4 de entrada y $20 de salida —un 20% menos que su predecesor—, con cache reads a $0,20 por millón de tokens, un 60% más barato. El modelo ya está disponible en AWS, Google Cloud y Microsoft Azure.
Anthropic ha confirmado que Sonnet 5.5 y Haiku 5.5 llegarán "en las próximas semanas", completando la familia 5.5 con el mismo patrón que se vio en la transición de la serie 5 a la 5.1: mejoras de eficiencia y precio antes que saltos grandes de capacidad.
Claude ya lidera el 26% de la I+D de Anthropic
El 18 de septiembre Anthropic publicó una cifra que ha generado bastante más ruido que un lanzamiento de modelo: Claude lidera actualmente el 26% del trabajo de investigación y desarrollo de IA dentro de la propia Anthropic, frente a prácticamente cero en febrero. "Liderar" significa que el modelo puede completar la mayor parte de una tarea de principio a fin a partir de un prompt de alto nivel, mientras permanece bajo supervisión humana.
Más del 90% del trabajo de I+D medido fue al menos colaborativo con Claude, aunque Anthropic fue clara en que no ha medido ninguna área en la que el modelo opere de forma completamente autónoma sin un humano en el bucle. La compañía también reportó unos 30.000 agentes de IA trabajando en tareas de investigación e ingeniería en un momento dado sobre su plataforma interna más usada, y que más del 80% del código fusionado en su base de código de producción es atribuible a Claude desde mayo.
Anthropic enmarca esto como el paso de la autosuperación recursiva de un escenario hipotético a un conjunto de precursores concretos que los laboratorios de frontera ya miden dentro de su propio proceso de desarrollo: Claude no solo escribe código, sino que ejecuta experimentos, investiga fallos, propone pasos de investigación y revisa código que alimenta el entrenamiento de su propio sucesor.
Los tres grandes avanzan hacia un organismo de autorregulación de seguridad
Según reportes que empezaron a circular entre el 13 y el 16 de septiembre, Anthropic, OpenAI y Google (a través de Google DeepMind) llevan desde julio trabajando en la creación de un organismo de estándares de seguridad para IA de frontera, autorregulado por la propia industria y sin supervisión gubernamental directa.
La propuesta original es de Demis Hassabis, quien el 14 de julio planteó públicamente un "organismo de estándares liderado por EE. UU." inspirado en parte en la estructura de FINRA (el regulador autorregulado de la industria financiera estadounidense): una estructura público-privada en lugar de una nueva agencia federal. Representantes de los tres laboratorios formaron un grupo de trabajo poco después y se han reunido periódicamente durante el verano.
El organismo, que los tres laboratorios buscan lanzar a finales de 2026 o principios de 2027, apoyaría pruebas de modelos por terceros antes del despliegue, detallaría cómo deben reportarse incidentes de seguridad, formalizaría los compromisos voluntarios de seguridad de los laboratorios y establecería cualificaciones para auditores independientes. Es, en esencia, la formalización de una práctica que los laboratorios ya venían aplicando por su cuenta desde el verano —programas de acceso escalonado, clasificaciones de riesgo propias, revisiones previas al lanzamiento— después de que un esfuerzo previo por una asociación público-privada con el Gobierno de EE. UU. quedara estancado.
Grok 4.7 llega tras varios días de retraso
xAI lanzó Grok 4.7 el 21 de septiembre, tras un objetivo inicial de fecha del 12 de septiembre que no se cumplió. Elon Musk explicó el 11 de septiembre que el modelo "necesitaba unos días más de cocción": el entrenamiento por refuerzo estaba penalizando demasiado la longitud de las respuestas, lo que hacía que el modelo abandonara prematuramente problemas difíciles y se saltara la autoverificación rigurosa.
Ya disponible de forma general en la plataforma de xAI con acceso escalonado según el plan de suscripción, Grok 4.7 es, según la compañía, el doble de rápido y la mitad de caro que modelos comparables de codificación y trabajo de conocimiento, frente a Grok 4.6 a igual precio y velocidad.
El patrón que deja septiembre
El mes cierra confirmando dos tendencias que ya se venían dibujando desde agosto. La primera es que la ciberseguridad —ofensiva y defensiva— se ha convertido en el eje de clasificación de riesgo más visible de la industria: los tres laboratorios de frontera ahora etiquetan explícitamente sus modelos por nivel de capacidad cibernética y restringen el acceso en consecuencia, en lugar de tratarlo como una capacidad más entre muchas. La segunda es que la conversación sobre gobernanza se está moviendo de la teoría a la práctica en dos frentes a la vez: hacia dentro, con Anthropic midiendo y publicando cuánto de su propio desarrollo ya depende de Claude; y hacia fuera, con los tres laboratorios construyendo la estructura que les permitiría autorregularse sin esperar a una ley.
Resumen de fechas (septiembre 2026)
| Fecha | Evento |
|---|---|
| 1 de septiembre | Anthropic lanza Claude Fable 5.1 y Mythos 5.1 con cache reads un 75% más baratos |
| 2 de septiembre | Google lanza Gemini 3.8 Flash Cyber, con acceso vía el nuevo Fairwind Program |
| 3 de septiembre | OpenAI lanza GPT-6 Astra, primer modelo en umbral "Crítico" de ciberseguridad |
| 11 de septiembre | Musk confirma retraso de Grok 4.7 por sobrepenalización de la longitud de respuesta |
| 13-16 de septiembre | Se conoce el plan de Anthropic, OpenAI y Google DeepMind de crear un organismo de autorregulación de seguridad |
| 18 de septiembre | Anthropic revela que Claude lidera el 26% de su I+D interna de modelos |
| 21 de septiembre | xAI lanza Grok 4.7 de forma general |
| 22 de septiembre | Anthropic lanza Claude Opus 5.5, un 40% más barato y 30% más rápido que Opus 5 |
Fuentes
- Google, Anthropic, and OpenAI Unveil Cyber AI Models, Safeguards, and Access Programs — The Hacker News
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber — Google
- Google's Gemini 3.8 Flash is built for agents, while its Cyber twin hunts vulnerabilities — VentureBeat
- OpenAI Launches GPT-6 Astra With Enhanced Cybersecurity Safeguards — Bloomberg
- OpenAI launches GPT-6 Astra, its first model to cross a critical cybersecurity threshold — CSO Online
- Safety overview: GPT-6 Astra — OpenAI
- Anthropic unveils Claude Opus 5.5 — BNN Bloomberg
- Anthropic upgrades Claude with new Opus 5.5 model, details here — 9to5Mac
- Anthropic's Claude 5.5 Release: Efficiency Gains and Strategic Consolidation — Forkast
- Anthropic says its model Claude is helping to build the next version of itself — TechXplore
- When AI builds itself — Anthropic
- Claude now leads 26% of Anthropic's AI research, development work: Report — The Nation
- OpenAI, Google and Anthropic Join Forces to Set AI Safety Standards — PYMNTS
- Google, OpenAI, and Anthropic working to launch independent AI safety standards body — Crypto Briefing
- OpenAI, Anthropic and Google are working to create an AI standards body — Canadian Affairs
- xAI Weekly: Grok 4.7 Slips, Grok Bot Galaxy, Microsoft Copilot — Big Hat Group
- Grok 5: Release Date, Specs & What's Confirmed (September 2026) — GeoToolbox
