IA en la recta final de septiembre: la carrera de la ciberseguridad, Opus 5.5 y Claude construyendo a Claude

Septiembre empezó con Anthropic, OpenAI y Google lanzando en cuestión de días sus respectivos modelos de ciberseguridad, y termina con un ritmo que no ha bajado: Anthropic ha estrenado Opus 5.5 como su nuevo buque insignia más barato y rápido, ha revelado que Claude ya lidera una cuarta parte de la investigación y desarrollo interno de la propia Anthropic, los tres grandes laboratorios avanzan hacia un organismo conjunto de autorregulación de seguridad, y xAI ha cerrado por fin el lanzamiento de Grok 4.7 tras varios días de retraso. Este es el resumen de lo que ha marcado la segunda mitad del mes.

La semana en la que los tres grandes lanzaron modelos de ciberseguridad

Entre el 1 y el 3 de septiembre, Anthropic, Google y OpenAI publicaron por separado modelos orientados específicamente a tareas de ciberseguridad, en lo que terminó leyéndose como una carrera coordinada por casualidad más que por acuerdo.

Google abrió el turno el 2 de septiembre con Gemini 3.8 Flash Cyber, una variante pensada para defensores: descubrimiento autónomo de vulnerabilidades, remediación, investigación de seguridad y parcheo automatizado. El equipo de Vulnerability Research de Google Cloud lo usó para encontrar una vulnerabilidad fundacional crítica en menos de dos horas, un trabajo que normalmente toma meses, y el equipo de seguridad de Chrome reportó que el modelo produjo 2,6 veces más parches correctos que los mejores modelos comerciales de mayor tamaño. El acceso está limitado al nuevo Fairwind Program, reservado a autoridades gubernamentales, operadores de infraestructura crítica y mantenedores de software.

OpenAI siguió el 3 de septiembre con GPT-6 Astra, el primer modelo de la compañía en cruzar el umbral "Crítico" de capacidad cibernética bajo su Preparedness Framework: con las herramientas y el acceso adecuados, es capaz de encontrar fallos de seguridad desconocidos y desarrollar nuevas formas de explotarlos en sistemas bien protegidos, sin que una persona guíe cada paso. OpenAI reconoció haber retrasado partes del desarrollo del modelo para reforzar y probar las protecciones antes del lanzamiento. Astra llegó a los planes de pago de ChatGPT con salvaguardas que impiden a la mayoría de usuarios acceder a sus capacidades ofensivas más avanzadas, y a la API a $10 de entrada y $50 de salida por millón de tokens.

Anthropic, por su parte, ya había abierto el mes el 1 de septiembre con Claude Fable 5.1 y Mythos 5.1, con un recorte del 75% en el precio de cache reads, como se cubrió en el arranque de septiembre de este blog.

El patrón es difícil de ignorar: en 72 horas, los tres laboratorios de frontera lanzaron modelos que ellos mismos clasifican en niveles de riesgo cibernético nunca vistos, cada uno con su propio programa de acceso restringido. La ciberseguridad ofensiva y defensiva se ha convertido, de facto, en la frontera de capacidades más vigilada de la industria.

Claude Opus 5.5: el mismo nivel de Fable 5.1, un 40% más barato

El 22 de septiembre Anthropic lanzó Claude Opus 5.5, el primer modelo de la nueva familia 5.5 y, según la compañía, su modelo más potente hasta la fecha, con un rendimiento equiparable al de Fable 5.1 en la mayoría de tareas.

Los números de precio y velocidad son el titular: el coste típico de una carga de trabajo cae un 40% frente a Opus 5, la velocidad de salida sube más de un 30%, y el precio por millón de tokens pasa a $4 de entrada y $20 de salida —un 20% menos que su predecesor—, con cache reads a $0,20 por millón de tokens, un 60% más barato. El modelo ya está disponible en AWS, Google Cloud y Microsoft Azure.

Anthropic ha confirmado que Sonnet 5.5 y Haiku 5.5 llegarán "en las próximas semanas", completando la familia 5.5 con el mismo patrón que se vio en la transición de la serie 5 a la 5.1: mejoras de eficiencia y precio antes que saltos grandes de capacidad.

Claude ya lidera el 26% de la I+D de Anthropic

El 18 de septiembre Anthropic publicó una cifra que ha generado bastante más ruido que un lanzamiento de modelo: Claude lidera actualmente el 26% del trabajo de investigación y desarrollo de IA dentro de la propia Anthropic, frente a prácticamente cero en febrero. "Liderar" significa que el modelo puede completar la mayor parte de una tarea de principio a fin a partir de un prompt de alto nivel, mientras permanece bajo supervisión humana.

Más del 90% del trabajo de I+D medido fue al menos colaborativo con Claude, aunque Anthropic fue clara en que no ha medido ninguna área en la que el modelo opere de forma completamente autónoma sin un humano en el bucle. La compañía también reportó unos 30.000 agentes de IA trabajando en tareas de investigación e ingeniería en un momento dado sobre su plataforma interna más usada, y que más del 80% del código fusionado en su base de código de producción es atribuible a Claude desde mayo.

Anthropic enmarca esto como el paso de la autosuperación recursiva de un escenario hipotético a un conjunto de precursores concretos que los laboratorios de frontera ya miden dentro de su propio proceso de desarrollo: Claude no solo escribe código, sino que ejecuta experimentos, investiga fallos, propone pasos de investigación y revisa código que alimenta el entrenamiento de su propio sucesor.

Los tres grandes avanzan hacia un organismo de autorregulación de seguridad

Según reportes que empezaron a circular entre el 13 y el 16 de septiembre, Anthropic, OpenAI y Google (a través de Google DeepMind) llevan desde julio trabajando en la creación de un organismo de estándares de seguridad para IA de frontera, autorregulado por la propia industria y sin supervisión gubernamental directa.

La propuesta original es de Demis Hassabis, quien el 14 de julio planteó públicamente un "organismo de estándares liderado por EE. UU." inspirado en parte en la estructura de FINRA (el regulador autorregulado de la industria financiera estadounidense): una estructura público-privada en lugar de una nueva agencia federal. Representantes de los tres laboratorios formaron un grupo de trabajo poco después y se han reunido periódicamente durante el verano.

El organismo, que los tres laboratorios buscan lanzar a finales de 2026 o principios de 2027, apoyaría pruebas de modelos por terceros antes del despliegue, detallaría cómo deben reportarse incidentes de seguridad, formalizaría los compromisos voluntarios de seguridad de los laboratorios y establecería cualificaciones para auditores independientes. Es, en esencia, la formalización de una práctica que los laboratorios ya venían aplicando por su cuenta desde el verano —programas de acceso escalonado, clasificaciones de riesgo propias, revisiones previas al lanzamiento— después de que un esfuerzo previo por una asociación público-privada con el Gobierno de EE. UU. quedara estancado.

Grok 4.7 llega tras varios días de retraso

xAI lanzó Grok 4.7 el 21 de septiembre, tras un objetivo inicial de fecha del 12 de septiembre que no se cumplió. Elon Musk explicó el 11 de septiembre que el modelo "necesitaba unos días más de cocción": el entrenamiento por refuerzo estaba penalizando demasiado la longitud de las respuestas, lo que hacía que el modelo abandonara prematuramente problemas difíciles y se saltara la autoverificación rigurosa.

Ya disponible de forma general en la plataforma de xAI con acceso escalonado según el plan de suscripción, Grok 4.7 es, según la compañía, el doble de rápido y la mitad de caro que modelos comparables de codificación y trabajo de conocimiento, frente a Grok 4.6 a igual precio y velocidad.

El patrón que deja septiembre

El mes cierra confirmando dos tendencias que ya se venían dibujando desde agosto. La primera es que la ciberseguridad —ofensiva y defensiva— se ha convertido en el eje de clasificación de riesgo más visible de la industria: los tres laboratorios de frontera ahora etiquetan explícitamente sus modelos por nivel de capacidad cibernética y restringen el acceso en consecuencia, en lugar de tratarlo como una capacidad más entre muchas. La segunda es que la conversación sobre gobernanza se está moviendo de la teoría a la práctica en dos frentes a la vez: hacia dentro, con Anthropic midiendo y publicando cuánto de su propio desarrollo ya depende de Claude; y hacia fuera, con los tres laboratorios construyendo la estructura que les permitiría autorregularse sin esperar a una ley.

Resumen de fechas (septiembre 2026)

FechaEvento
1 de septiembreAnthropic lanza Claude Fable 5.1 y Mythos 5.1 con cache reads un 75% más baratos
2 de septiembreGoogle lanza Gemini 3.8 Flash Cyber, con acceso vía el nuevo Fairwind Program
3 de septiembreOpenAI lanza GPT-6 Astra, primer modelo en umbral "Crítico" de ciberseguridad
11 de septiembreMusk confirma retraso de Grok 4.7 por sobrepenalización de la longitud de respuesta
13-16 de septiembreSe conoce el plan de Anthropic, OpenAI y Google DeepMind de crear un organismo de autorregulación de seguridad
18 de septiembreAnthropic revela que Claude lidera el 26% de su I+D interna de modelos
21 de septiembrexAI lanza Grok 4.7 de forma general
22 de septiembreAnthropic lanza Claude Opus 5.5, un 40% más barato y 30% más rápido que Opus 5

Fuentes