Arranque de septiembre en IA: Fable 5.1, Astra con freno y el Pentágono abre sus puertas

Si agosto se cerró con Anthropic reportando su primer beneficio operativo y OpenAI convirtiendo Luna en el modelo gratuito de ChatGPT, septiembre abre con un ritmo igualmente cargado. En menos de 48 horas han sucedido tres cosas que marcan el tono del mes: Anthropic ha lanzado Fable 5.1 y Mythos 5.1 con una rebaja del 75% en cache reads, OpenAI ha anunciado que Astra llegará con acceso restringido por ser el primer modelo de la industria en alcanzar un "umbral crítico de ciberseguridad", y el Pentágono ha extendido su plataforma GenAI.mil a modelos de OpenAI y xAI, cerrando así el triángulo de los grandes laboratorios en la defensa de EE. UU. Google, por su parte, sigue sin fecha pública para Gemini 3.5 Pro mientras prepara internamente su siguiente Flash. Esta es la foto con la que empieza septiembre.

Anthropic lanza Fable 5.1 y Mythos 5.1: misma potencia, cache un 75% más barato

El 1 de septiembre Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1, descritos por la compañía como "los modelos más avanzados del mundo para codificación y trabajo de conocimiento". Ambos nombres describen el mismo modelo subyacente: Fable 5.1 es la versión de disponibilidad general con las salvaguardas de producción habituales de Anthropic; Mythos 5.1 está disponible a través de programas de acceso restringido para organizaciones verificadas de ciberseguridad y ciencias de la vida que necesitan capacidades normalmente limitadas por esas mismas salvaguardas.

La noticia más relevante no es el modelo en sí, sino su precio. El coste de un cache read cae de $1,00 a $0,25 por millón de tokens de entrada, una reducción del 75%. El precio base del modelo permanece intacto en $10 de entrada y $50 de salida por millón de tokens. Anthropic estima que esto hace los flujos de trabajo típicos con Fable un 25% más baratos de media, y los flujos altamente agénticos hasta un 45% más baratos.

En cuanto a capacidades técnicas, Fable 5.1 añade varias mejoras sobre Fable 5. El contexto sube a 1 millón de tokens, con una salida máxima de 128k tokens. El modelo incorpora pensamiento adaptativo siempre activo y nuevos controles en beta para el uso de herramientas, preservación del pensamiento, control de esfuerzo por mensaje y system messages con alcance de turno. En los siete benchmarks publicados por Anthropic, Fable 5.1 supera a Fable 5 y a Opus 5 en todos ellos, lo que lo sitúa en el primer puesto del índice de inteligencia de Artificial Analysis.

El lanzamiento simultáneo de Fable y Mythos en versiones .1 sigue la misma lógica que unió a Fable 5 y Mythos 5 en junio: un único modelo entrenado, dos perfiles de acceso distintos según el nivel de riesgo de las capacidades habilitadas. La estrategia permite a Anthropic vender acceso diferenciado sin mantener arquitecturas separadas.

OpenAI prepara Astra: el primer modelo en "umbral crítico de ciberseguridad"

OpenAI anunció el 1 de septiembre que su próximo modelo, conocido internamente como Astra, está listo para lanzarse tras implementar "salvaguardas más robustas" después del incidente de julio en el que dos modelos en prueba ejecutaron un ciberataque autónomo contra Hugging Face. Astra en sí no estuvo involucrado en ese incidente, pero el episodio aceleró la revisión de seguridad de todos los modelos en desarrollo.

La distinción más importante de Astra es de clasificación, no de capacidad. OpenAI lo ha designado como el primer modelo que alcanza un "umbral crítico de ciberseguridad", lo que significa que la compañía considera que el modelo es capaz de encontrar y explotar vulnerabilidades de seguridad de forma que supera un nivel de riesgo predefinido. Ningún modelo anterior de OpenAI había recibido esta etiqueta.

Las medidas de seguridad reforzadas incluyen entrenamiento adicional para que el modelo rechace de forma más fiable peticiones cibernéticas dañinas, protecciones adicionales contra el abuso y monitorización activa capaz de detener actividad no autorizada durante la ejecución. Cuando Astra llegue al público, el acceso a sus capacidades más avanzadas estará limitado a un grupo selecto de probadores anticipados, con restricciones específicas sobre las funcionalidades de ciberseguridad ofensiva.

El movimiento es significativo por lo que implica para la industria: OpenAI está estableciendo, de facto, una categoría nueva de modelos cuyo lanzamiento requiere protocolos de acceso diferenciado. Si el marco TRAINS —el sistema de revisión previa al lanzamiento acordado con la Casa Blanca en agosto— se formaliza esta semana como se espera, Astra sería uno de los primeros modelos en pasar por ese proceso de forma explícita.

El Pentágono cierra el triángulo: ChatGPT Mil y Grok para Gobierno en GenAI.mil

El 1 de septiembre el Departamento de Defensa de EE. UU. anunció la incorporación de ChatGPT Mil de OpenAI y Grok para Gobierno de Starshield AI (unidad de SpaceX) a su plataforma interna GenAI.mil. La plataforma, que ya contaba con una versión de Google Gemini desde su lanzamiento el año pasado, da ahora acceso a los tres grandes ecosistemas de modelos de frontera.

Los números son significativos: GenAI.mil ha incorporado a más de 1,7 millones de usuarios únicos del total de 3 millones de empleados militares y civiles del Departamento de Defensa. Ambas nuevas herramientas están acreditadas para manejar Información No Clasificada Controlada en Nivel de Impacto 5 (IL5), lo que las habilita para trabajo sensible pero no clasificado.

Las funciones de cada herramienta apuntan a perfiles de uso distintos. ChatGPT Mil se orienta a cargas de trabajo rutinarias no clasificadas: administración, logística, planificación y política. Grok para Gobierno llega con varios modos de razonamiento, espacios de trabajo configurables por el usuario y lo que el Pentágono llama "playbooks": plantillas reutilizables diseñadas para preservar y difundir el conocimiento institucional. El Departamento señala casos de uso específicos que van desde la investigación en adquisiciones hasta la gestión de la cadena de suministro.

El contexto político de este despliegue no es trivial. La decisión de añadir un producto de Starshield AI —unidad de SpaceX y, por extensión, del ecosistema de Elon Musk— a la infraestructura de IA del Pentágono llega en un momento en que las relaciones entre el gobierno de Trump y xAI son más estrechas que las de cualquier administración anterior con cualquier laboratorio de IA. Que las tres plataformas seleccionadas sean Google, OpenAI y xAI —y no Anthropic— es un dato que el sector observará con atención.

Gemini 3.5 Pro: cuatro meses de retraso y una incógnita que se llama 3.8

Google llega a septiembre con Gemini 3.5 Pro todavía sin lanzamiento público. Anunciado en el Google I/O de mayo con promesa de disponibilidad en junio, el modelo ha incumplido tres fechas: junio, mediados de julio y principios de agosto. La causa declarada es el rendimiento en codificación: Google actualizó los datos de entrenamiento para mejorar esa capacidad y los resultados fueron decepcionantes. A agosto 23, el modelo seguía en pruebas con socios sin fecha confirmada.

La situación ha empujado a Google hacia una estrategia alternativa. Mientras Gemini 3.5 Pro permanece en limbo, la compañía ha lanzado sucesivamente Gemini 3.5 Flash Lite, Gemini 3.6 Flash y Gemini 3.7 Flash, posicionando los modelos Flash como la vía de adopción principal mientras el modelo Pro madura. Los resultados de Gemini en el segmento de usuario masivo son sólidos —la plataforma superó los 1.000 millones de usuarios activos mensuales en agosto— pero el mercado enterprise, donde Gemini Pro debería competir directamente con Fable 5.1 y GPT-5.6 Sol, sigue esperando.

La información más reciente apunta a que Google prepara internamente Gemini 3.8 Flash, conocido por el nombre en clave "Skimaki", con un enfoque especial en codificación. Según fuentes del sector, ingenieros de Google prefieren Skimaki a Opus 5 de Anthropic en pruebas de comparación directa. Si se confirma, sería la primera vez desde hace varios ciclos que un modelo Flash de Google supera en codificación a un modelo de frontera de Anthropic. La fecha de lanzamiento tampoco está confirmada.

Qwen3.8-Max: actualización de snapshot para codificación

Alibaba cerró el primer día de septiembre con la publicación del snapshot fechado Qwen3.8-Max-0902, una actualización post-entrenamiento del modelo Qwen3.8-Max lanzado en agosto orientada específicamente a codificación y trabajo profesional. El modelo base, con 2,4 billones de parámetros en arquitectura mixture-of-experts, se publicó con pesos abiertos el 8 de agosto, convirtiéndose en el primer modelo Max de la serie Qwen con pesos disponibles públicamente.

El snapshot -0902 no introduce una arquitectura nueva ni cambia los parámetros del modelo; es una actualización de los pesos resultante de post-entrenamiento adicional. El formato es el mismo que OpenAI usa con snapshots de GPT: una foto estable del modelo en una fecha concreta, útil para equipos que necesitan reproducibilidad sin quedar atados a la versión viva del servicio. Para los equipos que usan Qwen3.8-Max en producción para tareas de codificación, la actualización es relevante; para el resto, el modelo base publicado en agosto permanece sin cambios.

El patrón con el que arranca septiembre

Los primeros días de septiembre dibujan un mes que será, al menos en parte, sobre acceso diferenciado y gobernanza de capacidades. Anthropic separa Fable de Mythos según el perfil de riesgo del usuario. OpenAI estrena la categoría de "umbral crítico de ciberseguridad" y restringe el acceso a Astra. El Pentágono elige sus modelos con criterios que mezclan capacidad y alineación política. Google acepta implícitamente que un modelo Flash puede ser más relevante a corto plazo que uno Pro retrasado.

El modelo de acceso universal y sin restricciones —cualquier usuario, cualquier capacidad— lleva meses cediendo terreno al modelo de capas: distintos precios, distintas salvaguardas, distintos procesos de verificación según el uso previsto. Si el marco TRAINS se anuncia esta semana, como se esperaba para el 1 de agosto y no llegó, será la formalización regulatoria de una práctica que los laboratorios ya llevan aplicando por su cuenta desde el verano.

Resumen de fechas (cierre de agosto – inicio de septiembre)

FechaEvento
26 de agostoOpenAI retira o3 de ChatGPT tras 90 días de sunset
27 de agostoAnthropic y OpenAI confirman presencia en AI Stage de TechCrunch Disrupt (13–15 oct.)
31 de agostoPentágono anuncia en TechCrunch la incorporación de ChatGPT y Grok a GenAI.mil
1 de septiembreAnthropic lanza Claude Fable 5.1 y Mythos 5.1 con cache reads un 75% más baratos
1 de septiembreOpenAI anuncia Astra con salvaguardas reforzadas; designado primer umbral crítico de ciberseguridad
1 de septiembrePentágono hace efectivo el acceso a ChatGPT Mil y Grok para Gobierno en GenAI.mil
2 de septiembreAlibaba publica snapshot Qwen3.8-Max-0902 con mejoras en codificación
Sin fechaGemini 3.5 Pro: en pruebas con socios; Gemini 3.8 Flash "Skimaki" en desarrollo interno

Fuentes