IA en el cierre de agosto: Anthropic gana dinero, Luna gratis, Gemini llega a mil millones y xAI no para
Si el inicio de agosto estuvo dominado por la guerra de precios entre OpenAI y Anthropic y por la entrada en vigor del reglamento europeo de IA, la segunda quincena del mes ha sido igualmente densa en noticias financieras, de modelos y de infraestructura. Anthropic reveló los primeros números que muestran beneficio operativo —un hito sin precedentes para un laboratorio de frontera—. Google cruzó la barrera de los mil millones de usuarios en Gemini y lanzó un nuevo Flash más barato. xAI publicó Grok 4.6 y tiene Grok 4.7 en el calendario en semanas. Y DeepSeek, que venía comprimiendo precios del sector, hizo lo contrario: subir los suyos. Este es el resumen de lo que importa antes de que cierre el mes.
Anthropic Q2 2026: $10,9 mil millones de ingresos y el primer beneficio operativo de su historia
El 13 de agosto, materiales de inversores filtrados revelaron los resultados proyectados de Anthropic para el segundo trimestre de 2026: $10,9 mil millones de ingresos, un incremento del 130% respecto a los $4,8 mil millones del Q1, y un beneficio operativo de aproximadamente $559 millones —el primero en los cinco años de historia de la compañía, con dos años de adelanto sobre sus proyecciones internas de agosto de 2025.
Tres factores explican el salto. Primero, Claude Code capturó más de 1.000 cuentas enterprise con gasto de $1M o más en API, generando ingresos recurrentes de codificación agéntica. Segundo, Claude Sonnet 5 —lanzado a finales de junio con precio introductorio de $2/M— aceleró la adopción masiva en API por parte de empresas mientras el coste del modelo era inferior al de sus predecesores. Tercero, la joint venture Ode with Anthropic comenzó a desplegar implementaciones a escala en bancos, sistemas de salud y fabricantes, añadiendo ingresos de integración sobre los ingresos de API. El coste de cómputo por cada dólar de ingresos cayó de 71 céntimos en el Q1 a 56 céntimos en el Q2, una mejora de eficiencia de 15 céntimos en un solo trimestre.
Hay un matiz importante, y Anthropic lo reconoció en los propios materiales: el acuerdo de cómputo con SpaceX —valorado en $15 mil millones anuales— incluye un descuento de arranque durante los primeros meses del contrato, que coinciden exactamente con el Q2 2026. Cuando el precio completo del contrato entre en vigor, el coste de cómputo sube. La compañía advirtió que la rentabilidad sostenida durante el Q3 y el Q4 de 2026 "no está garantizada". El Q3, cuando el tipo completo de SpaceX entre en vigor, será la prueba real de si los ingresos pueden superar la presión del cómputo.
El contexto competitivo añade perspectiva: OpenAI factura en torno a $2 mil millones al mes —aproximadamente $6 mil millones trimestrales— pero proyecta una pérdida operativa de $14 mil millones para el conjunto de 2026 y no espera ser rentable hasta 2030. Los números de Anthropic para Q2, con todos sus asteriscos, son la primera evidencia de que un laboratorio de frontera puede superar sus costes de cómputo con ingresos. Si se confirma en Q3, cambia el cálculo de riesgo de toda la industria.
GPT-5.6 Luna es ahora el ChatGPT gratuito, y la guerra de precios se consolida
El 30 de julio OpenAI recortó el precio de GPT-5.6 Luna un 80%, de $1/$6 por millón de tokens a $0,20/$1,20/M. A efectos prácticos esto convirtió a Luna en el modelo más barato del mercado cerrado —más barato incluso que gpt-5.4-nano—. El 6 de agosto OpenAI fue un paso más allá: Luna se convirtió en el modelo predeterminado de ChatGPT gratuito con chats ilimitados y acceso al modo Think. Para los más de 1.000 millones de usuarios activos mensuales de OpenAI —cifra anunciada simultáneamente—, esto significa acceso a un modelo de frontera sin coste.
En la misma semana, OpenAI ajustó el resto de la familia. Terra bajó un 20%, a $2/$12/M. Sol se mantuvo sin cambios en precio, pero apareció GPT-5.6 Sol Fast: la misma inteligencia de Sol a 2,5 veces la velocidad, a 2 veces el precio ($10/$60/M), disponible en Cerebras a través del modelo de escala de oblea WSE-3. Para equipos que necesitan latencia baja en producción, Sol Fast es la opción más rápida del mercado entre los modelos de frontera.
La implicación práctica para quienes tienen sistemas en producción es directa: cualquier tabla de precios con Luna a $1/M estaba sobreestimando el coste en 5 veces. Y cualquier flujo de trabajo de alta frecuencia ruteado a gpt-5.4-mini o modelos anteriores debería revisarse contra Luna a $0,20/M, que ofrece mayor capacidad al mismo precio o inferior.
Gemini cruza los 1.000 millones de usuarios activos mensuales y lanza Gemini 3.7 Flash
El 11 de agosto, Sundar Pichai anunció que la app de Gemini había cruzado la barrera de 1.000 millones de usuarios activos mensuales —el producto de crecimiento más rápido de la historia de Google y el décimocuarto en la historia de la compañía en alcanzar ese umbral. Es la primera vez que dos asistentes de IA —ChatGPT ya cruzó el millón en junio— alcanzan simultáneamente los 1.000 millones de usuarios. El 63% de los usuarios de Gemini interactúa con las funciones de voz.
Dos días después, el 13 de agosto, Google lanzó Gemini 3.7 Flash: un modelo centrado en codificación y flujos de trabajo agénticos, con un precio introductorio de $0,75 por millón de tokens de entrada y $3,75 de salida —la mitad del precio que Gemini 3.6 Flash en su lanzamiento—. Los benchmarks muestran mejoras sustanciales en ingeniería de software, desarrollo web y automatización de negocios frente a 3.6 Flash. El mensaje de Google es claro: no es un modelo flagship, sino un caballo de trabajo para codificación cotidiana y agentes, a un precio que presiona directamente a los modelos equivalentes de la competencia.
El lanzamiento llega después de que Gemini 3.5 Pro —el flagship esperado— siguiera sin fecha concreta tras semanas de retrasos. La decisión de Google de lanzar un Flash mientras el Pro sigue en revisión interna sugiere que los estándares de calidad para el flagship han subido tras los problemas encontrados en las pruebas.
Grok 4.6: empate con Sol en el índice de inteligencia, 500K de contexto y la trampa del precio
El 12 de agosto xAI lanzó Grok 4.6, la primera iteración del ciclo de actualización rápida que Elon Musk anunció al presentar Grok 4.5. El modelo alcanza un índice de inteligencia de 61 en Artificial Analysis —empatado con GPT-5.6 Sol Max y un punto por debajo de Claude Fable 5 Max (62)— con un precio base de $2/$6/M, la misma tarifa que Grok 4.5. La ventana de contexto se expande a 500.000 tokens, y en CursorBench v3.2 el modelo logra el 69,9%, frente al 66,7% de Grok 4.5.
El detalle que más importa en producción es la estructura de precios: los $2/M se aplican únicamente a peticiones con un prompt de menos de 200.000 tokens. Por encima de ese umbral, la tarifa se dobla a $4/$12/M —y se aplica a todos los tokens de la petición, no solo a los que exceden el límite—. Una petición de 201.000 tokens se factura al doble de tarifa en su totalidad. Para equipos que quieran aprovechar el contexto extendido, la tarifa de entrada en caché ($0,50/M) es donde está el ahorro real; gestionar el contexto con caché agresiva mantiene las ventajas de precio incluso en conversaciones largas.
En cuanto al calendario, Musk confirmó en X que Grok 4.7 —con una arquitectura significativamente mayor, estimada en 2,1 billones de parámetros— está previsto en cuestión de semanas. Grok 4.6 es una mejora de post-entrenamiento sobre la misma base de 1,5 billones de parámetros que Grok 4.5; Grok 4.7 sería el salto de escala real del ciclo.
DeepSeek sube precios: V4 Flash un 93% más caro a partir del 14 de agosto
Mientras el resto del sector presionaba los precios a la baja, DeepSeek fue en dirección contraria. El 14 de agosto, la compañía subió el precio de entrada de deepseek-v4-flash de $0,14/M a $0,27/M —un incremento del 93%— manteniendo el precio de salida en $0,28/M. V4 Flash sigue siendo más barato que la mayoría de las alternativas, pero la ventaja se ha estrechado notablemente.
El movimiento llegó acompañado de un aviso de depreciación: deepseek-chat y deepseek-reasoner quedarán obsoletos el 24 de octubre de 2026. Los equipos que usan esos identificadores en producción tienen poco más de dos meses para migrar. DeepSeek también anunció en agosto la disponibilidad general de V4 Pro, su modelo flagship de mayor capacidad con precio significativamente superior —aproximadamente nueve veces más por token de entrada y catorce veces más por token de salida que V4 Flash—, posicionándolo como opción para tareas agénticas exigentes que justifiquen el coste.
La subida de precios de DeepSeek es relevante porque el modelo chino había sido el principal motor de la guerra de precios del sector desde principios de año. Su decisión de subir márgenes en V4 Flash, aunque sea modestamente, sugiere que la presión competitiva empieza a equilibrarse con la necesidad de sostener la infraestructura de inferencia.
EU AI Act en vigor: la Comisión Europea empieza a aplicar el reglamento
El 2 de agosto la Comisión Europea, junto con las autoridades nacionales, comenzó a aplicar el Reglamento de Inteligencia Artificial (AI Act). La Oficina de IA de la UE asume la supervisión de los proveedores de modelos de propósito general, mientras los reguladores nacionales se encargan del resto de sistemas.
Las nuevas obligaciones de transparencia que entraron en vigor ese día son concretas: los chatbots y otros sistemas interactivos de IA deben informar a los usuarios de que están interactuando con una IA —no con un humano—; los deepfakes y otros contenidos generados o alterados por IA deben llevar etiquetas visibles; y el contenido generado por IA debe incorporar marcas legibles por máquina para facilitar su detección. Los proveedores de modelos de propósito general deben documentar sus modelos, adoptar políticas de derechos de autor, publicar resúmenes de los datos de entrenamiento y gestionar los riesgos sistémicos.
Las multas por incumplimiento pueden alcanzar hasta 15 millones de euros o el 3% de la facturación global anual, la cifra que resulte mayor. Anthropic respondió anunciando que está integrando marcas de agua imperceptibles en los textos generados por Claude y señales de procedencia en archivos como parte de su respuesta a las nuevas normas. Las reglas no exigen aprobación previa antes de desplegar sistemas de IA; añaden una capa de cumplimiento que opera sobre los sistemas existentes.
Sonnet 5 sube de precio el 1 de septiembre: lo que hay que hacer antes del plazo
Un dato práctico que afecta directamente a quienes tienen Claude en producción: el 1 de septiembre, Claude Sonnet 5 pasa de $2/M a $3/M de entrada —un incremento del 50%—. El precio de salida sube proporcionalmente. Simultáneamente, Anthropic introducirá un cambio en el tokenizador de Sonnet 5 que añade hasta un 35% más de tokens por texto equivalente. El efecto combinado de la subida de precio y el tokenizador más granular puede representar un incremento de coste real del 80-100% para ciertos flujos de trabajo, dependiendo de la relación entre tokens de entrada y de salida.
Las tres acciones concretas antes del 31 de agosto: primero, identificar los flujos de alto volumen actualmente ruteados a Sonnet 5 y estimar el impacto del nuevo precio con el tokenizador actualizado; segundo, adelantar trabajo de procesamiento por lotes antes del cambio; tercero, evaluar si el ruteo hacia Grok 4.6 ($2/M bajo 200K tokens) o hacia Luna ($0,20/M para tareas ligeras) tiene sentido económico a partir de septiembre.
El patrón del cierre de agosto
Agosto de 2026 cierra con una industria que por primera vez muestra señales concretas de sostenibilidad financiera —aunque con asteriscos—. El beneficio de Anthropic en Q2 es real pero está inflado por condiciones contractuales de cómputo que cambiarán en Q3. La escala de usuarios de ChatGPT y Gemini en los mil millones simultáneos es inédita y refleja que los asistentes de IA han alcanzado una penetración comparable a aplicaciones de comunicación masiva.
La guerra de precios de modelos continúa, pero con una vuelta de tuerca: el movimiento de DeepSeek al alza sugiere que el sector empieza a buscar márgenes después de una primera fase de captura de cuota. Y en el frente regulatorio, el AI Act europeo pasa de texto legal a obligaciones ejecutables con sanción económica real, lo que convierte el cumplimiento en un coste de operación concreto para cualquier empresa que sirva a usuarios en la UE.
Resumen de fechas (segunda quincena de agosto)
| Fecha | Evento |
|---|---|
| 2 de agosto | EU AI Act: transparencia y marcado de contenido IA entra en vigor |
| 6 de agosto | GPT-5.6 Luna se convierte en el modelo predeterminado de ChatGPT gratuito |
| 11 de agosto | Gemini cruza 1.000 millones de usuarios activos mensuales (Sundar Pichai) |
| 12 de agosto | Grok 4.6: AA Index 61, $2/M, 500K contexto; Grok Bot lanzado |
| 13 de agosto | Anthropic Q2: $10,9B de ingresos, primer beneficio operativo de $559M |
| 13 de agosto | Google lanza Gemini 3.7 Flash a mitad de precio que 3.6 Flash |
| 14 de agosto | Grok 4.6 disponible públicamente; DeepSeek sube V4 Flash un 93% |
| 31 de agosto | Claude Sonnet 5: precio pasa de $2/M a $3/M + cambio de tokenizador |
| 24 de octubre | Depreciación de deepseek-chat y deepseek-reasoner (aviso con 10 semanas) |
Fuentes
- Anthropic Q2 2026: $10,9B de ingresos y primer beneficio — AIToolsRecap
- GPT-5.6 Luna gratis, DeepSeek sube precios, Gemini 1B usuarios — AIToolsRecap
- Grok 4.6: AA Index 61, $2/M, 500K contexto — AIToolsRecap
- LLM News agosto 2026: agentes y recortes de precio — Augusto Digital
- Comisión Europea empieza a aplicar el AI Act — Shaping Europe's digital future
- EU AI Act: qué cambia desde agosto de 2026 — Euronews
- Noticias IA 15 agosto 2026 — AIToolsRecap
- Noticias IA agosto 2026 — AI Weekly