Edición del 16 de agosto de 2026
Gemini cae en escritura detectada, pero gana cuota en la web
Gemini parece retroceder en los textos que llegan a un detector y avanzar en visitas web. La contradicción abre la edición: antes de comparar cuotas de IA hay que preguntar qué mide cada una.

01 · Google · OpenAI · Anthropic Gemini cae en escritura detectada, pero gana cuota en la web
En resumen
Dos métricas cuentan historias distintas. En los textos enviados al detector de Pangram, la cuota atribuida a Gemini bajó del 12% al 1,9% y la de Anthropic subió del 4,3% al 14,9%. En tráfico web, Similarweb muestra que Gemini ganó cuota con fuerza durante el último año. La pista llegó vía The Decoder.
Por qué importa
No existe una única cuota de mercado de la IA. Escritura detectada, tráfico web y consumo de API capturan tareas y públicos distintos. Para Google, la distribución de Gemini crece; para Anthropic, la señal fuerte está en usuarios técnicos. Comparar proveedores exige nombrar primero qué comportamiento mide cada gráfico.
Los detalles
- Pangram advierte de que su clasificador de familia de modelos acierta el 91% en primera opción y solo permite observar tendencias agregadas, no atribuir con certeza cada texto.
- Su muestra procede de textos anonimizados enviados al detector; por diseño, representa tareas de escritura y no el uso total de asistentes, aplicaciones o API.
- Similarweb mide visitas web: sitúa a Gemini en torno al 27%-28% en mayo, frente a menos del 9% un año antes, mientras Claude ronda el 9%.
02 · Coste de inferencia El precio medio de inferencia cae un 43% en poco más de dos meses

En resumen
El coste medio de inferencia empresarial bajó de 2,04 dólares por millón de tokens el 31 de mayo a entre 1,16 y 1,18 dólares del 6 al 8 de agosto. Es una caída aproximada del 43% y el mínimo de 2026, según una nota de Jefferies recogida por SCMP. La pista llegó vía Xataka.
Por qué importa
La inteligencia se abarata como componente, pero eso no garantiza una factura menor. Un precio unitario más bajo vuelve rentables más tareas y los agentes pueden multiplicar razonamiento y llamadas a herramientas. La ventaja operativa pasa por asignar el modelo suficiente a cada trabajo y vigilar el consumo total.
Los detalles
- El índice combina precios de proveedores de API empresariales y plataformas de inferencia con pesos abiertos utilizadas por desarrolladores.
- Jefferies atribuye el mínimo de 2026 a la competencia, la eficiencia y la adopción de modelos chinos de bajo coste, entre ellos DeepSeek V4 Flash.
- La métrica es un precio medio por millón de tokens: no incorpora por sí sola cuántos tokens consume cada tarea ni el coste completo de operar un agente.
03 · Infraestructura de IA La inferencia supera al entrenamiento en el gasto de nube para IA

En resumen
La inferencia representará por primera vez más gasto que el entrenamiento dentro de la infraestructura de nube optimizada para IA. Gartner calcula que concentrará el 55% de ese mercado en 2026. La previsión describe un coste recurrente ligado al uso, no solo grandes ciclos de entrenamiento. La pista llegó vía Xataka.
Por qué importa
El centro de gravedad económico se desplaza de construir modelos a servirlos de forma continua. Eso premia latencia, eficiencia energética, memoria y coste por token, además de potencia bruta. También vuelve más visible una tensión: aunque cada inferencia se abarate, el gasto agregado puede crecer con el volumen de aplicaciones.
Los detalles
- Gartner proyectó 37.500 millones de dólares de gasto mundial en IaaS optimizada para IA en 2026, frente a 18.300 millones en 2025.
- Las cargas de inferencia alcanzarían 20.600 millones de dólares y el 55% del total en 2026; la previsión supera el 65% para 2029.
- La categoría incluye GPU, ASIC, redes de alta velocidad y almacenamiento optimizado ofrecidos como infraestructura bajo demanda; no mide todo el gasto empresarial en IA.
04 · DeepSeek DeepSeek V4 Pro consolida un nivel premium para agentes

En resumen
DeepSeek ha desplegado la revisión V4-Pro-0813 en su plataforma de API, según Pandaily. La versión mantiene un contexto de un millón de tokens y herramientas para agentes, con un precio algo superior al triple del nivel Flash en entrada sin caché y salida. La documentación de lanzamiento confirma que V4 Pro está disponible por API desde abril.
Por qué importa
DeepSeek ya no compite solo con un modelo barato. La separación entre Flash y Pro crea una escalera de precio y capacidad para cargas agénticas largas. Falta una comparación independiente equivalente para hablar de paridad de frontera, pero el proveedor está segmentando la inferencia como un producto premium, no como una tarifa única.
Los detalles
- DeepSeek lanzó V4 en abril como familia Pro y Flash; ambos modelos admiten modos con y sin razonamiento, llamadas a herramientas y hasta un millón de tokens de contexto.
- La tarifa oficial sitúa V4 Pro en 0,435 dólares por millón de tokens de entrada sin caché y 0,87 de salida, frente a 0,14 y 0,28 para Flash.
- DeepSeek presenta V4 Pro como su opción de mayor capacidad, pero sus comparaciones de rendimiento siguen siendo autorreportadas y no prueban por sí solas paridad con modelos cerrados.