03 · Infraestructura de IA
La inferencia supera al entrenamiento en el gasto de nube para IA

La inferencia representará por primera vez más gasto que el entrenamiento dentro de la infraestructura de nube optimizada para IA. Gartner calcula que concentrará el 55% de ese mercado en 2026. La previsión describe un coste recurrente ligado al uso, no solo grandes ciclos de entrenamiento. La pista llegó vía Xataka.
Por qué importa
El centro de gravedad económico se desplaza de construir modelos a servirlos de forma continua. Eso premia latencia, eficiencia energética, memoria y coste por token, además de potencia bruta. También vuelve más visible una tensión: aunque cada inferencia se abarate, el gasto agregado puede crecer con el volumen de aplicaciones.
Los detalles
- Gartner proyectó 37.500 millones de dólares de gasto mundial en IaaS optimizada para IA en 2026, frente a 18.300 millones en 2025.
- Las cargas de inferencia alcanzarían 20.600 millones de dólares y el 55% del total en 2026; la previsión supera el 65% para 2029.
- La categoría incluye GPU, ASIC, redes de alta velocidad y almacenamiento optimizado ofrecidos como infraestructura bajo demanda; no mide todo el gasto empresarial en IA.