Modelos de inteligencia artificial, la competencia se traslada al precio de la inferencia
OpenAI recorta el costo de GPT-5.6 Luna, Anthropic coloca Claude Opus 5 a mitad de precio de su modelo insignia, DeepSeek sube un 93% el precio de V4 Flash. En el mismo cuadro, Alibaba publica Qwen 3.8 con licencia abierta y Google presenta un compilador para la inferencia sobre datos cifrados.
La edición de la mañana no cubrió la sección Tech. El hecho que justifica la nota de la tarde es un cambio de terreno en la competencia entre los productores de modelos de lenguaje: ya no las puntuaciones en las pruebas de referencia, sino el precio pagado por cada millón de unidades procesadas y la velocidad con la que el modelo responde.
Los movimientos recientes van en dos direcciones opuestas. OpenAI ha reducido de manera sustancial el precio de GPT-5.6 Luna, convertido en la configuración predeterminada para los usuarios gratuitos de ChatGPT. Anthropic ha colocado Claude Opus 5 a alrededor de la mitad del precio de su propio modelo de gama superior, Fable 5. En sentido contrario se ha movido la china DeepSeek, que el 14 de agosto aumentó un 93% el precio de V4 Flash, llevándolo de 0,14 a 0,27 dólares por millón de unidades procesadas (Tech Startups; AIToolsRecap).
| Proveedor | Movimiento | Dato |
|---|---|---|
| OpenAI | Reducción de precio de GPT-5.6 Luna | modelo predeterminado para usuarios gratuitos |
| Anthropic | Posicionamiento de Claude Opus 5 | alrededor de la mitad del precio de Fable 5 |
| DeepSeek | Alza de V4 Flash (14 de agosto) | +93%, de 0,14 a 0,27 dólares |
Según datos citados por el Financial Times y recogidos por la revista tecnológica, los precios pagados por los clientes por los principales modelos estadounidenses han caído de manera significativa desde mediados de julio. El criterio de compra que emerge de las mismas fuentes se refiere a la relación entre el costo del procesamiento y el trabajo efectivamente producido: un parámetro que favorece a los modelos eficientes frente a los simplemente más grandes.
Por qué un proveedor sube los precios
El alza de DeepSeek es la anomalía que permite leer el resto. En un mercado donde el competidor principal recorta, aumentar un 93% el precio de lista de una variante rápida significa o que la demanda para esa configuración específica excede la capacidad disponible, o que el precio anterior estaba fijado por debajo del costo. Las fuentes disponibles no permiten establecer cuál de las dos hipótesis es válida, y este periódico no elige entre ambas.
Licencias abiertas y datos cifrados
En la misma fase se ubican dos lanzamientos de signo distinto. El grupo Qwen de Alibaba ha publicado Qwen 3.8 27B bajo licencia Apache 2.0, modelo con visión integrada que declara un contexto nativo de 262 mil unidades textuales, ampliable hasta un millón, sobre arquitectura Gated DeltaNet y Gated Attention. La variante FP8 reporta 61,7 en SWE-Bench Pro, 73,0 en Terminal-Bench 2.1 y 90,3 en LiveCodeBench v6: son datos publicados por el propio desarrollador, es decir, medidas declaradas por la parte interesada y no verificaciones independientes.
Google ha presentado HEIR, una cadena de herramientas de código abierto que convierte modelos ya entrenados para que la inferencia se ejecute directamente sobre datos cifrados, sin que el servidor vea las entradas en claro. La demostración abarcó un sistema de recomendación y un caso de detección de fraudes con tarjetas de crédito.
Sobre estos dos lanzamientos la noticia proviene de momento de una única fuente (AI Weekly, que recoge las publicaciones del grupo Qwen en Hugging Face y el blog oficial de Google); no hay confirmación independiente disponible.
El punto verificable es el precio de lista: el precio por millón de unidades procesadas es público para todos los proveedores citados, y la comparación con los valores de mediados de julio se puede repetir dentro de un mes sobre los mismos listados.
← Archivo · Portada · Editoriales anteriores · Señala un error · Artículo original (en italiano)