Radar IA para empresas — sábado 15 de agosto de 2026
noticias radar ia precios de ia agentes de ia automatizacion

Radar IA para empresas — sábado 15 de agosto de 2026

· CompaniesAutomation

Hoy la IA para empresas se juega en lo que cuesta cada llamada al modelo. Google publicó el 13 de agosto Gemini 3.7 Flash con un precio introductorio de 0,75 dólares por millón de tokens de entrada y 3,75 de salida —la mitad que la versión anterior— pero solo hasta el 31 de diciembre: el 1 de enero pasa a 1,50 y 7,50. El mismo día DeepSeek presentó V4-Pro y anunció una subida de hasta el 1.100% que entra en vigor el 16 de agosto a las 16:00 UTC, con cobro por franjas horarias (hora punta de 01:00 a 04:00 y de 06:00 a 10:00 UTC; el resto, a mitad de precio). IBM y OpenAI sellaron una alianza que mete GPT-5.6, Codex y ChatGPT Work dentro de IBM Consulting Advantage con una práctica dedicada de miles de consultores. Y OpenAI presentó Ultrafast, un nivel de servicio de su API que alcanza 750 tokens por segundo sobre chips de Cerebras: la latencia empieza a venderse como línea aparte de la factura.

El radar de ayer iba de quién aprieta el botón; hoy va de lo que cuesta apretarlo. En veinticuatro horas Google ha partido por la mitad el precio de su modelo para agentes —con fecha de caducidad el 31 de diciembre— y DeepSeek ha anunciado que multiplica el suyo hasta por cuatro a partir del domingo, estrenando además tarifa por franjas horarias. En paralelo, IBM se ha convertido en el brazo instalador de OpenAI dentro de las grandes empresas y OpenAI ha empezado a vender la velocidad como una línea aparte de la factura.

Google baja a la mitad el precio del modelo que mueve agentes, pero solo hasta fin de año

Google publicó el 13 de agosto Gemini 3.7 Flash, tres semanas después del 3.6 Flash, con un precio introductorio de 0,75 dólares por millón de tokens de entrada y 3,75 por millón de salida: la mitad que la versión anterior. Ese precio vale hasta el 31 de diciembre de 2026; el 1 de enero pasa a 1,50 y 7,50. En capacidad de programar sube fuerte —DeepSWE v1.1 del 49,0% al 65,3% y FrontierCode 1.1 Main del 34,4% al 43,6%—, acepta texto, imagen, audio y vídeo con ventana de un millón de tokens, y está disponible desde ya en la API de Gemini, en Antigravity y en la plataforma de agentes de Gemini Enterprise. Para tu empresa: un precio introductorio con fecha de caducidad no es una base de costes, es una promoción. Si vas a montar una automatización encima, calcula el coste por operación con las tarifas de enero (1,50 y 7,50), no con las de agosto, y comprueba que el proceso sigue saliendo a cuenta al doble. Y monta la llamada al modelo detrás de una capa propia que puedas cambiar de proveedor sin reescribir el flujo: el descuento dura cuatro meses, tu automatización debería durar más. Fuente

El domingo, el modelo barato de la competencia se multiplica por cuatro —y cobra distinto según la hora

El mismo 13 de agosto DeepSeek presentó V4-Pro y anunció una subida de tarifas que entra en vigor el 16 de agosto a las 16:00 UTC, de hasta el 1.100% según el caso: la salida de V4-Pro pasa de 0,87 a 3,96 dólares por millón de tokens en hora punta, y la de V4-Flash de 0,28 a 1,32. Lo verdaderamente nuevo es que estrena cobro por franjas —la hora punta es de 01:00 a 04:00 y de 06:00 a 10:00 UTC, y el resto del día se factura a la mitad—, después de haber prometido en mayo que dejaba permanentes las tarifas promocionales. Para tu empresa: mira el reloj antes que el precio. Esa franja punta de 06:00 a 10:00 UTC son las 08:00-12:00 en España: justo cuando lanzas los procesos de la mañana. Si tienes trabajos por lotes que no corren prisa —transcripciones, clasificación de correo, enriquecimiento de contactos, resúmenes—, moverlos a la tarde te cuesta la mitad sin tocar una línea de código. Y la lección de fondo va más allá de este proveedor: si tu caso de uso solo era rentable con la tarifa de oferta, no era rentable. Fuente

IBM se convierte en el instalador de OpenAI dentro de la gran empresa

IBM y OpenAI anunciaron el 13 de agosto una alianza que mete GPT-5.6, Codex y ChatGPT Work dentro de IBM Consulting Advantage, la plataforma con la que IBM presta sus servicios de consultoría. IBM entra en el nivel Elite de socios de OpenAI, crea una práctica dedicada con miles de consultores e ingenieros certificados y desplegará equipos incrustados en el cliente para tres frentes: convertir operaciones heredadas en flujos listos para IA, modernizar aplicaciones y desarrollo, y ciberseguridad; el foco sectorial es banca, administración pública, telecomunicaciones y retail, y el funcional, finanzas, compras, atención al cliente y recursos humanos. Para tu empresa: el mensaje es que el cuello de botella ya no es el modelo, es meterlo dentro de un proceso que ya existe —y eso es precisamente lo que una pyme puede hacer sin contratar a miles de consultores. Lo que IBM va a cobrar caro por hacer en un banco (conectar el modelo con el sistema viejo, definir quién aprueba qué, dejar rastro) tú lo puedes hacer en pequeño esta semana en un solo proceso de compras o de atención. Y si vendes servicios profesionales a empresas grandes, cuenta con que a partir de ahora tu propuesta se compara con la de IBM. Fuente

La velocidad empieza a venderse aparte

OpenAI presentó el 13 de agosto Ultrafast, un nuevo nivel de servicio de su API para GPT-5.6 Sol que alcanza 750 tokens de salida por segundo, hasta 14 veces más rápido que el procesamiento estándar, corriendo sobre chips de Cerebras. Está en vista previa limitada para clientes seleccionados y apunta a casos donde el tiempo de respuesta manda: respuesta a incidentes, análisis financiero, atención al cliente y voz en tiempo real, comercio. Conviene leer las cifras con cautela: las mediciones son del propio fabricante, hechas en julio, no de un tercero independiente. Para tu empresa: lo relevante no es el récord, es que la latencia pasa a ser un producto con precio propio. Antes de plantearte pagar por ella, mide dónde se va de verdad el tiempo en tu automatización: en un agente de voz o un chat en vivo la espera del modelo se nota, pero en la mayoría de flujos internos el retraso está en los pasos intermedios, en las esperas entre sistemas y en la aplicación antigua a la que consultas. Pagar velocidad de modelo para un proceso que corre de noche es tirar dinero. Fuente

¿Qué mirar mañana?

Mañana domingo a las 16:00 UTC entran las nuevas tarifas de DeepSeek: si algo tuyo depende de ese proveedor, la primera factura real la verás el lunes. Y sigue pendiente el modelo grande de Google, Gemini 3.5 Pro, que continúa sin fecha mientras la gama económica se renueva cada tres semanas.

Ve el vídeo de un minuto