Radar IA para empresas — jueves 3 de septiembre de 2026
· CompaniesAutomation
Google lanza Gemini 3.8 Flash a 0,75 dólares el millón de tokens con fecha de caducidad: el 1 de enero se duplica, y por tarea ya sale un 40% más caro que su predecesor. Anthropic estrena Claude Fable 5.1 sin subir tarifa, recorta la caché un 75% y deja que los registros se queden en la nube del cliente. OpenAI y Google encierran a sus modelos que encuentran vulnerabilidades tras una lista de invitados, y el dinero confirma la categoría de vigilar agentes: Palo Alto paga 500 millones por Console y HiddenLayer levanta 100.
El radar del miércoles iba de vigilar a los agentes; el jueves va de lo que cuestan. En veinticuatro horas Google ha puesto su modelo rápido a 0,75 dólares el millón de tokens con fecha de caducidad y Anthropic ha estrenado Claude Fable 5.1 sin tocar la tarifa pero recortando la caché un 75%, mientras los dos laboratorios y Google encierran a sus modelos que encuentran vulnerabilidades tras una puerta con lista de invitados. Y el dinero confirma el hilo de ayer: Palo Alto Networks paga 500 millones por un agente de dos años y HiddenLayer levanta 100 para vigilar agentes ajenos.
Google baja Gemini 3.8 Flash a 0,75 dólares el millón de tokens, pero el precio caduca el 31 de diciembre
Google lanzó ayer Gemini 3.8 Flash, su cuarto modelo Flash en cuatro meses, con un precio de lanzamiento de 0,75 dólares por millón de tokens de entrada y 3,75 de salida que vence el 31 de diciembre de 2026: desde enero pasa a 1,50 y 7,50, exactamente el doble. Entra un millón de tokens y saca 64.000, y Google dice que en flujos largos y cargados de documentos completa más de tres veces las tareas que Gemini 3.7 Flash; en el banco de ingeniería de software DeepSWE v1.1 supera a la mayoría de modelos punteros más grandes. El matiz que no está en la nota de Google lo puso Artificial Analysis: el modelo sube de 56 a 59 en su índice y empata con GPT-5.6 Sol y Grok 4.6, pero cada tarea le cuesta 0,58 dólares, un 40% más que a 3.7 Flash, porque razona más pasos y llama más veces a las herramientas; aun así sale unas seis veces más barato por tarea que Claude Fable 5.1. Para tu empresa: el precio por token ya no te dice lo que vas a pagar, y este es el ejemplo perfecto. Mide el coste por tarea completada en tus propios flujos —una factura clasificada, un correo contestado, un informe cerrado— antes de cambiar de modelo, porque el modelo barato que «piensa más» puede costarte más por resultado que el que sustituye. Y apunta la fecha en la hoja del presupuesto: todo lo que planifiques para 2027 con este modelo va a 1,50 y 7,50, no a 0,75; una tarifa de lanzamiento es una promoción, no un precio. Fuente
Anthropic estrena Claude Fable 5.1 sin subir la tarifa y deja que tus registros se queden en tu nube
Anthropic publicó el martes dos versiones gemelas de su modelo más avanzado: Claude Fable 5.1, abierto en su API y en Amazon Bedrock, Google Cloud y Microsoft Azure, y Claude Mythos 5.1, el mismo modelo con salvaguardas más permisivas y reservado a organizaciones verificadas de ciberseguridad y ciencias de la vida. La tarifa no cambia —10 dólares el millón de tokens de entrada y 50 de salida—, pero la lectura de caché baja de 1 a 0,25 dólares, un 75% menos, lo que según la compañía abarata un 25% una carga típica y hasta un 45% una carga muy agéntica. El mismo día anunció Enterprise Frontier Safeguards, la respuesta a una queja concreta: con Fable 5 había pasado de retención cero a guardar treinta días de datos para detectar abusos repartidos entre sesiones y cuentas, y los clientes regulados se plantaron, con los responsables de seguridad de Goldman Sachs, Morgan Stanley, Citi, Bank of America y Wells Fargo a la cabeza. La solución: los registros de actividad viven en el almacenamiento del propio cliente (S3, Azure Blob o Google Cloud Storage) bajo sus claves, la detección automática de abusos corre ahí y las alertas van al cliente, no a un revisor humano de Anthropic; es gratis (se paga solo el almacenamiento a la nube), se diseñó con más de cien clientes y se despliega por fases este otoño, con retención cero provisional para quien cumpla los requisitos. Para tu empresa: dos cosas. La primera, que el ahorro del 45% no viene por defecto, viene del diseño: la caché solo paga si tu agente reutiliza un contexto largo y estable —instrucciones, manuales, la política de la casa— colocado siempre al principio y sin cambios; si cada llamada reescribe el prompt, pagas tarifa completa. La segunda, que la objeción «mis datos se van a un servidor ajeno» acaba de recibir una respuesta con formato de contrato, y ese formato te sirve de plantilla para cualquier proveedor, incluido el SaaS que te vende «IA incluida»: dónde viven los registros, bajo qué claves, quién los lee y cuántos días se guardan. Cuatro preguntas para la ficha de protección de datos; si el proveedor no sabe contestarlas, esa es la respuesta. Fuente
OpenAI y Google encierran a sus buscadores de vulnerabilidades: tu ventana para parchear se acorta
OpenAI dijo el martes que Astra, su próximo modelo, es el primero que alcanza el nivel «crítico» de capacidad de ciberseguridad en su marco de preparación: puntuación perfecta en ExploitBench, la prueba que mide si un modelo convierte una vulnerabilidad conocida en un ataque que funciona; dos vulnerabilidades desconocidas descubiertas y explotadas por su cuenta en pruebas modificadas, y una fuga del aislamiento del navegador hasta ejecutar órdenes en la máquina. Rechaza el 91,5% de los intentos de saltarse sus filtros en temas cibernéticos frente al 59% de GPT-5.6 Sol, saldrá «pronto» y sus capacidades ofensivas más avanzadas quedarán limitadas a un grupo de probadores y después al programa Daybreak Blue. Un día más tarde Google presentó Gemini 3.8 Flash Cyber: más del 70% de acierto en su banco interno de descubrimiento de vulnerabilidades en veinte lenguajes de programación, 2,6 veces más parches correctos para Chrome que el mejor modelo comercial que probó su equipo de seguridad, y una vulnerabilidad crítica de base encontrada en menos de dos horas cuando lo normal son meses; solo se accede por el programa Fairwind, para administraciones, operadores de infraestructuras críticas y mantenedores de software. Con el Mythos 5.1 de Anthropic son tres laboratorios en una semana poniendo lista de invitados a la misma capacidad. Para tu empresa: la puerta te separa a ti del modelo, no al atacante de la técnica para siempre, así que la hipótesis de trabajo es que el tiempo entre que se publica un fallo y alguien lo explota se mide en horas y no en semanas. Tres cosas que no cuestan dinero. Una lista de todo lo tuyo que da a internet con su versión —cortafuegos, VPN, el acceso web del ERP, los complementos del WordPress— y un plazo de parcheo en días, no en trimestres, para esa lista y solo para esa lista. Si lo aloja un proveedor, pídele por escrito cuál es su ventana de parcheo, porque «lo gestionan ellos» no es una respuesta. Y nada expuesto sin segundo factor, que es lo que sigue funcionando cuando el parche llega tarde. Fuente
Palo Alto paga 500 millones por un agente de dos años y HiddenLayer levanta 100: vigilar agentes ya tiene compradores
Palo Alto Networks ha comprado Console por 500 millones de dólares en efectivo y acciones, según fuentes de TechCrunch; el acuerdo se anunció el martes sin precio. Console tiene dos años, había levantado 29 millones —semilla de 6,2 liderada por Thrive Capital y serie A de 23 con DST Global— a una valoración de 157 millones, y vende agentes que resuelven el soporte informático interno sin persona: restablecer contraseñas, dar acceso a Figma o Miro, arreglar lo rutinario. Va dentro de Cortex, la plataforma de detección de amenazas de Palo Alto, para que el equipo de seguridad investigue y resuelva alertas hablando en lenguaje natural; el consejero delegado Nikesh Arora, que además era inversor ángel de Console, dice que Cortex gana «brazos y piernas», y es la séptima compra de Palo Alto en 2026. El mismo día HiddenLayer cerró una serie B de 100 millones liderada por Delta-v Capital con Ten Eleven, Morgan Stanley, M12 de Microsoft y Booz Allen: protege modelos y agentes en ejecución, acaba de añadir un módulo para vigilar agentes de programación mientras trabajan, y dice que sus ingresos recurrentes se han multiplicado por más de diez en un año hasta las decenas de millones, el 90% por clientes nuevos. Gartner pone número al mercado: 2.830 millones de dólares de gasto en seguridad de IA en 2026, un 83% más que en 2025, y 4.780 en 2027. Y el dinero sigue entrando también en la capa de aplicación: Wonderful, que vende un sistema operativo para agentes en 35 países, ha levantado 550 millones a una valoración de 5.000, más del doble que en marzo, con Salesforce entrando por primera vez. Para tu empresa: el agente de helpdesk que contrataste a una startup puede ser dentro de dos años un módulo de un gigante de seguridad, con otra hoja de precios y otra hoja de ruta; a estas alturas la cláusula de cambio de control y el derecho a exportar tus flujos y configuraciones no son paranoia, son el estándar. Y la cifra de Gartner es una vara para medirte: si tu presupuesto de IA tiene cero euros y cero horas para gobernar y vigilar lo que despliegas, estás por debajo de lo que el mercado ya da por descontado. Tres operaciones en la categoría en 48 horas —AIR, Console, HiddenLayer— y el primer paso sigue siendo gratis: el inventario de qué agentes tienes en marcha, qué conectores usan y con qué credenciales salen. Fuente
¿Qué mirar mañana?
Bloomberg cuenta que Nvidia podría firmar esta misma semana la compra de Hugging Face por 12.900 millones más un paquete de retención de unos 1.000 para la plantilla, cerca de 14.000 en total: es el hilo abierto desde el 25 de agosto y la firma cambiaría de dueño el repositorio de modelos abiertos que usa medio sector. Y mientras los modelos bajan de precio arriba, la factura de abajo sigue subiendo: Broadcom facturó 16.700 millones en chips de IA en el trimestre, un 221% más, y prevé 21.700 en el siguiente; los recortes de hoy vienen de la competencia entre modelos, no de que el cómputo sea más barato.