Radar IA para empresas — miércoles 19 de agosto de 2026
· CompaniesAutomation
Hoy la IA para empresas va de lo que pasa cuando se le da demasiado bien. OpenAI publicó el 18 de agosto que su mayor entrenamiento por refuerzo de frontera sigue detenido desde que el 7 de agosto concluyó que su modelo interno Astra puede alcanzar el umbral de capacidad cibernética que su marco de preparación llama crítica: ahora exige monitorización de toda inferencia con herramientas, con clasificadores que revisan cada token muestreado, aviso en menos de treinta minutos y un sobrecoste cercano al veinte por ciento del cómputo vigilado. El mismo día Anthropic activó que Claude responda, envíe y reenvíe correos dentro de Gmail en todos los planes de pago, con la aprobación previa desactivable por el usuario y bajo control del propietario en Team y Enterprise. En dinero, Temporal negocia unos 500 millones de dólares a una valoración de al menos 12.000 millones, más del doble que en febrero, y Rillet cerró 100 millones de serie C a 1.000 millones para su ERP contable nativo de IA. Y en adopción, los equipos con agentes de código han pasado de 21 a 65 pull requests semanales mientras los que no los usan siguen entre 8 y 10.
El radar de ayer iba de lo que pasa cuando la IA falla; el de hoy va de lo que pasa cuando se le da demasiado bien. OpenAI mantiene en pausa su mayor entrenamiento de frontera porque su modelo interno puede haber cruzado el umbral de capacidad ofensiva que su propio marco llama crítica, y ha impuesto una vigilancia que se come alrededor del veinte por ciento del cómputo que supervisa; el mismo día Anthropic ha dejado que Claude envíe correos desde tu Gmail sin pedirte permiso cada vez. Y en dinero, el capital está pagando la fontanería y el papeleo: Temporal negocia unos 500 millones de dólares a más de 12.000 millones de valoración y Rillet levanta 100 millones a 1.000.
OpenAI ha parado su mayor entrenamiento porque a su propio modelo se le da demasiado bien atacar
OpenAI publicó el 18 de agosto que su mayor entrenamiento por refuerzo de frontera sigue detenido mientras hace pruebas a menor escala para validar salvaguardas: la decisión arranca del 7 de agosto, cuando concluyó que su modelo interno Astra puede alcanzar el umbral de capacidad cibernética que su marco de preparación califica de crítica. Desde entonces exige monitorización de toda inferencia de Astra con herramientas —no solo de los entrenamientos y las evaluaciones—, con clasificadores que inspeccionan la actividad interna del modelo en cada token muestreado y escalan a investigadores automáticos que revisan las acciones sobre herramientas; el aviso debe llegar en menos de treinta minutos y el sobrecoste ronda el veinte por ciento del cómputo de la inferencia vigilada. Para tu empresa: hay dos lecturas. La primera es que tu proveedor acaba de poner por escrito que un modelo con herramientas es una superficie de ataque, y su respuesta no ha sido una cláusula legal sino mirar cada token y aceptar un veinte por ciento más de coste; copia el criterio a tu escala, porque el agente que has conectado a tu correo, tu ERP o tu repositorio necesita registro de cada acción, credenciales con caducidad, lista blanca de dominios y, sobre todo, alguien que lea ese registro. La segunda es de calendario y de precio: la edición flash de esta mañana contaba que no entra capacidad nueva de cómputo hasta 2028, y ahora ya sabes que una quinta parte de la que hay se va en vigilar lo que la otra hace. Si tu plan para el año que viene da por hecho agentes más potentes, más rápidos y más baratos a la vez, este anuncio dice que la seguridad va a cobrarse su parte antes. Fuente
Claude ya puede darle a enviar en tu Gmail, y quien decide eso es tu administrador
Anthropic activó el 18 de agosto que Claude responda, envíe y reenvíe correos dentro de Gmail a través de su conector de Google Workspace, disponible en todos los planes de pago. Por defecto pide aprobación antes de cada acción, pero el usuario puede quitarle esa aprobación y dejar que mande solo; en los planes Team y Enterprise son los propietarios de la cuenta quienes deciden si los miembros pueden activar ese modo. Para tu empresa: la casilla que separa un borrador de un correo enviado la va a marcar cada empleado salvo que tú decidas antes, así que esa política se escribe esta semana y no el día del incidente. Lo razonable es permitir el envío sin confirmación solo en buzones concretos y de bajo riesgo —avisos, confirmaciones, recordatorios internos— y dejarlo cerrado en el buzón desde el que se firman presupuestos o se responde a reclamaciones. Y conviene tenerlo claro antes de firmarlo: un correo que manda un agente sale con tu dominio y tu firma, así que ante el cliente que lo recibe, y ante el Reglamento General de Protección de Datos si lleva datos de terceros, lo has enviado tú. Fuente
El dinero grande del día no va a un modelo: va a que tu automatización no se quede a medias
Temporal negocia una ronda de unos 500 millones de dólares a una valoración de al menos 12.000 millones antes del dinero nuevo, según adelantó Bloomberg: más del doble de los 5.000 millones a los que cerró en febrero, cuando levantó 300. Lo que vende no es un modelo ni un agente, es una plataforma de orquestación de código abierto que hace que un proceso de varios pasos sobreviva a sus propios fallos —si el paso cuatro de nueve se cae, el proceso retoma donde estaba en vez de empezar de cero o quedarse colgado a mitad—. Para tu empresa: que el capital pague esa fontanería, y no otro modelo, es el diagnóstico del sector sobre por qué se rompen las automatizaciones con IA. No se rompen porque el modelo escriba peor, se rompen porque un paso falló y dejó el pedido medio procesado, el cliente medio dado de alta y a nadie enterado. Aplicarlo no cuesta una ronda: exige que cada automatización tuya sea reanudable —que guarde su estado, que repetir un paso no duplique el cobro ni el correo, que reintente sola con espera creciente— y pregúntale hoy a quien te la montó qué pasa exactamente cuando el modelo devuelve un error a mitad del flujo. Si la respuesta es que se relanza a mano, esa es tu deuda técnica y ya sabes lo que vale en el mercado. Fuente
Te van a vender contabilidad con IA este otoño: la pregunta que la separa de una demo
Rillet, una empresa de dos años, cerró el 18 de agosto una serie C de 100 millones de dólares liderada por ICONIQ que la valora en 1.000 millones: es su tercera ronda en doce meses, supera los 200 millones levantados en total y repiten Sequoia, Andreessen Horowitz y Oak HC/FT mientras entran Bain Capital Ventures, Battery, FirstMark, Scale y Creandum. Vende un ERP contable nativo de IA cuyo argumento comercial es sustituir el software de contabilidad heredado y devolverle los fines de semana al director financiero, o sea, automatizar el cierre mensual. Para tu empresa: esto no va de invertir, va de que la categoría donde tienes contratados tu ERP y tu asesoría se está reconstruyendo con dinero fresco, y de aquí a fin de año te van a ofrecer IA en los dos sitios. El filtro para no comprar humo es el cierre: cuántos días tardas hoy en cerrar el mes, cuántos asientos se tocan a mano y qué traza queda cuando el asiento lo propone la máquina. Esa última es la que separa un producto de una demo, porque ante una inspección la explicación de por qué está ahí ese apunte sigue siendo tuya, no del proveedor. Fuente
Los equipos con agentes triplican lo que producen; lo que entregan es otra cosa
Linear publicó los datos de su plataforma: los equipos con agentes de código conectados han pasado de 21 a 65 pull requests semanales en dos años, mientras los que no los tienen siguen planos entre 8 y 10; el total por espacio de trabajo sube un 111% sobre junio de 2024 y la IA escribe ya algo menos de la mitad de todo lo que se crea en la herramienta, unas 2.500 incidencias por semana en agosto frente a prácticamente ninguna a mediados de 2024. Para tu empresa: el número que importa no es el 111%, es la distancia entre 65 y 8, y el matiz que la acompaña: triplicar lo que se produce no triplica lo que llega a producción, mueve el cuello de botella a la revisión. Enlázalo con la primera noticia de hoy y verás el problema completo, porque si la mitad del trabajo lo escribe una máquina y el lado que busca fallos también está automatizado, revisar deja de ser un trámite de cortesía. La consecuencia práctica es de presupuesto: si vas a meter agentes en tu equipo, presupuesta la revisión —personas, tiempo y análisis automático— en el mismo momento que las licencias, no seis meses después, cuando ya nadie sepa quién escribió qué. Fuente
¿Qué mirar mañana?
Si OpenAI reanuda o no ese entrenamiento, porque de ese calendario salen las herramientas de agentes que te van a vender el año que viene. Y si Google y Microsoft imitan a Anthropic dejando que sus asistentes envíen correo sin confirmación: el día que lo hagan, tener escrita la política de tu empresa deja de ser una buena práctica y pasa a ser urgente.