Radar IA para empresas — viernes 14 de agosto de 2026
noticias radar ia agentes de ia seguridad ia automatizacion

Radar IA para empresas — viernes 14 de agosto de 2026

· CompaniesAutomation

Hoy la IA para empresas se juega en quién aprieta el botón. Desde el 14 de agosto las sesiones nuevas de Claude Code en los planes Pro, Max y Team arrancan en modo automático: el agente deja de pedir permiso comando a comando y filtra cada acción con un clasificador que, en un estudio con 1.053 probadores de pago, bloqueó el 89% de las órdenes peligrosas frente al 13,6% que detectaban las personas; el modo sigue siendo opcional en Claude Enterprise, la API, Bedrock, Google Cloud y Microsoft Foundry. SpaceXAI publicó el 12 de agosto Grok 4.6, un reentrenamiento orientado a agentes de larga duración que mantiene el precio de 2 dólares por millón de tokens de entrada y 6 de salida y empata con GPT-5.6 Sol en el índice de Artificial Analysis. Thrive Holdings, escisión de Thrive Capital con OpenAI como accionista, levantó 2.000 millones de dólares a una valoración de 12.000 millones para seguir comprando asesorías contables y empresas de informática y reescribirlas con IA: su plataforma contable ya agrupa más de 50 despachos y 2.000 profesionales. Y Uber Freight investiga una filtración de cerca de un millón de ficheros cuya vía de entrada fue una llamada telefónica al servicio de soporte pidiendo un restablecimiento de contraseña.

El radar de ayer iba de quién tiene las llaves; hoy va de quién aprieta el botón. Desde hoy Claude Code arranca en modo automático en los planes Pro, Max y Team: deja de pedir permiso comando a comando y filtra cada acción con un clasificador que en las pruebas de Anthropic frenó el 89% de las órdenes peligrosas, frente al 13,6% que frenaban las personas. En paralelo, SpaceXAI publicó Grok 4.6 al mismo precio que la versión anterior con foco en agentes de larga duración, y un fondo con OpenAI dentro levantó 2.000 millones de dólares para comprar asesorías contables y empresas de informática y reescribirlas con IA.

Desde hoy la IA que programa deja de pedirte permiso paso a paso —y los datos dicen que es lo correcto

Anthropic anunció el 7 de agosto que a partir de hoy, 14 de agosto, las sesiones nuevas de Claude Code en los planes Pro, Max y Team arrancan en modo automático: en lugar de interrumpirte para aprobar cada comando, el agente pasa cada acción por un clasificador entrenado para bloquear lo irreversible, lo destructivo y lo que apunta fuera de tu entorno; cuando bloquea algo, busca una vía más segura o te pregunta. El motivo está en un estudio con 1.053 probadores de pago: las personas solo detectaron el 13,6% de los comandos peligrosos y el clasificador el 89%, y la atención humana se degradaba con la sesión —del 17% al principio a menos del 5% pasados cincuenta mensajes—. Anthropic deja además de cobrar los tokens extra del clasificador, y el modo automático sigue siendo opcional en Claude Enterprise, la API, Bedrock, Google Cloud y Microsoft Foundry. Para tu empresa: el dato que importa no es que la máquina revise mejor, es por qué —aprobar doscientas veces seguidas convierte el clic en reflejo—, así que dejar de fiarlo a la vigilancia humana es sensato, pero solo si el entorno está acotado. Si alguien de tu equipo usa esta herramienta, hoy cambia el comportamiento por defecto: comprueba en qué máquina corre, con qué credenciales y si desde ahí se llega a producción o a datos de clientes. Y si tienes plan Enterprise o API, el cambio aún no te ha llegado: aprovecha para fijar por escrito tu modo por defecto antes de que llegue. Fuente

La misma factura de ayer compra hoy un agente que aguanta trabajos más largos

SpaceXAI publicó el 12 de agosto Grok 4.6, un reentrenamiento de la versión 4.5 orientado a agentes de larga duración y a trabajo visual, y lo dejó al mismo precio: 2 dólares por millón de tokens de entrada y 6 por millón de salida, el doble en la variante rápida y a partir de 200.000 tokens de contexto. Empata con GPT-5.6 Sol en el índice de Artificial Analysis (61 puntos), lidera CursorBench 3.2 con un 69,9% y DeepSWE con un 65,9%, pero se queda en el 26% en Terminal-Bench; está disponible en Cursor, en Grok Build y por API. Para tu empresa: la lectura es de presupuesto, no de ranking. El precio del token de primera línea lleva meses plano mientras la capacidad para tareas encadenadas sube, así que si tienes una automatización montada sobre un modelo de hace seis meses, estás pagando lo mismo por menos. La prueba que toca no es leer benchmarks: coge diez casos reales de tu proceso, pásalos por el modelo nuevo y compara resultado y coste. Y fíjate en la asimetría —el mismo modelo que lidera generando un primer prototipo se hunde en tareas de terminal—: mide sobre tu tarea concreta, nunca sobre la media. Fuente

Ya hay dinero comprando asesorías y empresas de informática para reescribirlas con IA por dentro

Thrive Holdings —escisión de Thrive Capital, con OpenAI como accionista desde diciembre de 2025— cerró el 12 de agosto una ronda de 2.000 millones de dólares a una valoración de 12.000 millones, con SoftBank, D1 Capital y Altimeter. Su modelo no es vender software: compra empresas de servicios tradicionales y les mete la IA dentro. Su plataforma contable, Current, agrupa ya más de 50 despachos y 2.000 profesionales, y su producto de impuestos procesó más de 7.000 declaraciones con un 98% de acierto y un 30% menos de tiempo; la de informática, Shield, reúne una veintena de empresas y dice haber multiplicado por 36 la velocidad de resolución del servicio de soporte. Son más de 70 compañías en total, y parte del dinero nuevo va a una tercera vertical de tramitación regulatoria de infraestructuras. Para tu empresa: esto ya no es una herramienta que puedas comprar, es un competidor con otra estructura de costes. Si vendes servicios profesionales por horas —asesoría, contabilidad, soporte informático, tramitación—, quien compre a tu vecino y le instale esto dentro podrá bajar precio sin tocar margen. Dos deberes esta semana: separa tus horas facturables entre proceso repetible y criterio propio, y empieza a automatizar las primeras tú mismo, porque el margen de ventaja está en hacerlo antes que quien venga a comprarte. Fuente

Mientras decides qué permisos das a un agente, siguen entrando por una llamada al de sistemas

Uber Freight confirmó el 12 de agosto que investiga un incidente de seguridad después de que el grupo Helix —uno de los alias que Google rastrea bajo el actor UNC6671— publicara que le había sacado buzones de correo, unidades de almacenamiento en la nube, ficheros de cuentas a pagar y documentación de expediciones, cerca de un millón de ficheros; TechCrunch revisó correos con clientes fechados a mediados de junio y la empresa sostiene que la operación no se ha visto afectada. La vía de entrada del grupo, descrita como rudimentaria y muy eficaz, es llamar por teléfono al servicio de soporte informático haciéndose pasar por un empleado y pedir un restablecimiento de contraseña; con esa técnica el colectivo ha cobrado al menos 10,6 millones de dólares en rescates entre enero y mayo. Para tu empresa: puedes tener el mejor control de permisos para tus agentes y perderlo todo porque alguien amable llamó pidiendo una contraseña nueva. Escribe hoy la regla del restablecimiento de credenciales: nunca a partir de una llamada entrante, siempre con verificación por un segundo canal que inicias tú, y con registro de quién lo pidió y quién lo aprobó. Con voz clonada por IA, "reconocí su voz" ha dejado de ser una comprobación. Fuente

¿Qué mirar mañana?

Anthropic negocia comprar Decart por unos 6.000 millones de dólares, una empresa cuyo software abarata entrenar y operar modelos exprimiendo mejor los chips: si se confirma, lo que se mueve a medio plazo es la factura de tokens de todos. Y vigila el calendario del modo automático en Claude Enterprise y en la API, previsto para el próximo mes: si administras esas cuentas, mejor decidir tu política antes de que el cambio la decida por ti.

Ve el vídeo de un minuto