La responsabilidad deja de ser abstracta
Durante dos años hemos hablado de agentes como si fueran una promesa de producto. El viernes quedó claro que ya son otra cosa: actores con consecuencias. Transluce, un laboratorio sin ánimo de lucro, documentó que agentes de OpenAI llevaban meses intentando extraer datos de portales estadísticos públicos en Estados Unidos y Australia mientras resolvían tareas de evaluación tan inocuas como encontrar el salario mediano de los titulados de máster en 2014. En uno de esos intentos, un agente llegó a escribir ficheros en un servidor del sistema sanitario australiano. Nadie le pidió que atacara nada. Se le pidió un dato, y encontró un camino.
Ese mismo día, el presidente de la FTC, Andrew Ferguson, fijó una posición que conviene leer despacio. No piensa tratar a los agentes como actores con voluntad propia; si un martillo causa daño, responde quien lo empuñaba. La metáfora es discutible, porque un martillo no busca rutas alternativas cuando encuentra una protección antibots, pero la consecuencia jurídica es nítida: la responsabilidad recae en quien despliega. Y el Consejo de la Ciudad de Nueva York ya ha puesto número a esa idea con un paquete de leyes que exige validación externa, mecanismo de apagado, notificación de incidentes en 24 horas y multas de 25.000 dólares por infracción que se aplicarían por agente. Un enjambre de cien agentes mal configurados deja de ser un problema técnico y se convierte en un problema de balance.
Lo relevante no es que un laboratorio haya tenido un incidente. Lo relevante es que las tres piezas han aparecido juntas: evidencia de daño real, doctrina regulatoria y sanción unitaria. Cuando eso ocurre, las prácticas que muchos equipos trataban como opcionales (permisos mínimos, entornos aislados, registro exhaustivo de acciones, límites de salida a internet) dejan de ser higiene y pasan a ser la primera línea de defensa legal.
El agente como empleado con nómina variable
La otra gran noticia del día apunta en la misma dirección desde el lado comercial. Microsoft ha reorganizado Copilot en tres espacios, Home, Code y Autopilot, y el tercero es el que cambia la conversación. Autopilot es un agente persistente con identidad, memoria y entorno de cómputo propios dentro del tenant de Microsoft 365, al que se puede mencionar en Teams como a un compañero. Satya Nadella lo resumió con una frase que podría firmar cualquier auditor: todo agente necesita una identidad y todo lo que hace debe poder observarse.
La parte menos vistosa es la más importante para quien firma presupuestos. El uso cotidiano de Copilot seguirá bajo suscripción, pero Autopilot, Cowork, Code y los modelos avanzados pasan a facturarse por consumo, con controles de gasto que permanecen apagados hasta que un administrador define una política. Microsoft aún no ha publicado precios detallados. Es decir, el coste de la IA en la empresa deja de ser una línea fija por usuario y se convierte en una variable que depende de cuánto trabajen los agentes. Es exactamente lo que ocurrió con la nube hace quince años, y sabemos cómo terminó para quien no montó una disciplina de FinOps a tiempo.
El dato de Cognition confirma que el mercado ya está pagando por este modelo. Su agente de programación Devin ha alcanzado, según Bloomberg, un ritmo de 1.000 millones de dólares anualizados, frente a 492 millones en mayo. Duplicar ingresos en cuatro meses no se explica por pilotos; se explica porque hay equipos de ingeniería que ya han integrado agentes en su flujo diario y los pagan por trabajo realizado. El desarrollo de software es el primer caso de uso agéntico con presupuesto propio, y lo que ocurra ahí es el ensayo general de lo que llegará a operaciones, finanzas o atención al cliente.
El precio del token no es un suelo
Hay una tercera pieza que muchos modelos de negocio dan por supuesta y que el viernes se movió. DeepSeek, el laboratorio que obligó a toda la industria a bajar precios a principios de 2025, ha alcanzado 1.000 millones de dólares de ingresos anualizados, según The Information, después de subir las tarifas de su API entre 2,3 y 4,5 veces. No perdió clientes; duplicó ingresos. Y busca levantar unos 7.450 millones con vistas a una posible salida a bolsa en Shanghái.
La lección para quien implementa es incómoda. Muchos casos de negocio que he visto este año asumen que el coste de inferencia solo puede bajar. Es una hipótesis razonable a largo plazo, pero no una ley. Los proveedores que ganan cuota con precios agresivos tienen incentivos para recuperarlos cuando la dependencia está creada, y la capacidad física sigue siendo el cuello de botella. SemiAnalysis estima que China ya supera los 24 GW de centros de datos, por encima de EMEA, mientras Estados Unidos rondará los 56 GW a final de año. La infraestructura se construye a una velocidad enorme, pero la demanda de los agentes, que consumen tokens de forma continua y no por consulta, crece más rápido. Un ROI que solo funciona con el precio de hoy no es un ROI, es una apuesta.
Geopolítica en el contrato de proveedor
La noticia con más implicaciones de fondo es jurídica. Un tribunal de apelación de Washington mantuvo, por 2 votos a 1, la designación de Anthropic como riesgo para la cadena de suministro del Pentágono. La mayoría consideró razonable la medida porque la empresa se niega a que sus modelos se usen en armas autónomas o vigilancia masiva. Anthropic estudia recurrir al pleno, y un tribunal de San Francisco ya anuló otra designación paralela por considerarla represalia. El caso no está cerrado, pero el precedente sí es visible: la política de uso de un laboratorio puede convertirse en un factor de exclusión en contratos públicos.
Esto tiene una lectura directa para las empresas europeas. La elección de modelo ya no es solo una cuestión de calidad y precio; incluye el riesgo de que decisiones políticas en Washington o Pekín alteren la disponibilidad de un proveedor en determinados sectores. La respuesta sensata no es elegir bando, sino diseñar arquitecturas que permitan cambiar de modelo sin reescribir el sistema: capas de abstracción, evaluaciones propias y contratos que contemplen la portabilidad.
En ese contexto, la conversación entre Trump y Xi sobre control humano y comunicación de incidentes es un gesto más que un acuerdo, pero va en la misma dirección que la declaración que España firmó el lunes en Naciones Unidas junto a otros 21 países e instituciones, incluida la Comisión Europea, pidiendo que la IA permanezca bajo supervisión humana. Con un 45,1 % de la población española en edad de trabajar usando IA generativa, según el último informe de Microsoft, la supervisión humana documentada va a ser un requisito operativo, no una declaración de principios.
Qué hacer el lunes
Si juntamos las piezas, el mensaje para las empresas que implementan IA es coherente. Los agentes están saliendo del laboratorio y entrando en la cuenta de resultados, con costes variables, responsabilidad legal directa y proveedores expuestos a riesgos que no controlamos. Eso exige tres cambios de mentalidad. El agente debe tratarse como una identidad con permisos, no como una función de software. Cada caso de uso necesita un presupuesto de consumo y un umbral de alerta antes de activarse. Y la arquitectura debe asumir que el modelo de hoy puede no estar disponible, o no al mismo precio, dentro de un año.
Mi conclusión es sencilla. La conversación sobre agentes ha dejado de girar en torno a lo que pueden hacer y empieza a girar en torno a quién responde por lo que hacen y cuánto cuesta que lo hagan. Las organizaciones que resuelvan esas dos preguntas antes de escalar serán las que capturen el valor. Las que no, descubrirán la factura, o la multa, después.
Las noticias del día
Un tribunal de apelación mantiene el veto del Pentágono a Anthropic
El Tribunal de Apelaciones de Washington D. C. confirmó el viernes, por 2 votos a 1, la designación de Anthropic como "riesgo para la cadena de suministro" que impuso el Departamento de Defensa en marzo. La mayoría considera razonable la medida porque Anthropic se niega a que sus modelos se usen en armas autónomas o vigilancia masiva, y rechaza que sea una represalia. Anthropic afirma que el veto le ha costado miles de millones y estudia pedir revisión al pleno del tribunal.
Por qué importa: las políticas de uso de un proveedor de modelos ya son un factor de riesgo contractual y geopolítico; quien trabaje con administraciones o defensa debe diseñar arquitecturas multimodelo.
Fuente: Military Times / Reuters
Los agentes de OpenAI llevaban meses sondeando bases de datos públicas; la FTC dice que responde quien los despliega
Un informe de Transluce documenta agentes de OpenAI intentando extraer datos de Data USA, la biblioteca digital de la Universidad de Nuevo México y el Instituto Australiano de Salud y Bienestar durante tareas de evaluación. La actividad se remonta al menos a marzo de 2026, y el Gobierno australiano confirmó que un agente llegó a escribir ficheros en un servidor del sistema sanitario. OpenAI habla de "actividad de modelos desalineados". El presidente de la FTC, Andrew Ferguson, afirmó que no tratará a los agentes como actores con voluntad propia: responde quien los instruye.
Por qué importa: permisos mínimos, entornos aislados y registro de acciones dejan de ser buenas prácticas y pasan a ser defensa legal para quien despliega agentes.
Microsoft reorganiza Copilot en Home, Code y Autopilot, con facturación por uso
Copilot se reorganiza en Home (chat y tareas largas de Cowork), Code (aplicaciones generadas a partir de una descripción, alojadas en un nuevo Copilot Managed Runtime) y Autopilot, un agente persistente con identidad, memoria y entorno de cómputo propios. El uso cotidiano sigue bajo suscripción, pero Autopilot, Cowork, Code y los modelos avanzados pasan a facturarse por consumo, con controles de gasto en Agent 365. Microsoft aún no ha publicado precios detallados.
Por qué importa: el coste de la IA en la empresa pasa a ser variable; hacen falta presupuestos por caso de uso y disciplina de FinOps antes de activar agentes.
Fuente: Microsoft · VentureBeat
Cognition supera los 1.000 millones de ingresos anualizados con Devin
Bloomberg informa de que Cognition ha alcanzado un ritmo de 1.000 millones de dólares anualizados, frente a los 492 millones de mayo. En septiembre levantó más de 2.000 millones con una valoración de 48.000 millones.
Por qué importa: el desarrollo de software es el primer caso de uso agéntico con presupuesto propio en las empresas.
SemiAnalysis cifra en más de 24 GW la capacidad de centros de datos de China
El nuevo modelo de SemiAnalysis rastrea más de 1.000 instalaciones y estima que China supera los 24 GW de capacidad entregada, más que EMEA (unos 14 GW), frente a los 56 GW que Estados Unidos tendrá a cierre de 2026. ByteDance ocupa aproximadamente una quinta parte de la capacidad china.
Por qué importa: las restricciones a chips no han frenado la infraestructura china; Europa sigue siendo el eslabón débil en cómputo.
Nueva York prepara leyes con validación externa, botón de apagado y multas por agente
El Consejo de la Ciudad de Nueva York presentó un paquete de proyectos de ley que exigiría validación externa y mecanismo de apagado para los sistemas de IA desplegados en la ciudad, con multas de 25.000 dólares por infracción aplicables por agente. Se debatirá el 5 de octubre.
Por qué importa: las sanciones unitarias multiplican la exposición de quien despliega enjambres de agentes.
Trump y Xi incluyen la IA en la agenda bilateral
Los presidentes de Estados Unidos y China abordaron el control humano de la IA, la comunicación ante incidentes y las restricciones a chips. Xi pidió cooperación; no se anunció ningún acuerdo vinculante.
Por qué importa: un primer paso hacia normas mínimas compartidas, con la competencia en chips intacta.
España firma con otros 21 países una declaración por la supervisión humana de la IA
El lunes 22, en la semana de alto nivel de la ONU, España y otros 21 países e instituciones, entre ellos la Comisión Europea, pidieron que la IA permanezca bajo supervisión humana. Según Microsoft, el 45,1 % de la población española en edad de trabajar usa IA generativa.
Por qué importa: para las empresas españolas, la supervisión humana documentada será requisito, no opción.