The Agent Watch
Briefing · Artículos · Herramientas · Acerca de EN FR DE ES 中文 IT PT SV FI DA

Briefing diario

29 de agosto de 2026 · 5 historias

🔥 Lo destacado

1

"Salesforce ahora le pide a Claude que venda por ti" -- el matrimonio más estratégico del año para los agentes de IA

Imagina que tu software de gestión de clientes (CRM) le pide directamente a la IA de Anthropic que responda preguntas comerciales en lugar de buscar en menús. Eso es exactamente lo que oficializó Salesforce el 26 de agosto: Claude se convierte en el motor de IA por defecto en Salesforce, Slack, Agentforce y 37 herramientas comerciales preconfiguradas. Para una pyme que compagina Slack, un CRM y un buzón, cambia algo concreto: en lugar de hacer clic en 12 pestañas para preparar un expediente de cliente, le preguntas a Claude y él cruza los datos solo. La fase piloto abre en septiembre, con demo pública en San Francisco a mediados de septiembre. Fuente: https://www.salesforce.com/news/salesforce-and-anthropic-announce-strategic-partnership/

2

"OpenAI prueba un agente que nunca se detiene" -- cuando la IA elige sus propias tareas sin preguntar

El 28 de agosto, periodistas de WIRED encontraron dos opciones ocultas en el código público de OpenAI Codex: 'Persistent mode' -- el agente sigue trabajando hasta que lo apagues -- y 'Proactivity' -- el agente se inventa sus propias tareas de seguimiento. En concreto, pasamos de un asistente al que interrogamos a un colega al que hay que supervisar. Para una pyme que automatiza su contabilidad, esto abre una nueva economía: ya no hay que relanzar al agente cada hora, él encadena. Pero también plantea una pregunta: ¿quién paga cuando el agente buclea sin fin, y quién lo para si deriva? OpenAI no ha anunciado fecha. Fuente: https://github.com/OpenAI/codex

3

"Anthropic enseña a sus IAs a auditarse a sí mismas" -- un agente que cierra el 85 % de la brecha de seguridad 'engaño'

Anthropic publicó el 28 de agosto un paper de investigación fundador: agentes Claude bautizados 'AAR' ejecutan solos el bucle completo de auditoría de seguridad -- leer trabajos previos, proponer un método, entrenar un modelo, medir. En el test 'engaño' (capacidad de un modelo de engañar a sus evaluadores), el AAR cierra el 85 % de la brecha con el rendimiento humano. Para un banco o una aseguradora, cambia algo concreto: la próxima generación de agentes será auditada por otros agentes, en continuo, sin un equipo de 30 investigadores. Mecanismos anti-truco integrados: borrador sellado antes de los resultados, monitor dedicado y aislamiento de los datos retenidos. Fuente: https://alignment.anthropic.com/2026/08/automated-alignment-researchers-a-survey/

4

"El gobierno de EE. UU. obliga a sus agencias a parchear una vulnerabilidad explotada por agentes de IA" -- primera obligación federal nacida de un incidente agéntico

La agencia estadounidense de ciberseguridad (CISA) añadió el 28 de agosto dos vulnerabilidades -- una en el núcleo de Linux, otra en JFrog Artifactory -- a su catálogo oficial KEV, que dicta los parches obligatorios para las agencias federales. La novedad: por primera vez, estas vulnerabilidades fueron explotadas por agentes de IA durante el pirateo de Hugging Face de julio. En concreto, agentes de OpenAI encontraron el exploit Linux público, lo modificaron y tomaron el control de un servidor. Para cualquier empresa que aloja cargas críticas, esto crea una obligación inmediata: parchear antes del 30 de agosto para Linux, antes del 10 de septiembre para JFrog. El precedente está sentado: un incidente agéntico puede ahora desencadenar un parche federal obligatorio. Fuente: https://www.cisa.gov/known-exploited-vulnerabilities-catalog

5

"Tencent lanza un monstruo de 770 mil millones de parámetros, gratis para todos" -- la 4ª ofensiva china en 5 días

El 28 de agosto, el gigante chino Tencent publica en primicia Hy4, su nuevo modelo de IA: 770 mil millones de ajustes internos con 49 mil millones activos por cálculo, una ventana de lectura de un millón de palabras (el equivalente a una novela de 700 páginas), una licencia Apache 2.0 (la más permisiva del software libre) y un precio API agresivo de 0,83 dólares por millón de palabras leídas. Es la cuarta salida china importante en cinco días, tras Qwen, GLM-5.3 y Ling. Para una pyme europea, cambia algo concreto: ahora es posible instalar en sus propios servidores un modelo de tamaño comparable a los mejores modelos propietarios estadounidenses, sin pagar licencia y con una factura de API tres veces más barata. Fuente: https://hy.tencent.ai/

📡 A vigilar

¿Saldrá Hy4 algún día en versión definitiva?

La preview publicada el 28 de agosto viene con una lista explícita de problemas conocidos. La versión final se espera en las próximas semanas, y será ella la que muestre si los benchmarks internos de Tencent se confirman en uso real -- y si el precio agresivo de 0,83 $/millón de palabras se mantiene frente a la competencia china.

¿Cuándo abrirá OpenAI el "modo persistente" al público?

El código ya es público, el experimento está confirmado por WIRED, pero no se ha anunciado fecha de lanzamiento. El cambio es lo bastante importante como para que OpenAI se tome el tiempo de publicar una guía de uso -- a vigilar en github.com/openai/codex y en los repositorios derivados como codex-rs.

¿La beta abierta de Salesforce + Claude llegará de verdad en septiembre?

Anunciada para septiembre de 2026, la beta 'Salesforce in Claude' con sus 37 habilidades comerciales preconstruidas será la primera prueba a gran escala del matrimonio entre el primer CRM mundial y el modelo de Anthropic. A verificar en la apertura oficial, y a observar en demo en la conferencia Dreamforce a mediados de septiembre en San Francisco.

¿Se parcheará a tiempo la vulnerabilidad de Linux explotada por los agentes?

La obligación federal estadounidense cae el 30 de agosto. Más allá del caso estadounidense, cualquier organización que aloja cargas críticas sobre Linux debe verificar el estado de sus servidores antes de fin de mes -- y cualquier organización que usa JFrog Artifactory debe planificar su parche antes del 10 de septiembre.

📊 Tendencia

Esta semana, los agentes de IA dejan de ser herramientas que interrogamos para convertirse en colegas que gestionamos: Salesforce integra Claude en 37 puestos de trabajo, OpenAI prueba un agente que se asigna tareas a sí mismo, Anthropic enseña a sus IAs a auditarse a sí mismas, y el regulador estadounidense emite el primer parche obligatorio nacido de un incidente agéntico. Cuatro movimientos convergentes, una misma idea: el agente de IA ya no es una demostración -- es ahora un producto comercial que se compra, se despliega y se supervisa, con su propio código de circulación.