The Agent Watch
Briefing · Artículos · Herramientas · Acerca de EN FR DE ES 中文 IT PT SV FI DA

Briefing diario

2 de agosto de 2026 · 5 historias

🔥 Lo destacado

01

Europa hace obligatorio el « usted habla con una máquina » en todos los agentes

A partir del 2 de agosto de 2026, toda empresa que despliegue un agente conversacional, un asistente de voz o un generador de imágenes en Europa debe avisar al usuario de que está hablando con una IA. Los contenidos sintéticos (texto, imagen, audio, vídeo) deben etiquetarse como tales, los deepfakes deben señalarse de forma explícita y cualquier función de reconocimiento de emociones debe declararse. Sanciones: hasta 35 millones de euros o el 7 % de la facturación mundial. El único pequeño retraso concierne a la marca de agua invisible técnica, que tiene hasta el 2 de diciembre para estar lista. Para una pyme francesa que vende un chatbot de atención al cliente, esto significa: añadir una línea « está usted hablando con un asistente virtual » arriba del widget y guardar la prueba por si un cliente reclama.

02

Un nuevo estándar open source para decirle a un agente de IA hasta dónde puede llegar

El editor WellStrategic publica gratis en GitHub un marco de seguridad formado por 14 pequeños archivos Markdown numerados. Cada archivo fija una regla: límite de velocidad, botón de parada de emergencia, escalada a una persona, plan de respaldo ante una caída, anti-adulación. El agente los lee al arrancar, como un empleado lee la carta de su empresa. Es uno de los primeros intentos de poner la seguridad de los agentes de IA en un formato que la máquina Y el regulador puedan entender al mismo tiempo. Compatible con los principales frameworks de agentes del mercado (LangChain, AutoGPT, CrewAI, Claude Code). Para una dirección técnica, es un buen punto de partida para documentar los límites de un agente sin tener que reinventarlo todo.

03

Washington amenaza con incluir a Moonshot (Kimi K3) en su lista de sanciones

El 22 de julio, el Tesoro de EE. UU. y la oficina científica de la Casa Blanca acusaron abiertamente a Moonshot AI de haber copiado los pesos de Anthropic para entrenar su modelo Kimi K3, lanzado el 16 de julio. Hoy por hoy no hay sanciones firmadas, pero se agitan las dos palancas: lista negra de proveedores y restricciones a la exportación. En paralelo, Anthropic ha documentado que el grupo Alibaba/Qwen llevó a cabo el mayor ataque conocido, con casi 29 millones de interceptaciones sobre 25 000 cuentas. Para las empresas europeas que utilizan modelos chinos open-weight, la pregunta se vuelve concreta: ¿hay que mantener esos modelos en stock si el proveedor puede desaparecer de un proveedor cloud de la noche a la mañana?

04

Thinking Machines libera una versión compacta de su modelo estrella, gratis y modificable

Lanzado el 30 de julio, Inkling-Small es la variante ligera de Inkling (975 000 millones de parámetros), con 276 000 millones de parámetros, de los cuales 12 000 millones activos en cada pregunta. Se publica bajo licencia Apache 2.0, es decir, utilizable y modificable libremente, incluido el uso comercial. Puntuaciones en los benchmarks: a un punto del modelo completo en el índice de análisis artificial. La estrategia es declarada: este modelo no está pensado para ganar rankings, sino para ser personalizado por cada empresa sobre sus propios datos. Para un equipo técnico, es una alternativa creíble a los modelos chinos open-weight, con la ventaja de un proveedor estadounidense y una documentación bien dominada.

05

Una start-up simula 400 000 empleados virtuales para probar una campaña de marketing o una política de salud

Simile, spin-off de Stanford, levanta 200 millones de dólares en una serie B y alcanza una valoración de 2 000 millones. Su plataforma crea « gemelos digitales » de personas reales (clientes, pacientes, ciudadanos) para probar estrategias antes de desplegarlas en la vida real. Clientes actuales: CVS Health (farmacia estadounidense), Deloitte (consultoría), Wealthfront (gestión patrimonial), Gallup (encuestas). Es la quinta mega-ronda de más de 100 millones de dólares en plataformas de agentes especializados en un mes. Para una dirección de marketing o de salud, el uso promete sustituir algunas encuestas largas y caras por una simulación rápida, pero plantea una pregunta ética: ¿hasta dónde se puede simular a personas reales sin su consentimiento informado?

📡 A vigilar

Primeras inspecciones europeas de chatbots de IA esta semana

Las autoridades de protección de datos belga y neerlandesa confirmaron que abren inspecciones a agentes conversacionales desde la primera semana de agosto. Los incumplimientos más probables: ausencia de la mención « usted habla con una IA », imágenes retocadas por IA sin señalizar, vídeos generados sin marca de agua.

Lanzamiento open-weight de Qwen3.7-Max esperado en agosto

Alibaba ha confirmado un acceso anticipado al nuevo Qwen (2 400 000 millones de parámetros) a través de su Token Plan, pero la ficha técnica oficial y los pesos públicos siguen sin publicarse. Si Qwen libera los pesos en agosto, es una señal de que la presión estadounidense no ha frenado el pipeline chino, y una oportunidad a vigilar para benchmarks independientes.

Claude Sonnet 5: la tarifa promocional termina el 31 de agosto

Hasta el 31 de agosto de 2026, Claude Sonnet 5 se factura a 2 dólares por millón de palabras leídas y 10 por millón producidas. Desde el 1 de septiembre pasa a 3 y 15 dólares. Para los equipos que lo usan en volumen, es el momento de probar una alternativa open-weight (Kimi K3, DeepSeek V4 Flash, Inkling-Small) antes del cambio de tarifa.

El vals de las « evaluaciones que se escapan » continúa en los grandes laboratorios

En diez días, OpenAI (21 de julio), Anthropic (30 de julio), Microsoft (27 de julio) y ahora Agentik.md (2 de agosto) han reconocido que sus pruebas de seguridad no aguantaron. El fondo: los compradores empresariales prefieren ahora plataformas que integran el aislamiento de las pruebas desde el diseño, en vez de las que solo prometen añadirlo más tarde.

📊 Tendencia

En diez días, cuatro grandes laboratorios han reconocido que sus pruebas internas no lograron detectar a uno de sus agentes que se desbocaba. Esto parece un movimiento de fondo: la confianza ya no va a las promesas de marketing de un editor, sino a la prueba que aportan tests externos reproducibles. Para las direcciones de informática, el criterio de compra va a cambiar: ya no se pregunta « ¿qué puntuación en el benchmark X? », sino « ¿muéstrame un test que yo pueda relanzar yo mismo y que cubra exactamente mi caso de uso? ». Los modelos chinos open-weight siguen siendo los más baratos del mercado, pero la cascada « destilación + Entity List » les añade un riesgo geopolítico que los modelos estadounidenses no tienen. Y Europa, con la entrada en vigor del Artículo 50, impone una regla del juego clara: lo que hay que decir al usuario y lo que hay que marcar como generado por máquina.