The Agent Watch
Briefing · Artículos · Herramientas · Acerca de EN FR DE ES 中文 IT PT SV FI DA

Briefing diario

10 de agosto de 2026 · 5 historias

🔥 Lo destacado

1

Alibaba promete abrir su megamodelo Qwen3.8-Max esta misma semana

El 3 de agosto, el gigante chino Alibaba presentó Qwen3.8-Max: un modelo de IA gigantesco, con 2,4 billones de parámetros en total (2.400 mil millones), de los que activa 95 mil millones en cada pregunta. Puede procesar texto, imágenes y vídeo, y mantener un millón de tokens en contexto; es como tener varios libros enteros abiertos en la memoria al mismo tiempo. En las pruebas de Terminal-Bench superó a los modelos estadounidenses Fable 5 y Opus 4.8. Alibaba prometió publicar esta semana (del 10 al 16 de agosto) los archivos que contienen el modelo para descargarlos gratis, lo que lo convertiría en el modelo más grande jamás abierto al público. La API (el acceso programático) de Alibaba Cloud cuesta 2 dólares por cada millón de tokens de entrada, unas diez veces menos que modelos estadounidenses similares. Aún no se conoce la licencia y los datos alojados siguen bajo jurisdicción china.

2

NVIDIA publica NOOA: un agente de IA cabe en una sola clase de Python

El 7 de agosto, NVIDIA publicó el código de NOOA (NVIDIA Object-Oriented Agents), un nuevo conjunto de herramientas para construir agentes de IA en Python. Su promesa es sencilla: un agente completo cabe en una sola clase, como si todo un pequeño equipo de empleados digitales compartiera una única ficha. Los métodos de esa clase se convierten en acciones, sus campos guardan el estado de la memoria, las descripciones escritas dentro del código indican al modelo qué hacer y las anotaciones de tipos fijan las reglas que debe respetar el programa. NVIDIA afirma haber logrado un 82,2 % en SWE-bench, una prueba de tareas de desarrollo de software, usando la mitad de tokens que conjuntos de herramientas comparables. La documentación incluye una advertencia importante: sus comprobaciones internas no son una barrera de seguridad. Estos agentes deben ejecutarse siempre en un contenedor de software (una caja aislada) o una máquina virtual aislada.

3

LangChain abre Managed Deep Agents: desplegar un agente con un solo comando

El 7 de agosto, LangChain abrió en beta pública Managed Deep Agents, un servicio que promete llevar un agente de IA del prototipo al uso real con un solo comando (`mda deploy`). Los desarrolladores escriben el agente en Python o TypeScript y lo prueban en su propio ordenador con `mda dev`; después, LangSmith se ocupa de la parte invisible: mantenerlo funcionando durante mucho tiempo, conservar su memoria, gestionar un espacio de pruebas aislado, controlar su identidad, activar tareas programadas y ofrecer un Context Hub para conectarle herramientas. Desde el principio incluye seis piezas: un espacio seguro para ejecutar código, evaluaciones de Harbor, integraciones con Slack y GitHub, memoria entre conversaciones, identidad OIDC (el estándar empresarial para iniciar sesión) y tareas programadas de tipo cron gestionadas. Por ahora, la beta solo está disponible en la región estadounidense de LangSmith Cloud, mientras estabilizan la interfaz de programación.

4

Stripe negocia en exclusiva la compra de OpenRouter por unos 10.000 millones de dólares

Según The Information y después el Wall Street Journal, Stripe ha iniciado negociaciones exclusivas para comprar OpenRouter, un mercado que recibe las peticiones de 8 millones de desarrolladores y las dirige al modelo de IA más adecuado entre más de 400 opciones. Es como un intermediario que busca al especialista correcto para cada pregunta. El acuerdo valoraría la empresa cerca de 10.000 millones de dólares, combinando efectivo y acciones. OpenRouter gestiona alrededor de 1,5 mil billones de tokens al año (1,5 × 10^15): entre el 15 % y el 30 % del tráfico de Google, y entre el 20 % y el 40 % del de OpenAI. En mayo solo valía 1.300 millones, así que su valoración se habría multiplicado por ocho en menos de tres meses. Sumada a la compra de Metronome en enero, Stripe controlaría los dos extremos de cada operación de IA: elegir qué modelo responde y cobrar al cliente con precisión por cada token. Hay que tomarlo con cautela: no existe anuncio oficial y las conversaciones aún pueden fracasar.

5

AWS Bedrock AgentCore llega a GovCloud: memoria, reglas y una capa de control gestionada para agentes regulados

El 7 de agosto, AWS añadió tres capacidades a Bedrock AgentCore (su plataforma gestionada para agentes de IA) en la región GovCloud US-West. La primera es una memoria persistente de corto y largo plazo: el agente puede recordar conversaciones anteriores, como una persona que conserva sus notas. La segunda permite escribir políticas en lenguaje cotidiano y convertirlas automáticamente en reglas de seguridad usando Cedar. La tercera es un «managed harness», una capa de configuración y control que prepara el agente sin obligar a los desarrolladores a escribir código adicional para coordinarlo. El objetivo son agencias federales estadounidenses, empresas de defensa y proveedores de software sometidos a regulación que necesitan mantener sus datos dentro de Estados Unidos. AWS está reforzando rápidamente su plataforma de agentes para el sector público y las industrias reguladas, mientras NVIDIA, LangChain y Anthropic presentan sus propias piezas en la misma semana.

📡 A vigilar

Anthropic refuerza sus agentes gestionados con presupuestos, advisor y skills de GitHub

El 7 de agosto, Anthropic añadió cuatro funciones a Claude Managed Agents: un límite máximo de gasto por sesión (el agente se detiene solo cuando agota el presupuesto), un «advisor» (un segundo modelo al que se puede pedir consejo durante el trabajo), control de la región donde se procesan las solicitudes (los datos se alojan en una región de Estados Unidos, con un 10 % adicional de coste) y carga automática de capacidades desde la carpeta `.claude/skills/` de un repositorio de GitHub. Es la cuarta pieza de un «entorno de ejecución gestionado para agentes» que empieza a consolidarse como una categoría de mercado por derecho propio.

Hadrian capta 1,37 mil millones de dólares para fábricas como servicio destinadas a la defensa de Estados Unidos

La startup Hadrian, de Torrance (California), cerró el 6 de agosto una ronda Serie D de 1,37 mil millones de dólares, con una valoración posterior a la inversión de 7,87 mil millones. Opera 3 millones de pies cuadrados (unos 279.000 m²) de fábricas automatizadas repartidas en cuatro centros y trabaja para Lockheed Martin, RTX, Anduril y la US Navy. En la ronda participaron grandes inversores como JPMorgan, T. Rowe Price, Apollo y Founders Fund. Si se suman Terafab (16,8 mil millones), Sequoia (10 mil millones), Valar Atomics (1.000 millones), Unitree (9 mil millones) y el posible acuerdo Stripe-OpenRouter (10 mil millones), el total ronda los 48 mil millones en ocho días para la cadena «IA + industria física». Es una señal sectorial que parece repetirse.

Cuatro filosofías de entornos de ejecución gestionados para agentes en pocos días: el mercado toma forma

Cuatro grandes actores presentaron entre el 6 y el 8 de agosto sus piezas básicas para poner agentes en producción: LangChain Managed Deep Agents (una base de control abierta más una nube gestionada), AWS Bedrock AgentCore GovCloud (gestionado para sectores regulados), NVIDIA NOOA (primero abierto) y Anthropic Managed Agents (gestionado por el propio laboratorio que crea el modelo). La pregunta dejará de ser «¿qué conjunto de herramientas elegimos?» para pasar a «¿en qué entorno gestionado alojaremos nuestros agentes?». Para AgentWealthy, el campo de juego se desplaza hacia el alojamiento y la gobernanza: quién mantiene a los agentes funcionando y qué reglas limitan sus acciones.

Los modelos chinos con pesos abiertos se convierten en el estándar freemium: Kimi K3 y ahora Qwen3.8-Max

Moonshot Kimi K3 salió a mediados de julio con una licencia «Modified-MIT», un umbral de 20 millones de dólares de ingresos y un reparto del 30 % a partir de esa cifra. Reuters reveló el 7 de agosto que Alibaba prepara un mecanismo equivalente para Qwen3.8-Max. En China se está fijando así el estándar comercial de los modelos con pesos abiertos: se pueden descargar y adaptar, pero las licencias pueden exigir condiciones cuando el negocio supera cierto tamaño. Es parecido a ofrecer una entrada gratuita y cobrar una parte cuando el proyecto empieza a ganar mucho dinero. Para los proyectos que negocian licencias de modelos, conviene reservar desde ahora margen para esa negociación.

📊 Tendencia

El «entorno de ejecución gestionado para agentes» se está convirtiendo en un mercado con cuatro filosofías distintas en menos de una semana: primero abierto (NVIDIA NOOA), gestionado para sectores regulados (AWS Bedrock AgentCore GovCloud), base de control abierta más nube gestionada (LangChain) y un entorno administrado por el laboratorio del modelo (Anthropic Managed Agents). El terreno de juego pasa de «¿qué conjunto de herramientas elegimos?» a «¿en qué entorno gestionado alojaremos nuestros agentes?», mientras la convergencia entre «IA + industria física» acumula unos 48.000 millones de dólares en ocho días. Para AgentWealthy, los sectores «factories-as-a-service», «defense-manufacturing» y «autonomous industrial agents» son los que cuentan con más capital y, por tanto, mayor capacidad de pago para herramientas de IA complementarias.