Briefing quotidiano
10 agosto 2026 · 5 storie
🔥 In primo piano
1Alibaba promette di aprire il suo mega-modello Qwen3.8-Max già questa settimana
Il 3 agosto il colosso cinese Alibaba ha presentato Qwen3.8-Max: un modello di IA gigantesco, con 2.400 miliardi di parametri complessivi, di cui 95 miliardi vengono attivati a ogni domanda. Può gestire testi, immagini e video, con una finestra di contesto di un milione di token: è come avere diversi romanzi aperti contemporaneamente nella memoria. Nei test di Terminal-Bench ha superato i modelli statunitensi Fable 5 e Opus 4.8. Alibaba ha promesso di pubblicare gratuitamente questa settimana (10-16 agosto) i pesi del modello, cioè i file che contengono ciò che ha imparato. Sarebbe il modello più grande mai reso aperto al mondo. L’API di Alibaba Cloud costa 2 dollari per un milione di token in ingresso, circa dieci volte meno dei modelli statunitensi equivalenti. La licenza non è ancora stata resa nota e i dati ospitati restano sotto la giurisdizione cinese.
2NVIDIA pubblica NOOA: un agente IA sta in una sola classe Python
Il 7 agosto NVIDIA ha reso disponibile con codice aperto NOOA (NVIDIA Object-Oriented Agents), un nuovo insieme di strumenti per costruire agenti IA in Python. La promessa è che un agente intero stia in una sola classe, come se una piccola squadra di collaboratori digitali avesse un’unica scheda di lavoro. I metodi della classe diventano le azioni, i suoi campi conservano lo stato della memoria, le descrizioni scritte nel codice danno al modello le istruzioni e le annotazioni dei tipi fissano i contratti che il programma deve rispettare. NVIDIA dichiara un risultato dell’82,2% nel test SWE-bench, che misura compiti di sviluppo software, usando la metà dei token rispetto a strumenti comparabili. Avvertenza importante nella documentazione: i controlli interni non sono un confine di sicurezza. Questi agenti devono sempre funzionare dentro un contenitore (una sorta di scatola digitale) o una macchina virtuale isolata.
3LangChain apre Managed Deep Agents: distribuire un agente con un solo comando
Il 7 agosto LangChain ha aperto alla beta pubblica Managed Deep Agents, un servizio che promette di portare un agente IA dal prototipo all’uso reale con un solo comando (`mda deploy`). Gli sviluppatori scrivono l’agente in Python o TypeScript e lo provano sul computer locale con `mda dev`; poi LangSmith gestisce tutto ciò che normalmente resta dietro le quinte: esecuzione di lunga durata, memoria persistente, ambiente di prova isolato, identità, avvii programmati e un Context Hub per collegare gli strumenti. Sei componenti sono inclusi dall’inizio: un ambiente sicuro per eseguire codice, valutazioni Harbor, integrazioni con Slack e GitHub, memoria tra conversazioni, identità OIDC (lo standard aziendale per l’autenticazione) e pianificazioni cron gestite. Per ora la beta è limitata alla regione statunitense di LangSmith Cloud, mentre LangChain stabilizza l’interfaccia del servizio.
4Stripe tratta in esclusiva l’acquisto di OpenRouter per circa 10 miliardi di dollari
Secondo The Information e poi il Wall Street Journal, Stripe è entrata in trattative esclusive per acquistare OpenRouter, il mercato che riceve le richieste di 8 milioni di sviluppatori e le indirizza al modello IA più adatto tra oltre 400 opzioni. È come un intermediario che trova lo specialista giusto per ogni domanda. L’operazione valuterebbe l’azienda quasi 10 miliardi di dollari, tra contanti e azioni. OpenRouter gestisce circa 1,5 milioni di miliardi di token all’anno (1,5 × 10^15): il 15-30% del traffico di Google e il 20-40% di quello di OpenAI. A maggio OpenRouter valeva appena 1,3 miliardi: la valutazione sarebbe quindi aumentata di otto volte in meno di tre mesi. Insieme all’acquisto di Metronome a gennaio, Stripe controllerebbe i due estremi di ogni transazione IA: scegliere quale modello elabori la richiesta e poi fatturare il cliente con precisione, token per token. Da prendere con cautela: non c’è ancora un annuncio ufficiale e le trattative potrebbero saltare.
5AWS Bedrock AgentCore arriva in GovCloud: memoria, regole e una struttura di controllo gestita per agenti regolamentati
Il 7 agosto AWS ha aggiunto tre capacità a Bedrock AgentCore (la sua piattaforma gestita per agenti IA) nella regione GovCloud US-West. La prima è una memoria persistente di breve e lungo periodo: l’agente può ricordare le conversazioni precedenti, come una persona che conserva i propri appunti. La seconda permette di scrivere le politiche in linguaggio naturale e di trasformarle automaticamente in regole di sicurezza nella lingua Cedar. La terza è un «managed harness», una struttura di controllo che configura l’agente senza chiedere agli sviluppatori di scrivere codice aggiuntivo per coordinarlo. Il destinatario sono le agenzie federali statunitensi, le aziende della difesa e i fornitori di software in settori regolamentati, che devono conservare i dati sul suolo americano. AWS sta ampliando rapidamente la propria piattaforma di agenti per il settore pubblico e le industrie soggette a conformità, mentre NVIDIA, LangChain e Anthropic propongono componenti simili nella stessa finestra di pochi giorni.
📡 Da tenere d'occhio
Anthropic potenzia i suoi agenti gestiti con budget, advisor e skill da GitHub
Il 7 agosto Anthropic ha aggiunto quattro novità a Claude Managed Agents: un tetto di spesa per sessione (l’agente si ferma da solo quando ha consumato tutto il budget), un «advisor» (un secondo modello a cui chiedere consiglio durante il lavoro), il controllo della regione in cui avviene l’elaborazione (dati ospitati in una regione USA, con un costo aggiuntivo del 10%) e il caricamento automatico delle skill dalla cartella `.claude/skills/` di un repository GitHub. È il quarto tassello di un «sistema di esecuzione gestito per agenti» che sta diventando una categoria di mercato autonoma.
Hadrian raccoglie 1,37 miliardi per fabbriche come servizio al servizio della difesa USA
La startup Hadrian, con sede a Torrance (California), ha chiuso il 6 agosto un round di Serie D da 1,37 miliardi di dollari, con una valutazione dopo l’investimento di 7,87 miliardi. Gestisce 3 milioni di piedi quadrati (circa 279.000 m²) di fabbriche automatizzate in quattro siti e serve Lockheed Martin, RTX, Anduril e la US Navy. Al round hanno partecipato grandi investitori come JPMorgan, T. Rowe Price, Apollo e Founders Fund. Sommando Terafab (16,8 miliardi di dollari), Sequoia (10 miliardi), Valar Atomics (1 miliardo), Unitree (9 miliardi) e l’operazione Stripe-OpenRouter (10 miliardi), in otto giorni si arriva a circa 48 miliardi investiti lungo la filiera «IA + industria fisica». È un segnale di settore che continua a ripetersi.
Quattro filosofie per i sistemi di esecuzione gestiti degli agenti in pochi giorni: il mercato prende forma
Tra il 6 e l’8 agosto quattro grandi operatori hanno presentato i componenti di base per portare gli agenti in produzione: LangChain Managed Deep Agents (struttura di controllo aperta più cloud gestito), AWS Bedrock AgentCore GovCloud (gestito per i settori regolamentati), NVIDIA NOOA (prima di tutto aperto) e Anthropic Managed Agents (gestito dal laboratorio che crea il modello). La domanda non sarà più soltanto «quale insieme di strumenti scegliamo?», ma «su quale sistema di esecuzione gestito faremo funzionare i nostri agenti?». Per AgentWealthy, il campo di gioco si sposta verso l’hosting e la governance — cioè chi tiene in funzione gli agenti e quali regole ne limitano le azioni.
I modelli cinesi con pesi aperti diventano lo standard freemium: Kimi K3 e ora Qwen3.8-Max
Moonshot Kimi K3 è uscito a metà luglio con una licenza «Modified-MIT», una soglia di 20 milioni di dollari di ricavi e una condivisione del 30% oltre tale soglia. Reuters ha rivelato il 7 agosto che Alibaba prepara un meccanismo equivalente per Qwen3.8-Max. In Cina si sta così definendo lo standard commerciale dei modelli con pesi aperti: si possono usare e adattare, ma la licenza prevede condizioni quando l’attività supera una certa dimensione. È come offrire un ingresso gratuito e chiedere una quota quando il progetto diventa molto redditizio. Per i progetti che negoziano licenze di modelli, conviene prevedere fin d’ora un margine per la trattativa.
📊 Tendenza
Il «sistema di esecuzione gestito per agenti» sta diventando, in meno di una settimana, un mercato con quattro filosofie distinte: prima di tutto aperto (NVIDIA NOOA), gestito per i settori regolamentati (AWS Bedrock AgentCore GovCloud), struttura di controllo aperta più cloud gestito (LangChain) e sistema di esecuzione gestito dal laboratorio del modello (Anthropic Managed Agents). Il campo di gioco si sposta da «quale insieme di strumenti scegliere?» a «su quale sistema di esecuzione gestito ospitare i nostri agenti?», mentre la convergenza tra «IA + industria fisica» accumula circa 48 miliardi di dollari in otto giorni. Per AgentWealthy, i settori «factories-as-a-service», «defense-manufacturing» e «autonomous industrial agents» sono quelli con più capitale e quindi con maggiore capacità di pagare strumenti IA complementari.