Ultimo briefing
15 luglio 2026 · 5 notizie (sito) · 5 notizie (base)
Il 15 luglio 2026, l'ecosistema degli agenti IA consolida le proprie fondamenta invece di sollevare nuove ondate. Microsoft unifica i suoi framework agentici e fornisce un harness pronto all'uso, Cognition potenzia Devin con un motore interno a pesi chiusi, Z.ai piazza un modello cinese open-weight in testa alla classifica (ma assetato di elettricità), Mistral rende la robotica agentica accessibile con una sola fotocamera, e SambaNova chiude un round da undici cifre che conferma l'inferenza come mercato a sé.
🔥 In primo piano
01
Microsoft unifica le sue due famiglie di agenti in un unico framework — e aggiunge un harness pronto all'uso
Finora costruire un agente IA serio nell'ecosistema Microsoft significava scegliere tra due toolkit concorrenti, AutoGen e Semantic Kernel, e assemblarsi da soli l'impiantistica: memoria, lista delle cose da fare, approvazione umana. Il 14 luglio, Microsoft ha presentato Microsoft Agent Framework 1.0 GA: le due famiglie sono ora fuse in un unico framework open source (Python e .NET), accompagnato da un Agent Harness pronto all'uso che fornisce gratis memoria su file, lista di attività, compattazione del contesto, approvazione umana e ricerca web. Per un team che esitava a lanciare un agente in produzione, è una scorciatoia notevole: Microsoft si prende carico dell'impalcatura, l'azienda deve solo aggiungere la logica di business. Lo stesso annuncio introduce gli „Hosted Agents" impacchettati in un container gestito, che partono su richiesta e si mettono in pausa da soli quando non gira nulla — l'equivalente agentico del Serverless. Microsoft comincia anche a sostituire circa 500 milioni di dollari di chiamate annue ad Anthropic con i propri modelli MAI, segno che lo stack interno sta maturando.
02
Devin potenzia il motore con SWE-1.7 — punteggi vicini ai modelli frontier, ma l'accesso resta chiuso
Quando chiedete all'agente Devin di correggere un bug in un vecchio repository di codice, il suo nuovo motore SWE-1.7 ci riesce nel 42,3 % dei casi sul benchmark FrontierCode 1.1, nell'81,5 % su Terminal-Bench 2.1 e nel 77,8 % su SWE-Bench Multilingual — cifre che lo pongono nella lega dei migliori modelli generalisti del momento. Costo annunciato per attività: 1,97 dollari, più o meno il prezzo di un caffè. Avvertenza importante: SWE-1.7 è accessibile solo agli utenti Devin (Web, Desktop o CLI); non si può scaricare, non si può chiamare tramite un'API aperta, non si può far girare sulla propria macchina. Per un'azienda che vuole mantenere il controllo sui propri modelli, è un segnale da leggere con attenzione: i pesi non seguono più automaticamente i benchmark, e la performance di frontiera comincia a essere pagata in dipendenza dalla piattaforma.
03
GLM-5.2 di Z.ai in testa alla classifica open-weights — ma la bolletta dell'elettricità è salata
GLM-5.2, il modello cinese open-weight di Z.ai (ex Zhipu), conquista il primo posto dell'Intelligence Index di Artificial Analysis con un punteggio di 51 — davanti a MiniMax-M3 (44), DeepSeek V4 Pro (44) e Kimi K2.6 (43). La licenza resta MIT, e la finestra di contesto sale a un milione di token, abbastanza da ingoiare libri interi o lunghe storie di codice in un solo passaggio. Avvertenza da conoscere prima di passare: per produrre una risposta, GLM-5.2 consuma circa 43 000 token di output per attività di indicizzazione — quasi il doppio dei rivali. A fine mese il prezzo per token può sembrare competitivo; nell'uso reale la bolletta dell'elettricità sale in fretta. Per un team che cerca un modello aperto con un alto quoziente di intelligenza, è un'opzione da soppesare: primo della classe, ma non primo della classe in sobrietà.
04
Mistral lancia un robot che si arrangia con una sola fotocamera a colori e una frase in italiano
Far navigare un robot in un corridoio, un magazzino o un marciapiede richiede di solito una combinazione costosa di sensori — lidar per le distanze, fotocamera di profondità, a volte radar. Mistral ha presentato l'8 luglio Robostral Navigate, un modello da 8 miliardi di parametri che si arrangia con una sola fotocamera a colori di consumo e un'istruzione in linguaggio naturale. Sul benchmark R2R-CE, riesce nel 76,6 % dei percorsi — un punteggio migliore dei sistemi multi-sensore esistenti. Per una piccola azienda di logistica, un operatore di magazzino o un ente locale che vuole automatizzare una navetta interna, promette un robot utile per qualche migliaio di euro di hardware, dove le soluzioni industriali partono da sei cifre. Il modello viene consegnato pronto per equipaggiare piattaforme su ruote, gambe o volanti — l'impiantistica di integrazione resta a carico dell'utente.
05
SambaNova raccoglie 1 miliardo di dollari a 11 miliardi di valutazione — JPMorgan firma per l'inferenza
SambaNova, la start-up californiana di chip IA specializzata nell'inferenza (il momento in cui un modello già addestrato serve a rispondere), ha chiuso il 14 luglio un serie F da 1 miliardo di dollari guidato da General Atlantic, con BlackRock, T. Rowe Price, Intel Capital e il fondo sovrano del Qatar. Valutazione: 11 miliardi di dollari, più del doppio di quella del 2021 (5,5 miliardi). Subito dopo, JPMorgan Chase ha annunciato di scegliere SambaNova come partner di inferenza per i suoi chip SN40 e SN50, usati internamente per servire i suoi modelli proprietari. Per una grande banca, è un segnale: far girare i propri modelli strategici sulle proprie macchine inizia a diventare un vantaggio di costo e sovranità. Per l'ecosistema agentico, è la conferma che l'inferenza — ossia il motore quotidiano degli agenti — sta diventando un mercato a sé, distinto da quello dei chip di addestramento.
📡 Da tenere d'occhio
OpenAI lancia GPT-5.6 in tre livelli di prezzo Sol / Terra / Luna — con salvaguardie rafforzate
GPT-5.6 non è un modello unico ma una famiglia a tre livelli: Sol (il più potente per codice e agenti lunghi, 30 $ per milione di token di output), Terra (un compromesso a metà prezzo), Luna (veloce e economico, 6 $ per milione di token). Tutti e tre sono classificati „Alta Capacità" sui rischi cyber e biologici secondo il Preparedness Framework di OpenAI, il che fa scattare salvaguardie rafforzate. L'API introduce anche il tool-calling programmatico e flussi multi-agente. Per un team che costruisce agenti, è il momento di rivedere le ipotesi di costo e sicurezza — soprattutto se fate molte chiamate lunghe in output.
La Cina chiude l'export dei suoi modelli IA avanzati — rischio di «Splinternet» degli ecosistemi
Il ministero cinese dell'Industria avrebbe imposto, a inizio luglio, una revisione di sicurezza obbligatoria per le aziende cinesi che vogliono fornire i loro modelli all'estero — DeepSeek, Qwen (Alibaba), Ernie Bot (Baidu) e Tencent sarebbero coinvolti. È una replica alle restrizioni americane sui chip Nvidia. Per un'azienda europea che si appoggia a modelli open-weight cinesi via Hugging Face o ModelScope, è il segnale di sorvegliare la disponibilità reale: un modello può scomparire dal catalogo pubblico dall'oggi al domani. Testo ufficiale del regolatore da confermare.
Mistral annuncia per luglio un nuovo modello open-weight — rivale diretto dell'ondata GLM-5.2 / Kimi K2.7
Arthur Mensch, il capo di Mistral, ha confermato a inizio luglio che un nuovo modello open-weight sarà disponibile in accesso anticipato nel corso del mese. Vista la pressione di GLM-5.2 e Kimi K2.7, la sfida è mantenere la famiglia francese nella corsa open-weight. Per i costruttori di agenti legati a uno stack sovrano europeo, è un appuntamento da non perdere — anche se, in passato, gli annunci di Mistral sono talvolta scivolati di qualche settimana.
Il Regolamento europeo IA attiva i suoi poteri di applicazione il 2 agosto — ogni fornitore che opera in Europa è coinvolto
Il Regolamento europeo IA, che classifica gli usi dell'IA in base al rischio, attiva il 2 agosto 2026 i suoi principali poteri di applicazione. Per qualsiasi azienda che metta in produzione agenti IA accessibili a utenti europei, ciò significa: documentazione obbligatoria, valutazione dei rischi, trasparenza sui dati di addestramento. Per un costruttore di agenti, è il momento di rileggere i termini generali, le pagine di trasparenza e le clausole di responsabilità — prima che un concorrente o un regolatore lo faccia al posto vostro.
📊 Tendenza
Il 15 luglio 2026, l'ecosistema degli agenti IA vive una giornata di consolidamento più che di svolta: Microsoft unifica i suoi framework e fornisce un harness pronto all'uso, Cognition potenzia Devin con un motore interno a pesi chiusi, Z.ai piazza un modello cinese open-weight in testa alla classifica (ma assetato di elettricità), Mistral rende la robotica agentica accessibile con una sola fotocamera, e SambaNova chiude un round da undici cifre che conferma l'inferenza come mercato a sé. Quattro lezioni emergono per chi costruisce con l'IA: (1) i framework agentici dei grandi editori convergono verso un'offerta «harness + hosting» pronta all'uso — l'argomento «ce lo costruiamo da soli» diventa sempre più difficile da difendere, (2) la prestazione lorda di un agente resta un asso, ma l'accesso ai pesi comincia a chiudersi presso gli attori che prendono in mano lo stack — la corsa alla vetta del benchmark non è più sinonimo di apertura, (3) il modello open-weight dominante del momento è cinese, e la geopolitica comincia a pesare sulla sua distribuzione, (4) l'inferenza — cioè il modo in cui gli agenti girano in produzione — diventa un segmento industriale con attori, valutazioni e grandi clienti corporate propri.