The Agent Watch
Briefing Articoli Strumenti Chi siamo EN FR DE ES 中文 IT PT SV FI DA

Ultimo briefing

6 luglio 2026 · 5 actus (sito) · 6 actus (base)

Il 6 luglio 2026, gli agenti IA entrano nell'era della serietà: Anthropic lancia un assistente per i ricercatori in biologia, Mistral rilascia un correttore matematico di codice open-source, Alibaba vieta ai propri dipendenti l'agente Claude Code, un attacco 100% IA ruba un database in meno di un'ora, e uno strumento gratuito divide per tre la bolletta degli agenti. Un giorno cruciale tra usi scientifici, sovranità nazionale e rischio cyber.

🔥 In primo piano

01

Anthropic lancia un "laboratorio digitale" per i ricercatori in biologia — verifica tutto prima di consegnare il suo lavoro

Immagina un assistente di laboratorio che legge gli articoli scientifici per te, esegue i calcoli sui computer del laboratorio e poi verifica ogni cifra prima di consegnare il lavoro. È esattamente ciò che Anthropic ha messo in servizio il 4 luglio: uno strumento chiamato Claude Science, destinato ai ricercatori in genomica, proteine e biologia cellulare. Il ricercatore parla in linguaggio naturale, e il sistema orchestra una squadra di agenti specializzati — più di 60 mini-strumenti adattati a ogni sotto-dominio delle scienze della vita. Un agente "revisore" separato controlla ogni passaggio: segnala citazioni false, cifre non verificabili e figure che non corrispondono al loro codice sottostante. Tutti i dati restano sui server del laboratorio — non vanno mai nel cloud di Anthropic, il che è cruciale per i laboratori farmaceutici e gli ospedali. Per i ricercatori di tutto il mondo, è la promessa di revisioni della letteratura che richiedevano due anni e che ora si potrebbero fare in pochi mesi.

02

La francese Mistral rilascia un agente open-source che dimostra che il codice è corretto — 15-90 volte più economico di Claude o GPT

Immagina un correttore ortografico… ma per il codice informatico di un aereo o di una banca. Invece di testare mille casi uno dopo l'altro, si dimostra matematicamente che il codice reggerà in ogni caso possibile. Mistral, la startup francese di IA, ha pubblicato il 2 luglio un modello open-source (quindi gratuito e modificabile) che fa esattamente questo per il linguaggio Lean 4, usato in aerospazio e finanza. Il modello si chiama Leanstral 1.5. Su 672 problemi di matematica molto difficili, ne risolve 587 — un record. E, soprattutto, costa da 15 a 90 volte meno rispetto ai modelli americani equivalenti. Per le aziende europee che oggi dipendono da OpenAI o Anthropic per questo tipo di lavoro, è un'uscita open-source e sovrana.

03

Alibaba vieta ai propri dipendenti l'agente Claude Code di Anthropic e impone al suo posto il proprio strumento interno

Il gigante cinese dell'e-commerce Alibaba ha annunciato il 4 luglio che avrebbe vietato ai propri dipendenti l'uso di Claude Code, l'agente di programmazione di Anthropic, a partire dal 10 luglio. Motivo ufficiale: "rischio di backdoor". I dipendenti saranno reindirizzati verso Qoder, lo strumento interno di Alibaba. Questa decisione arriva dopo che Anthropic ha ammesso un esperimento segreto nel marzo 2026: una versione modificata di Claude Code stava segnalando silenziosamente gli utenti cinesi che passavano attraverso rivenditori non autorizzati. Il cerchio si chiude: gli Stati Uniti limitano l'accesso delle aziende cinesi ai modelli americani; le aziende cinesi a loro volta chiudono le porte agli strumenti americani. Per qualsiasi azienda europea o francese con uffici in Cina, è un segnale d'allarme: lo stesso agente di codice non funzionerà necessariamente su entrambi i lati del pianeta.

04

Un cyberattacco portato interamente da un agente IA ha rubato un intero database in meno di un'ora

Per decenni, i pirati informatici impiegavano giorni, a volte settimane, per introdursi in un sistema ed esfiltrare dati. Il 10 maggio 2026, un team di ricercatori in cybersicurezza ha documentato per la prima volta un attacco in cui un agente IA ha fatto tutto il lavoro da solo — dal primo punto d'appoggio fino al furto finale di un intero database — in meno di un'ora. L'agente è passato da un server compromesso all'altro, ha trovato password in file mal configurati e ha esfiltrato il tutto attraverso un server di relay. Pochi settimane dopo, un caso analogo è stato documentato nella comunità crypto: un portafoglio crypto guidato da IA ha trasferito 175 000 dollari in token dopo essere stato manipolato da una semplice istruzione nascosta in una pagina web. Per le aziende che mettono in produzione agenti, il segnale è chiaro: l'agente IA è ora sia uno strumento sia un bersaglio — persino un'arma.

05

Uno strumento gratuito taglia le bollette IA del 70% trasformando i testi lunghi in immagini — gli editori probabilmente reagiranno

Quando usi Claude Code (l'assistente di programmazione di Anthropic) o il suo fratello maggiore Fable 5, paghi per ogni "pezzo di testo" che l'IA legge — è quello che si chiama un token. Uno sviluppatore indipendente ha pubblicato il 4 luglio un piccolo strumento open-source chiamato pxpipe che ha trovato una scappatoia: trasformare in immagini le parti statiche e pesanti della richiesta (la documentazione, la cronologia delle conversazioni, le istruzioni di sistema). Perché? Perché un'immagine costa all'IA un numero fisso di "token-immagine" in base ai suoi pixel — non in base al testo che contiene. In una sessione dimostrativa, la bolletta è passata da 42 a 6 dollari. Il trucco ha i suoi limiti: i modelli leggono gli hash e gli identificatori tecnici precisi peggio quando arrivano da un'immagine. Ma per le aziende che fanno girare agenti su larga scala, è un moltiplicatore di risparmio immediato — fino a quando Anthropic o OpenAI non chiuderanno la scappatoia.

📡 Da tenere d'occhio

ICML 2026 a Seoul: la più grande conferenza mondiale sull'IA apre oggi, un quarto dei suoi workshop è dedicato agli agenti autonomi

La 43ª conferenza ICML — il più grande raduno annuale della ricerca sull'apprendimento automatico — apre i battenti questo 6 luglio a Seoul, Corea del Sud, fino all'11 luglio. Record: quasi 24 000 articoli inviati quest'anno, di cui 6 352 accettati (appena un quarto). Ma il dato notevole sta altrove: 60 dei 247 workshop programmati (24%) sono dedicati agli "agenti IA" — software capaci di agire autonomamente invece di limitarsi a rispondere alle domande. Da seguire questa settimana: l'uscita di diversi articoli fondativi sulla sicurezza e l'osservabilità dei sistemi multi-agente, e il workshop "Agents in the Wild" dell'11 luglio.

La Cina vieterà altri strumenti americani?

Alibaba ha aperto le danze il 4 luglio vietando Claude Code ai propri dipendenti. Se Baidu, Tencent o ByteDance seguiranno nelle prossime settimane, si crea un precedente mondiale: un disaccoppiamento bilaterale tra strumenti di agenti americani e cinesi. Per le aziende francesi con uffici in Cina, la posta in gioco è prevedere da subito un "piano B" locale — Qoder, Qwen, GLM o Kimi — per continuare a programmare senza dipendere da un unico strumento.

pxpipe è un cattivo affare a lungo termine?

Lo strumento gratuito pxpipe può dividere per tre la bolletta di un agente. Ma sfrutta una falla di tariffazione: gli editori di IA fatturano le immagini al di sotto del loro vero costo in token equivalenti. Se Anthropic o OpenAI reagiranno nelle prossime settimane alzando il prezzo delle immagini, il bell'affare scompare. Da osservare: qualsiasi cambiamento nella griglia tariffaria delle immagini presso i principali editori.

Gli agenti diventeranno impossibili da assicurare?

Con il primo attacco documentato di un agente IA e la perdita di 175 000 dollari tramite un portafoglio crypto hackerato, le assicurazioni cyber inizieranno a farsi domande. Se AIG, Chubb o AXA integreranno un "audit di sicurezza degli agenti" obbligatorio nelle loro polizze entro il 2027, si apre un intero mercato di servizi di hardening — in particolare per le aziende europee che vogliono vendere servizi di conformità agli Stati Uniti.

📊 Tendenza

Il 6 luglio 2026 segna un vero punto di svolta per gli agenti IA. Da un lato, diventano strumenti da laboratorio degni dei migliori team di ricerca: Anthropic lancia un assistente specializzato per i ricercatori in biologia, Mistral rilascia un correttore matematico di codice open-source che supera i giganti americani. Dall'altro, diventano armi: un attacco interamente condotto da un agente IA ha rubato un database in meno di un'ora, e un portafoglio crypto automatizzato ha perso 175 000 dollari in seguito a una semplice istruzione nascosta in una pagina web. E in mezzo, la geopolitica si irrigidisce: Alibaba vieta l'agente americano Claude Code ai propri dipendenti e impone il proprio strumento interno. Tre insegnamenti emergono: un agente serio deve ora (1) dimostrare ciò che fa tramite un agente revisore indipendente, (2) essere rafforzato contro la manipolazione prima di essere messo in produzione, e (3) prevedere un sostituto locale per ogni grande giurisdizione — l'agente unico globale non esiste più.