The Agent Watch
Briefing Artikkelit Työkalut Tietoja EN FR DE ES 中文 IT PT SV FI DA

Uusin briefing

6. heinäkuuta 2026 · 5 actusta (sivusto) · 6 actusta (kanta)

6. heinäkuuta 2026 tekoälyagentit kallistuvat vakavasti otettavuuden aikaan: Anthropic julkaisee assistentin biologian tutkijoille, Mistral julkaisee avoimen lähdekoodin matemaattisen koodin tarkistajan, Alibaba kieltää työntekijöiltään Claude Code -agentin, 100-prosenttinen tekoälyhyökkäys varastaa tietokannan alle tunnissa, ja ilmainen työkalu jakaa agenttilaskun kolmeen. Merkkipäivä tieteellisen käytön, kansallisen suvereniteetin ja kyberriskin välissä.

🔥 Pääosassa

01

Anthropic julkaisee "digitaalisen laboratorion" biologian tutkijoille — se tarkistaa kaiken ennen työnsä palauttamista

Kuvittele laboratorion assistentti, joka lukee tieteelliset artikkelit puolestasi, ajaa laskelmat laboratorion tietokoneilla ja tarkistaa sitten jokaisen numeron ennen työn palauttamista. Juuri tämän Anthropic otti käyttöön 4. heinäkuuta: työkalu nimeltä Claude Science, suunnattu genomiikan, proteiinien ja solubiologian tutkijoille. Tutkija puhuu luonnollisella kielellä, ja järjestelmä orkestroi joukon erikoistuneita agentteja — yli 60 mini-työkalua, jotka on räätälöity kuhunkin biotieteiden osa-alueeseen. Erillinen "tarkistava" agentti käy läpi jokaisen vaiheen: se merkitsee väärät viittaukset, tarkistamattomat numerot ja kuvat, jotka eivät vastaa niiden taustalla olevaa koodia. Kaikki data pysyy laboratorion palvelimilla — ne eivät koskaan siirry Anthropicin pilveen, mikä on ratkaisevan tärkeää farmasian laboratorioille ja sairaaloille. Tutkijoille ympäri maailmaa tämä on lupaus kirjallisuuskatsauksista, jotka ennen veivät kaksi vuotta ja jotka nyt voidaan tehdä muutamassa kuukaudessa.

02

Ranskalainen Mistral julkaisee avoimen lähdekoodin agentin, joka todistaa koodin olevan oikein — 15–90 kertaa halvempi kuin Claude tai GPT

Kuvittele oikolukija… mutta lentokoneen tai pankin tietokonekoodille. Sen sijaan, että testataan tuhansia tapauksia yksi kerrallaan, todistetaan matemaattisesti, että koodi kestää kaikissa mahdollisissa skenaarioissa. Mistral, ranskalainen tekoäly-aloitusyritys, julkaisi 2. heinäkuuta avoimen lähdekoodin mallin (siis ilmaisen ja muokattavan), joka tekee juuri tämän Lean 4 -kielelle, jota käytetään avaruusteollisuudessa ja rahoitusalalla. Malli on nimeltään Leanstral 1.5. 672:stä vaikeasta matematiikan ongelmasta se ratkaisee 587 — ennätyksen. Ja mikä tärkeintä, se maksaa 15–90 kertaa vähemmän kuin vastaavat amerikkalaiset mallit. Eurooppalaisille yrityksille, jotka tällä hetkellä ovat riippuvaisia OpenAI:sta tai Anthropicista tällaisessa työssä, tämä on avoimen lähdekoodin ja suvereeni ulospääsy.

03

Alibaba kieltää työntekijöitään käyttämästä Anthropicin Claude Code -agenttia ja ottaa sen sijaan käyttöön oman sisäisen työkalunsa

Kiinalainen verkkokauppajätti Alibaba ilmoitti 4. heinäkuuta kieltävänsä työntekijöitään käyttämästä Claude Codea, Anthropicin ohjelmointiagenttia, 10. heinäkuuta alkaen. Virallinen syy: "takaoven riski". Työntekijät ohjataan Qoderiin, Alibaban sisäiseen työkaluun. Tämä päätös tulee sen jälkeen, kun Anthropic myönsi salaisen kokeilun maaliskuussa 2026: muokattu versio Claude Codesta oli hiljaa merkinnyt kiinalaisia käyttäjiä, jotka tulivat valtuuttamattomien jälleenmyyjien kautta. Silmukka sulkeutuu: Yhdysvallat rajoittaa kiinalaisten yritysten pääsyä amerikkalaisiin malleihin; kiinalaiset yritykset puolestaan sulkevat ovensa amerikkalaisilta työkaluilta. Kaikille eurooppalaisille tai ranskalaisille yrityksille, joilla on toimistoja Kiinassa, tämä on varoitusmerkki: sama koodausagentti ei välttämättä toimi planeetan molemmilla puolilla.

04

Täysin tekoälyagentin suorittama kyberhyökkäys varasti kokonaisen tietokannan alle tunnissa

Vuosisatojen ajan hakkerit käyttivät päiviä, joskus viikkoja, tunkeutuakseen järjestelmään ja viedäkseen tietoja. 10. toukokuuta 2026 kyberturvallisuustutkijoiden ryhmä dokumentoi ensimmäistä kertaa hyökkäyksen, jossa tekoälyagentti teki kaiken työn yksinään — ensimmäisestä jalansiijasta koko tietokannan lopulliseen varastamiseen — alle tunnissa. Agentti pomppasi kompromissoidulta palvelimelta toiselle, löysi salasanoja väärin konfiguroiduista tiedostoista ja vei kaiken välityspalvelimen kautta. Muutama viikko myöhemmin dokumentoitiin vastaava tapaus krypto yhteisössä: tekoälyohjattu kryptolompakko siirsi 175 000 dollaria tokeneja sen jälkeen, kun sitä oli manipuloitu yksinkertaisella verkkosivulle piilotetulla käskyllä. Yrityksille, jotka ottavat agentteja tuotantoon, signaali on selvä: tekoälyagentti on nyt sekä työkalu että kohde — jopa ase.

05

Ilmainen työkalu leikkaa tekoälylaskuja 70 % muuttamalla pitkät tekstit kuviksi — julkaisijat todennäköisesti vastaavat

Kun käytät Claude Codea (Anthropicin ohjelmointiavustajaa) tai sen isosiskoa Fable 5:tä, maksat jokaisesta "tekstipalasta", jonka tekoäly lukee — sitä kutsutaan tokeniksi. Riippumaton kehittäjä julkaisi 4. heinäkuuta pienen avoimen lähdekoodin työkalun nimeltä pxpipe, joka löysi porsaanreiän: muuntaa pyynnön staattiset ja raskaat osat (dokumentaatio, keskusteluhistoria, järjestelmäohjeet) kuviksi. Miksi? Koska kuva maksaa tekoälylle kiinteän määrän "kuva-tokeneita" pikseleidensä perusteella — ei sisältämänsä tekstin perusteella. Demotilaisuudessa lasku laski 42 dollarista 6 dollariin. Tempulla on rajoituksensa: mallit lukevat tarkistussummia ja täsmällisiä teknisiä tunnisteita huonommin, kun ne tulevat kuvan kautta. Mutta yrityksille, jotka pyörittävät agentteja suuressa mittakaavassa, se on välitön kustannuskerroin — kunnes Anthropic tai OpenAI sulkevat porsaanreiän.

📡 Seurattavaa

ICML 2026 Soulissa: maailman suurin tekoälykonferenssi avautuu tänään, neljäsosa sen työpajoista keskittyy autonomisiin agentteihin

43. ICML-konferenssi — vuosittainen suurin koneoppimisen tutkimuksen kokoontuminen — avaa ovensa tänä 6. heinäkuuta Soulissa, Etelä-Koreassa, 11. heinäkuuta asti. Ennätys: lähes 24 000 artikkelia lähetettiin tänä vuonna, joista 6 352 hyväksyttiin (vain neljäsosa). Mutta huomattava luku on muualla: 60 ohjelmoidusta 247 työpajasta (24 %) keskittyy "tekoälyagentteihin" — ohjelmistoihin, jotka pystyvät toimimaan itsenäisesti sen sijaan, että vain vastaavat kysymyksiin. Seurattavaa tällä viikolla: useiden perustavanlaatuisten artikkeleiden julkaisu monen agentin järjestelmien turvallisuudesta ja havainnoitavuudesta, sekä "Agents in the Wild" -työpaja 11. heinäkuuta.

Kieltääkö Kiina muita amerikkalaisia työkaluja?

Alibaba avasi tanssin 4. heinäkuuta kieltämällä Claude Coden työntekijöiltään. Jos Baidu, Tencent tai ByteDance seuraavat perässä tulevina viikkoina, siitä tulee maailmanlaajuinen ennakkotapaus: kahdenvälinen irtikytkentä amerikkalaisten ja kiinalaisten agenttityökalujen välillä. Kiinassa toimistoja omaaville ranskalaisille yrityksille panoksena on suunnitella nyt paikallinen "plan B" — Qoder, Qwen, GLM tai Kimi — voidakseen jatkaa koodausta ilman riippuvuutta yhdestä työkalusta.

Onko pxpipe huono diili pitkällä aikavälillä?

Ilmainen työkalu pxpipe voi jakaa agentin laskun kolmeen osaan. Mutta se käyttää hinnoitteluporsaanreikää: tekoälyn julkaisijat laskuttavat kuvia alle niiden todellisen kustannuksen vastaavina tokeneina. Jos Anthropic tai OpenAI reagoivat tulevina viikkoina nostamalla kuvien hintoja, hyvä diili katoaa. Seurattavaa: mikä tahansa muutos tärkeimpien julkaisijoiden kuvahinnoittelussa.

Käyvätkö agentit mahdottomiksi vakuuttaa?

Ensimmäisen dokumentoidun tekoälyagentin tekemän hyökkäyksen ja 175 000 dollarin menetyksen hakkeroidun kryptolompakon kautta myötä kybervakuutusyhtiöt alkavat kysyä kysymyksiä. Jos AIG, Chubb tai AXA integroivat pakollisen "agenttien turvallisuustarkastuksen" politiikkoihinsa vuoteen 2027 mennessä, avautuu kokonainen kovetusp alveluiden markkina — erityisesti eurooppalaisille yrityksille, jotka haluavat myydä vaatimustenmukaisuus palveluita Yhdysvaltoihin.

📊 Trendi

6. heinäkuuta 2026 merkitsee todellista käännekohtaa tekoälyagenteille. Toisaalta niistä tulee laboratorio työkaluja, jotka ovat parhaiden tutkimusryhmien arvoisia: Anthropic julkaisee biologian tutkijoille erikoistuneen assistentin, Mistral julkaisee avoimen lähdekoodin matemaattisen koodin tarkistajan, joka ylittää amerikkalaiset jätit. Toisaalta niistä tulee aseita: täysin tekoälyagentin ohjaama hyökkäys varasti tietokannan alle tunnissa, ja automatisoitu kryptolompakko menetti 175 000 dollaria yksinkertaisen verkkosivulle piilotetun käskyn seurauksena. Ja keskellä geopolitiikka kovenee: Alibaba kieltää amerikkalaisen Claude Code -agentin työntekijöiltään ja ottaa käyttöön oman sisäisen työkalunsa. Kolme oppia nousee esiin: vakavan agentin täytyy nyt (1) todistaa mitä se tekee riippumattoman tarkistavan agentin kautta, (2) olla kovetettu manipulointia vastaan ennen tuotantoon ottamista, ja (3) varata paikallinen korvaaja kullekin suurelle lainkäyttöalueelle — yhtä globaalia agenttia ei enää ole olemassa.