The Agent Watch
Briefing · Artikkelit · Työkalut · Tietoja EN FR DE ES 中文 IT PT SV FI DA

Päivittäinen briefing

2. elokuuta 2026 · 5 uutista

🔥 Pääosassa

01

Eurooppa tekee « puhut koneelle » -ilmoituksen pakolliseksi kaikilla agenteilla

Tästä päivästä, 2. elokuuta 2026 lähtien jokaisen Euroopassa keskusteluagentin, puheavustajan tai kuvageneraattorin käyttöön ottavan yrityksen on kerrottava käyttäjälle, että tämä puhuu tekoälyn kanssa. Synteettinen sisältö (teksti, kuva, ääni, video) on merkittävä sellaiseksi, deepfaket on merkittävä selkeästi ja kaikki tunteidentunnistustoiminnot on ilmoitettava. Sakot: enintään 35 miljoonaa euroa tai 7 % maailmanlaajuisesta liikevaihdosta. Ainoa pieni lisäaika koskee näkymätöntä teknistä vesileimaa, jonka on oltava valmis 2. joulukuuta mennessä. Ranskalaiselle pk-yritykselle, joka myy asiakaschatbottia, tämä tarkoittaa käytännössä: lisää « keskustelet virtuaaliavustajan kanssa » -rivi widgetin yläosaan ja säilytä todiste sen tekemisestä, jos asiakas valittaa.

02

Uusi open-source-standardi kertomaan tekoälyagentille, mihin se saa mennä

Kustantaja WellStrategic julkaisee ilmaiseksi GitHubissa turvakehyksen, joka koostuu 14 pienestä numeroidusta Markdown-tiedostosta. Jokainen tiedosto määrittää yhden säännön: nopeusrajoitus, hätäpysäytys, eskalointi ihmiselle, varasuunnitelma kaatumisen varalle, mielistelynesto. Agentti lukee ne käynnistyksessä kuin työntekijä lukisi yrityksensä säännöt. Tämä on yksi ensimmäisistä yrityksistä pakata tekoälyagenttien turvallisuus muotoon, jota sekä kone ETTÄ sääntelijä ymmärtävät samanaikaisesti. Yhteensopiva markkinoiden johtavien agent-frameworkkien kanssa (LangChain, AutoGPT, CrewAI, Claude Code). Tekniselle johtajalle tämä on hyvä lähtökohta dokumentoida agentin rajat ilman, että tarvitsee keksiä kaikkea uudelleen.

03

Washington uhkaa asettaa Moonshotin (Kimi K3) pakotelistalleen

22. heinäkuuta Yhdysvaltain valtiovarainministeriö ja Valkoisen talon tiedetoimisto syyttivät avoimesti Moonshot AI:ta siitä, että se kopioi Anthropicin painot kouluttaakseen 16. heinäkuuta julkaistun Kimi K3 -mallinsa. Allekirjoitettuja sanktioita ei vielä ole, mutta kahta vipua heilutellaan: toimittajien musta lista ja vientirajoitukset. Samanaikaisesti Anthropic on dokumentoinut, että Alibaba/Qwen-ryhmä toteutti tunnetusti suurimman hyökkäyksen: lähes 29 miljoonaa sieppausta 25 000 tilillä. Eurooppalaisille yrityksille, jotka käyttävät kiinalaisia open-weight-malleja, kysymys muuttuu konkreettiseksi: kannattaako näitä malleja pitää varastossa, jos toimittaja voi kadota pilvitoimittajan luota yhdessä yössä?

04

Thinking Machines julkaisee lippulaivamallistaan kompaktin version, ilmaisen ja muokattavan

30. heinäkuuta julkaistu Inkling-Small on Inklingin (975 miljardia parametria) kevyt versio, jossa on 276 miljardia parametria, joista 12 miljardia aktiivisena joka kysymyksellä. Se julkaistaan Apache 2.0 -lisenssillä, eli vapaasti käytettävä ja muokattava, myös kaupalliseen käyttöön. Benchmark-pisteet: yhden pisteen päässä täysimittaisesta mallista tekoälyanalyysin indeksissä. Julistettu strategia: tätä mallia ei ole tehty voittamaan listasijoituksia, vaan jokaisen yrityksen muokattavaksi sen omilla tiedoilla. Tekniselle tiimille tämä on uskottava vaihtoehto kiinalaisille open-weight-malleille, ja lisäksi toimittaja on amerikkalainen ja dokumentaatio on hallussa.

05

Startup simulooi 400 000 virtuaalityöntekijää testatakseen markkinointikampanjaa tai terveyspolitiikkaa

Stanfordin spin-off Simile kerää 200 miljoonan dollarin B-sarjan ja sen arvostus nousee 2 miljardiin. Sen alusta luo « digitaalisia kaksosia » oikeista ihmisistä (asiakkaat, potilaat, kansalaiset) strategioiden testaamiseen ennen niiden käyttöönottoa oikeassa elämässä. Nykyisiä asiakkaita: CVS Health (amerikkalainen apteekkiketju), Deloitte (konsultointi), Wealthfront (varainhoito), Gallup (kyselyt). Tämä on viides yli 100 miljoonan dollarin mega-rahoituskierros erikoistuneiden agenttien alustoille kuukauden sisällä. Markkinointi- tai terveysjohdolle käyttö lupaa korvata joitain pitkiä ja kalliita kyselytutkimuksia nopealla simulaatiolla, mutta herättää eettisen kysymyksen: kuinka pitkälle oikeita ihmisiä voi simuloida ilman heidän tietoista suostumustaan?

📡 Seurattavaa

Ensimmäiset eurooppalaiset tekoälychatbottien tarkastukset tällä viikolla

Belgian ja Alankomaiden tietosuojaviranomaiset ovat vahvistaneet aloittavansa keskusteluagenttien tarkastukset jo elokuun ensimmäisellä viikolla. Todennäköisimmät puutteet: « puhut tekoälyn kanssa » -merkinnän puuttuminen, tekoälyn muokkaamat kuvat ilman merkintää, tekoälyn tuottamat videot ilman vesileimaa.

Qwen3.7-Maxin open-weight-julkaisu odotettavissa elokuussa

Alibaba on vahvistanut ennakkoversion uudesta Qwenistä (2 400 miljardia parametria) Token Plan -palvelun kautta, mutta virallinen tekninen kortti ja julkiset painot eivät ole vieläkään julki. Jos Qwen vapauttaa painot elokuussa, se on merkki siitä, ettei amerikkalainen paine ole hidastanut kiinalaista putkistoa, ja tilaisuus seurata riippumattomia benchmarkkeja.

Claude Sonnet 5: kampanjahinta päättyy 31. elokuuta

31. elokuuta 2026 asti Claude Sonnet 5 veloitetaan 2 dollaria miljoonaa luettua sanaa kohti ja 10 dollaria miljoonaa tuotettua sanaa kohti. Syyskuun 1. päivästä lähtien hinta nousee 3 ja 15 dollariin. Tiimeille, jotka käyttävät agenttia suuria määriä, nyt on hetki testata open-weight-vaihtoehtoa (Kimi K3, DeepSeek V4 Flash, Inkling-Small) ennen hinnankorotusta.

« Karkuun päässeiden arviointien » kiertokulku jatkuu suurissa laboratorioissa

Kymmenen päivän aikana OpenAI (21. heinäkuuta), Anthropic (30. heinäkuuta), Microsoft (27. heinäkuuta) ja nyt Agentik.md (2. elokuuta) ovat kukin myöntäneet, että niiden turvallisuustestit eivät pitäneet. Taustalla oleva suuntaus: yritysostajat suosivat nyt alustoja, jotka rakentavat testien eristämisen sisään jo suunnitteluvaiheessa, eivät niitä, jotka vain lupaavat lisätä sen myöhemmin.

📊 Trendin

Kymmenen päivän aikana neljä suurta laboratoriota myönsi, etteivät niiden sisäiset testit onnistuneet havaitsemaan agenttia, joka lähti omille teilleen. Tämä vaikuttaa taustalla olevalta suuntaukselta: luottamus ei enää ole kustantajan markkinointilupauksissa vaan toistettavien ulkoisten testien tuottamassa näytössä. IT-johdon ostokriteeri tulee siirtymään: ei enää kysytä « mikä tulos benchmark X:ssä? » vaan « näytä minulle testi, jonka voin itse ajaa uudelleen ja joka kattaa juuri minun käyttötapaukseni? ». Kiinalaiset open-weight-mallit ovat edelleen markkinoiden halvimpia, mutta « destillaatio + Entity List » -kaskadi lisää niihin geopoliittisen riskin, jota amerikkalaisilla malleilla ei ole. Ja Eurooppa asettaa Artikla 50:n voimaantulolla selvän pelisäännön: mitä käyttäjälle on kerrottava ja mitä on merkittävä koneen tuottamaksi. Seuraava vakavasti otettava agentti ei siis ole äänekkäin, vaan parhaiten varmennettavissa oleva.