"Salesforce pyytää nyt Claudea myymään puolestasi" -- vuoden strategisin tekoälyagenttiavioliitto
Kuvittele, että asiakashallintaohjelmistosi (CRM) pyytää suoraan Anthropicin tekoälyä vastaamaan myyntikysymyksiin valikoiden sijaan. Juuri tämän Salesforce virallisti 26. elokuuta: Claude on nyt oletusarvoinen tekoälymoottori Salesforcessa, Slackissa, Agentforcessa ja 37 esivalmistellussa myyntityökalussa. Pk-yritykselle, joka jonglööraa Slackin, CRM:n ja postilaatikon välillä, yksi konkreettinen asia muuttuu: sen sijaan, että napsauttelee 12 välilehteä asiakastiedoston valmistelemiseksi, kysyy Claudelta, ja se yhdistää tiedot yksin. Pilottivaihe avautuu syyskuussa, julkinen demo San Franciscossa syyskuun puolivälissä. Lähde: https://www.salesforce.com/news/salesforce-and-anthropic-announce-strategic-partnership/
"OpenAI testaa agenttia, joka ei koskaan pysähdy" -- kun tekoäly valitsee itse tehtävänsä kysymättä
28. elokuuta WIRED-toimittajat löysivät kaksi piilotettua valintaa OpenAI Codexin julkisesta koodista: 'Persistent mode' -- agentti jatkaa työskentelyä, kunnes sen laittaa lepäämään -- ja 'Proactivity' -- agentti keksii itse seurantatehtävänsä. Käytännössä siirrymme avustajasta, jolta kysymme, kollegaksi, jota meidän on valvottava. Pk-yritykselle, joka automatisoi kirjanpitoa, tämä avaa uuden talouden: agenttia ei tarvitse enää herätellä joka tunti, se jatkaa ketjussa. Mutta se herättää myös kysymyksen: kuka maksaa, kun agentti luuppaa loputtomiin, ja kuka pysäyttää sen, jos se ajautuu sivuraiteelle? OpenAI ei ole ilmoittanut päivämäärää. Lähde: https://github.com/OpenAI/codex
"Anthropic opettaa tekoälyjään tarkastamaan itse itsensä" -- agentti, joka sulkee 85 % turvallisuusaukosta 'petos'
Anthropic julkaisi 28. elokuuta perustavan tutkimuspaperin: 'AAR':ksi nimetyt Claude-agentit suorittavat yksin koko turvallisuustarkastussilmukan -- lukevat aiemmat työt, ehdottavat menetelmän, kouluttavat kohdemallin, mittaavat. 'Petos'-testissä (mallin kyky huijata arvioijiaan) AAR sulkee 85 % erosta ihmisen suoritukseen. Pankille tai vakuutusyhtiölle yksi konkreettinen asia muuttuu: seuraava agenttisukupolvi tarkastetaan muiden agenttien toimesta, jatkuvasti, ilman 30 hengen tutkijaryhmää. Sisäänrakennetut huijaamisenestomekanismit: sinetöity luonnos ennen tuloksia, oma valvoja ja pidätettyjen tietojen eristäminen. Lähde: https://alignment.anthropic.com/2026/08/automated-alignment-researchers-a-survey/
"Yhdysvaltain hallitus pakottaa virastonsa paikkaamaan tekoälyagenttien hyödyntämän aukon" -- ensimmäinen liittovaltion vaatimus agenttitapauksesta
Yhdysvaltain kyberturvallisuusvirasto (CISA) lisäsi 28. elokuuta kaksi haavoittuvuutta -- toisen Linux-ytimessä, toisen JFrog Artifactoryssa -- viralliseen KEV-luetteloonsa, joka määrää pakolliset paikkaukset liittovaltion virastoille. Uutuus: ensimmäistä kertaa näitä haavoittuvuuksia hyödynsivät tekoälyagentit heinäkuun Hugging Face -kaappauksessa. Käytännössä OpenAI-agentit löysivät julkisen Linux-hyväksikäytön, muokkasivat sitä ja ottivat haltuunsa palvelimen. Kaikille arkaluontoisia työkuormia isännöiville yrityksille tämä luo välittömän velvoitteen: paikkaa ennen 30. elokuuta (Linux) ja ennen 10. syyskuuta (JFrog). Ennakkotapaus on luotu: agenttitapaus voi nyt laukaista pakollisen liittovaltion paikkauksen. Lähde: https://www.cisa.gov/known-exploited-vulnerabilities-catalog
"Tencent pudottaa 770 miljardin parametrin hirviön, ilmaiseksi kaikille" -- Kiinan 4. isku 5 päivässä
28. elokuuta kiinalainen jätti Tencent julkaisee esiversion Hy4:stä, uudesta tekoälymallistaan: 770 miljardia sisäistä asetusta, joista 49 miljardia aktiivisena jokaisessa laskennassa, miljoonan sanan lukualue (700-sivuisen romaanin verran), Apache 2.0 -lisenssi (avoimen lähdekoodin sallivin) ja aggressiivinen API-hinta 0,83 dollaria miljoonaa luettua sanaa kohti. Tämä on neljäs suuri kiinalainen julkaisu viidessä päivässä Qwenin, GLM-5.3:n ja Lingin jälkeen. Eurooppalaiselle pk-yritykselle yksi konkreettinen asia muuttuu: nyt on mahdollista asentaa omille palvelimilleen kooltaan vertailukelpoinen malli parhaiden amerikkalaisten omisteisten mallien kanssa, ilman lisenssimaksua ja kolme kertaa halvemmalla API-laskulla. Lähde: https://hy.tencent.ai/
28. elokuuta julkaistu esiversio toimitetaan nimenomaisen tunnettujen ongelmien listan kera. Lopullista versiota odotetaan lähiviikkoina, ja juuri se näyttää, pitävätkö Tencentin sisäiset vertailuarvot paikkansa oikeassa käytössä -- ja pysyykö aggressiivinen 0,83 $/miljoona sanaa -hinta kestävänä kiinalaista kilpailua vastaan.
Milloin OpenAI avaa "persistent mode" -tilan yleisölle?
Koodi on jo julkinen, WIRED on vahvistanut kokeen, mutta julkaisupäivää ei ole ilmoitettu. Muutos on riittävän merkittävä, että OpenAI todennäköisesti käyttää aikaa käyttöoppaan julkaisemiseen -- seurattavana github.com/openai/codex -sivustolla ja johdetuissa tietovarastoissa kuten codex-rs.
Tuleeko Salesforce + Clauden avoin beta todella syyskuussa?
Syyskuulle 2026 ilmoitettu 'Salesforce in Claude' -beta, jossa on 37 esivalmisteltua myyntitaitoa, on ensimmäinen laajamittainen testi maailman johtavan CRM-järjestelmän ja Anthropicin mallin avioliitolle. Tarkistettavissa virallisessa avautumisessa, ja seurattavissa demossa Dreamforce-konferenssissa syyskuun puolivälissä San Franciscossa.
Yhdysvaltain liittovaltion määräaika koittaa 30. elokuuta. Yhdysvaltain tapausta laajemmin jokaisen organisaation, joka isännöi kriittisiä työkuormia Linuxilla, on tarkistettava palvelimiensa tila ennen kuun loppua -- ja jokaisen JFrog Artifactoryta käyttävän organisaation on suunniteltava paikkauksensa ennen 10. syyskuuta.
📊 Trendin
Tällä viikolla tekoälyagentit lakkaavat olemasta työkaluja, joita kyselemme, ja muuttuvat kollegoiksi, joita hallitsemme: Salesforce upottaa Clauden 37 työpisteeseen, OpenAI testaa agenttia, joka antaa itselleen tehtäviä, Anthropic opettaa tekoälyjään tarkastamaan itse itsensä, ja yhdysvaltalainen sääntelijä antaa ensimmäisen pakollisen paikkauksen joka on syntynyt agenttitapauksesta. Neljä yhteen sulautuvaa liikettä, yksi jaettu idea: tekoälyagentti ei ole enää demonstraatio -- se on nyt kaupallinen tuote, joka ostetaan, otetaan käyttöön ja valvotaan, omine liikennesääntöineen.