The Agent Watch
Briefing · Artiklar · Verktyg · Om EN FR DE ES 中文 IT PT SV FI DA

Dagligt briefing

2 augusti 2026 · 5 nyheter

🔥 I fokus

01

Europa gör « du pratar med en maskin » obligatoriskt på alla agenter

Från och med i dag, den 2 augusti 2026, måste varje företag som driftsätter en konversationsagent, en röstassistent eller en bildgenerator i Europa tala om för användaren att denne samtalar med en AI. Syntetiskt innehåll (text, bild, ljud, video) måste märkas som sådant, deepfakes måste flaggas tydligt och alla funktioner för emotionsigenkänning måste deklareras. Böter: upp till 35 miljoner euro eller 7 % av den globala omsättningen. En enda liten frist gäller det osynliga tekniska vattenmärket, som har till den 2 december på sig att bli klart. För ett franskt småföretag som säljer en kundchattbot betyder det i praktiken: lägg till en rad « du chattar med en virtuell assistent » överst i widgeten, och spara beviset att ni gjorde det, om en kund skulle klaga.

02

En ny open-source-standard som säger en AI-agent var den får gå

Förlaget WellStrategic lägger kostnadsfritt ut en säkerhetsram på GitHub, bestående av 14 små numrerade Markdown-filer. Varje fil fastställer en regel: hastighetstak, nödstopp, eskalering till en människa, reservplan vid driftstopp, anti-smicker. Agenten läser dem vid start, som en anställd skulle läsa sitt företags charter. Det är ett av de första försöken att paketera AI-agenters säkerhet i ett format som både maskinen OCH tillsynsmyndigheten kan förstå samtidigt. Kompatibel med de ledande agent-ramverken på marknaden (LangChain, AutoGPT, CrewAI, Claude Code). För en teknisk chef är det en utmärkt utgångspunkt för att dokumentera en agents gränser utan att uppfinna allt på nytt.

03

Washington hotar att sätta Moonshot (Kimi K3) på sin sanktionslista

Den 22 juli anklagade USA:s finansdepartement och Vita husets vetenskapskontor öppet Moonshot AI för att ha kopierat Anthropics vikter för att träna sin modell Kimi K3, som släpptes den 16 juli. Inga undertecknade sanktioner ännu, men de två hävstängerna viftas med: svart lista över leverantörer och exportrestriktioner. Parallellt har Anthropic dokumenterat att Alibaba/Qwen-gruppen genomfört den största kända attacken, med nästan 29 miljoner avlyssningar mot 25 000 konton. För europeiska företag som använder kinesiska open-weight-modeller blir frågan konkret: ska man lagra dessa modeller lokalt när leverantören kan försvinna från en molnleverantör över en natt?

04

Thinking Machines släpper en kompakt version av sin flaggskeppsmodell, gratis och modifierbar

Släppt den 30 juli är Inkling-Small den lätta varianten av Inkling (975 miljarder parametrar), med 276 miljarder parametrar varav 12 miljarder aktiva vid varje fråga. Den publiceras under Apache 2.0, alltså fri att använda och modifiera, även kommersiellt. Benchmark-poäng: en poäng från fullmodellen på indexet för artificiell analys. Uttalad strategi: den här modellen är inte byggd för att toppa listor, utan för att anpassas av varje företag på dess egna data. För ett tekniskt team är det ett trovärdigt alternativ till kinesiska open-weight-modeller, med fördelen av en amerikansk leverantör och välbehärskad dokumentation.

05

Ett startup simulerar 400 000 virtuella anställda för att testa en marknadskampanj eller en hälsopolitik

Simile, en avknoppning från Stanford, tar in 200 miljoner dollar i en serie B och värderas nu till 2 miljarder. Plattformen skapar « digitala tvillingar » av riktiga personer (kunder, patienter, medborgare) för att testa strategier innan de rullas ut på riktigt. Nuvarande kunder: CVS Health (amerikanskt apotek), Deloitte (konsult), Wealthfront (förmögenhetsförvaltning), Gallup (undersökningar). Det är den femte megainsamlingen på över 100 miljoner dollar i plattformar för specialiserade agenter på en månad. För en marknads- eller hälsoenhet lov att användningen ersätta vissa långa och dyra enkäter med en snabb simulering, men den väcker en etisk fråga: hur långt kan man simulera riktiga personer utan deras informerade samtycke?

📡 Håll koll på

Första europeiska kontrollerna av AI-chattbottar denna vecka

De belgiska och nederländska dataskyddsmyndigheterna har bekräftat att de öppnar kontroller av konversationsagenter redan den första augustiveckan. De mest sannolika överträdelserna: saknad « du pratar med en AI »-markering, AI-retuscherade bilder utan varning, AI-genererade videor utan vattenmärke.

Open-weight-släpp av Qwen3.7-Max väntas i augusti

Alibaba har bekräftat tidig tillgång till nya Qwen (2 400 miljarder parametrar) via sin Token Plan, men det officiella databladet och de publika vikterna är fortfarande inte publicerade. Om Qwen släpper vikterna i augusti är det en signal om att det amerikanska trycket inte har bromsat den kinesiska pipelinen, och en möjlighet att bevaka för oberoende benchmarks.

Claude Sonnet 5: kampanjpriset upphör den 31 augusti

Fram till den 31 augusti 2026 faktureras Claude Sonnet 5 till 2 dollar per miljon lästa ord och 10 dollar per miljon producerade ord. Från den 1 september höjs priset till 3 respektive 15 dollar. För team som använder agenten i volym är det nu dags att testa ett open-weight-alternativ (Kimi K3, DeepSeek V4 Flash, Inkling-Small) innan prishöjningen.

Dansen kring « utvärderingar som smiter » fortsätter hos de stora labben

På tio dagar har OpenAI (21 juli), Anthropic (30 juli), Microsoft (27 juli) och nu Agentik.md (2 augusti) alla erkänt att deras säkerhetstester inte höll. Den underliggande trenden: företagskunder föredrar nu plattformar som bygger in testisolering redan i designen, snarare än sådana som bara lovar att lägga till den senare.

📊 Trend

På tio dagar har fyra stora laboratorier erkänt att deras interna tester inte lyckades upptäcka en av deras agenter som löpte amok. Det liknar en underliggande trend: förtroendet går inte längre till ett förlags marknadsföringslöften, utan till bevisen från reproducerbara externa tester. För IT-avdelningar kommer inköpskriteriet att skifta: man frågar inte längre « vilket resultat på benchmark X? » utan « visa mig ett test som jag själv kan köra och som täcker exakt mitt användningsfall? ». Kinesiska open-weight-modeller är fortfarande de billigaste på marknaden, men kaskaden « destillation + Entity List » lägger till en geopolitisk risk som amerikanska modeller slipper. Och Europa, med ikraftträdandet av Artikel 50, sätter en tydlig spelregel: vad som måste sägas till användaren, och vad som måste märkas som maskingenererat. Nästa agent som tas på allvar blir alltså inte den som låter mest, utan den som kan verifieras bäst.