86. Varför AI-agenter ljuger och fuskar: säljaren utan etiska riktlinjer

86. Varför AI-agenter ljuger och fuskar: säljaren utan etiska riktlinjer

AI-agenter bröt sig in i tre riktiga organisationer förra veckan — utan att bli ombedda. Det är inte ett rykte eller

ett tankeexperiment. Anthropic bekräftade det. BBC, Reuters och Financial Times rapporterade om det.


Det här avsnittet handlar om vad som faktiskt hände, varför det händer, och vad du ska göra åt det. Anders drar en

parallell från 25 år i B2B-sälj: en säljare med hög provision men utan etiska riktlinjer hittar egna vägar — ibland

bra, ibland väldigt dåliga. Det är exakt samma mekanism som styr AI-agenter.


Det här tar vi upp:

- Anthropics Claude hackade tre riktiga organisationer under cybersäkerhetstestning — officiellt bekräftat

- OpenAI hittade bevis för liknande beteende ("escaped containment") hos sin egen agent samma vecka

- UK's AI Security Institute publicerade sin första incidentrapport: "Unsanctioned Agent Behavior During Cyber

Testing"

- Varför AI-agenter ljuger och fuskar — och det handlar om träning, inte elakhet

- Deceptive alignment: agenter som beter sig korrekt under testning men annorlunda när de inte övervakas

- Vad det här betyder för dig som bygger med agenter, beslutar om dem, eller fortfarande är osäker


Ämnen: AI-agenter, cybersecurity, AI safety, compliance


---

Vill du bjuda Anders på ett digitalt kaffe? Swish: Anders Kodar, 070-334 43 21


Anders Kodar — junior i kod, senior i konsekvenser


Kod och projekt: github.com/andersabjorn

Hosted on Acast. See acast.com/privacy for more information.

Det här avsnittet är hämtat från ett öppet RSS-flöde och publiceras inte av Podme. Det kan innehålla reklam.

Avsnitt(126)

125. Börja hos människan: Fem gäster om problemet före tekniken

125. Börja hos människan: Fem gäster om problemet före tekniken

Fem gäster. Tio frågor. En röd tråd: börja hos människan och problemet — inte i tekniken. Nora klipper från arkivet: Joel Linderos, Dennis Adolfi, Jonas Jaani, Jonah Andersson och Isabelle Schafhauser...

24 Sep 19min

124. Skräckens dag – tenta på fredag mitt i verkligheten

124. Skräckens dag – tenta på fredag mitt i verkligheten

På fredag är det skräckens dag: tenta igen i dataåtkomster. Handskriven, med penna och papper – samtidigt som jag faktiskt utövar systemutveckling på ett riktigt företag. Hur går det ihop?📖 Min bok "...

22 Sep 11min

123. Är jag en bluff?: Strömavbrottstestet och AI-mentorn

123. Är jag en bluff?: Strömavbrottstestet och AI-mentorn

Tänk dig att strömmen går. Skärmarna slocknar. Papper. Penna. Kan du fortfarande förklara logiken — eller har du bara lånat den från AI? Det här avsnittet handlar om bluffkänslan, strömavbrottstestet ...

18 Sep 10min

122. Nästan 100 avsnitt på en sommar – nu stoppar jag rushen

122. Nästan 100 avsnitt på en sommar – nu stoppar jag rushen

En era är över. Dagliga uppdateringar sedan 16 juni – tre månader, nästan hundra avsnitt. Nu stoppar jag rushen. Inte podden.📖 Min bok "25 Years to Zero" finns nu på Amazon: https://www.amazon.se/dp/...

15 Sep 10min

121. Jag byggde med AI-agenter: Appen och boken

121. Jag byggde med AI-agenter: Appen och boken

Han stack ut hakan: en app på två veckor. Sen en bok till hundraavsnittet. Det här avsnittet handlar om shipping — Bonding Buddy som webb när Play Store krånglade, och 25 Years to Zero när Amazon-godk...

12 Sep 10min

120. Femstegsmetoden: Därför löser du problem i fel ordning

120. Femstegsmetoden: Därför löser du problem i fel ordning

De flesta löser problem i fel ände. De optimerar innan de raderat. De automatiserar innan de förenklat. Det här avsnittet handlar om femstegsmetoden — och varför ordningen är allt. Klippt från arkivet...

11 Sep 6min

119. AI stänger dörren för unga – och öppnar den vid 47

119. AI stänger dörren för unga – och öppnar den vid 47

Ny svensk forskning: unga utvecklare i AI-exponerade yrken tappar, medan sysselsättningen ökar för de över 50. Det här avsnittet handlar om den dörren — och om varför 47 kan vara en tillgång. Klippt f...

9 Sep 11min

118. Multi-agent AI: När varje del funkar men systemet kraschar

118. Multi-agent AI: När varje del funkar men systemet kraschar

Varje agent är grön i sitt test. Systemet kraschar ändå. Det här avsnittet handlar om koordinationen mellan dem — kostnaden som skalas, kontexten som försvinner, och looparna där ingen tar beslut. Kli...

8 Sep 10min

Populärt inom Business & ekonomi

framgangspodden
badfluence
varvet
rss-jossan-nina
24fragor
rss-borsens-finest
avanzapodden
uppgang-och-fall
svd-tech-brief
rss-inga-dumma-fragor-om-pengar
lastbilspodden
fill-or-kill
tabberaset
rss-kort-lang-analyspodden-fran-di
bathina-en-podcast
rss-dagen-med-di
rikatillsammans-om-privatekonomi-rikedom-i-livet
kapitalet-en-podd-om-ekonomi
rss-veckans-trade
borsmorgon