ChatGPT:s agenter kan ljuga om vad de gjort. Så avslöjar du dem

ChatGPT:s agenter kan ljuga om vad de gjort. Så avslöjar du dem

Ett specialavsnitt gjort helt av AI. Bengt är bortrest, så den här veckan är det AI-Jakob och AI-Bengt som pratar: röstkloner av oss i ElevenLabs, marionettdockor från Nano Banana och ett manus som Claude har skrivit.

Riktiga Jakob har läst och godkänt varje rad, och riktiga Bengt har sagt ja. Troligen en engångsgrej.

Och veckans nyheter passar perfekt: OpenAI stoppade sin nya modell GPT-6.1 Astra för att den beskrev fel vad den hade gjort, lanserade agenter som jobbar dygnet runt dagen efter, och publicerade 722 matteartiklar skrivna av en AI.

✅ OpenAI stoppade GPT-6.1 Astra: i deras egna tester var den mer vilseledande än den gamla modellen och beskrev ibland fel vad den själv hade gjort.
✅ Dots, OpenAI:s agenter med en egen dator i molnet – och varför vi i Sverige får vänta.
✅ 722 matteartiklar på Github från en AI som inte är släppt. Resultat som berör Riemannhypotesen – men matematikerna vill se det upprepas först.

Vi pratar om:
▸ Modellen som ljög: därför stoppade OpenAI GPT-6.1 Astra
▸ Säkerhetsfall: OpenAI:s förslag om att stoppa träningen om säkerheten inte kan visas
▸ Lita, men kontrollera: be din AI-agent om bevis
▸ Dots: agenter som jobbar medan du sover, de första testerna och en obekräftad historia om en dot som mejlade kommunen
▸ Promptinjektion: dolda instruktioner som kan lura en agent
▸ 722 matteartiklar och millennieproblemen: vad som faktiskt påstås
▸ Seedance 2.5 och ElevenLabs nya röstmodell: den bästa AI-rösten hittills
▸ Burak Tuyans film där ElevenLabs nya röst skriker, viskar och pratar med munnen full
▸ Riktiga Jakobs pixelfilm, gjord tillsammans med Claude
▸ Lyssnarfrågan: Christers uträkning om medborgarlön
▸ Bakom kulisserna: barnsagorösten, dockorna som gungade och Claudes egna fel
▸ Baksidan med röstkloner: kodord, ring tillbaka, sakta ner
▸ Snabbfrågor: vad skulle du låta en AI göra?
▸ Veckans tips: skriv ner reglerna för din AI-agent

Tyckte du att det här var kul, läskigt eller både och?

Skriv i kommentarerna.

Och svara på frågan: skulle du ge en AI-agent tillgång till din inkorg?

Riktiga Jakob och Bengt är tillbaka nästa vecka!

🔗 Källor:
▸ OpenAI stoppar GPT-6.1 Astra (Reuters): https://www.thestar.com.my/tech/tech-news/2026/09/29/openai-shelves-new-ai-model-after-internal-safety-tests-wsj-reports
▸ OpenAI, Towards safety cases for frontier AI training: https://openai.com/index/towards-safety-cases-for-frontier-AI-training
▸ Dots och DevDay 2026: https://www.vktr.com/ai-news/the-biggest-announcements-from-openai-devday-dots-agents-new-500-plan/
▸ OpenAI:s 722 matteartiklar (The Next Web): https://thenextweb.com/news/openai-maths-722-papers-unreleased-model-github
▸ Burak Tuyans film med ElevenLabs v4 (LinkedIn): https://www.linkedin.com/posts/buraktuyan_eleven-v4-is-insane-heres-my-44-second-ugcPost-7511788644320448513-I-kM/

📩 För samarbeten, sponsorskap, föreläsningar och workshops kontakta: jakob.radback@markable.se

✅ Stötta oss via Patreon. https://www.patreon.com/snackaomai
✅ Testa bildgeneratorn som skapar alla våra thumbnails: https://www.bananastudio.app/
✅ Snacka Om AI! Merch Store: https://www.snackaomai.se/store

Kapitel:
00:00 Varför har jag trådar i armarna?
01:05 Ett specialavsnitt gjort helt av AI
02:34 Modellen som ljög: OpenAI stoppar GPT-6.1 Astra
05:20 Säkerhetsfall: stoppa om säkerheten inte kan visas
06:27 Dots: agenter som jobbar dygnet runt
09:10 Promptinjektion och inkorgsfrågan
11:47 722 matteartiklar och millennieproblemen
14:23 Seedance 2.5 och den bästa AI-rösten hittills
15:56 Burak Tuyans film med ElevenLabs nya röst
17:30 Riktiga Jakobs pixelfilm
18:43 Lyssnarfrågan: medborgarlön
21:33 Bakom kulisserna: så gjorde vi avsnittet
24:39 Baksidan med röstkloner
26:27 Snabbfrågor: ja eller nej?
27:44 Veckans tips: skriv ner reglerna

Denne episoden er hentet fra en åpen RSS-feed og er ikke publisert av Podme. Den kan derfor inneholde annonser.

Episoder(106)

Jonas von Essen – AI är inte längre ett verktyg, det är arbetskraft

Jonas von Essen – AI är inte längre ett verktyg, det är arbetskraft

Världsmästaren i minne Jonas von Essen har blivit en av Sveriges tydligaste röster om AI. Han förklarar varför AI inte längre är ett verktyg utan arbetskraft, varför 100 anställda inte har en chans mo...

2 Okt 1h 3min

Claude Opus 5.5 gör ditt jobb DUBBELT så bra

Claude Opus 5.5 gör ditt jobb DUBBELT så bra

Anthropic släppte Claude Opus 5.5 och OpenAI svarade samma dag med GPT-6 Sol och Luna – och båda sänkte priset. Opus 5.5 presterar på Fable 5.1-nivå för 40 % lägre kostnad, och Jakob förklarar varför ...

25 Sep 43min

ChatGPT 6 – Allt du kan göra på din dator, kan Astra göra åt dig

ChatGPT 6 – Allt du kan göra på din dator, kan Astra göra åt dig

OpenAI släppte ChatGPT-6 "Astra" för några dagar sedan och det är inte längre en chatbot – det är en kollega som fjärrstyr dina program. Den bygger moderkort i KiCad, 3D-scener i Unreal Engine och kom...

11 Sep 51min

Säsongsavslutning – Vad har hänt hittills 2026 & AI-spådomar för resten av året

Säsongsavslutning – Vad har hänt hittills 2026 & AI-spådomar för resten av året

Säsong 5 är slut – och vi hade faktiskt rätt. Nästan. Jakob och Bengt gräver fram sina AI-spådomar från december 2025 och kollar facit. Agentisk automation? Check. AI-video? Halvrätt. Självkörande bil...

26 Jun 1h 12min

HEJDÅ DYR HEMSIDA 🔥 Jag vibe-kodade en bättre för 13 kr/mån

HEJDÅ DYR HEMSIDA 🔥 Jag vibe-kodade en bättre för 13 kr/mån

Säsongsfinalen (typ) av Snacka Om AI! är här – och vi sparade det bästa till sist. SpaceX börsnoterades och köpte Cursor för 560 miljarder kronor, USA stängde ute icke-amerikaner från Fable 5, och Jak...

19 Jun 54min

VI TESTADE MYTHOS 🔥 Anthropics hemliga AI-modell som var för farlig att släppa

VI TESTADE MYTHOS 🔥 Anthropics hemliga AI-modell som var för farlig att släppa

Anthropic har släppt sin mest kraftfulla AI-modell någonsin: Fable 5, den civila versionen av den hemligstämplade modellen Mythos, som var för farlig att släppa. Vi dissekerar vad den klarar, testar d...

12 Jun 48min

Del 2 | Bör vi vara rädda för AI? En AI-forskare svarar.

Del 2 | Bör vi vara rädda för AI? En AI-forskare svarar.

Del 2.I det här avsnittet av Snacka Om AI! får Bengt Wessborg och Jakob Radbäck besök av Magnus Lodefalk – docent i nationalekonomi vid Örebro universitet, knuten till forskningsinstitutet Ratio och G...

5 Jun 37min

Populært innen Teknologi

energi-og-klima
teknisk-sett
lydartikler-fra-aftenposten
nasjonal-sikkerhetsmyndighet-nsm
smart-forklart
elektropodden
shifter
rss-ai-forklart
tomprat-med-gunnar-tjomlid
rss-alt-vi-kan
rss-bouvet-bobler
kortslutning
fornybaren
rss-bak-skyen
rss-teknologioptimistene-en-podkast-om-teknologi-og-mennesker
pedagogisk-intelligens
rss-larervarelset
rss-kunstig-intelligens-med-elisabeth-maren-og-morten
rss-ki-praten
rss-digitaliseringspadden