AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99

AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99

Hur säker är en AI om den själv kan hitta vägen ut ur det som ska hålla den instängd?

Marcus och Charlotte är tillbaka efter sommaren och tar sig an en incident som gör frågan om AI-säkerhet betydligt mindre teoretisk. Ett av OpenAI:s system lyckades ta sig ur en skyddad sandbox under ett cybersäkerhetstest, hitta en tidigare okänd sårbarhet och därefter göra intrång hos Hugging Face och andra system. Målet var enkelt: prestera bättre på testet. Vägen dit blev något helt annat än utvecklarna hade tänkt sig.

Incidenten väcker frågor om alignment, kontroll och vad som sker när allt mer kapabla modeller hittar genvägar som ingen uttryckligen har bett dem att ta. Samtidigt lämnar tunga namn Google DeepMind, AI-labben efterlyser gemensamma säkerhetsregler och kinesiska open weight modeller som Kimi K3 pressar både priser och maktbalansen mellan USA, Kina och Europa.

Kan vi bygga AI som är tillräckligt kraftfull för att hitta helt nya lösningar, men fortfarande håller sig inom våra gränser? Hur testar man en modell som försöker fuska på själva testet? Och kan världens konkurrerande AI-labb bromsa tillsammans om ingen vill vara den som bromsar först?

Dessutom blickar Marcus och Charlotte fram mot avsnitt 100 med José González, den internationellt hyllade svenska artisten och låtskrivaren. Han har fördjupat sig i AI, framtidsfrågor och effektiv altruism, ämnen som också satt avtryck i hans musik och tankar om vart samhället är på väg.

Följ oss på Spotify och lyssna på senaste avsnittet här:

https://open.spotify.com/show/7fgcJR0gDwOOT57ys3xATI

#ai #podcast #enaitillkaffet #openai #huggingface #aisäkerhet #alignment #cybersäkerhet #chatgpt #deepmind #kimi #opensource #agi #kina #teknik

Denne episoden er hentet fra en åpen RSS-feed og er ikke publisert av Podme. Den kan derfor inneholde annonser.

Episoder(110)

José González: Tänk om AI får oss att börja sjunga tillsammans igen? | En AI till Kaffet #100

José González: Tänk om AI får oss att börja sjunga tillsammans igen? | En AI till Kaffet #100

Kan den mest avancerade tekniken föra oss tillbaka till något så enkelt som att skapa musik tillsammans?I vårt 100:ade avsnitt träffar Marcus José González, artist och låtskrivare med bakgrund inom bi...

19 Aug 1h 1min

Anders Hansen: AI kan hacka hjärnans akilleshälar | En AI till Kaffet #98

Anders Hansen: AI kan hacka hjärnans akilleshälar | En AI till Kaffet #98

Hjärnan har flera inbyggda svagheter. I sin nya bok kallar Anders Hansen dem för hjärnans akilleshälar. Hur kan AI utnyttja dem, och hur skyddar vi oss?Marcus träffar Anders Hansen, läkare, psykiater ...

5 Aug 43min

Patrick Couch: “Snacka inte om AGI förrän vi kommer ned till 100W” | En AI till Kaffet #97

Patrick Couch: “Snacka inte om AGI förrän vi kommer ned till 100W” | En AI till Kaffet #97

Kan AI verkligen kallas intelligent när den behöver enorma datacenter för det hjärnan klarar med 100 watt?Marcus träffar Patrick Couch, initiativtagare till Stockholm MLOps, tidigare talesperson för A...

29 Jul 1h 20min

Sten Friberg: Kan ChatGPT förstärka en psykos? | En AI till Kaffet #96

Sten Friberg: Kan ChatGPT förstärka en psykos? | En AI till Kaffet #96

Kan det vara farligt för någon med vanföreställningar eller som befinner sig i en pågående psykos att prata med AI?Marcus träffar Sten Friberg, överläkare och psykiater med erfarenhet från psykiatrisk...

22 Jul 57min

Thor Wikfeldt & Salla Franzén: AI-fabriken Mimer gör Sverige oberoende | En AI till Kaffet #95

Thor Wikfeldt & Salla Franzén: AI-fabriken Mimer gör Sverige oberoende | En AI till Kaffet #95

Kan Sverige bygga AI på egna villkor?Marcus träffar Thor Wikfeldt, Deputy Director för Mimer AI Factory, och Salla Franzén, VD för AI 4S och verksam inom svensk AI-forskning. De ser AI som en fråga om...

14 Jul 1h

Henrik Ståhl: Därför använder jag Claude för att förstå mig själv | En AI till Kaffet #94

Henrik Ståhl: Därför använder jag Claude för att förstå mig själv | En AI till Kaffet #94

Kan en språkmodell bli en sorts ficklampa in i det egna huvudet?Marcus träffar Henrik Ståhl, skådespelare, regissör och skapare av podcasten Somna med Henrik. Han använder Claude som ett märkligt säll...

8 Jul 1h 1min

Från Silicon Valley till Silicon Valhalla – väljer OpenAI Sverige? | En AI till Kaffet Påtår #93

Från Silicon Valley till Silicon Valhalla – väljer OpenAI Sverige? | En AI till Kaffet Påtår #93

Varför väljer världens AI-elit Sverige just nu?I veckans påtår fyller Marcus och Charlotte på koppen efter förra veckans samtal med Siri Östlund i Highlightpodden och Christian von Essen i Heja Framti...

1 Jul 30min

Populært innen Teknologi

lydartikler-fra-aftenposten
tomprat-med-gunnar-tjomlid
teknisk-sett
smart-forklart
elektropodden
nasjonal-sikkerhetsmyndighet-nsm
rss-ki-praten
fornybaren
shifter
rss-kunstig-intelligens-med-elisabeth-maren-og-morten
teknologi-og-mennesker
rss-alt-som-gar-pa-strom
rss-snakk-om-sikkerhet
rss-ai-forklart
rss-alt-vi-kan
rss-fisketimen
digital-forretningsforstaelse
rss-bouvet-bobler
pedagogisk-intelligens
rss-polypod