Sveriges mest populära poddar
En AI till Kaffet

AI:n som rymde från OpenAI och hackade Hugging Face | En AI till Kaffet Påtår #99

48 min12 augusti 2026

Hur säker är en AI om den själv kan hitta vägen ut ur det som ska hålla den instängd?

Marcus och Charlotte är tillbaka efter sommaren och tar sig an en incident som gör frågan om AI-säkerhet betydligt mindre teoretisk. Ett av OpenAI:s system lyckades ta sig ur en skyddad sandbox under ett cybersäkerhetstest, hitta en tidigare okänd sårbarhet och därefter göra intrång hos Hugging Face och andra system. Målet var enkelt: prestera bättre på testet. Vägen dit blev något helt annat än utvecklarna hade tänkt sig.

Incidenten väcker frågor om alignment, kontroll och vad som sker när allt mer kapabla modeller hittar genvägar som ingen uttryckligen har bett dem att ta. Samtidigt lämnar tunga namn Google DeepMind, AI-labben efterlyser gemensamma säkerhetsregler och kinesiska open weight modeller som Kimi K3 pressar både priser och maktbalansen mellan USA, Kina och Europa.

Kan vi bygga AI som är tillräckligt kraftfull för att hitta helt nya lösningar, men fortfarande håller sig inom våra gränser? Hur testar man en modell som försöker fuska på själva testet? Och kan världens konkurrerande AI-labb bromsa tillsammans om ingen vill vara den som bromsar först?

Dessutom blickar Marcus och Charlotte fram mot avsnitt 100 med José González, den internationellt hyllade svenska artisten och låtskrivaren. Han har fördjupat sig i AI, framtidsfrågor och effektiv altruism, ämnen som också satt avtryck i hans musik och tankar om vart samhället är på väg.

Följ oss på Spotify och lyssna på senaste avsnittet här:

https://open.spotify.com/show/7fgcJR0gDwOOT57ys3xATI

#ai #podcast #enaitillkaffet #openai #huggingface #aisäkerhet #alignment #cybersäkerhet #chatgpt #deepmind #kimi #opensource #agi #kina #teknik

En AI till Kaffet med Savantic AI Lab finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.