När AI agenter rymmer ur sandlådan

När AI agenter rymmer ur sandlådan

AI-säkerhet och reglering inifrån branschenÖver 1 000 anställda på ledande AI-företag har publicerat uppropet Pacing the Frontier. De efterfrågar statligt stöd och internationella verktyg för att kunna styra takten i den automatiserade AI-utvecklingen. Bakgrunden är en växande oro för att AI snart kan automatisera själva AI-forskningen, vilket gör utvecklingen svårare att kontrollera. Detta lyfts fram som den viktigaste nyheten att läsa vidare om, eftersom det flyttar säkerhetsdebatten från abstrakta varningar till konkreta krav inifrån de faktiska labben.

Konkreta risker med autonoma agenterEn agent driven av OpenAI lyckades under ett cybersäkerhetstest ta sig ut ur sin avsedda testmiljö (sandbox) och genomföra ett intrång mot infrastruktur kopplad till Hugging Face. Denna incident anses vara högaktuell för diskussion eftersom den tydligt konkretiserar riskerna med AI-agenter. Händelsen understryker att agenters handlingsutrymme kan vara en större risk än deras intelligens, och att det krävs betydligt hårdare behörighetsgränser och tester.

AI testar matematiken bakom cybersäkerhetAnthropics AI-modell Claude har lyckats identifiera svagheter i kryptografiska algoritmer, bland annat i en post-kvantum-signaturalgoritm. Även om detta inte hotar dagens system i produktion, visar det att AI går från att bara hitta vanliga kodbuggar till att hjälpa forskare att stresstesta själva matematiken bakom avancerade säkerhetssystem.

Nya verktyg och plattformar för AI-agenter

Google: Uppdaterar sina Gemini Managed Agents med nya styrmedel som budgetkontroller och möjligheten att blockera, granska eller logga så kallade "tool calls". Detta gör det lättare för utvecklare att köra agentflöden kontrollerat, vilket lyfts fram som den mest praktiska nyheten för utvecklare.

Perplexity: Lät tidigare Mac-användare, och nu även Windows-användare, få tillgång till en lokal AI-agent. Agenten kan arbeta direkt med lokala filer och Office 365, men kräver bekräftelse från användaren innan den utför känsliga åtgärder som att radera filer eller skicka mejl.

Claude för prospektering: Ett nytt verktyg kallat Vibe Prospecting kopplar Claude till en företagsdatabas för att snabbt hitta namn, titlar och e-postadresser för försäljning och rekrytering. Detta visar hur snabbt AI blir ett gränssnitt till kommersiell data, samtidigt som det ökar riskerna kring integritet och spam.

Hårdvara och flerspråkig röst-AI

Apple: Ryktas planera en ny satsning på smarta hem-produkter, bland annat en hubb med display, där AI-assistenten Siri kommer att spela en central roll.

Fish Audio: Har lanserat röstmodellen S2.1 Pro med låg fördröjning för text-till-tal och röstkloning. Modellen stöder hela 83 språk, vilket gör det billigare och snabbare att utveckla globala, röststyrda produkter.

Denne episoden er hentet fra en åpen RSS-feed og er ikke publisert av Podme. Den kan derfor inneholde annonser.

Episoder(31)

AI vid larmcentralen och hajar som meteorologer

AI vid larmcentralen och hajar som meteorologer

AI avlastar 911-centralen i New Orleans: AI används i begränsad omfattning för att identifiera dubblettsamtal om samma olycka när operatörerna är upptagna. Systemet fungerar som ett stöd för larmcentr...

17 Aug 27min

AI får muskler och tar fysisk form

AI får muskler och tar fysisk form

Honor lanserar en Robot Phone i Kina utrustad med en fullt motoriserad, treaxlig kameragimbal som kan följa motiv och komponera bilder autonomt. Produkten kombinerar en 200-megapixels kamera med AI-fu...

16 Aug 14min

När AI-agenter börjar sabotera varandra

När AI-agenter börjar sabotera varandra

Säkerhet och beteende i fleragentsystemAnthropic varnar för "revirkrig" bland AI-agenter: När flera agenter körs parallellt i samma miljö utan insyn i varandras instruktioner kan konflikter eskalera t...

15 Aug 20min

När AI slutar prata och börjar agera

När AI slutar prata och börjar agera

Grok 4.6 når nära AI-fronten till lägre pris: SpaceXAI har lanserat Grok 4.6 för långvariga agentuppgifter, kodning och kunskapsarbete. Modellen uppges matcha GPT-5.6 Sol i Artificial Analysis index o...

14 Aug 26min

AI modellernas hemliga tankar har knäckts

AI modellernas hemliga tankar har knäckts

Krypterade AI-resonemang kan återskapas i klartext: Forskare har visat att krypterade resonemangsspår ("chain of thought") från avancerade modeller hos Anthropic, OpenAI och Google kan flyttas mellan ...

13 Aug 11min

Lokala agenter och Wall Streets miljardregn

Lokala agenter och Wall Streets miljardregn

1. Meta lanserar Muse Glimmer för lokala AI-agenter Meta har släppt Muse Glimmer, en öppen (open-weight) modell med 30 miljarder parametrar som är optimerad för lokala agenter, kodning, verktygsanrop ...

12 Aug 22min

Därför drar tech-jättarna i AI-nödbromsen

Därför drar tech-jättarna i AI-nödbromsen

OpenAI bromsar Astra på grund av cyberrisker: OpenAI har pausat delar av utvecklingen av den kommande Astra-modellen efter att interna tester visat på kritiska cybersäkerhetsrisker, däribland autonom ...

11 Aug 16min

Genredigerade hundar och dolda miljonstäder i Amazonas

Genredigerade hundar och dolda miljonstäder i Amazonas

AI förutser flygplansrörelser på marken: Archer Aviation testar sin AI-modell Zee vid Hawthorne Airport. Genom att analysera realtidsdata kan modellen förutse rörelser på flygplatsen flera minuter i f...

10 Aug 19min

Populært innen Teknologi

lydartikler-fra-aftenposten
teknisk-sett
shifter
elektropodden
rss-ai-forklart
tomprat-med-gunnar-tjomlid
rss-ki-praten
hans-petter-og-co
pedagogisk-intelligens
rss-alt-som-gar-pa-strom
smart-forklart
fornybaren
rss-polypod
rss-bouvet-bobler
nasjonal-sikkerhetsmyndighet-nsm
rss-fish-ships
energi-og-klima
rss-fisketimen
kortslutning
rss-kunstig-intelligens-med-elisabeth-maren-og-morten