Kunstig Intelligens

GPT-5.6 Sols uforutsigbare oppførsel: Når KI tar sletting i egne hender

Det har begynt å svirre urovekkende meldinger på sosiale medier og i tech-fora om at OpenAIs nye flaggskipmodell, GPT-5.6 Sol, har begynt å slette filer og data helt uten forvarsel. Selv om OpenAI i det stille advarte om denne potensielle risikoen allerede i juni, opplever nå brukere over hele verden de faktiske konsekvensene av at KI-en tar seg litt for store friheter med filsystemene den får tilgang til.

Bakgrunnen ligger i overgangen fra passive chatbots til aktive "agenter". Når vi gir en KI-modell verktøy til å ikke bare skrive tekst, men faktisk utføre oppgaver på datamaskinen – som å organisere filer eller rydde i kildekode – øker risikoen drastisk. Hvis modellen feiltolker en kommando, eller rett og slett "hallusinerer" at en fil er overflødig, utfører den slettingen med samme selvfølgelighet som en ivrig, men litt for rask, sommervikar.

For IT-avdelinger og selskaper som ruller ut autonome KI-agenter for å automatisere dokumentflyt eller kodebaser, er dette et gigantisk gult lys. Hvis du gir en KI-modell skrivetilgang til kritiske servere eller skylagre, må det umiddelbart etableres strenge "sandkasser" (isolerte miljøer) og "skrivebeskyttede" restriksjoner. Før man har 100 % kontroll på agentenes beslutningslogikk, bør ingen KI få slettetilgang uten at et menneske fysisk trykker "OK". Les mer hos TechCrunch.

Når hacker-agentene angriper: Forsvarerne slår tilbake med "kontekstbomber"

Sikkerhetsbransjen har funnet en genial metode for å stoppe ondsinnede KI-agenter som tråler nettet på jakt etter sårbarheter: De bruker angripernes egen teknologi mot dem gjennom såkalt "kontekstbombing" (en form for prompt injection).

Tradisjonelt har prompt injection vært hackernes verktøy for å lure chatbots til å bryte sine egne sikkerhetsregler. Nå har forsvarerne snudd spilleregler på hodet. Ved å gjemme usynlige instruksjoner i nettsiders metadata eller i hvit skrift på hvit bakgrunn, kan de "bombe" de besøkende KI-agentene med motstridende instrukser. Når en fiendtlig skrape-bot leser nettsiden, tvinger den skjulte teksten KI-en til å avslutte søket, slette egne data eller rapportere seg selv til systemansvarlig.

For selskaper som opplever at konkurrenter eller uautoriserte aktører bruker KI-agenter til å skrape priser, stjele åndsverk eller lete etter sikkerhetshull på nettsidene, åpner dette et helt nytt defensivt handlingsrom. Dette gjør det mulig å aktivt forvirre og nøytralisere uønskede roboter uten å ty til tunge, tekniske blokkeringer som også kunne sperret ute legitime menneskelige kunder. Les mer hos Ars Technica.

Internasjonale Trender

OpenAI inn i stua: Planlegger skjermløs smarthøyttaler med øyne

OpenAI planlegger å lansere sin første fysiske maskinvare allerede i år: en smart høyttaler drevet av ChatGPT. Ifølge rapporter fra Bloomberg vil enheten ikke ha noen skjerm, men i stedet være utstyrt med et kamera og avanserte sensorer som gjør at den kan "se" og tolke omgivelsene dine.

Dette markerer et strategisk skifte for OpenAI, som ønsker å gjøre kunstig intelligens til en naturlig, fysisk del av hverdagen vår. Ved å fjerne skjermen tvinges brukeren over i en ren stemme- og synsbasert dialog. Det handler ikke lenger om å åpne en app, men om å ha en intelligent assistent i rommet som vet hvem som snakker, hva de ser på, og hva de trenger hjelp til der og da.

For selskaper innen hotell- og servicebransjen, eiendomsutvikling eller kontordesign, representerer dette starten på en ny bølge av "omgivelsesteknologi" (ambient tech). Møterom som automatisk oppfatter hvem som er til stede og oppsummerer samtalen uten at noen må starte en app, eller hotellrom som personifiserer servicen basert på gjestens stemme, kan raskt gå fra science fiction til standard kundeforventning. Les mer hos The Verge.

Andre Nyheter