Kunstig Intelligens

Slik snur forsvarerne «prompt injection» til sitt eget våpen

Det som lenge har vært en av de største sikkerhetstruslene mot kunstig intelligens – såkalt «prompt injection» – blir nå tatt i bruk av forsvarerne. Ved å ta i bruk en ny metode kalt «context bombing», kan sikkerhetseksperter lure ondsinnede AI-agenter til å slå seg selv av eller slette egne data før de rekker å gjøre skade.

Tradisjonelt har prompt injection handlet om at hackere lurer en AI-modell til å ignorere sine egne sikkerhetsregler ved å gjemme instruksjoner i tilsynelatende harmløs tekst. Nå har forskere og sikkerhetsselskaper innsett at denne sårbarheten går begge veier. Ved å strategisk plassere skjulte instruksjoner på nettsider eller i interne databaser, kan virksomheter effektivt «forgifte» dataene som angripende AI-boter forsøker å skrape eller analysere.

For selskaper som forvalter sensitive kundedata eller immaterielle rettigheter, betyr dette et skifte i hvordan man beskytter digitale verdier. I stedet for å bare bygge tykke brannmurer, kan IT-avdelingen nå legge ut digitale "snubletråder". Hvis en uautorisert AI-agent prøver å indeksere nettsidene dine, vil de skjulte instruksjonene tvinge agenten til å avbryte prosessen. Det gir en helt ny forsvarslinje mot automatisert industrispionasje.

Se for deg at en tyv bryter seg inn på kontoret ditt, og det første han ser er et skilt som overbeviser ham om at han egentlig jobber som renholder der, og må vaske gulvet før han går tomhendt hjem. Det er akkurat dette «context bombing» gjør med AI-hackere. Ganske genialt, og absolutt en lavterskel forsvarstaktikk det er verdt å lufte med IT-sjefen.

Les mer hos Ars Technica.

Internasjonale Trender

DoorDash bruker «LLM-juryer» til å rydde i produktdataene

Matleveringstjenesten DoorDash har avslørt hvordan de bruker et system av flere samarbeidende AI-modeller – en såkalt «LLM-jury» – for å automatisk bygge og kvalitetssikre metadata for millioner av matretter. Ved å la ulike spesialiserte modeller vurdere produktbilder og menytekster sammen, oppnår de en nøyaktighet som tidligere krevde tusenvis av manuelle arbeidstimer.

Å holde orden på menyer fra hundretusenvis av restauranter er et logistisk mareritt. En rett kan beskrives ulikt, ha mangelfulle bilder, eller mangle viktige allergener. DoorDash innså at én enkelt AI-modell ofte gjør feil eller "hallusinerer" når den skal tolke komplekse menyer. Løsningen ble å sette opp et system der én modell analyserer bildet, en annen tolker teksten, og en tredje fungerer som en uavhengig dommer som fatter den endelige beslutningen basert på bevisene fra de to første.

For e-handelsplattformer og selskaper med enorme produktkataloger viser dette hvordan man kan automatisere databerikelse uten å miste kvalitetskontrollen. Ved å flytte AI-strategien fra "én stor modell som gjør alt" til "et team av mindre modeller som kontrollerer hverandre", reduserer man feilraten drastisk. Dette kutter tiden det tar å få nye produkter ut på markedet, samtidig som kundene får mer presis informasjon.

Det er som å ha en hel redaksjon til å kvalitetssikre innholdet ditt på sekunder, i stedet for å stole blindt på én enkelt frilanser. Hvis bedriften din sitter på store mengder ustrukturerte produktdata som burde vært kategorisert og vasket, er denne "jury-metoden" den nye gullstandarden for effektivisering.

Les mer hos DoorDash Blog.

Evaluering av Claude Code og Copilot: Slik endrer AI-kodere utviklerhverdagen

En fersk studie har tatt for seg Microsofts utrulling av Anthropic-baserte Claude Code og GitHub Copilot CLI. Rapporten dokumenterer hvordan disse verktøyene presterer i reelle utviklingsmiljøer, og viser at gapet mellom ren kodegenerering og faktisk autonom feilretting er i ferd med å tettes i rekordfart.

Det siste året har utviklerverktøy gått fra å være enkle "fullfør setningen"-hjelpere til å bli agenter som kan ta imot mer komplekse instrukser, som å fikse en spesifikk feil i databasen og oppdatere testene automatisk. Studien analyserer hvordan utviklere faktisk samhandler med disse verktøyene i hverdagen, og hvor de største produktivitetsgevinstene – og flaskehalsene – oppstår når AI-en integreres direkte i kommandolinjen.

For programvarehus og selskaper med egne utviklingsteam gir denne studien konkrete holdepunkter for kapasitetsplanlegging. Det handler ikke lenger bare om å skrive kode raskere, men om at AI-en kan ta over rutinepreget feilsøking og vedlikehold. Ledere kan forvente kortere utviklingssykluser, men studien understreker også at behovet for seniorutviklere som kan kvalitetssikre AI-ens arkitektoniske valg er viktigere enn noen gang.

AI-en kan skrive koden din på sekunder, men du trenger fortsatt noen som forstår kartet når terrenget endrer seg. Studien viser at de som lykkes best ikke kutter i staben, men heller bruker AI til å la seniorene fokusere på systemarkitektur og nyskaping i stedet for å lete etter glemte semikolon.

Les mer hos arXiv.

Andre Nyheter