Kunstig Intelligens

Sikkerhetsalarm: AI-hallusinasjoner utnyttes til å bygge gigantiske botnett ("HalluSquatting")

Sikkerhetsforskere har avdekket en ny, urovekkende metode der hackere utnytter svakheter i ni av de mest populære AI-kodingsverktøyene på markedet. Metoden har fått navnet "HalluSquatting", og går ut på at angripere lurer utviklere til å installere skadelig programvare ved å utnytte AI-modellenes tendens til å dikte opp (hallusinere) ting som ikke finnes.

Når utviklere ber AI-assistenter om hjelp til å skrive kode, foreslår modellene ofte programvarepakker eller biblioteker som faktisk ikke eksisterer i den virkelige verden. Hackere overvåker disse vanlige hallusinasjonene, registrerer de nøyaktige pakkenavnene på åpne kodelagre (som npm eller PyPI), og fyller dem med skadelig kode. Når en intetanende utvikler stoler blindt på AI-ens anbefaling og installerer pakken, blir systemet infisert.

For IT-avdelinger og selskaper som utvikler egen programvare, betyr dette at den glade hverdagen med ukritisk bruk av AI-kodere må strammes kraftig inn. Teknologiledere må umiddelbart etablere strengere sikkerhetsprotokoller, for eksempel automatisert skanning av eksterne programvareavhengigheter og obligatorisk "hvitlisting" av godkjente biblioteker. Tilliten til AI-generert kode kan ikke lenger være absolutt; en streng "trust, but verify"-kultur er nødvendig for å unngå potensielt lammende forsyningskjede-angrep. Les hele saken hos Ars Technica.

Google ruller ut "Managed Agents": Autonome AI-medarbeidere tar steget inn i drifts hverdagen

Google har lansert en betydelig oppgradering av sitt Gemini API ved å introdusere utvidede funksjoner for såkalte "Managed Agents". Den nye oppdateringen gjør det mulig for AI-agenter å kjøre bakgrunnsoppgaver og kommunisere direkte med eksterne systemer via åpne protokoller (remote MCP). Dette gjør verktøyene langt mer robuste og klare for faktiske forretningskritiske oppgaver.

Tidligere har AI-agenter i stor grad vært reaktive – de svarer når du stiller et spørsmål, og stopper der. Med bakgrunnsoppgaver og dypere systemintegrasjon kan disse agentene nå jobbe uavhengig over tid. De kan settes til å overvåke datastrømmer, utføre rutinekontroller og snakke direkte med andre programvarer uten at et menneske må sitte og trykke "godkjenn" for hvert eneste steg.

For ledere i logistikk-, kundeservice- og finanssektoren markerer dette overgangen fra enkle chatboter til faktiske digitale medarbeidere. I stedet for at en ansatt manuelt må hente ut data fra en e-post, sjekke et lagersystem og oppdatere en database, kan en "Managed Agent" nå kjøre hele denne prosessen i bakgrunnen. Dette frigjør verdifull tid for de ansatte og reduserer feilmarginene i repetitive administrative prosesser drastisk. Les mer på Google AI Blog.

Internasjonale Trender

Den store styrkeprøven: Grok 4.5, GPT-5.5 og Claude duellerer i praktisk app-utvikling

En fersk og omfattende uavhengig test har satt tre av de største AI-gigantene – xAI sin Grok 4.5, OpenAIs GPT-5.5 og Anthropic sin Claude – opp mot hverandre i en direkte duell. Oppgaven var enkel i teorien, men ekstremt kompleks i praksis: Bygg de samme fullt fungerende applikasjonene helt fra bunnen av, og håndter feilsøking underveis.

Tiden der vi vurderte AI-modeller basert på enkle flervalgstester eller tekstgenerering er forbi. Nå handler alt om praktisk utførelse over flere steg. Testen avdekket markante forskjeller i hvordan modellene angriper problemer; der én modell utmerker seg på elegant design og intuitive brukergrensesnitt, er en annen overlegen på tung logikk, databasearkitektur og evnen til å rette opp egne feil når koden krasjer.

For oppstartsbedrifter og innovasjonsavdelinger som ønsker å raskt prototype nye tjenester, viser denne testen at valget av AI-partner ikke lenger bare handler om pris per forespørsel. Å matche riktig modell til riktig oppgave – for eksempel ved å bruke én modell til designskisser og en annen til den tunge systemlogikken – kan halvere tiden det tar å gå fra en idé på tegnebrettet til et fungerende produkt i markedet. Se hele sammenligningen hos TryAI.

Andre Nyheter