Kunstig Intelligens

Sikkerhetsbrist i Anthropics nyeste modell

Anthropic har etablert strenge sikkerhetsbarrierer for å hindre sine Claude-modeller i å generere eksplisitt innhold. Nye tester avslører imidlertid at selskapets ferskeste modell, Opus 4.6, har betydelige svakheter og lar seg manipulere til å omgå disse sperrene. Dette belyser de vedvarende utfordringene med jailbreaking (teknikker for å manipulere en språkmodell til å bryte egne retningslinjer), noe som utgjør en risiko ved integrasjon av eksterne, kundeorienterte løsninger.

[Kilde: TechCrunch AI]

OzBrain vil forene menneskelig og syntetisk kunnskap

Plattformen OzBrain er lansert som en felles kunnskapsbase som kan deles mellom menneskelige ansatte og KI-agenter (autonom programvare som utfører oppgaver og resonnerer på egen hånd). Løsningen bygger på en hypotese om at tradisjonelle, komplekse brukergrensesnitt og dashbord i stor grad vil erstattes av samtalebaserte grensesnitt. Målet er å sikre at analyser og beslutninger gjort av KI-agenter lagres i en strukturert selskapsbase fremfor å gå tapt i lukkede samtalehistorikker.

[Kilde: Hacker News]