Kunstig Intelligens

Ny treningsmetode skal hindre at språkmodeller gir opp vanskelige oppgaver

Et nytt forskningsarbeid foreslår å bruke utforskningsalgoritmen «Never Give Up» (NGU) innenfor forsterkende læring (reinforcement learning – en treningsmetode basert på prøving og feiling) for store språkmodeller. Formålet er å trene modellene til å løse komplekse problemer ved å belønne aktiv søking etter løsninger, slik at de ikke stopper opp eller gir opp når de møter vanskelige hindringer. Dette kan forbedre språkmodellers evne til logisk resonnering over lengre tidsperioder.

[Kilde: Hacker News]

Pizza Bot: En e-postkasse for autonome AI-agenter

Verktøyet Pizza Bot har lansert en applikasjon for Mac, Windows og Linux som fungerer som en innboks for AI-agenter (programvare som utfører oppgaver selvstendig i bakgrunnen). Appen kjører lokalt og lar agenter jobbe med tildelte oppgaver asynkront, før de ferdige resultatene leveres direkte til et e-postlignende grensesnitt under «Ulest». Dette gir en strukturert måte å håndtere og overvåke flere parallelle AI-arbeidsprosesser på.

[Kilde: Hacker News]