Kunstig Intelligens

Hvorfor lokale språkmodeller ofte virker dummere enn de er

Mange opplever at lokale språkmodeller (LLM-er – KI-modeller som kjører direkte på egen maskinvare i stedet for i skyen) underperformer i forhold til sitt faktiske potensial. Dette skyldes sjelden selve modellen, men snarere feilaktige oppsettsmaler, suboptimale systeminstruksjoner eller for aggressiv kvantisering (en metode for å redusere modellens størrelse for å spare minne, noe som kan svekke resonneringsevnen). Å finjustere disse tekniske parameterne er kritisk for å hente ut den faktiske kapasiteten som bor i de åpne modellene. [Kilde: Hacker News]