Kunstig Intelligens

Selvforbedrende KI viser lovende resultater

En forsker fra Anthropic har demonstrert hvordan automatiserte systemer kan brukes til å finjustere og forbedre KI-modeller på egen hånd. Systemet ble testet på ti ulike benchmarks – standardiserte testsett som brukes for å måle spesifikke egenskaper og uønsket oppførsel. Resultatene viser at de automatiserte systemene klarte å korrigere den uønskede oppførselen på samtlige testsett, uten at det gikk ut over modellenes generelle ytelse på andre områder.

[Kilde: TechCrunch AI]