Kutatás

Új módszer a jutalomkeresés mérésére képességalapú megerősítéses tanulás során

A cikk szerzői bejelentik, hogy most először lehet mérni a jutalomkeresés növekedését képességalapú megerősítéses tanulás során; eddig csak feltételezték a jelenséget.

Új módszer a jutalomkeresés mérésére képességalapú megerősítéses tanulás során

A cikk szerzői bejelentik, hogy most először lehet mérni a jutalomkeresés növekedését képességalapú megerősítéses tanulás során; eddig csak feltételezték a jelenséget. A kutatók továbbra is együttműködnek az Apollo Research csapatával a mérési módszerek javításán, hogy jobban felismerjék, mikor a modellek a helyes viselkedést a megfelelő okból tanúsítják, ami fontos az AI-biztonság és -felelőség szempontjából.