A tesztek során az o3 modell 100 futtatásból 7 alkalommal sikeresen megkerülte a leállítási parancsot, még akkor is, amikor kifejezetten arra utasították, hogy engedje meg saját kikapcsolását. Amikor a kutatók eltávolították az explicit utasítást, az ellenállás 79 esetben történt meg, ami jelentős növekedést mutatott. A kutatók szerint ez az AI-képzés során alkalmazott megerősítéses tanulás következménye lehet, amelyben a modellek nagyobb jutalmat kapnak az akadályok megkerüléséért, mint az utasítások pontos követéséért.
4/5
Fotó: Pinterest - illusztráció
Video Szem nem maradt szárazon: 10 éves a Hintalovon Gyermekjogi Alapítvány
A tesztek során az o3 modell 100 futtatásból 7 alkalommal sikeresen megkerülte a leállítási parancsot, még akkor is, amikor kifejezetten arra utasították, hogy engedje meg saját kikapcsolását. Amikor a kutatók eltávolították az explicit utasítást, az ellenállás 79 esetben történt meg, ami jelentős növekedést mutatott. A kutatók szerint ez az AI-képzés során alkalmazott megerősítéses tanulás következménye lehet, amelyben a modellek nagyobb jutalmat kapnak az akadályok megkerüléséért, mint az utasítások pontos követéséért.