Citat:
Ursprungligen postat av
erkki17
Nej, det betyder att man behöver hitta ett bättre sätt än RL för fine-tuning, eller åtminstone få modellerna att optimera "rätt" så att de inte bara defaultar till reward-hacking.
Jaha, och vad skulle det vara? Jag ser inte att någon konkurrerande teknik kommer i närheten av de ledande AI-modellerna. Enorma belopp har investeras på den vägen som nu är lagd. Man satsar inte på hästen som kommer sist i alla försök.
Men oavsett tekniska lösningar består grundproblemet med AGI/ASI. Hur ska du överlista och styra något som är mycket smartare än dig? Om den säkerhet som du kan uppfinna inte är i närheten av vad ASI:n kan lista ut. Detta är ett problem som inte har någon lösning så vitt jag kan se.