Citat:
Ursprungligen postat av
Cyborg2030
Vad får dig att tro att någon kan lösa AI Control & AI Alignment? Finns det någon hypotes som du utgår från? Det är inte en retorisk fråga. Jag vill gärna förstå detta som jag tydligen har missat helt.
Lösa problemet helt och hållet med 100 % säkerhet vet jag inte om det någonsin kommer att vara möjligt eftersom det inte finns något som ett perfekt system.
Det mest uppenbara är att aldrig ge en AI full autonomitet och kontroll över viktig infrastruktur. Ovanpå det kan vi hitta bättre tekniker för post-training och fine-tuning. T.ex. att inte bara belöna resultatet utan även processen som leder modellen till resultatet. Sedan, som redan nämnts av andra tidigare i tråden, övervakning av andra, specialiserade, agenter som kontrollerar och verifierar att den håller sig "aligned". Även genom att vi lär oss att tydligare tolka betydelsen av aktiveringsfunktionerna i realtid så att vi kan bli notifierade om den börjar resonera om skadliga åtgärder.
Jag är inte intresserad av att spekulera om IQ 7500 ASI, så om det är vad du tänker kontra med kan du lika gärna avstå ifrån att svara.