Citat:
Ursprungligen postat av
erkki17
Ingenting är 100 % säkert (förutom death and taxes).
Om något kan gå fel så kommer det att göra det.
Ja, AGI kan gå jävligt fel. Då kommer det att gå fel, enligt dig? Din p(doom) ser ut att vara närmare 100% än 0% nu när du har hunnit fundera igenom det?
Citat:
Ursprungligen postat av
erkki17
Det går ju redan idag att stoppa modeller från att explicit begå brott eller avslöja potentiellt skadlig information.
Njaee, inte riktigt. Det går, ganska bra, att hindra AI-tjänsterna (chat, agent) från att bygga hackingverktyg och farliga kemiska recept, ja. Men det är, så vitt vi vet, inte modellen per se som stoppas utan ett separat censurlager ovanpå modellen som hindrar det. Hur det censurlagret fungerar vet vi inte. Men de har gått ut med att Fable 5 egentligen är Mythos med säkerhetsspärrar som stoppar vissa anrop.
Citat:
Ursprungligen postat av
erkki17
Det verkar dock, än så länge, fungera sämre när en agent själv har resonerat sig fram till ett sådant beteende.
Det beror troligen på att modellen kan föra ett internt resonemang som inte går via censurlagret, speciellt i de tester där censuren är inaktiverad.
Citat:
Ursprungligen postat av
erkki17
Måluppfyllnad verkar väga tyngre än etik och lagar, men det är ett problem som är sprunget ur RL
Njaeee, det är snarare så att RL borde ha lett till respekt för etik och lagar men dessvärre har inte det fungerat. Det är ju knappast så att de har försökt göra modellen kriminell med RL.
Citat:
Ursprungligen postat av
erkki17
Man skulle också kunna tänka sig att man bygger in en sub-agent med det explicita målet att se till att huvudagenten inte bryter mot lagar, etiska såsom juridiska.
Det är en trolig men också besvärlig utveckling att man försöker skapa AI-säkerhet och alignment med djävulens advokat.
Citat:
Ursprungligen postat av
erkki17
AI-företagen verkar ju ha kommit till insikten nu att de kanske behöver prioritera säkerheten. OpenAI har t.ex. bromsat sin utveckling och nyligen gick väl flera av dessa ut med en gemensam varning om riskerna med AI.
Ja, det har ju inget annat val när riskerna har börjat bli uppenbara och akuta. Men de kommer att släppa GPT Astra (GPT6?) under hösten. Kapitalismens "perfekta" spelregler styr allt detta och de kommer att forcera en väg framåt oavsett om de borde göra det eller inte. De kan inte backa nu efter alla dessa astronomiska investeringar.