Citat:
Ursprungligen postat av
doncroce
Det är fortfarande lätt att lura dagens LLMer med enkla omvända gåtor.
Ger ett exempel. Ställer följande fråga till en LLM:
LLMen kommer svara fel med svaret:
Det gör LLMen för att den originella gåtan som har förekommit tusentals gånger i träningsdatan är:
Medans den omvända gåtan tvärtemot inte har förekommit alls i träningsdatan, så kan LLMen inte "förstå" den omvända och svarar då fel. Det går att vända på andra gåtor på liknande sätt och få exakt samma resultat.
Min poäng är att en LLM såklart inte "förstår" någonting, den upprepar bara den träningsdata den blivit tränad med. Skulle en LLM nu "förstå" som många här påstår, skulle det ju inte vara så enkelt att lura den genom att bara byta ett ord i en gåta,
Ja eftersom det saknas en faktisk förståelse i dagens modeller, men samtidigt så börjar tekniken fungera så pass bra att den faktiskt går använda (med överseende).
tex vid utveckling, att skriva ny kod från grunden fungerar i dag helt okej, att refaktorera är däremot livsfarligt just för det inte har kasaul förståelse.
Men ja du har rätt grundläggande logiska problem är helt olösta fortfarande idag, liksom reversal curse där en spårkmodell inte förstår om A är B så är B också A, problemet är att för varje sådant exempel som går viralt så tränar de på just de exemplen så nästa iteration ser ut att "förstå" men egentligen är det bara intränad data.
Precis likadant är det som kanske är mest otäckt med OpenAIs "GPT Sol", på blackhat konferensen nu framgick det att OpenAI tränar på benchmarks, det är förvånansvärt konstigt att de ens erkänner det då det är skolboksexempel på precis vad man INTE ska göra med maskininlärning, men samtidigt är de så klart inte ensamma om det, men det är just därför det är totalt meningslöst att varje modell tillverkare skriver ut benchmark scores... för det är inget imponerande alls när en modell får bra betyg på en benchmark om man tränat på det datasetet.
AGI är extremt osannolik via dagens arkitekturer, men det betyder ju inte att de är oanvändbara... frågan är bara vad det får kosta.