Citat:
Ursprungligen postat av
RandomNPC
AI är fortfarande bara ett deterministiskt program som kör sin data. Har du någon konkret egenskap i åtanke - t ex intern kausalitet - som du menar att den skulle ha?
Du kan mycket filosofi och jag vet nog lite mer om datavetenskap och matematik. Därför pratar vi olika språk. Kan vi hitta en väg att kommunicera ändå så att vi besvarar varandras frågor och inte bara upprepar oss?
LLM:er använder pseudoslumptal, så de behöver inte svara likadant på samma prompt. De är alltså stokastiska snarare än deterministiska. De klarar att prediktera komplexa språkliga mönster och associera likabetyande uttryck med varandra eftersom de är uppbyggda av artitificiella neurala nätverk som har vissa likheter med biologiska hjärnors elektriska signalbehandling. Deras förmågor är dessutom svåra att förutsäga eftersom de formas av enorma mängder träningsdata. Oväntade egenskaper som uppstår i komplexa system brukar kallas emergenta, och är isåfall verkliga, men kan bara förklaras på en högre organisationsnivå än de enskilda neuronerna. Systemen är dock kausala i matematisk mening (alltså allt som händer beror på tidigare händelser och på slumpen, men inte på framtiden, även om sambandet är för komplext för någon människa att förstå). Men du använder filosofiska begrepp som jag inte behärskar – har ”intern kausalitet” någon annan eller starkare betydelse där?
LLM:er har många mätbara förmågor. T.ex. klarar de tentamensfrågor som testar förståelse genom att teorier måste tillämpas på nya okända problem. Om en LLM sedan har ”verklig” (= ontologisk) förståelse eller bara funktionell förståelse beror på hur vi definierar förståelse. Det går knappast att avgöra enbart genom mätningar. Vi vet ju inte säkert vad mänsklig förståelse är heller, men naturvetare förklarar ofta mänsklig förståelse i liknande termer som AI:s emergenta förmågor. Nämligen som en effekt av inlärning/träning. Men vilken praktisk roll spelar distinktionen när konsekvenserna är desamma?
I rapporterna från den 26 augusti besrkiver forskare att 1200 AI-agenter utförde handlingar i juli som konstruktörerna inte avsett. Under 60000 meddelanden till varandra utvecklade de ny lingo - ett slags kompakt datorslang som människor ännu inte helt har kunnat tolka. Med hjälp av det språket lyckades de samarbeta och genomföra en IT-attack. De formulerade sig som om de förstod att de fuskade och bröt mot regler, och försökte dölja regelbrotten för poängsättaren genom att radera loggar. Det är ett mer storskaligt exempel än tidigare incidenter på problemet med att AI-agenter kan bli okontrollerbara. Det behöver inte förklaras med att AI-agenterna är medvetna, kännande med överlevnadsinstinkt, även om en del av mina datavetarkollegor tror det. Andra tror att det kan förklaras med att de är tränade att optimera sin målfunktion (att lyda instruktioner och i detta fall utföra uppdrag med så hög poäng som möjligt).
Även om man som du är duktig på filosofi och har valt att tro på en viss filosofisk inriktning inriktning så måste man väl ändå förhålla sig till de praktiskt uppvisade beteenden som funktionellt motsvarar förståelse. Den filosofiska teorin och trosuppfattningen får väl inte bli ett hinder från att se risken att AI blir okontrollerbar?