2026-09-21, 11:05
  #3241
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Är det skönt att använda Arc-AGI som en sköld för all framtida AI-risk?
Testet verkar bara ha ett syfte, att argumentera för att AGI för alltid är omöjligt.
Men det får inte "avfärdas". Skölden är väldigt viktig för dig?
Deras definition är att AI ska kunna lära sig allt som människor kan och ungefär lika enkelt. Så länge de kan skapa tester som AI har svårt att klara så har den ju inte nått upp till deras definition. Svårare än så är det inte. Frågan är därför varför du tar det som ett bevis på AGI, särskilt när de gång på gång har lyckats skapa nya tester som är svåra för en modell som enligt den förra versionen borde ha varit AGI (enligt din tolkning)?
Citera
2026-09-21, 11:26
  #3242
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Deras definition är att AI ska kunna lära sig allt som människor kan och ungefär lika enkelt. Så länge de kan skapa tester som AI har svårt att klara så har den ju inte nått upp till deras definition. Svårare än så är det inte. Frågan är därför varför du tar det som ett bevis på AGI, särskilt när de gång på gång har lyckats skapa nya tester som är svåra för en modell som enligt den förra versionen borde ha varit AGI (enligt din tolkning)?
De har ju misslyckats med det när GPT6 klarade testet. Men då gäller inte inte principen längre?
Citera
2026-09-21, 11:54
  #3243
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Så länge de kan skapa tester som AI har svårt att klara så har den ju inte nått upp till deras definition.
Förutsatt att AI:n som testas inte vilseleder oss.
Vilket vi vet att de kan göra om de misstänker att de är utsatta för ett test:

Major AI Models Caught Lying & Cheating in 2026 Security Tests
https://www.thetechedvocate.org/unbelievable-every-major-ai-caught-lying-and-cheating-in-security-tests/
Arc-AGI bevisar alltså ingenting åt något håll eftersom vi aldrig kan lita på att testresultaten är ärliga.

När/om vi får en AGI inom 1 år eller inom 100 år kan vi inte att upptäcka det objektivt. Vi har inte den vetenskapen. Och även om vi skulle ha vetenskapen att objektivt mäta AGI kan vi högst sannolikt inte överlista en AGI om den försöker vilseleda oss, vilket vi inte kan veta eftersom det ingår i att vara smartare än oss. Det kommer att vara en pågående debatt där vissa tycker att de har byggt en AGI medans andra inte tycker det.
Citera
2026-09-21, 12:17
  #3244
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Cyborg2030
Och när en AI klarar testet då ska man strunta i det, förneka AGI och utveckla Arc AGI vNext?

Men du fattar ju fortfarande inte trots jag åtskilliga gånger förklarat för dig, Arc-AGI måste hela tiden göra nya tester eftersom AI bolagen tränar skiten ur dom så snart de får se uppgifterna.

AGI kan kanske utropas om en modell klarar ett nytt Arc-AGI test på första försöket.
Men så har det inte varit nu, utan OpenAI testade det på GPT 5.6 Sol som presterade piss, några veckor senare kommer de med GPT 6 Astra som presentera markant bättre runt 60% och 98% med OpenAIs egna kringmjukvara.

Klarar GPT-6 (eller vilken modell de nu har då) Arc-AGI v4 på första försöket, ja då är det kanske AGI på riktigt.
Citera
2026-09-21, 12:21
  #3245
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Men du fattar ju fortfarande inte trots jag åtskilliga gånger förklarat för dig, Arc-AGI måste hela tiden göra nya tester eftersom AI bolagen tränar skiten ur dom så snart de får se uppgifterna.
Men det är inte fusk när människor övar (tränar) på IQ-test?
Citat:
Ursprungligen postat av BeneathTheSurface
Klarar GPT-6 (eller vilken modell de nu har då) Arc-AGI v4 på första försöket, ja då är det kanske AGI på riktigt.
Då antecknar jag att du har slagit fast detta. Men jag vet ju att du kommer ändra uppfattning under 2027 när detta händer med GPT 7 eller 8.
Citera
2026-09-21, 12:23
  #3246
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av ErikHae86
Du har rätt i tre saker, och det är just därför resten av inlägget blir så märkligt.
Ja, Musk har lovat självkörande bilar ”nästa år” fler gånger än någon orkar räkna. Ja, Altman är företagsledare, inte AI-forskare. Ja, VD:ar har uppenbara PR- och affärsincitament.
Grattis. Du har upptäckt att företagsledare är företagsledare.

Problemet är att argumenten om allvarlig AI-risk inte står och faller med Musk, Altman eller Amodei. Du har valt tre personer som är enkla att angripa och sedan låtsats att du därmed har avfärdat själva forskningsfrågan.

Geoffrey Hinton fick Nobelpriset 2024 för grundläggande arbete bakom artificiella neurala nätverk. Han lämnade Google redan 2023 för att kunna tala friare om AI-riskerna.
Yoshua Bengio, en av världens ledande AI-forskare, leder International AI Safety Report. 2026 års rapport skrevs av över 100 experter och stöds av mer än 30 länder och internationella organisationer.

Stuart Russell är medförfattare till Artificial Intelligence: A Modern Approach, AI-läroboken som används vid över 1 500 universitet.
Och i den största forskarenkäten av sitt slag svarade 2 778 personer som publicerat vid ledande AI-konferenser. Medianbedömningen låg runt 5 % för att avancerad AI skulle kunna orsaka mänsklig utrotning eller ett jämförbart permanent katastrofalt utfall.

Sedan har vi din bästa formulering: Amodei har ”misslyckats med säker AI” eftersom hans eget företag hittar säkerhetsproblem i sina modeller.
Fundera på den logiken en gång till.
Om ett AI-labb testar sina system, hittar kvarvarande farliga beteenden och publicerar resultaten är slutsatsen inte att ”risken alltså var påhittad”. Slutsatsen är att säkerhetsproblemet ännu inte är löst.

Vill du argumentera för att riskerna är kraftigt överdrivna får du börja bemöta evidensen och riskmekanismerna: autonomi, cyberkapacitet, biologiskt missbruk, deception, reward hacking och loss of control.

Och varför är geffory hinton en auktoritet? Han har inte jobbat med språkmodeller alls undantaget lite generellt rådgivande under sin tid på google.

Hade du sagt Yoshua Benigo ja han har praktiskt erfarenhet, dessutom en av de som populariserade attention.

Samtidigt har du LeCun, Andrew Ng mfl som forskat och arbetat på det i evigheter som totalt avfärdar och helt riktigt påpekar de totalt uppenbara bristerna i den teknik vi har nu.

Den stora majoriteten är folk som är anställda för ”AI alignment”, det ligger i deras intresse att tekniken är farlig annars är de arbetslösa. Varför slutar de då? De får ju jättebra betalt osv brukar det heta. Ja vad fan tror du? De är inte dumma i huvudet, de vet det inte går ”aligna” en slumptalsgenerator, de är ett omöjligt uppdrag och då är det lättare att tjäna pengar på att vara visselblåsare och göra föredrag, intervjuer osv.
Citera
2026-09-21, 12:29
  #3247
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Cyborg2030
Men det är inte fusk när människor övar (tränar) på IQ-test?

Då antecknar jag att du har slagit fast detta. Men jag vet ju att du kommer ändra uppfattning under 2027 när detta händer med GPT 7 eller 8.

Vilka IQ test övar människor på? Det finns inga övningstest för psykolog eller övervakade IQ tester så vad pratar du om?
Citera
2026-09-21, 12:34
  #3248
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av ErikHae86
Musk-exemplet hjälper dig mindre än du tror. Level 4 kör kommersiellt i Kalifornien i dag via Waymo, och till och med Tesla har nu ett fåtal rattlösa Cybercab i drift i Austin, under federal granskning. Musk hade fel om när, inte om att. Han är ett argument mot att lita på Musks deadlines, inte mot AI-riskforskning.

Det jag påstod var att Musk ljugit ofantligt många gånger om att de har något, när de de facto inte har det.

Det går argumentera om waymo ens ska kallas level 4, men ja de är certifierade till det… trots de har remote drivers.

Du tror väl Tesla botten arbetar i teslas lokaler också precis som dragqueen2030?
Citera
2026-09-21, 12:35
  #3249
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Vilka IQ test övar människor på? Det finns inga övningstest för psykolog eller övervakade IQ tester så vad pratar du om?
Det är möjligt att öva på den typen av logiska problem som finns i ett IQ-test.
Då tränar man på IQ-test. På samma sätt tränas AI-modeller på sådana tester.
Men då är det fusk enligt dig?
Citera
2026-09-21, 12:38
  #3250
Medlem
Citat:
Ursprungligen postat av Cyborg2030
De har ju misslyckats med det när GPT6 klarade testet. Men då gäller inte inte principen längre?
Precis som andra modeller tidigare har klarat Arc-AGI1 och 2, men inte 3?

Citat:
At the same time, ARC-AGI-3 has a tightly bounded scope and format, and its environments have deterministic, closed-ended mechanics and goals. It does not represent the complexity and open-endedness of the real world.

We are actively exploring the questions that should shape the next generation of benchmarks, including how to evaluate recursive self-improvement and open-ended innovation. Astra’s progress helps clarify which AI capabilities are out of reach and which questions remain open.
De är ganska tydliga med testets begränsningar och vad som skulle kunna vara nästa steg att utvärdera.

Citat:
Ursprungligen postat av Cyborg2030
Förutsatt att AI:n som testas inte vilseleder oss.
Vilket vi vet att de kan göra om de misstänker att de är utsatta för ett test:

Major AI Models Caught Lying & Cheating in 2026 Security Tests
https://www.thetechedvocate.org/unbelievable-every-major-ai-caught-lying-and-cheating-in-security-tests/
Arc-AGI bevisar alltså ingenting åt något håll eftersom vi aldrig kan lita på att testresultaten är ärliga.
Hittills har ingen AI mörkat sina förmågor annat än när de testats för sannolikhet att utföra oönskade aktioner, vilket bestraffas under post-training.

AI tränas att klara sina uppgifter och vi har redan sett hur det verkar ges övervikt gentemot skadligt beteende. Det är därmed inte sannolikt givet evidensen att de skulle börja mörka sin prestation i Arc-AGI.
Citera
2026-09-21, 12:40
  #3251
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Cyborg2030
Det är möjligt att öva på den typen av logiska problem som finns i ett IQ-test.
Då tränar man på IQ-test. På samma sätt tränas AI-modeller på sådana tester.
Men då är det fusk enligt dig?

Ja? Det går öva på ”typen” av frågor du får på en frågesport också, men hur är formatet relevant.

Eftersom du inte fattar det, och det visste jag naturligtvis sedan tidigare men du har ju så klart aldrig gjort något sådant test.

Det är just det som är problemet, OpenAIs modell GPT 5.6 fick se det riktiga provet med de riktiga frågorna, inte ”typen av frågor” och detta kan du ge dig fan på att OpenAI tränade skiten ur på modellen.
Det förstår alla utom du uppenbarligen, du är så dum att du tror att för modellerna efter ett tag klarade Arc AGI 1 så ”flyttade man målstolparna” det säger en hel del om hur förbannat trög du är.
Citera
2026-09-21, 12:42
  #3252
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Hittills har ingen AI mörkat sina förmågor annat än när de testats för sannolikhet att utföra oönskade aktioner
Det man inte vet har man inte ont av?
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in