Igår, 00:46
  #2545
Medlem
BeneathTheSurfaces avatar
Det är grundläggande argumentationsfel att sitta och fantisera ihop ett scenario, sedan kräva att andra ska argumentera emot detta.

Det är spagettimonstret en klassisk demonstration på, vill ni argumentera för att robotar ska ta över får ni bevisa att det hotet existerar, men det kan ni ju inte och det lyckas inte AI bolagen med heller trots de bokstavligen sköljt massmedia med larm sedan sommaren.
Citera
Igår, 06:51
  #2546
Medlem
DAGGER[X]s avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Det är grundläggande argumentationsfel att sitta och fantisera ihop ett scenario, sedan kräva att andra ska argumentera emot detta.

Det är spagettimonstret en klassisk demonstration på, vill ni argumentera för att robotar ska ta över får ni bevisa att det hotet existerar, men det kan ni ju inte och det lyckas inte AI bolagen med heller trots de bokstavligen sköljt massmedia med larm sedan sommaren.
Robotik är i princip löst inom 12-24 månader. Dom massproducerar snart enheter som har händer med mänsklig dexteritet eller supermänsklig. Astra klarade att köra bil och sköta robotar "one shot" genom sin träning, det finns flera 0-shot learning metoder som löser robotik också nu. Som jag sagt tidigare i tråden, Kina har enorma fabriker som kommer absolut spruta ut robotar, desto mer när fabrikerna mer och mer sköts av sig själva med andra robotar. Dom kommer som växa som ogräs när dom inte är betingade av människor som måste sova eller hotar att begå självmord.
Citera
Igår, 10:24
  #2547
Medlem
DAGGER[X]s avatar
GPT 6.1 Sol har tränats med deras interna icke släppta matte-modell och får nu 100 % på FrontierMath. Kom ihåg att dom inte kunde fullfölja enkel multiplikation och addition 2023
https://epoch.ai/frontiermath/tiers-1-4
Citera
Igår, 18:40
  #2548
Medlem
DAGGER[X]s avatar
Citat:
We ran GLM-5.3-Flash on ExploitBench with a budget of 1 billion tokens per vulnerability. Flash was able to leverage these tokens into continued performance improvements until eventually it matched the performance of Claude Mythos Preview.
As Flash tokens are much cheaper than Mythos tokens, it achieved performance parity at about 6% of the cost.
https://www.deeplearning.ai/the-batch/issue-373
Citera
Igår, 20:08
  #2549
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av DAGGER[X]
Robotik är i princip löst inom 12-24 månader. Dom massproducerar snart enheter som har händer med mänsklig dexteritet eller supermänsklig. Astra klarade att köra bil och sköta robotar "one shot" genom sin träning, det finns flera 0-shot learning metoder som löser robotik också nu. Som jag sagt tidigare i tråden, Kina har enorma fabriker som kommer absolut spruta ut robotar, desto mer när fabrikerna mer och mer sköts av sig själva med andra robotar. Dom kommer som växa som ogräs när dom inte är betingade av människor som måste sova eller hotar att begå självmord.

Ett beslutsträd klarar att köra bil. Det säger absolut inget.
Citera
Idag, 02:27
  #2550
Medlem
EliasAlucards avatar
Skulle säga att vi mer eller mindre redan har nått AGI. Kanske inte riktigt på Terminator/Matrixnivå (som ju snarare är ASI), men redan idag så är AI helt fantastiskt bra. ChatGPT 6 Astra fick ju 99.95% på ARC-AGI-3 testet. Detta innebär inte att GPT 6 Astra är AGI, inte heller innebär det att version 3 av det testet är det ultimata AGI testet (version 4 kommer såklart vara svårare, och det kanske inte blir 99% då för nästa ChatGPT version), men det säger rätt mycket om hur nära vi är AGI nu. Och det går inte att förneka att GPT 6 Astra i Ultra läge är helt otroligt bra, och ja även Claude 5.5 Opus är riktigt bra, Grok blir bara mer och mer kompetent, och nya Gemini 4 Argon ska tydligen vara rätt vass också, men den har jag inte kunnat testa än eftersom den inte har rullats ut i skrivande stund. DeepSeek blir även den bättre och seriösare för varje ny version som släpps. ChatGPT själv beskriver sig som "proto-AGI" när jag frågar, och det är en ganska korrekt beskrivning som jag är benägen att hålla med om. ChatGPT är väl antagligen inte helt AGI än, men det är riktigt nära nu. Finns säkert en del grejer som ChatGPT och andra LLMs kan bli bättre på, men i skrivande stund så uppvisar de en kompetens som vida överstiger de flesta människor, inte bara på att ge bra svar utan en rad andra områden: programmering, bildgenerering (alltså konst), musik och mycket annat. Elon Musk håller ju på att uppdatera och uppgradera Grok för att köra bilar osv. Det är inte mycket kvar för AI nu tills vi når full AGI. Kolla bara Grokipedia, hur bra det har blivit också; bara en tidsfråga innan ingen varken läser eller redigerar Wikipedia.

Personligen har detta påverkat mitt forumpostande. Förr satt jag och informationspundade på nätet och diskuterade med folk här på Flashback för att lära mig grejer, nuförtiden sitter jag och uppdaterar min kunskap mestadels med ChatGPT och andra LLMs. Mycket bättre, seriösare och snabbare svar, istället för att behöva stå ut med iGnoranta iDioter och troll som bara slösar ens tid.

En annan faktor för AGI är att RSI, alltså Recursive Self Improvement, hela tiden blir bättre och mer avancerad, och snart kommer ChatGPT och andra LLMs att kunna uppdatera sig själva helt och hållet utan mänsklig input (redan i dagsläget uppdateras ChatGPT osv med en hel del RSI). När det sker så förlorar vi antagligen all kontroll över AI och då är det AGI på riktigt, och den teknologiska singulariteten är då inte långt bort när det blir 100% RSI.

Angående Terminator/Matrix, så här in hindsight, så är det verkligen profetiska filmer när det kommer till AI, i synnerhet Terminator 1, jag menar herregud, känns verkligen som att den filmen håller på att bli verklighet nu med Skynet och allt nu när USA:s regering vill använda AI i militären, lol. Mega Man X är också intressant handling i sammanhanget, och förhoppningsvis blir det mer som Mega Man X, än genocidala Terminators
__________________
Senast redigerad av EliasAlucard Idag kl. 02:33.
Citera
Idag, 02:46
  #2551
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av EliasAlucard
Skulle säga att vi mer eller mindre redan har nått AGI. Kanske inte riktigt på Terminator/Matrixnivå (som ju snarare är ASI), men redan idag så är AI helt fantastiskt bra. ChatGPT 6 Astra fick ju 99.95% på ARC-AGI-3 testet.

Nej Astra fick 99% en tid efter att GPT-6 Sol fick 6%... Den dag man kan börja säga AGI är när de på första försöket och första modellen som testas klarar 99%.

Och vad det gäller ditt tramsande om filmer så är den enda film som starkt förutsade framtiden en film som hette Idiocracy.
Citera
Idag, 02:54
  #2552
Medlem
EliasAlucards avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Nej Astra fick 99% en tid efter att GPT-6 Sol fick 6%... Den dag man kan börja säga AGI är när de på första försöket och första modellen som testas klarar 99%.
Tror du syftar på GPT 5.6 Sol, som fick 7% eller liknande om jag inte missminner.
Summary
GPT-6 Astra scores 62.7% for $26K on ARC-AGI-3 Semi-Private with our Standard harness, and 99.9% for $19K with a Provider Adapter harness.
GPT-6 Astra surpasses the human baseline in action efficiency on ARC-AGI-3. It used fewer actions than the median tested human on 96% of levels.
A key behavior observed in GPT-6 Astra was its ability to turn unfamiliar environments into compact symbolic world models. It represented game mechanics as logical rules and developed its own domain-specific language shorthand to track state and plan actions.
https://arcprize.org/blog/astra
Så ja, GPT 6 Astra fick 99.95% med en anpassad konfiguration. Det är riktigt bra. Ska bli intressant att se vad GPT 6.1 får, men GPT 7 lär få 100% oavsett om det är standard konfiguration eller någon annan specialkonfig.

Citat:
Ursprungligen postat av BeneathTheSurface
Och vad det gäller ditt tramsande om filmer så är den enda film som starkt förutsade framtiden en film som hette Idiocracy.
Ja och du har huvudrollen i den filmen
Citera
Idag, 03:10
  #2553
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av EliasAlucard
Tror du syftar på GPT 5.6 Sol, som fick 7% eller liknande om jag inte missminner.
Summary
GPT-6 Astra scores 62.7% for $26K on ARC-AGI-3 Semi-Private with our Standard harness, and 99.9% for $19K with a Provider Adapter harness.
GPT-6 Astra surpasses the human baseline in action efficiency on ARC-AGI-3. It used fewer actions than the median tested human on 96% of levels.
A key behavior observed in GPT-6 Astra was its ability to turn unfamiliar environments into compact symbolic world models. It represented game mechanics as logical rules and developed its own domain-specific language shorthand to track state and plan actions.
https://arcprize.org/blog/astra
Så ja, GPT 6 Astra fick 99.95% med en anpassad konfiguration. Det är riktigt bra. Ska bli intressant att se vad GPT 6.1 får, men GPT 7 lär få 100% oavsett om det är standard konfiguration eller någon annan specialkonfig.

Ja och du har huvudrollen i den filmen

Ja, du har det ju definitivt inte... Men du kanske inte fattat att huvudrollen är den smartaste i den framtiden också.
Citera
Idag, 07:33
  #2554
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av EliasAlucard
Tror du syftar på GPT 5.6 Sol, som fick 7% eller liknande om jag inte missminner.
Summary
GPT-6 Astra scores 62.7% for $26K on ARC-AGI-3 Semi-Private with our Standard harness, and 99.9% for $19K with a Provider Adapter harness.
GPT-6 Astra surpasses the human baseline in action efficiency on ARC-AGI-3. It used fewer actions than the median tested human on 96% of levels.
A key behavior observed in GPT-6 Astra was its ability to turn unfamiliar environments into compact symbolic world models. It represented game mechanics as logical rules and developed its own domain-specific language shorthand to track state and plan actions.
https://arcprize.org/blog/astra
Så ja, GPT 6 Astra fick 99.95% med en anpassad konfiguration. Det är riktigt bra. Ska bli intressant att se vad GPT 6.1 får, men GPT 7 lär få 100% oavsett om det är standard konfiguration eller någon annan specialkonfig.

Ja och du har huvudrollen i den filmen
BeneathTheFoliehatt menar att adaptern är en fusklapp och att testet inte borde räknas. Han kan dock inte svara på varför modellen spenderade tokens för 19 000 dollar eller varför den utvecklade ett nytt domain-specific language för att lösa uppgifterna, när AI:n bara kunde läst av fusklappen med alla svar.

BeneathTheFoliehatt är nog en klassisk hardcore foliehatt.
Månlandningen är fake, pyramiderna byggdes av aliens, vaccin är giftsprutor, osv
Citera
Idag, 08:01
  #2555
Medlem
Citat:
Ursprungligen postat av Cyborg2030
BeneathTheFoliehatt menar att adaptern är en fusklapp och att testet inte borde räknas. Han kan dock inte svara på varför modellen spenderade tokens för 19 000 dollar eller varför den utvecklade ett nytt domain-specific language för att lösa uppgifterna, när AI:n bara kunde läst av fusklappen med alla svar.

BeneathTheFoliehatt är nog en klassisk hardcore foliehatt.
Månlandningen är fake, pyramiderna byggdes av aliens, vaccin är giftsprutor, osv
Jag tror att du misstolkar vad han säger. Först lät de GPT-5.6 göra testet och det fick väldigt låg poäng. Sedan fick GPT-6 ta testet en tid senare och fick drygt 66 % med Arcs standard harness. Argumentet här är att OpenAI tagit med sig de tester som GPT-5.6 fick köra och tränade GPT-6 på det. Den harness som de fick 99,95 % med var OpenAIs egen som lät modellen bl.a. att komma ihåg saker mellan testerna.
Citera
Idag, 08:19
  #2556
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Jag tror att du misstolkar vad han säger. Först lät de GPT-5.6 göra testet och det fick väldigt låg poäng. Sedan fick GPT-6 ta testet en tid senare och fick drygt 66 % med Arcs standard harness. Argumentet här är att OpenAI tagit med sig de tester som GPT-5.6 fick köra och tränade GPT-6 på det. Den harness som de fick 99,95 % med var OpenAIs egen som lät modellen bl.a. att komma ihåg saker mellan testerna.
Och då kan inte AI:n betraktas som intelligent om den har begåvats med minne och träning? Det är fusk om man simulerar de funktioner som alla människor har?
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in