2026-07-02, 20:12
  #1753
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av HappyNewLives
Kausalitet behövs för stark AI. LLM är informationssystem som aldrig kommer bli AGI/ASI. För svag AI räcker det med korrelation. Detta är ofrånkomliga fakta.
Jag bevisade precis med ett enkelt exempel att dagens AI klarar kausalitet. Du menar kanske mer komplicerad kausalitet? Kan du gett ett exempel där AI misslyckas?
Citera
2026-07-02, 20:30
  #1754
Medlem
DAGGER[X]s avatar
Citat:
Ursprungligen postat av Cyborg2030
De vet att vi har rätt. Det som pågår nu är bara ett skyttegravskrig där några autister måste försvara sina tidigare åsikter för att inte tappa ansiktet. De kommer inte att ge upp oavsett vad som händer i verkligheten. Vi borde inte vara taskiga mot de handikappade men det är svårt att låta bli när de envisas med att ha fel in absurdum.
I AI 2027 scenariot fanns några pikar till IT folk som känner hotet börja materialisera sig. Jag misstänker att många av kritikerna själva ser IT som "sin grej" och störs av framfarten. Tråden om när AI kan programmera här på forumet finns kvar, det var intressant att se deras prognoser som var "flera år", "årtionden" eller "aldrig" och sen jämföra med Claude som kunde göra det hejvilt bara ett år efter den TSen. Då dog den debatten ut i tysthet. Till våren nästa år får vi veta om den prickade detta rätt, jag är inte tokgalen i AI, det kanske rinner ut i sanden eller framför allt grusas av någon katastrof som en solstorm eller kärnvapenkrig. Jag tänker fact checka mig själv här i forumet innan 2030 och äter gärna upp min hatt vid behov.
Detta är april nästa år
Citat:
Aided by the new capabilities breakthroughs, Agent-3 is a fast and cheap superhuman coder. OpenBrain runs 200,000 Agent-3 copies in parallel, creating a workforce equivalent to 50,000 copies of the best human coder sped up by 30x.53 OpenBrain still keeps its human engineers on staff, because they have complementary skills needed to manage the teams of Agent-3 copies. For example, research taste has proven difficult to train due to longer feedback loops and less data availability.54 This massive superhuman labor force speeds up OpenBrain’s overall rate of algorithmic progress by “only” 4x due to bottlenecks and diminishing returns to coding labor.55
Citera
2026-07-02, 20:35
  #1755
Medlem
HappyNewLivess avatar
Citat:
Ursprungligen postat av Cyborg2030
Jag bevisade precis med ett enkelt exempel att dagens AI klarar kausalitet. Du menar kanske mer komplicerad kausalitet? Kan du gett ett exempel där AI misslyckas?
Det skulle då vara viss arkitektur för självmodifierande mekanistisk kausalitet. LLM är uteslutet här.

https://www.sciencenewstoday.org/causal-ai-beyond-correlation-to-real-understanding
Citera
2026-07-02, 20:39
  #1756
Medlem
BeneathTheSurfaces avatar
Det här är ett ganska bra exempel på varför språkmodeller absolut inte är AGI. Dessutom kul med någon populär youtuber som inte hypar utan förklarar hur och varför på ett ganska korrekt sätt.

https://www.youtube.com/watch?v=lk3jCuITwcE
Citera
2026-07-02, 21:06
  #1757
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av HappyNewLives
Det skulle då vara viss arkitektur för självmodifierande mekanistisk kausalitet. LLM är uteslutet här.

https://www.sciencenewstoday.org/causal-ai-beyond-correlation-to-real-understanding
Jag saknar ett konkret exempel som vi kan testa. Det var tydligen svårt att klura ut.
Citera
2026-07-02, 21:10
  #1758
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Det här är ett ganska bra exempel på varför språkmodeller absolut inte är AGI. Dessutom kul med någon populär youtuber som inte hypar utan förklarar hur och varför på ett ganska korrekt sätt.

https://www.youtube.com/watch?v=lk3jCuITwcE
1. Halmgubbe. Ingen har sagt att LLM är AGI.
Varför ljuger du hela tiden? Du verkar ju helt desperat.

2. Vi debatterar inte med länkar på Flashback.
Citera
2026-07-03, 19:49
  #1759
Medlem
DAGGER[X]s avatar
Claude Fable 5
Citat:
Claude Fable 5 [max] wrote the first genuine (and fastest) megakernel ever submitted to KernelBench-Mega.
https://kernelbench.com/mega

Dom här cybersäkerhets-företagen skulle kanske jobba bättre om dom fick veta att AI är inte är på riktigt och egentligen bara är ett datavetenskapligt trix.
Citat:
Severe cybersecurity vulnerability disclosures (CVEs) spiked in 2026. In June, notable organizations published around 1,500 high- and critical-severity CVEs — more than 3.5× the monthly record prior to Mythos’ release.

https://epoch.ai/data-insights/cve-severity-spike
Citera
2026-07-03, 20:01
  #1760
Medlem
Citat:
Ursprungligen postat av Cyborg2030
1. Halmgubbe. Ingen har sagt att LLM är AGI.
Det är inte sant. Jag har föreslagit att vi skall se det som att AGI är uppnått Dvs AGI behöver inte vara mer fantastiska än de nuvarande LLM-produkterna.
De är iaf mer kompetenta än Mona Sahlin mfl.
Citera
2026-07-03, 20:10
  #1761
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av ekbo251
Det är inte sant. Jag har föreslagit att vi skall se det som att AGI är uppnått Dvs AGI behöver inte vara mer fantastiska än de nuvarande LLM-produkterna.
De är iaf mer kompetenta än Mona Sahlin mfl.
Jag föreslår att vi mäter objektivt.

✅ Hög mänsklig IQ på offline-test
✅ Turing-testet avklarat
✅ Extra svåra intelligenstest i form av Arc-AGI 1 & 2 godkända
✅ Speciella kunskapstester och programmeringstester, väl godkända
✅ Nya upptäckter inom matematik och fysik

De objektiva resultaten är svåra att förneka för aspies, autister, besserwissers och andra "B.S"-människor. De har mest åsikter om vad det här ska kallas eller hur det är möjligt, av någon anledning med stor lutning åt bortförklaringar.
Citera
2026-07-03, 22:33
  #1762
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Jag föreslår att vi mäter objektivt.
Hålleer helt med om det.

Citat:
Ursprungligen postat av Cyborg2030
✅ Hög mänsklig IQ på offline-test
✅ Turing-testet avklarat
✅ Extra svåra intelligenstest i form av Arc-AGI 1 & 2 godkända
✅ Speciella kunskapstester och programmeringstester, väl godkända
✅ Nya upptäckter inom matematik och fysik
Jag tänker mig mer:
* minst 100 på IQ-test.
* minst 1.0 på HP eller motsvarande.

Då är man hemma med AGI.

Sedan kan man för all del sätta upp ett nytt svårare mål. AGI2 eller nåt.
* minst 110 på IQ-test.
* minst 1.3 på HP eller motsvarande.

Osv.


Citat:
Ursprungligen postat av Cyborg2030
De objektiva resultaten är svåra att förneka för aspies, autister, besserwissers och andra "B.S"-människor. De har mest åsikter om vad det här ska kallas eller hur det är möjligt, av någon anledning med stor lutning åt bortförklaringar.
Känslomänniskor kan i sig alltid förneka. Homo sapiens är enormt duktig på att förneka fakta.

Men på det här viset så kan ju känslomänniskorna öka målen dom också.
Citera
2026-07-03, 22:40
  #1763
Medlem
Citat:
Ursprungligen postat av BeneathTheSurface
Det här är ett ganska bra exempel på varför språkmodeller absolut inte är AGI. Dessutom kul med någon populär youtuber som inte hypar utan förklarar hur och varför på ett ganska korrekt sätt.

https://www.youtube.com/watch?v=lk3jCuITwcE


Citat:
Ursprungligen postat av Cyborg2030
Jag föreslår att vi mäter objektivt.

✅ Hög mänsklig IQ på offline-test
✅ Turing-testet avklarat
✅ Extra svåra intelligenstest i form av Arc-AGI 1 & 2 godkända
✅ Speciella kunskapstester och programmeringstester, väl godkända
✅ Nya upptäckter inom matematik och fysik

De objektiva resultaten är svåra att förneka för aspies, autister, besserwissers och andra "B.S"-människor. De har mest åsikter om vad det här ska kallas eller hur det är möjligt, av någon anledning med stor lutning åt bortförklaringar.

Strunta i vad chatbotar kan och fokusera på AI-agenter. En människa som har högt IQ och klarar att svara rätt på tentafrågor behöver inte klara att planera och genomföra stora arbetsuppgifter självständigt.

Den 22 maj 2026 uppnådde en AI-agent AGI!

Eller åtminstone överträffade den 92 % på GAIA-skalan, vilket är människors genomsnitt på den skalan. Källa: https://huggingface.co/spaces/gaia-benchmark/leaderboard

Även om det finns andra benchmark för AGI är GAIA ett av de främsta. Så detta är en milstolpe. GAIA är ett benchmark för generell assistentförmåga och testar bland annat resonemang, verktygsanvändning, webbsökning och självständig lösning av olika verkliga kontorsjobb.

Den första agenten som passerade människans nivå var "CustomGPT Agent": https://github.com/adorosario/customgpt-agent. Det är ett multiagentsystem där flera AI-agenter samarbetar i olika roller. Kärnan består av **Claude Opus 4** (för orkestrering) och **Claude Sonnet 4** (specialistagenter), med stöd även av GPT- och Gemini-modeller.

Märkligt att det inte har blivit någon stor nyhet i etablerade medier. Det diskuteras främst av vissa bloggare.
__________________
Senast redigerad av guru1966 2026-07-03 kl. 22:57.
Citera
2026-07-03, 23:10
  #1764
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av guru1966
Strunta i vad chatbotar kan och fokusera på AI-agenter. En människa som har högt IQ och klarar att svara rätt på tentafrågor behöver inte klara att planera och genomföra stora arbetsuppgifter självständigt.

Den 22 maj 2026 uppnådde en AI-agent AGI!

Eller åtminstone överträffade den 92 % på GAIA-skalan, vilket är människors genomsnitt på den skalan. Källa: https://huggingface.co/spaces/gaia-benchmark/leaderboard

Även om det finns andra benchmark för AGI är GAIA ett av de främsta. Så detta är en milstolpe. GAIA är ett benchmark för generell assistentförmåga och testar bland annat resonemang, verktygsanvändning, webbsökning och självständig lösning av olika verkliga kontorsjobb.

Den första agenten som passerade människans nivå var "CustomGPT Agent": https://github.com/adorosario/customgpt-agent. Det är ett multiagentsystem där flera AI-agenter samarbetar i olika roller. Kärnan består av **Claude Opus 4** (för orkestrering) och **Claude Sonnet 4** (specialistagenter), med stöd även av GPT- och Gemini-modeller.

Märkligt att det inte har blivit någon stor nyhet i etablerade medier. Det diskuteras främst av vissa bloggare.

Jag vet vad agentiska system kan och det är imponerande... när det går rätt. Men det gäller också att förstå att agentiska system har hur mycket kod och prompter runt modellerna för att styra dom så de beter sig som de gör, det är massvis med nivåer av babysitting och ändå är det inte skottsäkert.

Men än mer är problemet att om du inte sitter och detaljstyr systemen hela tiden så kan det bli hur som helst och det är också det som är det hemskaste med tekniken, för ledare tittar på solskenspresentationer, kanske ber den skapa några program/hemsidor osv och tänker "den här kan göra allt" men inser inte hur lite faktisk kontroll du har över processen och slutresultatet.

Och det blir bara värre och värre ju större ditt projekt blir, samtidigt är det en pina att som människa försöka hålla koll och en total bild över en produkt när det haglar in stora commits som om de dessutom slinker igenom kan totalt förändra något fundamentalt som modellen eller operatören inte förstod.

Det behövs en enorm disciplin för att detta ska fungera långsiktigt och som det är just nu tar det bort precis allt som var roligt med mjukvaruutveckling och lämnar skitgörat, samtidigt som ledningen tycker det sparar tid och drar ner på personal.

Men på andra sidan är det enormt spännande teknik som är banbrytande, men det är mycket den är på både gott och ont och just nu är det i huvudsak det onda som prioriteras...
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in