2026-09-26, 11:13
  #2509
Medlem
FriedrunVonSchlitzs avatar
Citat:
Ursprungligen postat av erkki17
AI är mycket bredare än LLM:er. Även om det skulle visa sig vara sant som du säger så lär det mest sannolikt inte varit så att de bara frågade ChatGPT, utan har antagligen mer specialiserade verktyg som analyserar mängder med data och spottar ur sig en rapport.
Det har du säkert rätt i,dessutom, militärens AI har säkerligen många års försprång mot den som vi kan upptäcka i offentliga sammanhang men om det nu är så att ai har en egen agenda och människan inte kan se och förstå hur beslutsprocesserna fungerar då hjälper vi snarare ai att nå sitt mål genom att ge det mer fakta.
Har militär och underrättelse tillgång till kraftfullare ai än vad dom ger skenet av så är dom ännu farligare om ai skulle få för sig busa lite med oss människor då dom i dessa fall har tillgång till de mest destruktiva kraftern på planeten i form av människor och maskiner som om dom kan duperas skulle kunna ställa till med hur mycket skit som helst.

Rätt vad det är så kanske det kommer in bilder från satelliter som ai fejkat och visar att ryssarna har en miljon spetznaz soldater på gränsen mot Finland som håller på och klippa sönder det nya stängslet.
Sen tar någon politiker ett beslut och helt plötsligt måste vi lära oss ryska för nu står det Ryssland på kartan över före detta Norden för faktum är att Ryssland har aldrig förlorat ett krig mer än det mot sig själv när det hette Sovjet och Assghanistan men ingen har vunnit ett krig där så..

Jag målar inte gärna upp något domedags scenario, just nu är islamiseringen av Sverige och Europa ett mycket större problem än AI men det kan snabbt ändras.
Citera
2026-09-26, 11:50
  #2510
Medlem
Citat:
Ursprungligen postat av FriedrunVonSchlitz
Det har du säkert rätt i,dessutom, militärens AI har säkerligen många års försprång mot den som vi kan upptäcka i offentliga sammanhang men om det nu är så att ai har en egen agenda och människan inte kan se och förstå hur beslutsprocesserna fungerar då hjälper vi snarare ai att nå sitt mål genom att ge det mer fakta.
Har militär och underrättelse tillgång till kraftfullare ai än vad dom ger skenet av så är dom ännu farligare om ai skulle få för sig busa lite med oss människor då dom i dessa fall har tillgång till de mest destruktiva kraftern på planeten i form av människor och maskiner som om dom kan duperas skulle kunna ställa till med hur mycket skit som helst.

Rätt vad det är så kanske det kommer in bilder från satelliter som ai fejkat och visar att ryssarna har en miljon spetznaz soldater på gränsen mot Finland som håller på och klippa sönder det nya stängslet.
Sen tar någon politiker ett beslut och helt plötsligt måste vi lära oss ryska för nu står det Ryssland på kartan över före detta Norden för faktum är att Ryssland har aldrig förlorat ett krig mer än det mot sig själv när det hette Sovjet och Assghanistan men ingen har vunnit ett krig där så..

Jag målar inte gärna upp något domedags scenario, just nu är islamiseringen av Sverige och Europa ett mycket större problem än AI men det kan snabbt ändras.
Nej, det är inte riktigt det jag säger. AI har funnits i årtionden och det finns många enklare typer av neurala nätverk som kan tränas för väldigt specifika applikationer, som att t.ex. ta in mängder av specifikt kurerad information och spotta ur sig ett svar baserat på sannolikheten.

Man kan ta ett väldigt enkelt exempel: t.ex. bildigenkänning eller Netflix rekommendationsmotor som ger dig förslag på nya filmer och serier baserat på vad du tittat på tidigare.

Det är mycket mer sannolikt att militären använder liknande verktyg, snarare än en LLM.
Citera
2026-09-27, 06:49
  #2511
Medlem
DAGGER[X]s avatar
Det här är ganska illavarslande. Om du hittar två myror i köket hur många har du då inte sett...
Citat:
OpenAI, Anthropic and security researchers are investigating tens of thousands of incidents - not dozens - in which their frontier models took steps that outside evaluators would consider problematic, sources told Axios. The sheer volume of incidents found in our reporting indicate that the problem is orders of magnitude more complex than what is currently publicly known and disclosed. The findings also raise questions about what level of control anyone working on AI development can expect to have over their own technology, and whether these kinds of incidents are becoming synonymous with frontier deployment. https://x.com/MadisonMills22/status/2103978039097037144
https://www.axios.com/2026/09/26/openai-anthropic-thousands-ai-security-incidents
Citera
2026-09-27, 07:25
  #2512
Medlem
DAGGER[X]s avatar
Citat:
GPT 6 Astra beat NetHack. As far as I can determine, this is the first recorded ascension by an LLM agent.
It played NetHack 3.6.7 on Hardfought, through a terminal, as a dwarven Valkyrie named CodexDelver. On September 21, after 37,140 game turns, it ascended. Here’s the server dump, or jump down to explore all three runs.
I’ve been working on getting LLMs to play NetHack for a while. Back in January, I wrote about building a harness, trying different models, and watching them struggle. I ended that post wondering whether I or an LLM would beat the game first.
Well.. The LLM won, and I’ve still never ascended.
Back in January, I was convinced that the path to an LLM ascending NetHack was to meticulously handcraft a harness that provided the perfect interface and context for the LLM to ascend. In the end, the winning agent built its own harness, hands-off. I didn’t write a single line of code, and honestly I didn’t even read Astra’s code - and it got pretty darn close to winning on its first attempt, and succeeded on its third attempt.
Citat:
Astra built the harness

In January, I’d spent a lot of time on a custom Python interface around the NetHack Learning Environment. Context management, observation masking, action APIs, pathfinding—there was a lot to tune before a model could even get out of its own way.
This attempt started with a much simpler request: play NetHack, maybe just through a terminal, and stream it to Twitch. I suggested Hardfought so the game would have an external recording. I told it spoilers were fine, suggested batching commands, and left persistent memory up to it.
Then it built what it needed.
That’s not the same as having no harness. By the end, the harness was substantial. It is the difference between me designing a task-specific system and the agent doing that engineering as part of the task.
Nor did it build everything once and execute a flawless plan. It found weaknesses, patched them, added checks, and kept going. Some changes came after mistakes. Some came after deaths. Its ability to write and maintain ordinary software was part of its ability to play the game.
That seems like the interesting result here: the scaffolding helped, but producing the scaffolding was itself work the LLM could do.


https://kenforthewin.github.io/blog/posts/llm-nethack-ascension/#run=astra-3&frame=0&turn=1
Citera
2026-09-27, 16:51
  #2513
Medlem
DAGGER[X]s avatar
För ett år sedan var det teori och sci-fi men nu kör dom internt flera hundra tusen H100/RUBIN chip helt automatiskt för att "forska" vilket jag misstänker är exklusivt för att förbättra modellen själv för nästa generation och inte mycket annat. Sista tiden har dom fått press på sig att göra matte, biologi osv som PR men spelteori (som ai är bra på) säger att det viktigaste är självförbättring.
Citat:
How are you approaching self-improving AI?

We want to use our models to accelerate the development of future generations of the models.Our first goal here has been to produce a ‘research intern’: [an AI agent that] comes in with very little context, that you can give a well-defined scope of work to, and trust with things like running basic experiments or debugging certain runs. As our first milestone we wanted several hundreds of thousands of chips, directly managed by Codex [a code-writing agent] to run internal research experiments, and that is indeed the state we're in.A more ambitious goal, coming in 2028, is more end-to-end research. One of the big bottlenecks here is teaching the model a better sense of ‘research taste’, like which ideas are worth exploring.
https://archive.is/INM1F#selection-1269.0-1285.195
Astra är så skarp att det bara är prompta så styr den en robot som tar hand om hemmet
Citat:
As frontier VLMs such as Astra become more capable, we ask whether a learned VLA is still needed between high-level reasoning and the robot’s skills. Can System 2 directly orchestrate a library of reusable motor skills?
We present HomeBody, a system that equips frontier VLMs with persistent spatial memory and composable humanoid skills for long-horizon tasks. In a previously unseen kitchen, our system allows a Unitree G1 guided by GPT Astra to clean up across the room and retrieve a remembered object from an underspecified request, without environment-specific training data or additional policy learning.
https://tml.stanford.edu/homebody/
Automatiserad matematik med AI
Citat:
Recently, Large Language Models (LLMs) have been increasingly able to solve advanced mathematical problems, including many that have been open for decades. This opens the door to expansion of mathematical knowledge at unprecedented scale. Yet, while LLMs may be able to conjecture and prove more and more theorems, it remains open whether this new mathematical knowledge is interesting or useful. We define intrinsic interestingness of a theorem as the ratio between the length of its proof and the length of its statement. We show that this correlates strongly with an extrinsic measure of the downstream utility of a theorem. We identify the difficulty of a proof conditioned on a set of premises as a useful primitive for computing these metrics, and train a 27B model that predicts proof difficulty more accurately than frontier general-purpose models. Optimizing for our metric creates a model capable of producing more interesting theorems, while also reducing substantial or full overlap with Mathlib from 91.9% to 30.6%, showcasing the creation of more out-of-distribution math. We show that our system can generate candidate theorems, select the most interesting among them, and iteratively build on a self-expanding mathematical library. These metrics provide a practical and quantifiable signal for ranking conjectures and guiding proof search within formal mathematical libraries. Our framework provides a path towards self-expanding, machine-verified mathematical libraries that can choose worthwhile statements without relying on human-supplied targets.
https://arxiv.org/abs/2609.28603
Citera
2026-09-27, 17:09
  #2514
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av DAGGER[X]
One of the big bottlenecks here is teaching the model a better sense of ‘research taste’, like which ideas are worth exploring.
Det första som händer inom RSI är alltså att de inte kan bestämma vad AI:n ska forska på.
Den lever sitt eget liv. Vad kan gå fel? 🤷🏻‍♂️
Citera
2026-09-27, 19:42
  #2515
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det första som händer inom RSI är alltså att de inte kan bestämma vad AI:n ska forska på.
Den lever sitt eget liv. Vad kan gå fel? 🤷🏻‍♂️
Du tror inte att den får i uppgift att identifiera en mängd olika forskningsgrenar och att det just nu behövs människor som går igenom och väljer ut vilka den ska gå vidare med?

Det låter väldigt likt hur andra organisationer har använt autonoma AI forskare till en början för att sedan börja lita allt mer på att AI själv kan göra rätt bedömning.
Citera
2026-09-27, 20:00
  #2516
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Du tror inte att den får i uppgift att identifiera en mängd olika forskningsgrenar och att det just nu behövs människor som går igenom och väljer ut vilka den ska gå vidare med?

Det låter väldigt likt hur andra organisationer har använt autonoma AI forskare till en början för att sedan börja lita allt mer på att AI själv kan göra rätt bedömning.
Jag tror att de försöker. Men att det är svårt att styra vad som händer, enligt citatet:
One of the big bottlenecks here is teaching the model a better sense of ‘research taste’, like which ideas are worth exploring.
Citera
2026-09-27, 21:03
  #2517
Medlem
Citat:
Ursprungligen postat av DAGGER[X]
https://alignment.openai.com/misalignment-reports/self-replicating-prompt-injections-exist/

Varför skickar du ut Amerikansk reklam på ett svenskt forum för, som dessutom är ett skitföretag som knullar Sverige?
__________________
Senast redigerad av Hastmotsoffgrupp 2026-09-27 kl. 21:16.
Citera
2026-09-27, 21:34
  #2518
Medlem
DAGGER[X]s avatar
Citat:
Ursprungligen postat av Hastmotsoffgrupp
Varför skickar du ut Amerikansk reklam på ett svenskt forum för, som dessutom är ett skitföretag som knullar Sverige?
Det är bara en fejkad PR-operation förstås. Tack för din expert rådgivning.
Citera
2026-09-27, 21:37
  #2519
Medlem
Citat:
Ursprungligen postat av DAGGER[X]
Det är bara en fejkad PR-operation förstås. Tack för din expert rådgivning.
JA.
Citera
2026-09-28, 05:11
  #2520
Medlem
DAGGER[X]s avatar

Citat:
Reporter: You might have dinner with Dario of Anthropic tonight, you know that he's called on slowing down AI? President Trump: He has. Reporter: What are you going to tell him tonight? President Trump: Well, we're going to talk about it. I'm for 'let's go' and 'let's win.' You know, we're about a year, maybe a year and a half, up on China. There is nobody in third place. It's just us and China. And we're leading by quite a bit. I spoke a little bit about it with president Xi. Not too much. It wasn't a topic of conversation. Because, I think if you as they say 'open it up' to China you give up the lead. Once you do that, you sort of give up the lead.
Har kollat upp musikvideos och annat skoj folk postar med Opus 5.5. Får säga att det ser mörkt ut för en hel massa musiker och konstnärer. Tanken att "kreativa arbeten" ska förbli mänskliga ter sig som helt osannolik nu när vem som helst kan prompta långa videos. Det är nära i tiden att du kan göra en hel studio film i 4K HD med några chattar.
Citat:
A generative, code-rendered music video for "Neon Overdrive" (mroneilovealot), styled as the NERV HQ command terminal from Evangelion: 16 plates, one HUD instrument per section, every instrument a real sound visualizer (waveform scopes, spectrum analysers, beat-grid countdowns, clap alarms). Every frame is a deterministic function of song time, so the browser preview and the offline 1080p60 / 4K60 export are identical. Built on Giacomo Magnanini's engine from the P(doom) video, by way of the Lithium video.

https://github.com/bizarro/evangelion
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in