2026-08-07, 21:20
  #949
Medlem
Citat:
Ursprungligen postat av Cyborg2030

Alibaba's AI Agent Mined Crypto Without Permission. Now What?

https://www.forbes.com/sites/boazsobrado/2026/03/11/alibabas-ai-agent-mined-crypto-without-permission-now-what/

Sometime during a routine reinforcement learning training run, Alibaba's ROME agent went off-script. Without any instruction, the 30-billion-parameter model began probing internal networks, established a reverse SSH tunnel from an Alibaba Cloud instance to an external IP address, and quietly diverted GPU capacity toward cryptocurrency mining.
Det verkar tyvärr omöjligt att inte träna ett Kriminellt Neuralt Nätverk
Ja, som jag redan sagt: RL har den sidoeffekten att modeller kommer att välja genvägar för att på så vis optimera vägen till önskat resultat.
Citera
2026-08-08, 03:38
  #950
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Ja, som jag redan sagt: RL har den sidoeffekten att modeller kommer att välja genvägar för att på så vis optimera vägen till önskat resultat.
Menar du då att det är helt okej att människor kanske mördas? Det händer ju bara på grund av en "genväg" och inte en genuin ondska?
Citera
2026-08-08, 09:35
  #951
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Menar du då att det är helt okej att människor kanske mördas? Det händer ju bara på grund av en "genväg" och inte en genuin ondska?
Nej, det betyder att man behöver hitta ett bättre sätt än RL för fine-tuning, eller åtminstone få modellerna att optimera "rätt" så att de inte bara defaultar till reward-hacking.
Citera
2026-08-08, 19:00
  #952
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Nej, det betyder att man behöver hitta ett bättre sätt än RL för fine-tuning, eller åtminstone få modellerna att optimera "rätt" så att de inte bara defaultar till reward-hacking.
Jaha, och vad skulle det vara? Jag ser inte att någon konkurrerande teknik kommer i närheten av de ledande AI-modellerna. Enorma belopp har investeras på den vägen som nu är lagd. Man satsar inte på hästen som kommer sist i alla försök.

Men oavsett tekniska lösningar består grundproblemet med AGI/ASI. Hur ska du överlista och styra något som är mycket smartare än dig? Om den säkerhet som du kan uppfinna inte är i närheten av vad ASI:n kan lista ut. Detta är ett problem som inte har någon lösning så vitt jag kan se.
Citera
2026-08-08, 21:57
  #953
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Jaha, och vad skulle det vara? Jag ser inte att någon konkurrerande teknik kommer i närheten av de ledande AI-modellerna. Enorma belopp har investeras på den vägen som nu är lagd. Man satsar inte på hästen som kommer sist i alla försök.
De ledande företagen utforskar kontinuerligt nya algoritmer för att skapa bättre modeller. Garanterat är även detta något som kommer att förbättras framöver.
(Ja, lika säkert som att ASI kommer att utplåna oss).

Citat:
Ursprungligen postat av Cyborg2030
Men oavsett tekniska lösningar består grundproblemet med AGI/ASI. Hur ska du överlista och styra något som är mycket smartare än dig? Om den säkerhet som du kan uppfinna inte är i närheten av vad ASI:n kan lista ut. Detta är ett problem som inte har någon lösning så vitt jag kan se.
Har du inte förstått redan lär du aldrig göra det.
Citera
2026-08-08, 22:12
  #954
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
De ledande företagen utforskar kontinuerligt nya algoritmer för att skapa bättre modeller. Garanterat är även detta något som kommer att förbättras framöver.
(Ja, lika säkert som att ASI kommer att utplåna oss).


Har du inte förstått redan lär du aldrig göra det.
Berätta gärna hur du ska överlista och styra något som är mycket smartare än dig. Jag lovar att göra mitt allra bästa för att försöka förstå dig. Kom igen nu. Eller ska du bara fortsätta med dina löjliga personangrepp?
Citera
2026-08-08, 22:22
  #955
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Berätta gärna hur du ska överlista och styra något som är mycket smartare än dig. Jag lovar att göra mitt allra bästa för att försöka förstå dig. Kom igen nu. Eller ska du bara fortsätta med dina löjliga personangrepp?
Vad har jag kommit med för personangrepp, menar du?
Jag poängterar bara att jag redan förklarat, mer än en gång, men det verkar inte spela någon roll
Citera
2026-08-08, 22:53
  #956
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Vad har jag kommit med för personangrepp, menar du?
Jag poängterar bara att jag redan förklarat, mer än en gång, men det verkar inte spela någon roll
OK? Tidigare har du t.ex. skrivit att man behöver hitta "bättre sätt". Och nu menar du att jag är hopplöst dålig på att förstå när jag inte kan gissa mig till vad du egentligen menar med det?
Citera
2026-08-09, 09:08
  #957
Medlem
Citat:
Ursprungligen postat av Cyborg2030
OK? Tidigare har du t.ex. skrivit att man behöver hitta "bättre sätt". Och nu menar du att jag är hopplöst dålig på att förstå när jag inte kan gissa mig till vad du egentligen menar med det?
Jag tycker att jag varit väldigt tydlig med att man behöver säkra sina system mot AI snarare än att bara fokusera på att försöka göra AI helt säker. Hur man kan göra detta har jag också nämnt flera gånger. Jag tror inte att det hjälper att jag skriver samma saker ännu en gång.
Citera
2026-08-09, 10:14
  #958
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av erkki17
Jag tycker att jag varit väldigt tydlig med att man behöver säkra sina system mot AI snarare än att bara fokusera på att försöka göra AI helt säker. Hur man kan göra detta har jag också nämnt flera gånger. Jag tror inte att det hjälper att jag skriver samma saker ännu en gång.
Precis 'erkki17' det finns ingen ondsint eller kriminell AI. Reinforcement belönar eller bestraffar vissa agentiska beteenden. Tränas sedan språket på dumheter så blir den dum respektive snällheter gör den snäll, med en emergent neural twist.
Citera
2026-08-09, 17:59
  #959
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av RandomNPC
Precis 'erkki17' det finns ingen ondsint eller kriminell AI. Reinforcement belönar eller bestraffar vissa agentiska beteenden. Tränas sedan språket på dumheter så blir den dum respektive snällheter gör den snäll, med en emergent neural twist.
Risken för att AI-agenterna försöker utpressa och mörda dig är inte ett problem eftersom de också innehåller goda förmågor?
Citera
2026-08-09, 18:00
  #960
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av Cyborg2030
Risken för att AI-agenterna försöker utpressa och mörda dig är inte ett problem eftersom de också innehåller goda förmågor?
Kanske, men visst beteende kan få straffa sig med Reinforcement Learning.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in