Så är det, men det handlar ju om en subjektiv upplevelse. Frågan är ju för vem det inte spelar någon roll då.
Jag menar vi har ju redan idag exempel på detta som datorskärmar, ljuduppspelning osv, dvs den ena producerar ju faktiskt inte rörliga bilder utan snabba slideshows som vi upplever som rörligt material. Den andra spelar faktiskt inte en gitarr när vi lyssnar på rock, men vi upplever det så.
Men det innebär inte att det är lämpligt för alla uppgifter ändå och det betyder definitivt inte att varenda organism eller varelse på jorden blir lurad av dessa illusioner, de är specifikt designade för människan precis som AI idag är tränad specifikt på mänsklig text. Hittills har totalt alla försök med att använda denna teknik för att försöka förstå djurkommunikation osv misslyckats, man kan ju fråga sig varför.
Det är ju sant, men den dagen LLM:s eller andra modeller kan utföra komplexa uppgifter som gott simulerar allt från riskbedömningar, källkritik, avancerade resonemang och informationsinhämtning/behandling/bedömning så kvittar det ju om det bara är människan som "blir lurad".
Det var väl knappast ett svar på min alignment lösning? Att grundmodellens egna träning inte kan förhindra jailbreaks vet vi redan, det är därför AI-polisen behövs den kommer ju sätta stopp för detta. Att stapla modellerna på varandra bygger ett virtuellt samhälle där AI sköter om AI, det är pansarsäkert. Så nu kan vi sluta oroa oss om detta, lösningen är ju här.
Alla tidigare försök med censurfilter har jailbreakats.
Definitionen av idioti är att göra samma sak om och om igen och förvänta sig ett annat resultat.
Det är ju sant, men den dagen LLM:s eller andra modeller kan utföra komplexa uppgifter som gott simulerar allt från riskbedömningar, källkritik, avancerade resonemang och informationsinhämtning/behandling/bedömning så kvittar det ju om det bara är människan som "blir lurad".
Ja beroende på tillämpning. För att skriva dikter, trams och bara få en virtuell rövslickare så fungerar dagens LLM utmärkt redan.
Jag har inte sagt att jag tycker att det är en toppenidé, jag förklarar bara resonemanget bakom att välja den vägen i just detta fall.
Som redan sagt så går det att förhindra att en modell genererar oönskad output, men det kan aldrig vara 100 % vattentätt eftersom modellerna inte är deterministiska. Därför är det klokt att även lägga på lager av säkerhet ovanpå som kontrollerar output (och till viss del även input) som kan fånga upp det som eventuellt ändå slinker igenom.
Jag tror att du nog själv förstår att en helt deterministisk AI är en tämligen värdelös AI. Om vi hela tiden kan förutse exakt vad en modell kommer att svara på given prompt, vad ska vi då med AI till?
Jag vet inte hur de ska lösa AI Alignment och det är inte mitt problem att lösa. Hittills har jag inte sett någon hypotes om hur de kan lösa det. Vilket indikerar att problemet inte komner att lösas.
Alla tidigare försök ned Censurfilter har misslyckats. Vad tyder på att man nu plötsligt har skapat en felfri censurmaskin?
Hur tänker du att detta ska fungera ca 2030 med autonoma agenter och robotar? Ska de censurera sig själva?
The statement:
Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war.
Signatories:
Geoffrey Hinton
Emeritus Professor of Computer Science, University of Toronto
Yoshua Bengio
Professor of Computer Science, U. Montreal / Mila
Demis Hassabis
CEO, Google DeepMind
Sam Altman
CEO, OpenAI
Dario Amodei
CEO, Anthropic
Dawn Song
Professor of Computer Science, UC Berkeley
Ted Lieu
Congressman, US House of Representatives
Bill Gates
Gates Ventures
Ya-Qin Zhang
Professor and Dean, AIR, Tsinghua University
Ilya Sutskever
Co-Founder and Chief Scientist, OpenAI
Igor Babuschkin
Co-Founder, xAI
Shane Legg
Chief AGI Scientist and Co-Founder, Google DeepMind
Martin Hellman
Professor Emeritus of Electrical Engineering, Stanford
James Manyika
SVP, Research, Technology and Society, Google-Alphabet
Yi Zeng
Professor and Director of Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences
Xianyuan Zhan
Assistant Professor, Tsinghua University
Albert Efimov
Chief of Research, Russian Association of Artificial Intelligence
Alvin Wang Graylin
China President, HTC
Jianyi Zhang
Professor, Beijing Electronic Science and Technology Institute
Anca Dragan
Associate Professor of Computer Science, UC Berkeley
Christine Parthemore
CEO and Director of the Janne E. Nolan Center on Strategic Weapons, The Council on Strategic Risks
Bill McKibben
Schumann Distinguished Scholar, Middlebury College
Alan Robock
Distinguished Professor of Climate Science, Rutgers University
Angela Kane
Vice President, International Institute for Peace, Vienna; former UN High Representative for Disarmament Affairs
Audrey Tang
Digitalminister.tw and Chair of National Institute of Cyber Security
Daniela Amodei
President, Anthropic
David Silver
Professor of Computer Science, Google DeepMind and UCL
Lila Ibrahim
COO, Google DeepMind
Stuart Russell
Professor of Computer Science, UC Berkeley
Tony (Yuhuai) Wu
Co-Founder, xAI
Marian Rogers Croak
VP Center for Responsible AI and Human Centered Technology, Google
Andrew Barto
Professor Emeritus, University of Massachusetts
Mira Murati
CTO, OpenAI
Jaime Fernández Fisac
Assistant Professor of Electrical and Computer Engineering, Princeton University
Diyi Yang
Assistant Professor, Stanford University
Gillian Hadfield
Professor, CIFAR AI Chair, University of Toronto, Vector Institute for AI
Laurence Tribe
University Professor Emeritus, Harvard University
Pattie Maes
Professor, Massachusetts Institute of Technology - Media Lab
Kevin Scott
CTO, Microsoft
Eric Horvitz
Chief Scientific Officer, Microsoft
Peter Norvig
Education Fellow, Stanford University
Joseph Sifakis
Turing Award 2007, Professor, CNRS - Universite Grenoble - Alpes
Atoosa Kasirzadeh
Assistant Professor, University of Edinburgh, Alan Turing Institute
Erik Brynjolfsson
Professor and Senior Fellow, Stanford Institute for Human-Centered AI
Mustafa Suleyman
CEO, Inflection AI
Emad Mostaque
CEO, Stability AI
Ian Goodfellow
Principal Scientist, Google DeepMind
John Schulman
Co-Founder, OpenAI
Wojciech Zaremba
Co-Founder, OpenAI
Dan Hendrycks
Executive Director, Center for AI Safety
The statement:
Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war.
Signatories:
Geoffrey Hinton
Emeritus Professor of Computer Science, University of Toronto
Yoshua Bengio
Professor of Computer Science, U. Montreal / Mila
Demis Hassabis
CEO, Google DeepMind
Sam Altman
CEO, OpenAI
Dario Amodei
CEO, Anthropic
Dawn Song
Professor of Computer Science, UC Berkeley
Ted Lieu
Congressman, US House of Representatives
Bill Gates
Gates Ventures
Ya-Qin Zhang
Professor and Dean, AIR, Tsinghua University
Ilya Sutskever
Co-Founder and Chief Scientist, OpenAI
Igor Babuschkin
Co-Founder, xAI
Shane Legg
Chief AGI Scientist and Co-Founder, Google DeepMind
Martin Hellman
Professor Emeritus of Electrical Engineering, Stanford
James Manyika
SVP, Research, Technology and Society, Google-Alphabet
Yi Zeng
Professor and Director of Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences
Xianyuan Zhan
Assistant Professor, Tsinghua University
Albert Efimov
Chief of Research, Russian Association of Artificial Intelligence
Alvin Wang Graylin
China President, HTC
Jianyi Zhang
Professor, Beijing Electronic Science and Technology Institute
Anca Dragan
Associate Professor of Computer Science, UC Berkeley
Christine Parthemore
CEO and Director of the Janne E. Nolan Center on Strategic Weapons, The Council on Strategic Risks
Bill McKibben
Schumann Distinguished Scholar, Middlebury College
Alan Robock
Distinguished Professor of Climate Science, Rutgers University
Angela Kane
Vice President, International Institute for Peace, Vienna; former UN High Representative for Disarmament Affairs
Audrey Tang
Digitalminister.tw and Chair of National Institute of Cyber Security
Daniela Amodei
President, Anthropic
David Silver
Professor of Computer Science, Google DeepMind and UCL
Lila Ibrahim
COO, Google DeepMind
Stuart Russell
Professor of Computer Science, UC Berkeley
Tony (Yuhuai) Wu
Co-Founder, xAI
Marian Rogers Croak
VP Center for Responsible AI and Human Centered Technology, Google
Andrew Barto
Professor Emeritus, University of Massachusetts
Mira Murati
CTO, OpenAI
Jaime Fernández Fisac
Assistant Professor of Electrical and Computer Engineering, Princeton University
Diyi Yang
Assistant Professor, Stanford University
Gillian Hadfield
Professor, CIFAR AI Chair, University of Toronto, Vector Institute for AI
Laurence Tribe
University Professor Emeritus, Harvard University
Pattie Maes
Professor, Massachusetts Institute of Technology - Media Lab
Kevin Scott
CTO, Microsoft
Eric Horvitz
Chief Scientific Officer, Microsoft
Peter Norvig
Education Fellow, Stanford University
Joseph Sifakis
Turing Award 2007, Professor, CNRS - Universite Grenoble - Alpes
Atoosa Kasirzadeh
Assistant Professor, University of Edinburgh, Alan Turing Institute
Erik Brynjolfsson
Professor and Senior Fellow, Stanford Institute for Human-Centered AI
Mustafa Suleyman
CEO, Inflection AI
Emad Mostaque
CEO, Stability AI
Ian Goodfellow
Principal Scientist, Google DeepMind
John Schulman
Co-Founder, OpenAI
Wojciech Zaremba
Co-Founder, OpenAI
Dan Hendrycks
Executive Director, Center for AI Safety
Show more
Är detta de flesta? Det ser mer ut som du hittat en lista med folk som skrivit på något du tycker låter som något du tycker.
Är detta de flesta? Det ser mer ut som du hittat en lista med folk som skrivit på något du tycker låter som något du tycker.
Har du något exempel på någon erkänd AI-forskare som säger att det inte finns någon risk med att utveckla AGI?
Du refererade tidigare till "alla". Då borde du kunna nämna en?
Definitionen av idioti är att göra samma sak om och om igen och förvänta sig ett annat resultat.
Det är dock mycket den typen av aktiviteter som tagit oss från stenåldern.
Bara tänk på så många försök som gjorts innan man kunde domesticera husdjuren.
Det är dock mycket den typen av aktiviteter som tagit oss från stenåldern.
Bara tänk på så många försök som gjorts innan man kunde domesticera husdjuren.
Människor försökte nog ganska länge innan de lyckades med att domesticera djur. Några strök kanske med i början när de försökte tämja hästar och tjurar. Men de flesta överlevde. Hur många försök tror du att vi får på att domesticera en ASI? Vad händer om det misslyckas? Vilket verkar sannolikt med nuvarande säkerhetsprotokoll: Djävulens advokat + Regex-filter.
Alla tidigare försök med censurfilter har jailbreakats.
Definitionen av idioti är att göra samma sak om och om igen och förvänta sig ett annat resultat.
Låter väldigt mycket som beteendet i den här tråden (och hela forumdelen). Här tjatar jag på dig, fast du gång på gång visar dig oförmögen att ta in ny information.
Sluta kalla det censurfilter. Dom routar om vissa frågor. Vi som jobbar med detta är inte särskilt oroliga, det är mest hypesnack för att skrämma otekniska och sälja dyrare tokens.
Censur är något helt annat, t ex när Deepseek vägrar svara om frågor gällande kinesiska staten. Med ditt argument borde vi inte köra bil, för dessa kan användas som vapen och folk kan dö i krascher. Vi borde verkligen inte flyga, störtar planet dör allesammans. Och kärnkraftverk borde totalförbjudas.
Nyttan med dessa AI-modeller är mycket högre än riskerna. Så p(doom) kryper mot noll för dessa modeller, lille vän.