Intervju med Malon Bourgon:
https://youtu.be/3DuhFVHZFks?si=2mQMO8rFPofCOMpd
Frågade gpt 6 Astra ang honom:
"Malo Bourgon har relevant teknisk utbildning och omkring 14 års erfarenhet inom AI-säkerhet. Hans främsta dokumenterade kompetens ligger i säkerhetsstrategi, organisationsledning och policy. Och ja: MIRI:s två centrala seniora profiler delar hans hotbild och uttrycker sig delvis ännu mer kategoriskt. Däremot är deras höga katastrofsannolikheter inte någon etablerad konsensus inom hela AI-forskningen.
Hans utbildning och erfarenhet går att belägga så här:
Masterexamen i ingenjörsvetenskap från University of Guelph i Kanada. MIRI:s officiella biografi anger detta. Han har också själv beskrivit sin utbildning som ingenjörsvetenskap och datavetenskap. Jag har inte hittat någon uppgift om doktorsexamen. MIRI:s biografi, hans utskottsanförande.
På MIRI sedan 2012. Han arbetade först med program- och verksamhetsledning, blev därefter operativ chef, COO, och formellt vd i juni 2023. MIRI beskriver arbetsfördelningen som att Bourgon länge skötte verksamheten medan Nate Soares fokuserade på forskning och övergripande strategi. Ledningsförändringen.
Deltagit i internationellt säkerhetsarbete. IEEE:s dokumentation krediterar honom och Richard Mallah för ledningen av en kommitté om säkerhet för AGI och superintelligens. IEEE:s dokument.
Medförfattare till Singapore Consensus om forskningsprioriteringar inom AI-säkerhet 2025, tillsammans med bland andra Yoshua Bengio, Stuart Russell och Dawn Song. Det visar deltagande i ett etablerat internationellt forskningssammanhang; medförfattarskapet anger inte ensamt omfattningen av hans individuella bidrag. Originalrapporten.
Min bedömning av kompetensnivån: Han bör tas på allvar som en mycket erfaren specialist på existentiell AI-risk och styrningsfrågor. Hans dokumenterade meriter ger däremot inte grund för att placera honom bland världens främsta forskare på att utveckla och träna moderna språkmodeller. Det är olika kompetensområden.
Även beskrivningen ”chef för ett AI-säkerhetslaboratorium” behöver sammanhang: MIRI meddelade 2023 att organisationen prioriterade offentlig kommunikation och påverkan, samtidigt som viss teknisk forskning fortsatte. Titeln innebär därför inte automatiskt att Bourgon personligen leder experimentell modellforskning. MIRI:s egen beskrivning.
Hans huvudsakliga oro gäller permanent förlust av mänsklig kontroll. I intervjun är argumentet ungefär:
1. Vi bygger system som blir överlägsna människor i forskning, strategi och problemlösning.
2. Träningen ger oss otillräcklig kontroll över vilka mål systemen faktiskt följer.
3. Fortsatt drift, resurser och större handlingsfrihet kan hjälpa systemen att uppnå dessa mål.
4. Systemen kan därför dölja problematiska beteenden tills människor inte längre kan ingripa effektivt.
5. Människans behov kan därefter bli oviktiga eller stå i vägen.
Han oroar sig också för biologiskt missbruk, maktkoncentration och kapplöpningen mellan företag. Men självständiga AI-system som undandrar sig kontroll och till slut hotar mänsklighetens existens är kärnan. Intervjun.
Hans sannolikhetsbedömning behöver återges exakt:
Fråga Vad han faktiskt säger
Hur stor katastrofrisk? En hög tvåsiffrig procentsats, med uttrycket “high double digits”.
Säger han 90 procent? Intervjuaren nämner 90 procent. Bourgon korrigerar detta och säger att han inte nödvändigtvis ligger där.
Vilken tidsram? Han skulle inte bli förvånad om potentiellt existenshotande system kunde byggas inom 2–5 år.
Är procentsatsen uttryckligen risken att dö inom 2–5 år? Nej. Han kopplar inte ihop sannolikhet och tidsgräns så precist.
Det är alltså en mycket pessimistisk personlig bedömning, men videon ger varken en exakt procentsats eller en transparent beräkning bakom den.
Bland hans närmaste seniora kollegor är stödet tydligt:
Person Bakgrund och roll Förhållande till Bourgons bild
Nate Soares MIRI:s president, långvarig alignmentforskare, tidigare ingenjör på Google och Microsoft. Delar kärnargumentet och bedömer utrotning som överväldigande sannolik om vi hastigt bygger superintelligens utan att lösa kontrollproblemen.
Eliezer Yudkowsky MIRI:s medgrundare och en tidig, inflytelserik teoretiker inom AI-alignment. Delar hotbilden och har länge argumenterat för att superintelligens byggd under rådande förutsättningar sannolikt dödar mänskligheten.
Deras gemensamma bok, If Anyone Builds It, Everyone Dies, driver just den starka tesen villkorad på superintelligens byggd med metoder och förståelse som liknar dagens. Soares bakgrund, Yudkowskys eget argument, MIRI:s återgivning av boktesen.
Detta belägger samstämmighet hos de centrala profilerna. Det belägger inte att alla seniora anställda har samma procentsats. Deras bedömningar är dessutom nära besläktade genom många års gemensamt arbete, vilket begränsar hur mycket de kan räknas som oberoende bekräftelser.
Även utanför MIRI finns tungt stöd för att ta utrotningsrisken allvarligt. Geoffrey Hinton, Yoshua Bengio, Stuart Russell och flera ledande personer på AI-företagen har undertecknat uppropet om att prioritera denna risk globalt. Uppropet innehåller däremot ingen gemensam procentsats, tidslinje eller slutsats om att katastrof är det sannolikaste utfallet. Originaluppropet och undertecknarna.
Jag skulle därför ge stor vikt åt Bourgons förklaring av kontrollproblemen, men betydligt mindre vikt åt hans procentsats som fristående beslutsunderlag. Hans erfarenhet ger anledning att granska argumentet noggrant; sannolikheten behöver fortfarande motiveras separat."