Chef veiligheid Anthropic: 'Meer dan 10% kans dat AI mensheid binnen 10 jaar vernietigt'
Ja het Anthropic achter Claude ja
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
Maar hoopgevende noot: ze doen wel hun best! Evan Hubinger is chef 'allignment', wat er ongeveer op neerkomt dat het zijn taak is AI 'in lijn' te houden met 'menselijke waarden'. En als je er dan even vanuit gaat dat die menselijke waarden er niet op neerkomen dat de mensheid uitgeroeid moet worden, is hij niet unaniem enthousiast over de prognose. "We geloven er echt oprecht in dat AI alle mensen zou kunnen doden! Zelf denk ik dat de kans het komende decennium 10%> is. (...) We hebben nog geen plan om het alignment-vraagstuk voor superintelligentie op te lossen, en we liggen ook niet duidelijk op koers om dat te bereiken." Maar dat weerhoudt ze er dus niet van de wapenwedloop richting AGI/ASI (Artificial General Intelligence/Artificual Super Intelligence) te vertragen - alles is immers voor Bassie.
Hubinger reageert bovenstaand op een tweet van Jacob Coxon, en dat is dus een Antropic-onderzoeker die gisteren ontslag nam wegens zijn onderstaande gewetensnood. En dan berichtte de Financial Times gisteren ook nog dat Antropic heeft nagelaten zijn nieuwste frontiermodel Mythos 5.1 - sinds 1 september operationeel voor geselecteerde cliënten - in te dienen voor pre-lanceer-veiligheidstesten bij het Britse AI Security Institute en vergelijkbare Amerikaanse organen. Zal wel niks zijn!
Maar wat is er erger? Het vernietigen van de mensheid of de teksten van Rob Jetten?
Do not underestimate the power of this technology. These will soon be superhuman systems that can hack anything, revolutionize any field overnight, and acquire real power and resources. We have all witnessed the progress in each of these domains, and progress is not slowing.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Reaguursels
Dit wil je ook lezen
OpenAI had 'ernstig veiligheidsincident'. Prototypes 'ontsnapten internetvrije computer' en hackten AI-platform Hugging Face
Als dit mensen waren had je een goede film
OpenAI presenteert plan 'wereldwijde democratische AI, krijgt toch geen winstoogmerk'
Masters of the Universe kondigen wat geschuif in de kleine lettertjes aan
Elon 'doet bod' van $97 miljard op OpenAI, Sam Altman 'doet bod' van $9,74 miljard op Twitter
De volwassenen, waaronder (net als in april 2023) "Harry Bölz" weer achter het stuur!
OpenAI krijgt winstoogmerk, Sam Altman aandelen, benodigde $7 biljoen waarschijnlijker
Zeer relevant nieuws, want dit winstoogmerk maakt OpenAI veel aantrekkelijker voor investeerders tijdens het aantrekken van $7 biljoen (zevenduizendmiljard dollar, $7.000.000.000.000, 7 maal Nederlands bnp) voor de ontwikkeling van Artificial General Intelligence (AGI, wiki).
Chat-GPT4o verandert stem, Scarlett Johansson "geschokt en kwaad", stuurt advocaten
En in ander nieuws: OpenAI ontmantelt het gehele team dat onderzoek deed naar hoe gebruik "verantwoord en veilig" kan blijven.
Coca Cola geeft Microsoft $1,1 miljard voor AI-ontwikkeling
Onverminderd steeds minder zin in de toekomst
