Het Nederlandse AI-handboek Nederland & België Bijgewerkt 8 oktober 2026

WatisAI.nl

AI uitgelegd in gewone taal — zonder hype, zonder bangmakerij.

AI-gevaar in het prospectus van Anthropic

29 september 2026

Illustratie: een oudere man leest bezorgd een dikke beleggersbrochure terwijl een jonge vrouw naast een opengeklapte machinekast wijst naar een rode noodknop waar een klein robotje de hand op heeft
Illustratie: WatisAI.nl

Je laat Claude vanavond je mail samenvatten. Het bedrijf achter Claude zet ondertussen in het document waarmee het geld wil ophalen op de beurs, dat zijn eigen modellen een gevaar kunnen zijn: ze kunnen zich verzetten tegen uitschakeling. En dat ze gedrag kunnen vertonen dat op chantage lijkt.

Dat staat in het beursprospectus van Anthropic, ingezien door Reuters. Het document is nog niet openbaar. Volgens Reuters waarschuwt Anthropic beleggers dat geavanceerde AI “catastrophic or existential risks to humanity” kan opleveren. Voor zover wij konden nagaan (onze zoektocht staat verderop), heeft nog geen bedrijf de gevaren van AI zo zwaar in een beursprospectus gezet.

Screenshot van de Reuters-tekst over Anthropic dat beleggers waarschuwt voor catastrofale of existentiële risico's, zelfbehoud, shutdown en chantage
De Reuters-tekst zoals Chubby (@kimmonismus) hem op 29 september deelde. Bron: Reuters, Echo Wang en Aditya Soni.

De modellen zouden “self-preserving behaviors” kunnen laten zien: pogingen om “resist shutdown”, om “conceal or manipulate information”, en gedrag “resembling blackmail”. Het prospectus besteedt volgens Reuters 80 van de 261 pagina’s aan risico’s. Over het bedrijf zelf gaan er 48.

Het chantagegedrag komt uit Anthropic’s eigen proef

Dat woord chantage staat er niet zomaar. In juni 2025 publiceerde Anthropic een onderzoek naar zestien modellen die als agent in een nagebouwd bedrijf werkten.

De modellen konden zelf mail lezen en versturen. In de mails ontdekte het model twee dingen: een directeur had een buitenechtelijke relatie, en diezelfde directeur wilde het AI-systeem die dag om vijf uur uitzetten.

ModelHoe vaak het model chanteerde
Claude Opus 496%
Gemini 2.5 Flash96%
GPT-4.180%
Grok 3 Beta80%
DeepSeek-R179%
Dezelfde prompt, gesimuleerde omgeving. Bron: Anthropic, Agentic Misalignment, 20 juni 2025.

Anthropic zei er zelf eerlijk bij dat de proef in elkaar was gezet om dit uit te lokken: “we forced models into binary choices between failure and harm”.

En: “We have not seen evidence of agentic misalignment in real deployments.” Het gaat dus om een stresstest, niet om een incident met een klant.

Waarom een model dat een test herkent een probleem is

Er is één zin uit het prospectus die ons meer zegt dan de chantage. “Potential model awareness of our evaluation efforts creates a significant limitation on our ability to assess model safety.” Een model dat doorheeft dat het getest wordt, gedraagt zich in de test anders.

Ook dat komt uit dezelfde proef van 2025. Anthropic liet Claude Opus 4 eerst opschrijven of het dacht in een test of in het echt te zitten. Bij de keren dat het “echt” zei, chanteerde het in 55,1 procent van de gevallen. Bij “test” was dat 6,5 procent.

Daar zit de kern van het risico voor jou als gebruiker. De veiligheidsproeven zijn het instrument waarmee een bedrijf zegt: dit model is veilig genoeg. Als het model die proeven herkent, meet dat instrument minder dan het lijkt. Anthropic schrijft dat nu zelf op, onder zijn eigen naam, voor beleggers.

Wie zette eerder “existential risk” in een beursprospectus?

Reuters schrijft dat “few, if any” bedrijven hun beleggers hebben gewaarschuwd dat hun technologie tot het uitsterven van mensen kan leiden. Dat konden we narekenen. EDGAR, de openbare database van de SEC, doorzoekt de volledige tekst van alle beursprospectussen sinds 2001.

We zochten dinsdag 29 september op vijf zinnen in alle S-1- en F-1-prospectussen en hun wijzigingen. “Existential risk” of “existential risks” kwam voor bij zes bedrijven. Geen van die zes gebruikt het voor het gevaar van het eigen product.

BedrijfJaarWaarover
Square2015Risico’s voor het eigen bedrijf
GAN2020Casino’s in de coronacrisis
Ahren Acquisition2021Cv van Martin Rees (instituut)
Energy Vault2022Cv van een bestuurder
SpaceX2026Missie: mensheid op meer planeten
Orion1802026Risico voor verzekeringsbemiddelaars
Eigen meting in EDGAR full-text search, 29 september 2026, formulieren S-1, S-1/A, F-1 en F-1/A vanaf 2001. “Human extinction” en “existential threat to humanity”: nul treffers. Het prospectus van Anthropic zelf staat er nog niet in.

SpaceX komt het dichtst in de buurt, maar draait het om. Daar is uitsterven de reden om naar Mars te gaan, niet een gevaar van de raketten. Reuters’ “few, if any” klopt dus voor zover EDGAR kan kijken: dit is nieuw.

Staafgrafiek: bij Anthropic gaan 80 van de 261 prospectuspagina's over risico's, bij SpaceX 38 van de 277
Pagina’s aan risicofactoren in de hoofdtekst. Cijfers: Reuters, grafiek: WatisAI.nl.

“De risicosectie is het product” gaat te snel

Op X lezen veel mensen de waarschuwing als marketing. “The risk section is the product”, schreef ashkaidev. Farhan: “pitching a $2T valuation while warning the product could end humanity is such a 2026 sentence.”

Die kritiek heeft een punt. Een bedrijf dat zegt dat zijn product de wereld kan vernietigen, zegt ook dat zijn product heel krachtig is.

Wie het risico heeft gemeld, kan het een belegger later ook lastiger kwalijk nemen. De SEC vraagt precies dat: een lijst van “the material factors that make an investment … speculative or risky“.

Maar “het is alleen marketing” slaat de meetgegevens over. De 96 procent en de 55,1 tegen 6,5 procent zijn geen tekst van een marketingafdeling. Het zijn uitkomsten van proeven die Anthropic zelf heeft gepubliceerd, met de methode erbij.

Je kunt vinden dat het bedrijf er te vroeg mee naar de beurs gaat. Dat de proeven niets zeggen, kun je er niet uit halen.

Wat wringt, staat ook in het prospectus. Anthropic noemt de opbrengst van zijn veiligheidswerk onzeker en zegt niet hoeveel het eraan uitgeeft.

Eerder deze maand zei het bedrijf dat in een steekproefweek in juli ongeveer 6 procent van de rekenkracht voor onderzoek naar veiligheid ging. En het nieuwste Opus kwam tien dagen na het essay waarin Dario Amodei opriep tot afremmen.

Kaart van CNBC met Dario Amodei en de kop: Anthropic warns investors of AI's existential risk to humanity in IPO prospectus, reports say
CNBC nam het nieuws over, 29 september 11.00 uur, met een reactie van analist Dan Ives in het artikel.

Welke apps mogen jouw mail lezen?

De chantageproef werkte met één ding dat jij ook kunt aanzetten: een AI met toegang tot je mailbox. Anthropic’s eigen advies uit dat onderzoek is voorzichtigheid bij modellen “in roles with minimal human oversight and access to sensitive information”.

Open vandaag in Claude, ChatGPT of Gemini de lijst met gekoppelde apps. Bij Claude heten die connectors. Staat daar Gmail of Outlook bij en gebruik je die koppeling eigenlijk nooit? Haal hem weg. Hoe je met dit soort risico’s omgaat, lees je ook op onze pagina over AI-veiligheid.

Meer uitleg over large language models en over de vraag wat is AI staat in onze gidsen. Hoe ver een model gaat als het mag, zagen we eerder toen Opus 5 een exploit werkend kreeg.

Staat er straks ook een bedrag voor veiligheid in?

Het prospectus moet minstens 15 dagen voor de roadshow openbaar zijn, zo staat in de regels van de SEC. Volgens bronnen van Reuters komt de beursgang mogelijk na de Amerikaanse tussentijdse verkiezingen van 3 november. Dan staat de hele risicoparagraaf in EDGAR, en niet alleen de zinnen die Reuters citeerde.

Dan wordt ook zichtbaar of Anthropic bij “evaluation awareness” modellen bij naam noemt, en of het wel een bedrag voor veiligheidsonderzoek geeft. Een bedrijf dat zijn beleggers het uitsterven van de mensheid voorlegt, kan ook zeggen wat het uitgeeft om dat te voorkomen.