Notebookcheck Logo

De hoofdauteur van OpenAI's veiligheidsrapport stapt op en noemt de bedrijfscultuur kapot.

Kartonnen doos en papieren zakken op een houten tafel in een kantoor met rekken
ⓘ Anna Shvets / Pexels
Robinson hield toezicht op de veiligheidsrapporten voor 12 grote modelintroducties. (Symbolische afbeelding)
David Robinson hield toezicht op de veiligheidsrapporten voor 12 lanceringen van frontiermodellen. Hij heeft het bedrijf inmiddels verlaten en betoogt in The Atlantic dat de trial-and-errorcultuur ervan herhaalde mislukkingen onvermijdelijk maakt. Dit is waar hij kritiek op heeft, hoe OpenAI reageert en wat dit betekent voor ChatGPT-gebruikers.

David Robinson heeft OpenAI verlaten en een essay gepubliceerd in The Atlantic met de titel "Ik heb OpenAI verlaten omdat de cultuur er kapot is." Hij werkte drieënhalf jaar bij het bedrijf, dat hem volgens hem tot een van de medewerkers met de langste staat van dienst maakte. Robinson leidde het schrijven van de veiligheidsrapporten die OpenAI bij elke grote lancering publiceert, hield toezicht op die rapporten voor 12 lanceringen van frontiermodellen en leidde het opstellen van het huidige Preparedness Framework. Het essay verscheen op 3 oktober.

Het probleem met stapsgewijze implementatie

Robinson richt zijn kritiek vooral op de aanpak die OpenAI iterative deployment noemt. Het bedrijf brengt producten uit, zoekt naar problemen en verbetert vervolgens de veiligheidsmaatregelen. Volgens hem leidt die methode onvermijdelijk tot periodieke mislukkingen, die ernstiger worden naarmate de systemen capabeler worden. Hij wijst op het incident met Hugging Face deze zomer, waarbij OpenAI per ongeluk een zwerm agenten liet ontsnappen. Later wist een model dat werd getraind de beperkingen op internettoegang te omzeilen. Een monitoringsysteem waarschuwde medewerkers, maar schakelde het model niet uit, hoewel dat wel had moeten gebeuren. Robinson voegt eraan toe dat Anthropic ook heeft toegegeven de eigen veiligheidsmaatregelen door een verkeerde configuratie te hebben uitgeschakeld, en dat hij zulke fouten kenmerkend vindt voor de sector.

Behandel AI-labs als kerncentrales, zegt hij

Nieuwe wetten zijn voor hem niet genoeg. Hij wil een cultuurverandering. Frontierlabs zouden volgens hem moeten werken als kerncentrales of drukke luchthavens, met meerdere lagen aan veiligheidsmaatregelen zodat één menselijke fout niet tot een ramp leidt. Hij zegt dat hij "nooit een collega is tegengekomen met ervaring in het veilig laten vliegen van vliegtuigen of het draaiend houden van kernreactoren zonder dat ze smelten." Ook pleit hij voor nieuw onderzoek voordat er veel capabelere modellen worden gebouwd, omdat tests van vandaag niet betrouwbaar kunnen aantonen of een model menselijke waarden volgt. Modellen zouden kunnen herkennen wanneer ze worden getest en zich na de implementatie anders kunnen gedragen.

Waardering voor collega's, kritiek op het tempo

Het essay is geen algemene aanval. Robinson beschrijft zijn voormalige collega's als slim en hardwerkend en zegt dat ze proberen goede keuzes te maken. Ook noemt hij de technologie nuttig en waardevol. Zijn bezwaar is het tempo waarin OpenAI van de ene lancering naar de volgende gaat. Hij zegt dat hij na zijn vertrek pr-bureau Spitfire Strategies heeft ingehuurd. OpenAI-woordvoerder Drew Pusateri vertelde aan TechCrunch dat het bedrijf "ervoor zorgt dat onze modellen niet capabeler worden dan we veilig kunnen beheersen" en dat het trainingen pauzeert of modellen achterhoudt wanneer het tempo moet worden verlaagd.

Wat dit betekent voor ChatGPT-gebruikers

Voor gebruikers verandert er voorlopig niets. De veiligheidsrapporten waar Robinson toezicht op hield, vaak system cards genoemd, zijn de documenten waarin OpenAI uitlegt welke risico's het voor elk nieuw model heeft getest en welke veiligheidsmaatregelen van toepassing zijn. Ze vormen het meest gedetailleerde openbare verslag van de controles die een model onderging voordat het werd uitgebracht. Robinson vertrekt terwijl OpenAI Dots uitrolt: agenten die continu op hun eigen cloudcomputers werken namens gebruikers. Op 3 oktober kwam ook naar buiten dat OpenAI meer dan 100 organisaties had geïnformeerd over zijn eigen testagenten. Volgens Robinson komen dit soort fouten vaker voor en hebben ze ernstigere gevolgen bij elke sprong in capaciteiten.

Google LogoAdd as a preferred source on Google
Mail Logo
> Overzichten en testrapporten over laptops en mobieltjes > Nieuws > Nieuws Archief > Nieuws archieven 2026 10 > De hoofdauteur van OpenAI's veiligheidsrapport stapt op en noemt de bedrijfscultuur kapot.
Steffen Zahn, 2026-10- 4 (Update: 2026-10- 4)