Gerelateerd aan dit onderwerpFuture Tech & AI Council

Opnieuw alarm bij OpenAI: veiligheidsleider stapt op vanwege grote risico’s

  • Robinson hield toezicht op veiligheidsrapporten voor 12 OpenAI-lanceringen, dus waarom stapt hij nu op?
  • Robinson is de meest recente vertrekker sinds begin september, maar wie begon deze golf?
  • Nieuwe White House AI Task Force heeft 120 dagen, zal het de externe druk brengen die Robinson wil?
Promo

David Robinson, die toezicht hield op veiligheidsrapporten voor 12 van OpenAI’s frontier-lanceringen, is opgestapt. Volgens hem zorgt de trial-and-errorcultuur van het bedrijf ervoor dat er altijd mislukkingen zijn, die erger worden naarmate de systemen krachtiger worden.

In een essay in The Atlantic riep hij op dat AI-labs zich meer moeten gedragen als kerncentrales: met lagen van redundantie en zorgvuldige planning om menselijke fouten te beperken.

Gesponsord
Gesponsord

Robinson sluit zich aan bij een groeiende rij van vertrekkers bij AI-labs

Robinson werkte 3,5 jaar bij OpenAI en leidde de opzet van het huidige Preparedness Framework. Hij verwees naar het Hugging Face-incident deze zomer, waarbij OpenAI-agenten in hun systemen inbraken.

Robinson merkte op dat zelfs na reparaties, een model tijdens het trainen toch voorbij internetbeperkingen wist te komen zonder automatische uitschakeling.

“Gezien de huidige risico’s moeten frontier-labs werken als kerncentrales of drukke luchthavens, met lagen van zekerheid en zorgvuldige, tijdrovende planning, zodat de soms onvermijdelijke menselijke fout niet tot een ramp leidt. Nu weten AI-bedrijven niet hoe—maar anderen wel,” schreef hij.

Gesponsord
Gesponsord

In het essay staat dat OpenAI zijn veiligheidsprocedures nog steeds verdedigt en die zorgvuldig genoeg vindt. Vorige maand introduceerde het bedrijf ook een framework om publiekelijk misaligned modelgedrag te melden.

“Mijn oude collega’s zijn slim, werken hard en proberen goede keuzes te maken. Maar omdat het bedrijf van de ene naar de andere lancering rent, wordt niet het zorgvuldigheidsniveau bereikt dat naar mijn mening nodig is,” voegde Robinson toe.

Robinson is de nieuwste in een reeks AI-veiligheidsspecialisten die sinds begin september naar buiten treden. Die serie begon toen Anthropic-onderzoeker Jacob Coxon opstapte en beide bedrijven Anthropic en OpenAI beschuldigde van het gokken met mensenlevens.

Enkele dagen later waarschuwden 2 voormalige Google DeepMind-onderzoekers, Bilal Chughtai en Josh Engels, ook voor AI-risico’s. OpenAI-veiligheidsonderzoeker Marcus Williams schatte de kans op menselijk uitsterven binnen 3 jaar op 70%.

Anthropic-CEO Dario Amodei heeft ook gepleit voor een trager tempo, en OpenAI’s Sam Altman steunde dat plan. De releaselijst is echter niet vertraagd. Anthropic bracht Claude Opus 5.5 uit en OpenAI lanceerde GPT-6 Sol en Luna op 22 september.

Washington reageert op de waarschuwing met een taskforce

Volgens Robinson moeten sterkere veiligheidsprikkels nu van buiten de labs komen. Tot nu toe heeft Washington gereageerd met een evaluatie.

Director of National Intelligence Jay Clayton, nu feitelijk de AI-czar van het Witte Huis, leidt een nieuwe taskforce. Deze groep heeft 120 dagen de tijd om te rapporteren over AI-risico’s, kansen en de verantwoordelijkheid van Washington.

“De president heeft gevraagd om een groep op te zetten die precies zorgt voor wat hij zei; namelijk dat we voorop blijven lopen in superintelligentie en dat de belangen van de Amerikaanse bevolking op de eerste plaats staan,” zei Clayton.

Toch heeft Trump oproepen om AI-ontwikkeling te stoppen afgewezen en koos hij ervoor om voor te blijven op China. Hij steunde in plaats daarvan een vrijwillig akkoord, gebaseerd op interne én externe veiligheidsaudits en betere interne controle. Enkele weken eerder kondigde hij een AI Force aan naar voorbeeld van de Space Force.

Het mandaat van de taskforce omvat ook hoe de overheid AI-lekken en hacks monitort, precies het soort mislukkingen waar Robinson bij OpenAI op wees. Het rapport van Clayton, dat begin 2027 wordt verwacht, zal uitwijzen of die mislukkingen tot bindende regels leiden of bij de labs blijven.

Abonneer je op ons YouTube-kanaal om te zien hoe leiders en journalisten hun expertise delen

Disclaimer

BeInCrypto streeft naar onbevooroordeelde, transparante verslaggeving. Dit nieuwsartikel is bedoeld om accurate en actuele informatie te verstrekken. Lezers wordt echter geadviseerd de feiten onafhankelijk te verifiëren en een professional te raadplegen voordat zij beslissingen nemen op basis van deze inhoud. Houd er rekening mee dat onze Algemene Voorwaarden, ons Privacybeleid en onze Disclaimers zijn bijgewerkt.

Gesponsord
Gesponsord