Een onafhankelijke AI-evaluatie is een beoordeling van AI-risico’s door externe beoordelaars die onafhankelijk moeten kunnen werken van het bedrijf dat zij onderzoeken. Het AI Evaluator Forum publiceerde op 18 september 2026 een brief met vijf voorgestelde waarborgen: onafhankelijkheid, meerdere perspectieven, transparantie, bescherming tegen represailles en toegang tot relevante systemen en medewerkers. Die voorwaarden moeten evaluatoren in staat stellen verder te kijken dan de openbare modeluitvoer.

Een brief met vijf voorstellen

De brief richt zich op ingebedde evaluatie: externe beoordelaars krijgen toegang om binnen een AI-bedrijf risico’s en veiligheidsmaatregelen te onderzoeken. De pagina van het Forum vermeldde op 23 september 2026 meer dan 200 ondertekenaars; zij tekenden volgens het Forum op persoonlijke titel.

De voorstellen gaan niet alleen over wat een evaluator test. Ze beschrijven ook wie de evaluator aanstuurt, welke informatie die kan inzien en hoe bevindingen naar buiten kunnen komen.

Wat houden de vijf waarborgen in?

Voorgestelde waarborgWat het AI Evaluator Forum bepleit
OnafhankelijkheidEvaluatoren mogen niet in eigendom zijn van of bestuurd worden door de onderzochte AI-bedrijven. Ook moeten zij belangrijke commerciële banden en betalingen die afhangen van de uitkomst vermijden. Ze houden redactionele zeggenschap en moeten belangenconflicten bekendmaken en aanpakken.
Meerdere perspectievenBedrijven zouden meerdere evaluatieorganisaties met uiteenlopende expertise en risicoperspectieven moeten inschakelen, in plaats van op één team te leunen.
TransparantieMethoden, bevindingen, toegang en evaluatievoorwaarden moeten inzichtelijk zijn. Evaluatoren moeten tijdig en zonder filter met bestuurs- of andere bevoegde toezichtorganen kunnen communiceren. Eventuele beperkingen op openbare publicatie zouden nauw begrensd en tijdelijk moeten zijn.
Bescherming tegen represaillesJuridische bescherming en passende financiering moeten voorkomen dat evaluatoren worden bestraft voor redelijke methoden of ongunstige conclusies.
Toegang op senior werknemerniveauEvaluatoren zouden toegang moeten krijgen tot relevante systemen, gegevens, hulpmiddelen en fysieke ruimtes, en open met medewerkers moeten kunnen spreken. Bescherming van gevoelige klant- en gegevens van derden blijft daarbij een uitzondering.

Voor evaluatoren maakt die toegang het mogelijk om niet alleen gepubliceerde antwoorden te beoordelen, maar ook relevante systemen en belangrijke incidenten te onderzoeken. Het Forum bepleit daarom toegang die vergelijkbaar is met die van senior medewerkers die soortgelijke risicoanalyses uitvoeren.

Hoe verhouden bedrijfsvoornemens zich tot de brief?

In september meldden berichten dat Anthropic-topman Dario Amodei en OpenAI-topman Sam Altman hadden toegezegd ingebedde evaluaties in hun bedrijven te integreren. Ook zou xAI-topman Elon Musk Amodeis voorstel hebben gesteund. Deze gemelde voornemens zijn iets anders dan de vijf voorwaarden die het Forum in zijn brief uitwerkt.

De brief zelf is geen bindende regel en verplicht AI-bedrijven niet om de voorgestelde waarborgen over te nemen.

Ingebedde evaluatie als aanvulling

Het AI Evaluator Forum ziet evaluaties binnen bedrijven als aanvulling op bredere transparantie en onafhankelijke toegang voor onderzoekers. Zo’n evaluatie is volgens het Forum dus één onderdeel van toezicht, naast mogelijkheden voor onderzoek buiten de bedrijven zelf.