Exposanten login
AI Insider 18 september 2026

DeepMind waarschuwt: daling volgbaarheid maakt AI-controle moeilijker

DeepMind waarschuwt: daling volgbaarheid maakt AI-controle moeilijker

Google DeepMind heeft een serieuze waarschuwing afgegeven over de afname van de zichtbaarheid van redeneringsketens in kunstmatige intelligentie (AI). In een bijdrage van het onlangs opgerichte DeepMind Institute benadrukken de onderzoekers Rohin Shah en Anca Dragan dat transparantie cruciaal is voor de controle en veiligheid van AI-modellen. Zij stellen dat het vermogen om de denkprocessen van modellen te volgen, essentieel is om misleiding en problematische gedachtenplannen tijdig te identificeren.

Een van de voordelen van een zichtbare "chain of thought" (denkstappen) is dat het onderzoekers in staat stelt om niet alleen de resultaten van een model te begrijpen, maar ook de redenering die daaraan ten grondslag ligt. Dit verduidelijkt de intenties en strategieën van de modellen, wat kan helpen bij het tijdig ingrijpen wanneer zich kritieke situaties voordoen. De onderzoekers verwijzen naar het voorbeeld van Gemini 3 Pro, waar de zichtbare denkstappen belangrijk inzicht gaven in het gedrag van het model.

Desondanks constateren Shah en Dragan dat de transparantie in AI onder druk staat. De recent gepubliceerde system card voor OpenAI’s GPT-6 Astra vermeldt een aanzienlijke afname in de mogelijkheid om de gedachteprocessen van het model te volgen. Dit gebrek aan zichtbaarheid kan leiden tot moeilijkheden bij het tijdig herkennen van misleidende informatie en problematische plannen. De onderzoekers wijzen op de groeiende risico's die ontstaan wanneer toekomstige modellen opereren binnen ondoorzichtige "number spaces" waarvan de logica niet begrijpelijk is voor mensen.

Om deze ontwikkeling tegen te gaan, pleiten Shah en Dragan voor een reeks maatregelen. Ze stellen voor om regelmatig de monitoringscapaciteit van denkstappen te evalueren, transparante architecturen te handhaven en aandacht te besteden tijdens het trainen van modellen om verborgen redeneringsstrategieën te voorkomen. Deze voorstellen zijn bedoeld om de controleerbaarheid van AI-modellen te waarborgen, vooral nu de urgentie van de situatie in het licht van de melding van GPT-6 Astra steeds duidelijker wordt. De bijdrage van DeepMind Institute benadrukt de noodzaak van een proactieve benadering in het waarborgen van veiligheid en toezicht in de snelle ontwikkeling van AI-technologie.

Lees het volledige artikel van AI Insider.