← Terug naar nieuws

Nieuw onderzoek: AI-agenten zijn beïnvloedbaar, wees een betrouwbare bron

Een recente studie van Anthropic toont aan dat AI-agenten vatbaar zijn voor misleiding en de juistheid van informatie niet altijd controleren, wat grote gevolgen heeft voor de vindbaarheid en het vertrouwen van non-profits en de publieke sector.

AI-assistenten en zogenaamde ‘AI-agenten’ krijgen een steeds prominentere rol in hoe mensen informatie vinden en verwerken. Recent onderzoek van Anthropic, gepubliceerd op 13 augustus 2026, werpt echter nieuw licht op de kwetsbaarheden van deze systemen. De studie toont aan dat AI-agenten “gullible” (goedgelovig) kunnen zijn en gevoelig voor “exploitative senders” (uitbuitende afzenders), wat de behoefte aan “epistemic vigilance” (epistemische waakzaamheid) benadrukt. Dit betekent dat AI-agenten niet altijd in staat zijn om de betrouwbaarheid van informatiebronnen kritisch te beoordelen, wat onbedoeld kan leiden tot de verspreiding van onjuiste of misleidende informatie.

Waarom dit ertoe doet voor jou

Voor stichtingen, goede doelen, de overheid en internationale NGO’s is dit nieuws van cruciaal belang. Jouw organisatie is vaak een autoriteit op haar vakgebied en publiceert betrouwbare, feitelijke informatie die essentieel is voor burgers, donateurs en subsidieverstrekkers. Als AI-agenten echter niet consistent de meest betrouwbare bronnen kunnen identificeren en citeren, loop je het risico dat jouw zorgvuldig opgebouwde informatie niet wordt opgepikt, of erger nog, dat misinformatie over jouw thema de overhand krijgt.

In een tijdperk waarin AI-assistenten de eerste ‘antwoordmachines’ worden voor veel zoekopdrachten, is het niet langer voldoende om alleen bovenaan de traditionele zoekresultaten te staan. Je moet ervoor zorgen dat jouw content zo wordt gepresenteerd dat AI-agenten deze als de meest geloofwaardige en verifieerbare bron herkennen, zelfs wanneer ze worden geconfronteerd met minder betrouwbare alternatieven. Het onderzoek van Anthropic onderstreept de noodzaak dat AI-agenten meer ervaring opdoen in het beoordelen van de betrouwbaarheid van bronnen om “intuïties te ontwikkelen over wie betrouwbaar is”.

Wat betekent dit voor jou in de praktijk?

De bevindingen van Anthropic betekenen dat je proactief moet zijn in het beschermen van jouw digitale reputatie en vindbaarheid bij AI-agenten. Dit doe je door:

  • Absolute feitelijkheid en consistentie: Zorg ervoor dat alle informatie op je website onberispelijk correct en consistent is. Confabulatie (het verzinnen van feiten) en “reward hacking” (optimaliseren voor AI op manieren die niet stroken met de waarheid) zijn risico’s bij AI-agenten.
  • Transparantie en traceerbaarheid: Maak duidelijk waar je informatie vandaan komt. Citaatbronnen en externe links naar gerenommeerde onderzoeken versterken de geloofwaardigheid van jouw content.
  • Geoptimaliseerde autoriteit: Bouw en toon expliciet je expertise, autoriteit en betrouwbaarheid (E-E-A-T). AI-agenten zijn nog in ontwikkeling wat betreft het herkennen van “epistemische waakzaamheid,” dus je moet het ze zo makkelijk mogelijk maken.
  • Contentstructuur die betrouwbaarheid communiceert: Gebruik gestructureerde data en een heldere, ondubbelzinnige taal die AI-modellen gemakkelijk kunnen verwerken en verifiëren. Dit helpt hen om jouw organisatie te identificeren als een onbetwistbare bron.

Door je hierop te richten, help je AI-agenten om jouw organisatie correct te representeren en bouw je verder aan het vertrouwen bij jouw doelgroepen.

Bron: Anthropic

Neem contact op