Geaccrediteerde bedrijven worden erkend voor een duidelijk omschreven testaanbod. Ze kunnen bovendien in contact worden gebracht met organisaties die een gekwalificeerde tester zoeken. Dat moet het vertrouwen vergroten bij ontwikkelaars, organisaties die AI implementeren, andere belanghebbenden en eindgebruikers.
De accreditatie betekent overigens niet dat een specifiek AI-systeem daarmee volledig veilig of vrij van risico’s is verklaard. Risico’s die samenhangen met de concrete toepassing, integratie of nieuwe aanvalstechnieken kunnen blijven bestaan. De organisatie die het systeem inzet, blijft verantwoordelijk voor governance, het accepteren van risico’s en aanvullende maatregelen.
De geaccrediteerde bedrijven kunnen zogenoemde red-teamtests uitvoeren. Daarbij proberen testers opzettelijk zwakke plekken bloot te leggen. Ze kunnen bijvoorbeeld promptinjecties gebruiken of een systeem proberen te jailbreaken: de beveiligingsmaatregelen omzeilen en het model aanzetten tot beleidsschendend of ander onveilig gedrag.
De onderzoeken kunnen onder meer gericht zijn op:
Aanvragers worden niet alleen beoordeeld op hun technische testvaardigheden, maar ook op hun organisatorische slagkracht. De belangrijkste criteria zijn:
De Starter Kit is vrijwillige richtlijn voor basistests van de veiligheid en betrouwbaarheid van toepassingen die werken met grote taalmodellen, ofwel large language models (LLM’s). De richtlijn benoemt vijf belangrijke risicogebieden:
De bedoeling is niet dat elk AI-systeem exact dezelfde test ondergaat. De relevante risico’s, de omvang van het onderzoek en de drempels voor aanvaardbare prestaties moeten worden afgestemd op de concrete toepassing.
Volgens de AI Verify Foundation hoeven bedrijven geen aanvraag- of accreditatiekosten te betalen. Daarmee wil de Foundation de drempel voor deelname laag houden en de markt voor AI-assurance laten groeien.
Een accreditatie blijft twaalf maanden geldig. Daarna moet een bedrijf opnieuw aantonen dat het over voldoende deskundigheid beschikt. Dat is belangrijk omdat testmethoden, normen en het dreigingslandschap voortdurend veranderen.
De bedrijven die volgens de beschikbare informatie al belangstelling hebben getoond, zijn Advai, AIDX, Ernst & Young, Knovel Engineering, PwC, Resaro en Vulcan.
AI TAP moet zorgen voor een meer consistente en geloofwaardige markt voor externe AI-tests. Gemeenschappelijke verwachtingen over deskundigheid, gedocumenteerde testresultaten en een duidelijk afgebakende testscope kunnen organisaties helpen om onderzoeken beter te vergelijken en af te stemmen op hun eigen AI-gebruik.
De beschikbare bronnen bevatten geen afzonderlijke, concrete uitspraken van industrievertegenwoordigers over verbeterde maatwerkmogelijkheden, governance of vertrouwen in AI-veiligheid. Het ontwerp van het programma ondersteunt die mogelijke effecten wel: kopers kunnen makkelijker competente testers vinden, de reikwijdte van een test wordt explicieter en organisaties krijgen een extra onafhankelijke beoordeling voordat zij AI inzetten.