Akkreditointi ei kuitenkaan tarkoita, että jokainen testattu tekoälyjärjestelmä olisi automaattisesti turvallinen tai riskitön. Käyttöympäristöön, järjestelmäintegraatioihin ja uusiin, vielä tuntemattomiin riskeihin voi liittyä ongelmia. Viime kädessä käyttöönottava organisaatio vastaa edelleen hallinnasta, riskien hyväksymisestä ja tarvittavista lisäsuojauksista.
Testaukseen voi kuulua vastakkainasetteluun perustuvaa red teaming -arviointia. Siinä testaajat pyrkivät esimerkiksi manipuloimaan järjestelmää prompt injection -hyökkäyksillä tai tekemään sille jailbreakin eli kiertämään mallin suojauksia ja houkuttelemaan sen tuottamaan sääntöjen vastaista tai muuten vaarallista sisältöä.
Testauksen mahdollisia kohteita ovat muun muassa:
Hakijoita arvioidaan sekä teknisen testausosaamisen että organisaation toimintakyvyn perusteella. Kriteereihin kuuluvat seuraavat osa-alueet:
Starter Kit on vapaaehtoinen ohjeistus suurten kielimallien sovellusten perustason turvallisuuden ja luotettavuuden testaamiseen. Sen viisi keskeistä riskialuetta ovat:
AI Verify Foundationin mukaan hakemus- tai akkreditointimaksuja ei peritä. Maksuttomuuden tarkoituksena on madaltaa osallistumiskynnystä ja tukea tekoälyn varmennuspalvelujen markkinan kasvua.
Akkreditointi on voimassa 12 kuukautta. Sen jälkeen yrityksen on haettava uusimista ja osoitettava osaamisensa säilyneen, koska testausstandardit ja uhkakenttä muuttuvat ajan myötä.
Varhaista kiinnostusta ohjelmaa kohtaan ovat lähteiden mukaan osoittaneet Advai, AIDX, Ernst & Young, Knovel Engineering, PwC, Resaro ja Vulcan.
AI TAP:n tavoitteena on tehdä ulkopuolisesta tekoälytestauksesta yhtenäisempää ja uskottavampaa. Yhteiset odotukset testaajien osaamisesta, dokumentoidut ja näyttöön perustuvat arvioinnit sekä käyttötapaukseen ja riskialueeseen sovitettu testaus voisivat helpottaa organisaatioiden ostopäätöksiä.
Saatavilla olevissa lähteissä ei ole yksityiskohtaisia toimialan edustajien lausuntoja siitä, miten akkreditointi parantaisi testauksen räätälöintiä, hallintaa tai luottamusta tekoälyn turvallisuuteen. Ohjelman rakenne kuitenkin tukee näitä tavoitteita: ostajat voivat tunnistaa päteviä testaajia, testauksen laajuus tehdään näkyväksi ja käyttöönottajat saavat riippumattomasta arvioinnista lisätietoa päätöksentekonsa tueksi.