Ostrzeżenie, że sztuczna inteligencja może kiedyś wymknąć się spod kontroli, nie mówi jeszcze firmie, czy powinna podłączyć dzisiejszy system do swoich danych. Głosy z singapurskiego środowiska AI proponują więc bardziej praktyczne pytania: kto może sprawdzić system, jakie są jego ograniczenia i do czego wolno mu uzyskać dostęp? Chodzi o niezależną ocenę, przejrzystość zabezpieczeń i kontrolę wdrożeń — nie o wybór między nieograniczonym rozwojem a zatrzymaniem wszystkich prac.
7
32
Skąd powrót alarmujących ostrzeżeń?
We wrześniu 2026 r. Jacob Coxon odszedł z Anthropic. Badacz, który pracował również w OpenAI, zarzucił obu firmom nieodpowiedzialny wyścig ku AI zdolnej do samodzielnego doskonalenia swoich możliwości. Evan Hubinger z Anthropic zgodził się z jego obawami i osobiście ocenił ryzyko, że AI doprowadzi do wyginięcia ludzkości w ciągu najbliższej dekady, na ponad 10 proc. To jego subiektywna ocena, a nie zmierzone prawdopodobieństwo ani dowód, że katastrofa jest bliska.
3
4
Prezes Anthropic Dario Amodei wezwał do spowolnienia rozwoju AI. W propozycji z 12 września uwzględnił też dostęp dla zewnętrznych podmiotów oceniających: miałyby one sprawdzać przestrzeganie praktyk i deklaracji dotyczących bezpieczeństwa oraz zgłaszać incydenty. Tak ujęta debata dotyczy nie tylko skali zagrożenia, lecz także tego, co ktoś spoza firmy może rzeczywiście zweryfikować.
13
32
Co da się zbadać już teraz?
Testy nie rozstrzygną, czy każdy przyszły system AI będzie bezpieczny. Mogą jednak ujawnić ograniczenia systemów dostępnych dziś. Uruchomione w Singapurze w 2022 r. narzędzie AI Verify pomaga oceniać m.in. sprawiedliwość wyników, odporność systemu i możliwość wyjaśnienia jego działania. Opisywany jest również program akredytacji testerów AI, który ma rozwijać kompetencje potrzebne do takich ocen.
19
33
Niezależny audyt wymaga czegoś więcej niż zapewnienia dostawcy, że model przeszedł jego wewnętrzne testy. Oceniający potrzebują dostępu pozwalającego sprawdzić deklarowane praktyki i wykrywać incydenty. Z kolei organizacja wdrażająca AI powinna uzyskać od dostawcy informacje i narzędzia kontroli, zanim udostępni modelowi swoje dane oraz procesy. Sam dostęp do wag modelu nie daje jeszcze pełnego obrazu decyzji podjętych podczas jego trenowania, wcześniejszych błędów czy zastosowanych zabezpieczeń.
32
34
Nie oznacza to sprzeciwu wobec każdego spowolnienia prac. Jeden z ekspertów wypowiadających się w Singapurze wskazuje, że jeśli twórcy nie potrafią odpowiednio zabezpieczyć systemu lub wyjaśnić, jak zarządzają poważnym ryzykiem, powinni wstrzymać tę działalność. To warunek odnoszący się do konkretnego zagrożenia, a nie wezwanie do zamrożenia wszystkich zastosowań AI.
32
Agent AI powinien dostać tylko tyle uprawnień, ile potrzebuje
Sprawa staje się pilniejsza, gdy AI nie tylko odpowiada na pytania, ale może używać narzędzi i wykonywać działania w firmowych systemach. Singapurski urząd Infocomm Media Development Authority (IMDA) ogłosił w styczniu 2026 r. Model AI Governance Framework for Agentic AI — wytyczne dotyczące takich autonomicznych agentów. Zalecają one ocenę ryzyka przed wdrożeniem oraz ograniczanie samodzielności agenta i jego dostępu do narzędzi oraz danych. Zaktualizowana wersja wskazuje zasadę minimalnych uprawnień: agent ma otrzymać tylko dostęp potrzebny do wykonania zadania. Są to wytyczne, nie powszechny prawny zakaz wdrażania agentów.
50
48
52
W praktyce organizacja powinna wiedzieć, kto odpowiada za agenta, ograniczać jego uprawnienia, monitorować działania oraz — tam, gdzie to możliwe — zapewnić możliwość ich prześledzenia i cofnięcia. To bardziej konkretne zabezpieczenia niż ogólna deklaracja, że agent jest „bezpieczny”.
34 Singapurska minister Josephine Teo porównała rolę norm i zabezpieczeń AI w budowaniu zaufania z praktykami bezpieczeństwa w lotnictwie cywilnym.
17
Odpowiedź sprowadza się do odpowiedzialności mimo niepewności: testować to, co można przetestować, dopuszczać niezależną kontrolę i nie przyznawać systemom uprawnień, nad którymi nie da się zapanować. Nie kończy to sporu o długoterminowe ryzyko AI, ale wyznacza konkretne zadania jej twórcom i użytkownikom już dziś.
32
48