Oba łańcuchy exploitów wymagają polecenia RESTORE, a niektóre używają również EVAL, XGROUP lub modułu RedisBloom . Redis wydał siedem poprawek bezpieczeństwa 23 lipca, aby załatać te luki
. Exploity są opisane jako nieniszczące i zostały opublikowane przeciwko oficjalnym obrazom Dockera Redisa
.
Kilka istotnych czynników doprowadziło do powszechnego sceptycyzmu:
Rozdmuchany zakres bez dowodów. Publiczne dowody potwierdzają jeden poważny exploit dla Redis 8.8.0, a nie rzekome 19 zero-day. Ta liczba i podany harmonogram pozostają niepotwierdzone przez żadną niezależną stronę .
Brak potwierdzonego przydziału CVE. Rewelacja o 27 minutach nie ma potwierdzonego przydziału CVE. Jest to oddzielne zdarzenie od pięciu załatanych CVE, które Redis przypisał wymienionym z nazwiska ludzkim badaczom (CVE-2026-23479, CVE-2026-25243, CVE-2026-25588, CVE-2026-25589 i CVE-2026-23631, załatane 5 maja 2026). Łączenie tych dwóch wydarzeń zostało opisane jako „największy błąd w relacjonowaniu” w mediach .
Replikacja znanych podatności. Niektóre relacje opisują Kimi K3 jako „zreplikowało znaną podatność Redisa”, która była już załatana w Redis 8.8.0 . Jedna z analiz zauważyła, że testy agenta „łączyły znane problemy z bezpieczeństwem pamięci, zamiast odkrywać izolowane nowe błędy”
.
Dostęp do internetu podczas eksperymentu. Badacz potwierdził, że model miał dostęp do internetu podczas testu. Krytycy twierdzą, że oznacza to, iż model mógł uzyskać dostęp do istniejących informacji o podatnościach lub kodzie exploitów, co podważa twierdzenie o w pełni autonomicznym odkryciu .
Ocena rządów Wielkiej Brytanii i USA przeczy twierdzeniom o możliwościach na poziomie granicznym. Wstępna ocena UK AISI / CAISI wykazała, że Kimi K3 „wypada znacząco poniżej najnowszych modeli zdolnych do cyberataków na poziomie granicznym” w autonomicznych zadaniach cybernetycznych . W ataku na symulowaną sieć korporacyjną Kimi K3 osiągnął średnio krok 17 z 32-stopniowej ścieżki ataku, podczas gdy najbardziej zaawansowane modele amerykańskie osiągały średnio 28,5 kroku
. Zabezpieczenia modelu „nie zapobiegły próbom cyberataku”
.
Brak niezależnej weryfikacji. Twierdzenia Shou nie zostały niezależnie zweryfikowane przez opiekunów Redisa ani Moonshot AI i pozostają niepotwierdzone .
Niezależnie od dokładnego zakresu twierdzeń Shou, demonstracja ma istotne implikacje:
Radykalne skrócenie czasu tworzenia exploitów. Agenty AI dramatycznie skracają czas między przeglądem kodu źródłowego a wyprodukowaniem działającego explaita, co może skrócić okno, w którym obrońcy mogą zweryfikować i wdrożyć łatki .
Ryzyko proliferacji wag otwartych. Kimi K3 to model o otwartych wagach i 2,8 biliona parametrów, którego pełna wersja ma zostać wydana 27 lipca . W przeciwieństwie do modeli dostępnych wyłącznie przez API, umożliwi to każdemu pobranie, dostrojenie i zintegrowanie modelu z własnymi narzędziami bez nadzoru, obniżając próg dla użycia ofensywnego
.
Możliwości wciąż niedojrzałe na granicy możliwości. Ocena rządów Wielkiej Brytanii i USA oraz niezależne testy porównawcze sugerują, że obecne autonomiczne możliwości wykorzystywania luk są wciąż wczesne . Kimi K3 dobrze radzi sobie z rozumowaniem kodu i ponownym odkrywaniem podatności – ponownie odkrył 23 z 26 znanych CVE w specjalistycznym teście
– ale pozostaje w tyle za najlepszymi modelami w pełnołańcuchowych autonomicznych atakach na realistyczne sieci
. W jednym niezależnym teście Kimi K3 uzyskał 32,2% w ofensywnym teście cyberbezpieczeństwa, czyli mniej niż połowę średniej 76,2% osiągniętej przez wiodące modele amerykańskie, i nie zdołał osiągnąć arbitralnego wykonania kodu w żadnej z 41 testowanych podatności
.
Nowa pilność obronna. Demonstracja przyspieszyła wezwania do automatycznego priorytetyzowania łat, narzędzi do analizy binarnej w czasie rzeczywistym i ostrzejszych kontroli wokół wydawania modeli o otwartych wagach o wysokich możliwościach . Branża cyberbezpieczeństwa stoi teraz w obliczu przyszłości, w której okno od podatności do exploita kurczy się z miesięcy do minut
, a agenty AI mogą działać z prędkością maszyny na wielu celach jednocześnie
.