OpenAI mengatakan kampanye yang berupaya menampilkan penalaran tersembunyi modelnya mulai terdeteksi pada awal Juli 2026 dan berhasil diganggu pada 28 Juli. Pada 24–25 Juli, OpenAI mencatat 16.000 permintaan dengan pola ekstraksi dari lebih dari 4.000 pengguna.
Diterbitkan olehDiedit dengan GPT-6 LunaGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What has OpenAI alleged about Moonshot AI’s attempts to extract hidden reasoning from GPT models, including the scale, timing, and limits of. Article summary: OpenAI says it disrupted a July 2026 campaign that tried to make GPT models reveal protected, hidden reasoning, and attributes a core cluster —not the entire campaign—to individuals associated with Moonshot AI.. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
OpenAI mengatakan telah mengganggu kampanye yang berupaya membuat model GPT menampilkan penalaran internal yang biasanya tidak diberikan dalam jawaban. Perusahaan mengaitkan kelompok inti aktivitas dengan orang-orang yang berhubungan dengan Moonshot AI, pengembang keluarga model Kimi. Namun, OpenAI juga menyatakan belum bisa memastikan apakah semua operator yang terpantau berasal dari satu pihak.
Angka-angka yang diumumkan adalah jumlah percobaan, bukan ukuran penalaran yang berhasil dicuri. Laporan pemerintah AS dan Anthropic memuat tuduhan terpisah yang cakupannya lebih luas; semuanya tetap merupakan tuduhan yang dilaporkan oleh pihak-pihak tersebut, bukan bukti bahwa setiap permintaan berhasil atau dilakukan Moonshot.
OpenAI menyebut aktivitas awal terpantau pada 1 Juli 2026. Pada 24–25 Juli, perusahaan melihat 16.000 permintaan dari lebih dari 4.000 pengguna yang menggunakan pola terkait ekstraksi. Penyelidikan lebih luas menemukan pola prompt serupa di antara lebih dari 15.000 pengguna. OpenAI mengatakan telah mengganggu kelompok aktivitas tersebut pada 28 Juli. Angka pengguna dan permintaan itu tidak berarti semua akun dikendalikan oleh satu operator.
Salah satu teknik yang dijelaskan dalam laporan adalah menyalin penalaran terenkripsi dari satu percakapan, lalu meminta model dalam percakapan lain untuk menguraikan dan menyalinnya. Dengan demikian, tuduhan OpenAI berfokus pada manipulasi interaksi dengan model agar informasi yang dilindungi muncul dalam bentuk yang dapat dibaca peminta—bukan klaim bahwa pelaku membobol basis data atau mengakses langsung percakapan pengguna yang tersimpan.
Dalam peringatan bersama yang terbit pada September, NSA, CISA, dan FBI menyebut Moonshot sebagai salah satu dari enam perusahaan berbasis di Tiongkok yang dituduh melakukan kampanye distilasi terhadap model AI terdepan AS. Peringatan itu menggambarkan aktivitas kolektif berupa jutaan permintaan dan ekstraksi miliaran token sejak setidaknya akhir 2024; angka gabungan tersebut bukan angka khusus untuk Moonshot.
Distilasi adalah teknik melatih model yang lebih kecil atau kurang mampu dengan memanfaatkan keluaran model yang lebih kuat. Teknik ini juga memiliki penggunaan yang sah. Dalam peringatan tersebut, badan-badan AS menuduh permintaan untuk mengambil kemampuan model dirutekan melalui beberapa jalur, termasuk API, penyedia cloud jarak jauh, dan agregator pihak ketiga yang dapat menyamarkan metadata pengguna. Mereka merekomendasikan deteksi dan mitigasi yang menyeluruh. Materi yang dirujuk di sini tidak cukup untuk memastikan daftar kontrol teknis yang lengkap, jadi rincian checklist tertentu tidak dapat dipastikan dari sumber tersebut.
Dalam laporan terpisah, Anthropic menuduh Moonshot meneruskan permintaan pelanggan ke Claude tanpa memberi tahu pengguna, lalu menyajikan jawabannya seolah diproses oleh Kimi. Anthropic mengatakan bahwa dalam satu periode sepuluh hari, hampir 300.000 permintaan pelanggan diteruskan ke layanannya, sebagian besar ke model Opus. Ini adalah tuduhan Anthropic mengenai penggunaan Claude—bukan angka dari penyelidikan OpenAI atas upaya menampilkan penalaran tersembunyi GPT.
Anthropic juga menempatkan aktivitas itu dalam konteks dugaan distilasi untuk meningkatkan model lain. Distilasi sendiri tidak otomatis merupakan tindakan terlarang; yang dipersoalkan dalam laporan tersebut adalah penggunaan yang menurut Anthropic melanggar ketentuan layanan dan dilakukan tanpa sepengetahuan pengguna.
Pada akhir September, laporan menyebut Kimi K3 dari Moonshot dapat digunakan pelanggan enterprise melalui Codex lewat Baseten, penyedia infrastruktur inferensi asal AS. Biayanya dapat dihitung ke dalam komitmen belanja OpenAI yang sudah dimiliki pelanggan, sehingga tidak perlu membuat kontrak pengadaan pemasok baru. Laporan menyebutnya sebagai model terbuka pertama dari Tiongkok yang masuk ke kanal pengadaan enterprise tersebut. 3
Ketersediaan ini memang kontras dengan tuduhan OpenAI terhadap kelompok yang dikaitkan dengan Moonshot, tetapi tidak menjadi bukti bahwa integrasi Kimi K3 di Codex memfasilitasi upaya ekstraksi yang dituduhkan. Tidak ada dasar dalam sumber yang dirujuk untuk menyimpulkan hubungan sebab-akibat semacam itu. 3
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
OpenAI mengatakan kampanye yang berupaya menampilkan penalaran tersembunyi modelnya mulai terdeteksi pada awal Juli 2026 dan berhasil diganggu pada 28 Juli.
OpenAI mengatakan kampanye yang berupaya menampilkan penalaran tersembunyi modelnya mulai terdeteksi pada awal Juli 2026 dan berhasil diganggu pada 28 Juli. Pada 24–25 Juli, OpenAI mencatat 16.000 permintaan dengan pola ekstraksi dari lebih dari 4.000 pengguna.
Peringatan NSA, CISA, dan FBI serta laporan Anthropic memuat tuduhan lain soal distilasi model dan penerusan permintaan ke Claude.