Dakwaan itu wajar dibaca dengan berhati-hati. Frasa “menghampiri Opus 4.8” merujuk kepada set penilaian yang dipilih DeepSeek; ia bukan bukti bahawa kedua-dua model mempunyai kualiti yang sama dalam semua tugasan visual, beban kerja pengekodan atau sesi ejen yang panjang.
Log rasmi turut menyenaraikan beberapa skor Vision-Exp, termasuk 36.5 untuk ApexBench, 27.3 untuk Agents’ Last Exam, 64.3 untuk Chartography dan 35.0 untuk ZeroBench Pass@5.
Angka-angka ini masih tidak menjawab beberapa persoalan penting dalam penggunaan sebenar. Keputusan penanda aras boleh berubah mengikut arahan, persekitaran alat, jenis tugasan, keperluan kependaman, pengendalian kegagalan dan kaedah penilaian. Berdasarkan bahan yang tersedia, bukti bebas masih belum mencukupi untuk menganggap perbandingan ini sebagai kedudukan muktamad antara model.
Kekuatan utama yang diketengahkan untuk tugasan berasaskan teks ialah kesinambungan, bukannya kemenangan yang jelas. DeepSeek memasarkan Vision-Exp sebagai model yang mengekalkan keupayaan teks V4-Flash, supaya pembangun tidak perlu mengorbankan penaakulan dan tingkah laku ejennya semata-mata untuk mendapatkan input imej.
Perbezaan ini penting ketika memilih model:
DeepSeek menyediakan Vision-Exp melalui platform APInya. Pelancaran ini menyokong Chat Completions, Messages dan Responses, termasuk input campuran teks serta imej.
Imej boleh dihantar melalui tiga cara:
file_id bagi imej yang dimuat naik melalui Files API.Format yang didokumenkan ialah JPEG, PNG, GIF dan WebP. Responses API juga menerima bahagian kandungan
input_image dengan URL imej, data URL base64 atau rujukan fail yang dimuat naik.
Input imej ditukar kepada token yang boleh dibilkan. DeepSeek menyatakan setiap imej menyumbang tidak lebih daripada 384 token input, menggunakan struktur harga V4-Flash.
Kadar V4-Flash yang dikaitkan dengan pelancaran ini ialah:
Had 384 token menjadikan kos bahagian imej dalam sesuatu permintaan lebih mudah dijangka. Namun, had itu tidak merangkumi teks yang disertakan, panggilan alat atau output yang dijana. Satu interaksi ejen lengkap masih boleh menggunakan jauh lebih banyak token berbanding imej itu sendiri.
DeepSeek turut melancarkan Harness 0.1.1 dengan sokongan terbina dalam untuk Vision-Exp. Perkara ini relevan kepada pembangun yang membina ejen, bukan sekadar menghantar soalan imej secara berasingan, kerana model ini direka untuk beroperasi dalam aliran kerja yang menggunakan alat.
Pelancaran tersebut turut memperkenalkan Files API yang percuma. Pembangun boleh memuat naik imej sekali dan menggunakannya semula dalam permintaan seterusnya dengan menghantar file_id, tanpa perlu menghantar semula data imej yang sama. DeepSeek mendokumenkan rujukan fail dalam format file-api-....
Rujukan fail yang boleh digunakan semula amat berguna apabila ejen perlu meneliti tangkap layar, halaman dokumen atau bahan visual yang sama dalam beberapa giliran. Walaupun Files API itu sendiri percuma, inferens model dan penggunaan token masih dikenakan bayaran.
Vision-Exp menunjukkan bahawa persaingan AI semakin melangkaui kualiti model semata-mata. Keupayaan multimodal, harga API, keserasian antara muka, fail yang boleh digunakan semula dan alat pembangunan kini turut menjadi faktor utama.
DeepSeek menawarkan peluasan visual kepada barisan Flash pada kadar token V4-Flash yang diterbitkan, manakala Opus 4.8 Anthropic menjadi titik perbandingan kelas tinggi dalam laporan DeepSeek.
Kepentingan praktikal model ini akhirnya kurang bergantung pada satu jadual penanda aras dan lebih kepada kebolehpercayaan dalam tugas seperti pengekodan berasaskan tangkap layar, analisis dokumen, ejen antara muka dan penggunaan alat visual. Label “eksperimen” juga mengingatkan pembangun supaya menguji aliran kerja masing-masing terlebih dahulu sebelum menggunakannya untuk tugasan produksi yang kritikal.
Kesimpulan paling munasabah buat masa ini adalah sederhana: DeepSeek telah menjadikan penaakulan visual berkos rendah lebih mudah dicapai melalui ekosistem APInya, manakala keputusan awalnya menunjukkan cabaran yang bermakna dalam beberapa ujian multimodal terpilih. Penilaian bebas, kebolehpercayaan dunia sebenar dan penerimaan berterusan oleh pembangun akan menentukan sama ada Vision-Exp menjadi alternatif yang kukuh atau kekal sebagai pelancaran eksperimen yang menarik.