Model keputusan menjawab pertanyaan dengan pilihan terbatas—misalnya menentukan alat yang perlu dipakai agen AI—sehingga dapat mempercepat tugas klasifikasi dan perutean. Jev dari TypeSafe AI menawarkan layanan ter host dengan harga yang dipublikasikan sebesar $0,042 per juta token input.
Diterbitkan olehDiedit dengan GPT-6 LunaGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: How do decision models make fast, probability backed choices for AI agents instead of generating text, and how do TypeSafe AI’s Jev, OpenAI’. Article summary: Decision models answer a bounded question—such as “Which tool should this agent use?”—by selecting from allowed outcomes and returning a score or probability, rather than generating an explanation token by token.. Topic tags: general web, ai safety, openai, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
Model AI yang biasa dipakai untuk menulis menghasilkan teks sedikit demi sedikit. Model keputusan punya tugas yang lebih sempit: menjawab pertanyaan dengan memilih dari daftar opsi yang telah ditentukan. Misalnya, sebuah agen menerima permintaan pelanggan lalu harus memilih tim yang tepat untuk menanganinya.
Karena tidak perlu menyusun paragraf, model dapat mengembalikan pilihan, skor, atau probabilitas untuk digunakan langsung oleh perangkat lunak. Pendekatan ini cocok untuk keputusan berulang yang sensitif terhadap waktu, seperti klasifikasi, perutean permintaan, atau memilih langkah berikutnya bagi agen. Namun, probabilitas tinggi tetap bukan jaminan bahwa pilihan itu benar. 11
12
| Produk | Cara kerja dan ketersediaan | Kecepatan dan harga yang dilaporkan |
|---|---|---|
| Jev — TypeSafe AI | Model khusus keputusan yang tersedia sebagai layanan ter-host. Dirancang untuk mengembalikan pilihan bertipe, skor, dan probabilitas. TypeSafe belum membuka bobot model atau menjelaskan arsitekturnya secara rinci. |
TypeSafe melaporkan latensi sekitar 70–500 milidetik. Harga yang dipublikasikan adalah $0,042 per juta token input, tanpa biaya token output. Angka performanya belum dapat diverifikasi lewat pengujian independen yang sebanding. |
| Decisions API — OpenAI | Memungkinkan pengembang memberikan konteks berupa teks atau gambar, pertanyaan, dan kumpulan jawaban terbatas. Hasilnya dapat dipakai untuk klasifikasi, mengarahkan permintaan, atau memilih tindakan agen. Saat diumumkan, layanan ini masih dalam pratinjau terbatas. |
Liputan peluncuran menyebut sekitar 150 milidetik per keputusan. OpenAI belum mengumumkan harga maupun tolok ukur langsung yang membandingkannya dengan Jev. |
| Strands Decider 2B — AWS | Model sumber terbuka berukuran sekitar 2 miliar parameter untuk pilihan terbatas, probabilitas ya/tidak, dan skor. Bobot serta materi pelatihannya tersedia, sehingga pengembang dapat bereksperimen dan menjalankannya sendiri. |
Pengujian yang dilaporkan menunjukkan median sekitar 106–115 milidetik, tetapi hasilnya bergantung pada perangkat keras dan metode pengujian. Bobot model dapat diunduh tanpa biaya; komputasi untuk menjalankannya tetap perlu disediakan. |
| Clef dan Clef-flash — Cloudflare | Dua model berbobot terbuka yang dapat dijalankan sendiri atau digunakan melalui Workers AI. Clef ditujukan untuk keputusan yang lebih kuat, sedangkan Clef-flash menekankan kecepatan. | Harga ter-host yang dilaporkan adalah $0,24 per juta token input untuk Clef dan $0,09 untuk Clef-flash. Pengujian yang dikaitkan dengan Cloudflare menempatkan median Clef-flash di sekitar 39 milidetik. Perbandingan ini bukan uji biaya dan kecepatan yang setara dengan Jev. |
Angka latensi memberi gambaran, tetapi bukan perbandingan akhir. Hasilnya dapat berubah menurut perangkat keras, panjang konteks, jenis masukan, serta cara sebuah pengujian dilakukan. Untuk layanan ter-host, harga per token juga belum tentu mencakup seluruh biaya operasional aplikasi. Sementara itu, model yang dijalankan sendiri menghindari biaya layanan per token, tetapi membutuhkan perangkat keras atau komputasi cloud.
Ada pula perbedaan ketersediaan. OpenAI Decisions API masih berada dalam pratinjau terbatas menurut pengumuman peluncurannya. AWS dan Cloudflare menawarkan model berbobot terbuka yang dapat dicoba sendiri; Cloudflare juga menyediakan opsi ter-host melalui Workers AI. 12
19
Jev hadir lebih dulu, tetapi kini bukan satu-satunya pilihan. OpenAI menawarkan jalur ter-host, sedangkan AWS dan Cloudflare memberi pengembang opsi berbobot terbuka; Cloudflare juga memiliki layanan ter-host. Persaingan ini dapat membuat pembeli membandingkan bukan hanya latensi, tetapi juga ketepatan keputusan, biaya keseluruhan, kemudahan integrasi, dan kebutuhan untuk menjalankan model sendiri.
TypeSafe AI dilaporkan mengumpulkan pendanaan sebesar $40 juta. Sejumlah laporan juga menyebut perkiraan atau pembicaraan soal valuasi, tetapi angka-angka tersebut tidak cukup untuk diperlakukan sebagai valuasi final yang terverifikasi. Dengan arsitektur Jev yang belum diungkap secara memadai dan klaim performa yang belum diuji secara independen dalam perbandingan sepadan, langkah penting bagi TypeSafe adalah menunjukkan hasil pada beban kerja nyata—serta membuktikan kualitas keputusan dan biaya totalnya.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Model keputusan menjawab pertanyaan dengan pilihan terbatas—misalnya menentukan alat yang perlu dipakai agen AI—sehingga dapat mempercepat tugas klasifikasi dan perutean.
Model keputusan menjawab pertanyaan dengan pilihan terbatas—misalnya menentukan alat yang perlu dipakai agen AI—sehingga dapat mempercepat tugas klasifikasi dan perutean. Jev dari TypeSafe AI menawarkan layanan ter host dengan harga yang dipublikasikan sebesar $0,042 per juta token input.
AWS Strands Decider 2B dan model Clef dari Cloudflare menyediakan pilihan berbobot terbuka untuk dijalankan sendiri; Cloudflare juga menawarkan Clef melalui Workers AI.