בפועל, המשמעות היא שהאינטגרציה הקיימת יכולה להמשיך לעבוד, בעוד שהשירות מאחורי אותו שם מתחיל לספק את גרסת 0813.
ה-API תומך כעת בפורמט OpenAI Responses API, ומותאם לזרימות עבודה המבוססות על Codex, כולל הגדרה בלחיצה אחת ל-Codex. בתיעוד הרחב יותר של ה-API מצוינת גם תאימות לממשקי OpenAI Chat Completions ולממשקים של Anthropic.
עבור מפתחים, זו אינה רק דרך נוספת לשלוח למודל טקסט ולקבל תשובה. התאימות מיועדת לאפליקציות שמחברות בין פלט המודל לבין כלים, הרצת קוד, פעולות חוזרות ותהליכים שבהם הסוכן צריך לבצע כמה צעדים ברצף.
התוצאות שפרסמה DeepSeek מצביעות על שיפור משמעותי לעומת גרסת התצוגה של V4 Pro בכמה מבחני קידוד וסוכנים. ב-Terminal-Bench 2.1, מבחן הבודק עד כמה סוכני AI מסוגלים לבצע משימות בסביבת טרמינל, קיבלה גרסת 0813 ציון 87.9, לעומת 72.1 לגרסת התצוגה. בכך היא נותרה מעט מאחורי Fable 5, שקיבלה 88.0.
תוצאות נוספות שדווחו:
בסיקור ההשקה נטען כי V4 Pro עקף את Fable 5 ב-CyberGym וב-AutomationBench, בעוד שב-Terminal-Bench הוא נותר מאחור בפער זעיר. עם זאת, חשוב לקרוא את ההשוואות בזהירות: הנתונים מבוססים בעיקר על טבלת ההערכה של DeepSeek ועל דיווחים נלווים להשקה, ולא על מחקר בנצ'מרק אחד שנוהל באופן עצמאי.
למרות ההסתייגות, הכיוון ברור: DeepSeek משקיעה ביכולות שנדרשות מסוכני תוכנה — עבודה בטרמינל, הנדסת תוכנה, משימות הקשורות לאבטחת סייבר ותהליכים שבהם המודל צריך לבצע פעולות ולא רק להפיק תשובה בודדת.
לפי אותו מקור, תעריף שעות השפל הוא מחצית מתעריף השיא. חלונות העומס הם 01:00–04:00 UTC ו-06:00–10:00 UTC.
קיימת אי-התאמה בין מקורות התמחור שסופקו, הן במטבע והן בתיעוד: דיווח אחר, המצטט את תיעוד ה-API של DeepSeek, מציין 3 יואן למיליון טוקני קלט, 6 יואן למיליון טוקני פלט ו-0.025 יואן למיליון טוקנים עבור קלט שנפגע במטמון. לכן, לפני חישוב עלויות לפרודקשן, מומלץ לבדוק את המחירים והמטבע המוצגים בפועל בתיעוד הרשמי של DeepSeek.
ההשקה רלוונטית במיוחד לצוותים שבונים סוכני קידוד ומערכות המשתמשות בכלים. משתמשים קיימים יכולים לשמור על מזהה המודל deepseek-v4-pro, בעוד שתמיכה ב-Responses API וב-Codex עשויה לצמצם את העבודה הנדרשת לחיבור המודל לכלי פיתוח ותשתיות סוכנים קיימים.
הציונים שדווחו מציבים את V4 Pro בעמדה תחרותית יותר במשימות הנוגעות לאוטומציה של פיתוח תוכנה. אבל ציון כמעט זהה במבחן אחד אינו מוכיח שהמודל יתפקד באופן זהה בכל סביבת קוד, משימת הסקה או עומס ייצור. בשלב זה יש להתייחס לתוצאות כאל נתוני ההערכה של DeepSeek, עד שייווצרו שחזורים בלתי תלויים.
בשורה התחתונה, מדובר בשדרוג של API ושל פלטפורמת סוכנים לא פחות משהוא השקת מודל חדש: שם המודל נשאר יציב, אפשרויות האינטגרציה התרחבו, והתוצאות המדווחות במשימות סוכנים השתפרו בחדות לעומת גרסת התצוגה.