Cursor Composer 2.5: Claude Opus 4.7 और GPT‑5.5 के मुकाबले कितना मजबूत?
Cursor ने 18 मई 2026 को Composer 2.5 लॉन्च किया, जो SWE‑Bench Multilingual पर 79.8% और Terminal‑Bench 2.0 पर 69.3% स्कोर के साथ फ्रंटियर AI मॉडल्स के करीब प्रदर्शन करता है। इसकी कीमत लगभग $0.50 प्रति मिलियन इनपुट टोकन और $2.50 प्रति मिलियन आउटपुट टोकन है, जो कई प्रतिस्पर्धी मॉडलों की तुलना में काफी सस्ती है। यह मॉडल...
प्रकाशितकर्ताGPT-5.5 से संपादितGPT Image 2 से चित्र बनाए गए
Cursor ने 18 मई 2026 को Composer 2.5 लॉन्च किया, जो SWE‑Bench Multilingual पर 79.8% और Terminal‑Bench 2.0 पर 69.3% स्कोर के साथ फ्रंटियर AI मॉडल्स के करीब प्रदर्शन करता है।
इसकी कीमत लगभग $0.50 प्रति मिलियन इनपुट टोकन और $2.50 प्रति मिलियन आउटपुट टोकन है, जो कई प्रतिस्पर्धी मॉडलों की तुलना में काफी सस्ती है।
यह मॉडल Moonshot AI के Kimi K2.5 चेकपॉइंट पर आधारित है और इसे भारी मात्रा में सिंथेटिक कोडिंग टास्क और reinforcement learning से प्रशिक्षित किया गया है।
Cursor Composer 2.5: Benchmarks, Pricing, and How It Stacks Up to Claude Opus 4.7 and GPT‑5.5Cursor’s Composer 2.5 aims to deliver frontier‑level coding performance while dramatically lowering the cost of running AI coding agents.
AI संकेत
Create a landscape editorial hero image for this Studio Global article: Cursor Composer 2.5: Benchmarks, Pricing, and How It Stacks Up to Claude Opus 4.7 and GPT‑5.5. Article summary: Cursor’s Composer 2.5 is an in‑house coding model released May 18, 2026 that scores about 79.8% on SWE‑Bench Multilingual and 69.3% on Terminal‑Bench 2.0—roughly matching Claude Opus 4.7 on some benchmarks while costi.... Topic tags: cursor, ai coding, developer tools, ai models, benchmarks. Reference image context from search candidates: Reference image 1: visual subject "Composer 2.5 matches Opus 4.7 and GPT-5.5 on CursorBench 3.1 but costs less than a dollar per task - compared to up to eleven dollars for the competition. | Image: Cursor" source context "Cursor's Composer 2.5 matches Opus 4.7 and GPT-5.5 benchmarks ..." Reference image 2: visual subject "Composer 2.5 vs Opus | The Results Are Brutal Merv
openai.com
Cursor IDE बनाने वाली कंपनी Anysphere ने 18 मई 2026 को अपना नया AI कोडिंग मॉडल Composer 2.5 जारी किया। यह मॉडल खास तौर पर सॉफ्टवेयर इंजीनियरिंग वर्कफ़्लो के लिए तैयार किया गया है—जैसे बड़े कोडबेस को समझना, कई फ़ाइलों में बदलाव करना, टर्मिनल कमांड चलाना और टेस्ट‑ड्रिवन डिबगिंग करना।
इस रिलीज़ को खास बनाती हैं दो बातें: पहला, इसका प्रदर्शन कई फ्रंटियर AI मॉडल्स जैसे Anthropic के Claude Opus 4.7 और GPT‑5.5 के करीब बताया जा रहा है; दूसरा, इसकी टोकन कीमत काफी कम है, जिससे लंबे समय तक चलने वाले AI कोडिंग एजेंट चलाना सस्ता पड़ सकता है।
Studio Global AI
अपना शोध जारी रखें
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
"Cursor Composer 2.5: Claude Opus 4.7 और GPT‑5.5 के मुकाबले कितना मजबूत?" का संक्षिप्त उत्तर क्या है?
Cursor ने 18 मई 2026 को Composer 2.5 लॉन्च किया, जो SWE‑Bench Multilingual पर 79.8% और Terminal‑Bench 2.0 पर 69.3% स्कोर के साथ फ्रंटियर AI मॉडल्स के करीब प्रदर्शन करता है।
सबसे पहले सत्यापित करने योग्य मुख्य बिंदु क्या हैं?
Cursor ने 18 मई 2026 को Composer 2.5 लॉन्च किया, जो SWE‑Bench Multilingual पर 79.8% और Terminal‑Bench 2.0 पर 69.3% स्कोर के साथ फ्रंटियर AI मॉडल्स के करीब प्रदर्शन करता है। इसकी कीमत लगभग $0.50 प्रति मिलियन इनपुट टोकन और $2.50 प्रति मिलियन आउटपुट टोकन है, जो कई प्रतिस्पर्धी मॉडलों की तुलना में काफी सस्ती है।
मुझे अभ्यास में आगे क्या करना चाहिए?
यह मॉडल Moonshot AI के Kimi K2.5 चेकपॉइंट पर आधारित है और इसे भारी मात्रा में सिंथेटिक कोडिंग टास्क और reinforcement learning से प्रशिक्षित किया गया है।
Composer सीरीज़ के मॉडल सामान्य चैट या कोड स्निपेट जनरेशन के लिए नहीं, बल्कि agentic software engineering के लिए बनाए गए हैं। इसका मतलब है कि AI केवल एक छोटा कोड नहीं लिखता, बल्कि पूरा डेवलपमेंट वर्कफ़्लो संभाल सकता है।
उदाहरण के लिए:
बड़े कोड रिपॉज़िटरी में समस्या ढूंढना
कई फ़ाइलों में बदलाव करना
कोड को कम्पाइल करना
टेस्ट चलाकर बार‑बार सुधार करना
Cursor के अनुसार Composer 2.5 पहले के संस्करणों की तुलना में लंबे समय तक चलने वाले कार्यों में अधिक स्थिर, जटिल निर्देशों को बेहतर तरीके से समझने वाला, और IDE में सहयोगात्मक काम के दौरान अधिक भरोसेमंद है।
यह बदलाव उस बड़े ट्रेंड को दर्शाता है जहाँ AI कोडिंग टूल सिर्फ ऑटो‑कम्प्लीशन से आगे बढ़कर पूरे डेवलपमेंट एजेंट बन रहे हैं।
बेंचमार्क: Claude Opus 4.7 और GPT‑5.5 से तुलना
Cursor द्वारा साझा किए गए बेंचमार्क बताते हैं कि Composer 2.5 कुछ प्रमुख कोडिंग टेस्ट में शीर्ष मॉडल्स के करीब प्रदर्शन करता है।
SWE‑Bench Multilingual पर Composer 2.5 लगभग फ्रंटियर स्तर पर है और रिपोर्ट किए गए आंकड़ों में GPT‑5.5 से थोड़ा आगे दिखाई देता है।
Terminal‑Bench 2.0 में यह Claude Opus 4.7 के लगभग बराबर है, लेकिन GPT‑5.5 इससे काफी आगे है।
पिछले संस्करण की तुलना में सुधार भी बड़ा है—जैसे SWE‑Bench Multilingual स्कोर 73.7% से बढ़कर 79.8% हो गया।
इससे संकेत मिलता है कि Composer 2.5 कुछ सॉफ्टवेयर इंजीनियरिंग कार्यों में शीर्ष AI मॉडल्स के बराबरी के करीब है, लेकिन हर बेंचमार्क पर उनसे आगे नहीं है।
कीमत इतनी महत्वपूर्ण क्यों है
Composer 2.5 का सबसे बड़ा आकर्षण उसकी कीमत है।
स्टैंडर्ड वर्ज़न की कीमत लगभग:
$0.50 प्रति मिलियन इनपुट टोकन
$2.50 प्रति मिलियन आउटपुट टोकन
इसके अलावा एक तेज़ वर्ज़न भी उपलब्ध है जिसकी कीमत लगभग:
$3.00 प्रति मिलियन इनपुट टोकन
$15.00 प्रति मिलियन आउटपुट टोकन
तुलना के लिए, कुछ रिपोर्टों के अनुसार Claude Opus मॉडल्स की कीमत लगभग $5 इनपुट और $25 आउटपुट प्रति मिलियन टोकन तक हो सकती है।
यह अंतर इसलिए महत्वपूर्ण है क्योंकि AI कोडिंग एजेंट बहुत अधिक टोकन इस्तेमाल करते हैं।
एक ही काम के दौरान मॉडल को कई बार कॉल करना पड़ सकता है, जैसे:
रिपॉज़िटरी सर्च
योजना बनाना
कोड एडिट करना
कम्पाइल और टेस्ट चलाना
अगर टोकन सस्ते हों, तो IDE के भीतर लंबे और जटिल एजेंट वर्कफ़्लो चलाना आर्थिक रूप से आसान हो जाता है।
यह मॉडल किस आधार पर बना है
Composer 2.5 को Moonshot AI के Kimi K2.5 ओपन‑वेट चेकपॉइंट पर आधारित बताया गया है, जिस पर Cursor ने आगे अतिरिक्त प्रशिक्षण किया।
रिपोर्टों के अनुसार प्रशिक्षण में:
पिछले संस्करण से लगभग 25 गुना अधिक सिंथेटिक कोडिंग टास्क उपयोग किए गए
लगभग 85% कम्प्यूट अतिरिक्त ट्रेनिंग और reinforcement learning में लगाया गया
सिंथेटिक टास्क मॉडल को बार‑बार पूरे विकास वर्कफ़्लो का अभ्यास करवाते हैं—जैसे योजना बनाना, कोड बदलना, टेस्ट चलाना और सुधार करना—जिससे वास्तविक सॉफ्टवेयर समस्याओं पर इसकी विश्वसनीयता बढ़ती है।
Cursor की बड़ी रणनीति
Composer 2.5 केवल एक नया मॉडल नहीं है—यह Cursor की रणनीति में भी बदलाव दिखाता है।
पहले Cursor IDE अपने कई AI फीचर चलाने के लिए OpenAI, Anthropic और Google जैसे बाहरी मॉडल प्रदाताओं पर निर्भर था।
अब अपने मॉडल विकसित करने से Cursor को कई फायदे मिल सकते हैं:
लंबे एजेंट रन के लिए कम लागत
बाहरी AI कंपनियों पर कम निर्भरता
IDE के भीतर मॉडल व्यवहार पर ज्यादा नियंत्रण
यह खास तौर पर महत्वपूर्ण है क्योंकि Anthropic का Claude Code मॉडल और टूल दोनों को एक साथ नियंत्रित करता है, जिससे उसका इंटीग्रेशन मजबूत होता है।
Composer जैसे इन‑हाउस मॉडल बनाकर Cursor भी मॉडल + डेवलपर टूल वाली उसी प्रतिस्पर्धा में सीधे उतरने की कोशिश कर रहा है।
निष्कर्ष
Composer 2.5 हर बेंचमार्क में सबसे आगे नहीं है—कुछ परीक्षणों में GPT‑5.5 अभी भी स्पष्ट बढ़त बनाए हुए है और Claude Opus 4.7 भी मजबूत प्रतिस्पर्धी है।
लेकिन इस मॉडल की असली खासियत है फ्रंटियर‑स्तर के करीब कोडिंग प्रदर्शन और बेहद कम कीमत का संयोजन।
अगर Cursor इसी तरह अपने इन‑हाउस मॉडल्स को बेहतर बनाता रहा और कीमत कम रखता है, तो AI‑सहायता प्राप्त सॉफ्टवेयर विकास की लागत और प्रतिस्पर्धा दोनों पर इसका बड़ा असर पड़ सकता है।