DeepSeek ने 31 जुलाई को V4 Flash 0731 को सार्वजनिक बीटा के रूप में जारी किया। कंपनी के अनुसार इसमें पहले प्रीव्यू की बनावट और आकार रखा गया, साथ ही प्रशिक्षण के बाद का नया चरण जोड़ा गया। रिलीज API के जरिए उपलब्ध थी और उपभोक्ता ऐप, वेब सेवा या API में DeepSeek के Pro मॉडल की जगह नहीं आई।
DeepSeek दस्तावेज के अनुसार मॉडल दस लाख टोकन की संदर्भ विंडो और अधिकतम 384,000 आउटपुट टोकन संभालता है। इसमें Responses API और Codex के लिए बदलाव भी हैं। ये स्पेसिफिकेशन लंबे दस्तावेज व कोडिंग के उपयोग खोलते हैं, लेकिन बहुत बड़ा संदर्भ स्वीकार करना उसके हर हिस्से के प्रभावी उपयोग का प्रमाण नहीं।
प्रति दस लाख टोकन आधिकारिक कीमत कैश में मिले इनपुट के लिए 0.0028 डॉलर, कैश में न मिले इनपुट के लिए 0.14 डॉलर और आउटपुट के लिए 0.28 डॉलर थी। कैश वाले और नए इनपुट की बड़ी दूरी वर्कलोड को तुलना के केंद्र में रखती है। कैश हिट वाली मुख्य दर बार बार नया संदर्भ भेजने वाले काम को नहीं दर्शाती।
कच्ची टोकन कीमत में लेटेंसी, रीजनिंग टोकन, दोबारा कोशिश, असफल कॉल और आउटपुट गुणवत्ता शामिल नहीं। अगर काम को बार बार सुधारना पड़े तो प्रति टोकन सस्ता मॉडल स्वीकार परिणाम पर महंगा हो सकता है। GPT, Claude, Gemini या Kimi से तुलना में समान इनपुट और कैश व्यवहार तथा पूरा होने की शर्तें बतानी चाहिए।
बीटा होने के कारण मॉडल आईडी और कीमत बदल सकते हैं। डेवलपर डिप्लॉयमेंट से पहले सक्रिय API प्रविष्टि जांचें और लागत रिकॉर्ड को तारीख से जोड़ें। प्रति कार्य लागत का दोहराया जा सकने वाला परीक्षण उस लॉन्च तालिका से अधिक टिकेगा जो हर टोकन को सबसे कम दर पर मानती है।
अब आगे क्या
सक्रिय बीटा मॉडल और कीमत की पुष्टि कर पूरी कार्य लागत मापें, जिसमें कैश दर, लेटेंसी, दोबारा कोशिश, संदर्भ उपयोग और असफल कॉल बताई जाएं।
स्रोत
यह पुनरावलोकन 3 अगस्त 2026 को DeepSeek अपडेट, कीमत पृष्ठ और मॉडल भंडार के आधार पर तैयार किया गया। बाजार संदर्भ के लिए Axios रिपोर्ट भी देखी गई। AI News of Today ने API लागत या गुणवत्ता परीक्षण नहीं किया।
जहां संभव हो, हम मूल दस्तावेज़ों और प्रत्यक्ष रिपोर्टिंग के लिंक देते हैं।