VM0 पर DeepSeek V4 Flash। सबसे सस्ते प्राइस टियर पर एजेंटिक कोडिंग
DeepSeek का ओपन-वेट Mixture-of-Experts मॉडल: 284B पैरामीटर, प्रति टोकन 13B सक्रिय। 0731 बिल्ड DeepSeek द्वारा प्रकाशित हर एजेंट बेंचमार्क में V4 Pro से आगे है, वह भी $0.14 / $0.28 प्रति 1M टोकन पर।
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash, DeepSeek की V4 पीढ़ी का दक्षता वाला हिस्सा है: 284B पैरामीटर का Mixture-of-Experts मॉडल जो प्रति टोकन 13B सक्रिय करता है और MIT लाइसेंस के तहत खुले वेट के साथ जारी हुआ है। 31 जुलाई 2026 को आई 0731 बिल्ड ने आर्किटेक्चर वैसा ही रखा और सिर्फ पोस्ट-ट्रेनिंग एजेंट डेटा पर दोबारा चलाई, जिससे यह DeepSeek द्वारा प्रकाशित सभी नौ एजेंट बेंचमार्क में DeepSeek V4 Pro (प्रीव्यू) से आगे निकल गया — Terminal-Bench 2.1 पर 82.7 बनाम 72.1 और DeepSWE पर 54.4 बनाम 12.8।
वेंडर लिस्ट प्राइस $0.14 / $0.28 प्रति 1M टोकन है, कैश हिट $0.0028 / 1M पर और कैश राइट पर कोई शुल्क नहीं — इसी वजह से यह VM0 की मौजूदा लाइनअप का सबसे सस्ता रीज़निंग मॉडल है। इसमें 1M टोकन का कॉन्टेक्स्ट विंडो, 384K तक आउटपुट और डिफ़ॉल्ट रूप से चालू थिंकिंग मोड है। यह केवल टेक्स्ट है: विज़न नहीं। जहाँ किसी चरण में छवियाँ या Claude Code फ्रेमवर्क चाहिए वहाँ Claude Sonnet 4.6 चुनें, और अगर आपको OpenAI परिवार का सस्ता टियर चाहिए तो GPT 5.6 Luna।
DeepSeek V4 Flash क्या है?
31 जुलाई 2026 (DeepSeek-V4-Flash-0731, पब्लिक बीटा) · DeepSeek V4 परिवार का दक्षता वाला हिस्सा: V4 Pro के 49B के मुकाबले 13B सक्रिय पैरामीटर, एजेंट कार्य के लिए पोस्ट-ट्रेन किया गया।
DeepSeek V4 Flash पहली बार 24 अप्रैल 2026 को V4 परिवार के छोटे हिस्से के रूप में सामने आया — 1.6T पैरामीटर वाले V4 Pro के साथ, प्रति टोकन 13B सक्रिय करने वाला 284B MoE, 1M टोकन कॉन्टेक्स्ट विंडो के साथ। 31 जुलाई 2026 को यह DeepSeek-V4-Flash-0731 के रूप में प्रीव्यू से बाहर आया — एक पब्लिक बीटा बिल्ड जिसने आर्किटेक्चर को छुआ नहीं और सिर्फ पोस्ट-ट्रेनिंग चरण दोबारा चलाया, इस बार एजेंट-केंद्रित डेटा पर।
यही दोबारा की गई ट्रेनिंग इस रिलीज़ की पूरी कहानी है। DeepSeek के अपने आँकड़ों में 0731 बिल्ड लगभग एक-चौथाई पैरामीटर सक्रिय करते हुए भी सभी नौ प्रकाशित एजेंट बेंचमार्क में V4 Pro (प्रीव्यू) से आगे है: Terminal-Bench 2.1 Flash प्रीव्यू के 61.8 से बढ़कर 82.7, DeepSWE 7.3 से 54.4 और Toolathlon-Verified 49.7 से 70.3। इनमें से कई आँकड़े Claude Opus 4.8 से कुछ ही अंक पीछे हैं — Terminal-Bench 2.1 पर 82.7 बनाम 85.0, Agents' Last Exam पर 25.2 बनाम 25.7 — और वह भी बेहद कम कीमत पर।
सीमाएँ भी साफ़ कहना ज़रूरी है। सभी स्कोर DeepSeek के अपने बताए हुए हैं और DeepSeek Harness पर चले हैं, जो अभी जारी नहीं हुआ है, इसलिए इनमें से कोई भी स्वतंत्र रूप से दोहराया नहीं गया है, और नौ में से दो सेट DeepSeek के आंतरिक हैं। मॉडल केवल टेक्स्ट है, स्नातकोत्तर-स्तरीय रीज़निंग में अग्रणी मॉडलों से पीछे है, और लंबे बहु-चरणीय कार्यों में अब भी V4 Pro से पीछे रहता है। थिंकिंग मोड डिफ़ॉल्ट रूप से चालू है और थिंकिंग टोकन आउटपुट के रूप में बिल होते हैं।
DeepSeek V4 Flash में क्या उल्लेखनीय है
मुख्य architecture और capability विशेषताएँ।
V4 Flash एक स्पार्स Mixture-of-Experts मॉडल है: कुल 284B पैरामीटर, जिनमें से 13B प्रति टोकन सक्रिय होते हैं। हर MoE लेयर में 1 साझा एक्सपर्ट और 2048 इंटरमीडिएट डाइमेंशन वाले 256 रूटेड एक्सपर्ट होते हैं, और प्रति टोकन 6 रूटेड एक्सपर्ट सक्रिय होते हैं। पहली तीन MoE लेयर हैश रूटिंग का उपयोग करती हैं और मल्टी-टोकन प्रेडिक्शन डेप्थ 1 है। प्रकाशित 0731 चेकपॉइंट 304B पैरामीटर का है क्योंकि उसमें 284B बेस के ऊपर स्पेक्युलेटिव डिकोडिंग के लिए एक ड्राफ्ट मॉड्यूल शामिल है। यह 1M टोकन कॉन्टेक्स्ट विंडो और 384K तक आउटपुट, थिंकिंग व नॉन-थिंकिंग मोड, तथा low, high और max स्तरों वाला reasoning_effort पैरामीटर सपोर्ट करता है। वेट MIT लाइसेंस पर और बिना किसी रोक के उपलब्ध हैं।
एक नज़र में specs
DeepSeek V4 Flash benchmarks
DeepSeek-V4-Flash-0731 मॉडल कार्ड से DeepSeek द्वारा बताए गए आँकड़े, DeepSeek Harness के minimal मोड में अधिकतम रीज़निंग एफर्ट (temperature 1.0, top_p 0.95) पर चलाए गए। हार्नेस जारी नहीं हुआ है, इसलिए इनमें से कोई भी स्वतंत्र रूप से दोहराया नहीं गया है; DSBench-FullStack और DSBench-Hard DeepSeek के आंतरिक टेस्ट सेट हैं।
DeepSeek V4 Flash pricing
Provider सूची मूल्य, प्रति 1M tokens।
DeepSeek V4 Flash व्यवहार में कैसा प्रदर्शन करता है
Production agent runs से देखा गया व्यवहार।
एजेंटिक निष्पादन
0731 पोस्ट-ट्रेनिंग का निशाना यही था: टर्मिनल चलाना, क्रम से टूल कॉल करना और बिना किसी इंसान के लूप में रहे काम पूरा करना। Terminal-Bench 2.1 पर 82.7 और Toolathlon-Verified पर 70.3 इसे इस कीमत पर अग्रणी श्रेणी में ला देते हैं।
लागत प्रोफ़ाइल
$0.14 / $0.28 प्रति 1M टोकन, कैश हिट $0.0028 / 1M और कैश राइट पर कोई बिलिंग नहीं। यह मौजूदा लाइनअप की सबसे सस्ती स्थिति है और V4 Pro के आउटपुट मूल्य का लगभग एक-तिहाई, इसलिए बड़े पैमाने के काम के लिए यही मॉडल है।
लंबा कॉन्टेक्स्ट
1M टोकन इनपुट और 384K तक आउटपुट, इसलिए पूरी रिपॉज़िटरी पढ़ना या लंबे ट्रांसक्रिप्ट बिना टुकड़ों में बाँटे समा जाते हैं। लंबे, बहु-चरणीय एजेंट लूप में गुणवत्ता अब भी V4 Pro से पीछे है।
रीज़निंग की गहराई
low, high और max — तीन reasoning_effort स्तर विलंब और विचार-गहराई के बीच अदला-बदली करते हैं, और DeepSeek के प्रकाशित सभी स्कोर max पर हैं। स्नातकोत्तर-स्तरीय रीज़निंग इसकी ताकत नहीं है; वहाँ Claude Opus 5 और GPT 5.6 Sol आगे रहते हैं।
मोडैलिटी
केवल टेक्स्ट और कोड। जहाँ स्क्रीनशॉट, स्कैन किया PDF या चार्ट शामिल हो, वहाँ Claude Sonnet 4.6 या GPT 5.6 Luna जैसा विज़न मॉडल चाहिए।
DeepSeek V4 Flash के लिए सर्वश्रेष्ठ agent tasks
बड़े पैमाने के कोडिंग एजेंट
थोक PR रिव्यू, टेस्ट लिखना, lint-और-फिक्स पास और शेड्यूल किए गए रीफैक्टर, जहाँ एक ही एजेंट दिन में सैकड़ों बार चलता है। $0.28 प्रति 1M आउटपुट टोकन पर प्रति रन लागत इतनी कम रहती है कि मात्रा अब बाधा नहीं रह जाती।
टर्मिनल और टूल-आधारित ऑटोमेशन
0731 बिल्ड के सबसे मजबूत प्रकाशित नतीजे टर्मिनल कार्य और टूल उपयोग पर हैं — यानी वही जो बिल्ड-फिक्स, डिप्लॉयमेंट-चेक या लॉग-ट्राइएज एजेंट दिन भर करता है।
पूरी रिपॉज़िटरी पढ़ना
1M टोकन की विंडो में मध्यम आकार की पूरी रिपॉज़िटरी, लंबी इंसिडेंट टाइमलाइन या डिज़ाइन दस्तावेज़ों का पूरा सेट एक ही बार में आ जाता है, जिससे माइग्रेशन या ऑडिट एजेंट टुकड़ों के बजाय पूरे पर विचार कर सकता है।
अग्रणी ऑर्केस्ट्रेटर के नीचे की सस्ती परत
योजना और समीक्षा Claude Opus 5 या GPT 5.6 Sol पर छोड़ें, और फ़ाइलें पढ़ना, कमांड चलाना, पैच का मसौदा बनाना जैसे कई यांत्रिक चरण V4 Flash को दें। तब अग्रणी दर सिर्फ उन्हीं चरणों पर चुकानी पड़ती है जो नतीजा तय करते हैं।
DeepSeek V4 Flash को कब छोड़ें
जहाँ छवियाँ शामिल हों वहाँ V4 Flash छोड़ दें, क्योंकि इसमें विज़न नहीं है, और स्नातकोत्तर-स्तरीय रीज़निंग में भी, जहाँ अग्रणी मॉडल साफ़ आगे हैं। घंटों तक सुसंगत रहने वाले लंबे रन अब भी V4 Pro और Claude Opus का क्षेत्र हैं। और जब तक DeepSeek Harness जारी नहीं होता, प्रकाशित एजेंट स्कोर को वेंडर के दावे मानकर चलें: प्रोडक्शन एजेंट को यहाँ लाने से पहले अपनी रिपॉज़िटरी पर उन्हें परखें।
DeepSeek V4 Flash बनाम अन्य models
DeepSeek V4 Flash बनाम DeepSeek V4 Pro
एक ही परिवार, उलटा समझौता। Pro प्रति टोकन 49B सक्रिय करने वाला 1.6T फ्लैगशिप है; Flash 13B सक्रिय करता है और आउटपुट कीमत Pro की एक-तिहाई है। DeepSeek के प्रकाशित एजेंट बेंचमार्क में 0731 Flash बिल्ड अब सभी नौ में V4 Pro (प्रीव्यू) से आगे है, इसलिए Pro चुनने की वजह लंबी बहु-चरणीय रीज़निंग की गहराई है, एजेंट थ्रूपुट नहीं। V4 Pro अब VM0 पर उपलब्ध नहीं है — यहाँ उसका पेज सिर्फ संदर्भ सामग्री है।
DeepSeek V4 Flash बनाम GPT 5.6 Luna
दोनों अपने-अपने परिवार का सस्ता टियर हैं और दोनों Codex फ्रेमवर्क पर चलते हैं। Luna मल्टीमॉडल है और OpenAI के इकोसिस्टम पर टिका है; Flash केवल टेक्स्ट, ओपन-वेट है, Luna के आउटपुट मूल्य के एक-चौथाई से भी कम पर मिलता है और प्रकाशित एजेंट बेंचमार्क में कहीं आगे है। विज़न या OpenAI-विशिष्ट व्यवहार चाहिए तो Luna चुनें, और काम कोड व टूल का हो तो Flash।
DeepSeek V4 Flash बनाम Claude Sonnet 4.6
Sonnet 4.6 विज़न, Claude Code फ्रेमवर्क और Anthropic की टूल-रूटिंग विश्वसनीयता वाला कोर एजेंट मॉडल है; Flash लागत बचाने वाला, केवल टेक्स्ट मॉडल है जिसकी आउटपुट कीमत Sonnet की लगभग पचासवें हिस्से जितनी है। जो चरण रन का नतीजा तय करते हैं वहाँ Sonnet रखें और उसके नीचे की मात्रा Flash को दें।
निष्कर्ष: क्या आपको DeepSeek V4 Flash इस्तेमाल करना चाहिए?
DeepSeek V4 Flash, VM0 पर सक्षम कोडिंग एजेंट चलाने का सबसे सस्ता तरीका है: अग्रणी के करीब एजेंट बेंचमार्क, 1M टोकन विंडो और $0.28 प्रति 1M आउटपुट टोकन। वेंडर के आँकड़े अपनी रिपॉज़िटरी पर जाँचें, विज़न और सबसे कठिन रीज़निंग कहीं और रखें — फिर प्रति पूर्ण कार्य लागत में इसे हराना मुश्किल है।
अक्सर पूछे जाने वाले सवाल
DeepSeek V4 Flash का कॉन्टेक्स्ट विंडो कितना है?
1M टोकन इनपुट और प्रति उत्तर 384K टोकन तक आउटपुट। DeepSeek high और max रीज़निंग एफर्ट स्तरों पर पूरे 384K आउटपुट की सलाह देता है।
DeepSeek V4 Flash की कीमत कितनी है?
वेंडर लिस्ट प्राइस $0.14 प्रति 1M इनपुट टोकन और $0.28 प्रति 1M आउटपुट है, कैश हिट $0.0028 प्रति 1M और कैश राइट पर कोई शुल्क नहीं। VM0 पर यह $ प्राइस टियर में है, चारों में सबसे सस्ता। DeepSeek ने पीक-आवर नीति की घोषणा की है जो बीजिंग समयानुसार 09:00–12:00 और 14:00–18:00 के बीच उसके अपने लिस्ट प्राइस दोगुने कर देगी; यह अभी लागू नहीं हुई है।
क्या DeepSeek V4 Flash, DeepSeek V4 Pro से बेहतर है?
0731 बिल्ड के लिए DeepSeek द्वारा प्रकाशित नौ एजेंट बेंचमार्क के आधार पर, हाँ: यह हर एक में V4 Pro (प्रीव्यू) से ऊपर है, वह भी Pro के 49B के मुकाबले सिर्फ 13B पैरामीटर सक्रिय करते हुए। लंबी बहु-चरणीय रीज़निंग में बढ़त Pro के पास रहती है। V4 Pro अब VM0 पर उपलब्ध नहीं है।
क्या DeepSeek V4 Flash विज़न सपोर्ट करता है?
नहीं। यह केवल टेक्स्ट और कोड लेता है। स्क्रीनशॉट, चार्ट या PDF आधारित चरण Claude Sonnet 4.6 या GPT 5.6 Luna जैसे मल्टीमॉडल मॉडल को भेजें।
VM0 पर DeepSeek V4 Flash कौन-सा फ्रेमवर्क इस्तेमाल करता है?
Codex। VM0 इसे DeepSeek की Responses API से रूट करता है, जिसे फ़िलहाल DeepSeek के मॉडलों में केवल V4 Flash सपोर्ट करता है। इसे VM0 क्रेडिट में बिल होने वाले Built-in मॉडल के रूप में चलाएँ, या अपनी DeepSeek API की चाबी लाएँ।
विकल्प
VM0 पर DeepSeek V4 Flash का उपयोग
VM0 पर DeepSeek V4 Flash तक पहुँचने के दो तरीके
VM0, DeepSeek V4 Flash को VM0 क्रेडिट में बिल होने वाले Built-in मॉडल के रूप में और DeepSeek API key के साथ ब्रिंग-योर-ओन के ज़रिए भी सपोर्ट करता है। Built-in रास्ता VM0 Managed रूटिंग और नीचे बताए गए प्राइस टियर का उपयोग करता है; ब्रिंग-योर-ओन रास्ते में अपस्ट्रीम वेंडर सीधे आपसे शुल्क लेता है और VM0 क्रेडिट रूपांतरण पूरी तरह छूट जाता है।
VM0 की सिफ़ारिश
VM0, DeepSeek V4 Flash को एक core agent model के बजाय एक cost-saving विकल्प के रूप में रखता है। इसका उपयोग गैर-core काम पर unit cost को optimise करने के लिए करें, जैसे bulk classification, pre-filters, latency-critical छोटे जवाब, या pinned legacy agents, जबकि जो steps run तय करते हैं उन पर Claude Opus 4.7, Claude Opus 4.6, या Claude Sonnet 4.6 को बनाए रखें।
क्रेडिट और $ प्राइस टियर
VM0 हर Built-in मॉडल को चार चरणों वाले क्रेडिट स्केल — $, $$, $$$, $$$$ — पर रखता है, जो मॉडल पिकर में बैज के रूप में और zero model ls की price tier पंक्ति में दिखता है। DeepSeek V4 Flash $ पर है। यही टियर तय करता है कि आपके VM0 क्रेडिट बैलेंस से कितना कटेगा; ऊपर की तालिका में दिया वेंडर लिस्ट प्राइस वह है जो अपस्ट्रीम प्रोवाइडर वसूलता है, इससे पहले कि VM0 उसे क्रेडिट में बदले।
July 31, 2026 से VM0 पर उपलब्ध।