सभी models

VM0 पर DeepSeek V4 Flash। सबसे सस्ते प्राइस टियर पर एजेंटिक कोडिंग

DeepSeek का ओपन-वेट Mixture-of-Experts मॉडल: 284B पैरामीटर, प्रति टोकन 13B सक्रिय। 0731 बिल्ड DeepSeek द्वारा प्रकाशित हर एजेंट बेंचमार्क में V4 Pro से आगे है, वह भी $0.14 / $0.28 प्रति 1M टोकन पर।

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash, DeepSeek की V4 पीढ़ी का दक्षता वाला हिस्सा है: 284B पैरामीटर का Mixture-of-Experts मॉडल जो प्रति टोकन 13B सक्रिय करता है और MIT लाइसेंस के तहत खुले वेट के साथ जारी हुआ है। 31 जुलाई 2026 को आई 0731 बिल्ड ने आर्किटेक्चर वैसा ही रखा और सिर्फ पोस्ट-ट्रेनिंग एजेंट डेटा पर दोबारा चलाई, जिससे यह DeepSeek द्वारा प्रकाशित सभी नौ एजेंट बेंचमार्क में DeepSeek V4 Pro (प्रीव्यू) से आगे निकल गया — Terminal-Bench 2.1 पर 82.7 बनाम 72.1 और DeepSWE पर 54.4 बनाम 12.8।

वेंडर लिस्ट प्राइस $0.14 / $0.28 प्रति 1M टोकन है, कैश हिट $0.0028 / 1M पर और कैश राइट पर कोई शुल्क नहीं — इसी वजह से यह VM0 की मौजूदा लाइनअप का सबसे सस्ता रीज़निंग मॉडल है। इसमें 1M टोकन का कॉन्टेक्स्ट विंडो, 384K तक आउटपुट और डिफ़ॉल्ट रूप से चालू थिंकिंग मोड है। यह केवल टेक्स्ट है: विज़न नहीं। जहाँ किसी चरण में छवियाँ या Claude Code फ्रेमवर्क चाहिए वहाँ Claude Sonnet 4.6 चुनें, और अगर आपको OpenAI परिवार का सस्ता टियर चाहिए तो GPT 5.6 Luna।

DeepSeek V4 Flash क्या है?

31 जुलाई 2026 (DeepSeek-V4-Flash-0731, पब्लिक बीटा) · DeepSeek V4 परिवार का दक्षता वाला हिस्सा: V4 Pro के 49B के मुकाबले 13B सक्रिय पैरामीटर, एजेंट कार्य के लिए पोस्ट-ट्रेन किया गया।

DeepSeek V4 Flash पहली बार 24 अप्रैल 2026 को V4 परिवार के छोटे हिस्से के रूप में सामने आया — 1.6T पैरामीटर वाले V4 Pro के साथ, प्रति टोकन 13B सक्रिय करने वाला 284B MoE, 1M टोकन कॉन्टेक्स्ट विंडो के साथ। 31 जुलाई 2026 को यह DeepSeek-V4-Flash-0731 के रूप में प्रीव्यू से बाहर आया — एक पब्लिक बीटा बिल्ड जिसने आर्किटेक्चर को छुआ नहीं और सिर्फ पोस्ट-ट्रेनिंग चरण दोबारा चलाया, इस बार एजेंट-केंद्रित डेटा पर।

यही दोबारा की गई ट्रेनिंग इस रिलीज़ की पूरी कहानी है। DeepSeek के अपने आँकड़ों में 0731 बिल्ड लगभग एक-चौथाई पैरामीटर सक्रिय करते हुए भी सभी नौ प्रकाशित एजेंट बेंचमार्क में V4 Pro (प्रीव्यू) से आगे है: Terminal-Bench 2.1 Flash प्रीव्यू के 61.8 से बढ़कर 82.7, DeepSWE 7.3 से 54.4 और Toolathlon-Verified 49.7 से 70.3। इनमें से कई आँकड़े Claude Opus 4.8 से कुछ ही अंक पीछे हैं — Terminal-Bench 2.1 पर 82.7 बनाम 85.0, Agents' Last Exam पर 25.2 बनाम 25.7 — और वह भी बेहद कम कीमत पर।

सीमाएँ भी साफ़ कहना ज़रूरी है। सभी स्कोर DeepSeek के अपने बताए हुए हैं और DeepSeek Harness पर चले हैं, जो अभी जारी नहीं हुआ है, इसलिए इनमें से कोई भी स्वतंत्र रूप से दोहराया नहीं गया है, और नौ में से दो सेट DeepSeek के आंतरिक हैं। मॉडल केवल टेक्स्ट है, स्नातकोत्तर-स्तरीय रीज़निंग में अग्रणी मॉडलों से पीछे है, और लंबे बहु-चरणीय कार्यों में अब भी V4 Pro से पीछे रहता है। थिंकिंग मोड डिफ़ॉल्ट रूप से चालू है और थिंकिंग टोकन आउटपुट के रूप में बिल होते हैं।

DeepSeek V4 Flash में क्या उल्लेखनीय है

मुख्य architecture और capability विशेषताएँ।

V4 Flash एक स्पार्स Mixture-of-Experts मॉडल है: कुल 284B पैरामीटर, जिनमें से 13B प्रति टोकन सक्रिय होते हैं। हर MoE लेयर में 1 साझा एक्सपर्ट और 2048 इंटरमीडिएट डाइमेंशन वाले 256 रूटेड एक्सपर्ट होते हैं, और प्रति टोकन 6 रूटेड एक्सपर्ट सक्रिय होते हैं। पहली तीन MoE लेयर हैश रूटिंग का उपयोग करती हैं और मल्टी-टोकन प्रेडिक्शन डेप्थ 1 है। प्रकाशित 0731 चेकपॉइंट 304B पैरामीटर का है क्योंकि उसमें 284B बेस के ऊपर स्पेक्युलेटिव डिकोडिंग के लिए एक ड्राफ्ट मॉड्यूल शामिल है। यह 1M टोकन कॉन्टेक्स्ट विंडो और 384K तक आउटपुट, थिंकिंग व नॉन-थिंकिंग मोड, तथा low, high और max स्तरों वाला reasoning_effort पैरामीटर सपोर्ट करता है। वेट MIT लाइसेंस पर और बिना किसी रोक के उपलब्ध हैं।

एक नज़र में specs

परिवारDeepSeek V4 सीरीज़ (Flash)
पैरामीटरकुल 284B / सक्रिय 13B (MoE)
मोडैलिटीटेक्स्ट, कोड (विज़न नहीं)
लाइसेंसMIT, ओपन वेट
प्रॉम्प्ट कैशिंगसमर्थित (DeepSeek)
कॉन्टेक्स्ट विंडो1M टोकन
अधिकतम आउटपुट384K टोकन तक
रीज़निंग एफर्टLow / High / Max
वेंडर लिस्ट प्राइस$0.14 इनपुट / $0.28 आउटपुट प्रति 1M

DeepSeek V4 Flash benchmarks

DeepSeek-V4-Flash-0731 मॉडल कार्ड से DeepSeek द्वारा बताए गए आँकड़े, DeepSeek Harness के minimal मोड में अधिकतम रीज़निंग एफर्ट (temperature 1.0, top_p 0.95) पर चलाए गए। हार्नेस जारी नहीं हुआ है, इसलिए इनमें से कोई भी स्वतंत्र रूप से दोहराया नहीं गया है; DSBench-FullStack और DSBench-Hard DeepSeek के आंतरिक टेस्ट सेट हैं।

Terminal-Bench 2.1एजेंटिक टर्मिनल कार्य; V4 Pro (प्रीव्यू) 72.1
82.7
SWE-bench Verifiedप्रीव्यू बिल्ड, वेंडर-रिपोर्टेड
79.0%
Cybergymवेंडर-रिपोर्टेड
76.7
Toolathlon (verified)टूल उपयोग; V4 Pro (प्रीव्यू) 55.9
70.3
DSBench-FullStackDeepSeek का आंतरिक सेट
68.7
DSBench-HardDeepSeek का आंतरिक सेट
59.6
DeepSWEप्रीव्यू बिल्ड के 7.3 से बढ़कर
54.4
NL2Repoरिपॉज़िटरी निर्माण
54.2
Agents' Last ExamClaude Opus 4.8 का स्कोर 25.7
25.2

DeepSeek V4 Flash pricing

Provider सूची मूल्य, प्रति 1M tokens।

Input$0.14
Output$0.28
Cache read$0.003
Cache writeबिल नहीं किया गया

DeepSeek V4 Flash व्यवहार में कैसा प्रदर्शन करता है

Production agent runs से देखा गया व्यवहार।

एजेंटिक निष्पादन

0731 पोस्ट-ट्रेनिंग का निशाना यही था: टर्मिनल चलाना, क्रम से टूल कॉल करना और बिना किसी इंसान के लूप में रहे काम पूरा करना। Terminal-Bench 2.1 पर 82.7 और Toolathlon-Verified पर 70.3 इसे इस कीमत पर अग्रणी श्रेणी में ला देते हैं।

लागत प्रोफ़ाइल

$0.14 / $0.28 प्रति 1M टोकन, कैश हिट $0.0028 / 1M और कैश राइट पर कोई बिलिंग नहीं। यह मौजूदा लाइनअप की सबसे सस्ती स्थिति है और V4 Pro के आउटपुट मूल्य का लगभग एक-तिहाई, इसलिए बड़े पैमाने के काम के लिए यही मॉडल है।

लंबा कॉन्टेक्स्ट

1M टोकन इनपुट और 384K तक आउटपुट, इसलिए पूरी रिपॉज़िटरी पढ़ना या लंबे ट्रांसक्रिप्ट बिना टुकड़ों में बाँटे समा जाते हैं। लंबे, बहु-चरणीय एजेंट लूप में गुणवत्ता अब भी V4 Pro से पीछे है।

रीज़निंग की गहराई

low, high और max — तीन reasoning_effort स्तर विलंब और विचार-गहराई के बीच अदला-बदली करते हैं, और DeepSeek के प्रकाशित सभी स्कोर max पर हैं। स्नातकोत्तर-स्तरीय रीज़निंग इसकी ताकत नहीं है; वहाँ Claude Opus 5 और GPT 5.6 Sol आगे रहते हैं।

मोडैलिटी

केवल टेक्स्ट और कोड। जहाँ स्क्रीनशॉट, स्कैन किया PDF या चार्ट शामिल हो, वहाँ Claude Sonnet 4.6 या GPT 5.6 Luna जैसा विज़न मॉडल चाहिए।

DeepSeek V4 Flash के लिए सर्वश्रेष्ठ agent tasks

बड़े पैमाने के कोडिंग एजेंट

थोक PR रिव्यू, टेस्ट लिखना, lint-और-फिक्स पास और शेड्यूल किए गए रीफैक्टर, जहाँ एक ही एजेंट दिन में सैकड़ों बार चलता है। $0.28 प्रति 1M आउटपुट टोकन पर प्रति रन लागत इतनी कम रहती है कि मात्रा अब बाधा नहीं रह जाती।

टर्मिनल और टूल-आधारित ऑटोमेशन

0731 बिल्ड के सबसे मजबूत प्रकाशित नतीजे टर्मिनल कार्य और टूल उपयोग पर हैं — यानी वही जो बिल्ड-फिक्स, डिप्लॉयमेंट-चेक या लॉग-ट्राइएज एजेंट दिन भर करता है।

पूरी रिपॉज़िटरी पढ़ना

1M टोकन की विंडो में मध्यम आकार की पूरी रिपॉज़िटरी, लंबी इंसिडेंट टाइमलाइन या डिज़ाइन दस्तावेज़ों का पूरा सेट एक ही बार में आ जाता है, जिससे माइग्रेशन या ऑडिट एजेंट टुकड़ों के बजाय पूरे पर विचार कर सकता है।

अग्रणी ऑर्केस्ट्रेटर के नीचे की सस्ती परत

योजना और समीक्षा Claude Opus 5 या GPT 5.6 Sol पर छोड़ें, और फ़ाइलें पढ़ना, कमांड चलाना, पैच का मसौदा बनाना जैसे कई यांत्रिक चरण V4 Flash को दें। तब अग्रणी दर सिर्फ उन्हीं चरणों पर चुकानी पड़ती है जो नतीजा तय करते हैं।

DeepSeek V4 Flash को कब छोड़ें

जहाँ छवियाँ शामिल हों वहाँ V4 Flash छोड़ दें, क्योंकि इसमें विज़न नहीं है, और स्नातकोत्तर-स्तरीय रीज़निंग में भी, जहाँ अग्रणी मॉडल साफ़ आगे हैं। घंटों तक सुसंगत रहने वाले लंबे रन अब भी V4 Pro और Claude Opus का क्षेत्र हैं। और जब तक DeepSeek Harness जारी नहीं होता, प्रकाशित एजेंट स्कोर को वेंडर के दावे मानकर चलें: प्रोडक्शन एजेंट को यहाँ लाने से पहले अपनी रिपॉज़िटरी पर उन्हें परखें।

DeepSeek V4 Flash बनाम अन्य models

DeepSeek V4 Flash बनाम DeepSeek V4 Pro

एक ही परिवार, उलटा समझौता। Pro प्रति टोकन 49B सक्रिय करने वाला 1.6T फ्लैगशिप है; Flash 13B सक्रिय करता है और आउटपुट कीमत Pro की एक-तिहाई है। DeepSeek के प्रकाशित एजेंट बेंचमार्क में 0731 Flash बिल्ड अब सभी नौ में V4 Pro (प्रीव्यू) से आगे है, इसलिए Pro चुनने की वजह लंबी बहु-चरणीय रीज़निंग की गहराई है, एजेंट थ्रूपुट नहीं। V4 Pro अब VM0 पर उपलब्ध नहीं है — यहाँ उसका पेज सिर्फ संदर्भ सामग्री है।

DeepSeek V4 Flash बनाम GPT 5.6 Luna

दोनों अपने-अपने परिवार का सस्ता टियर हैं और दोनों Codex फ्रेमवर्क पर चलते हैं। Luna मल्टीमॉडल है और OpenAI के इकोसिस्टम पर टिका है; Flash केवल टेक्स्ट, ओपन-वेट है, Luna के आउटपुट मूल्य के एक-चौथाई से भी कम पर मिलता है और प्रकाशित एजेंट बेंचमार्क में कहीं आगे है। विज़न या OpenAI-विशिष्ट व्यवहार चाहिए तो Luna चुनें, और काम कोड व टूल का हो तो Flash।

DeepSeek V4 Flash बनाम Claude Sonnet 4.6

Sonnet 4.6 विज़न, Claude Code फ्रेमवर्क और Anthropic की टूल-रूटिंग विश्वसनीयता वाला कोर एजेंट मॉडल है; Flash लागत बचाने वाला, केवल टेक्स्ट मॉडल है जिसकी आउटपुट कीमत Sonnet की लगभग पचासवें हिस्से जितनी है। जो चरण रन का नतीजा तय करते हैं वहाँ Sonnet रखें और उसके नीचे की मात्रा Flash को दें।

निष्कर्ष: क्या आपको DeepSeek V4 Flash इस्तेमाल करना चाहिए?

DeepSeek V4 Flash, VM0 पर सक्षम कोडिंग एजेंट चलाने का सबसे सस्ता तरीका है: अग्रणी के करीब एजेंट बेंचमार्क, 1M टोकन विंडो और $0.28 प्रति 1M आउटपुट टोकन। वेंडर के आँकड़े अपनी रिपॉज़िटरी पर जाँचें, विज़न और सबसे कठिन रीज़निंग कहीं और रखें — फिर प्रति पूर्ण कार्य लागत में इसे हराना मुश्किल है।

अक्सर पूछे जाने वाले सवाल

DeepSeek V4 Flash का कॉन्टेक्स्ट विंडो कितना है?

1M टोकन इनपुट और प्रति उत्तर 384K टोकन तक आउटपुट। DeepSeek high और max रीज़निंग एफर्ट स्तरों पर पूरे 384K आउटपुट की सलाह देता है।

DeepSeek V4 Flash की कीमत कितनी है?

वेंडर लिस्ट प्राइस $0.14 प्रति 1M इनपुट टोकन और $0.28 प्रति 1M आउटपुट है, कैश हिट $0.0028 प्रति 1M और कैश राइट पर कोई शुल्क नहीं। VM0 पर यह $ प्राइस टियर में है, चारों में सबसे सस्ता। DeepSeek ने पीक-आवर नीति की घोषणा की है जो बीजिंग समयानुसार 09:00–12:00 और 14:00–18:00 के बीच उसके अपने लिस्ट प्राइस दोगुने कर देगी; यह अभी लागू नहीं हुई है।

क्या DeepSeek V4 Flash, DeepSeek V4 Pro से बेहतर है?

0731 बिल्ड के लिए DeepSeek द्वारा प्रकाशित नौ एजेंट बेंचमार्क के आधार पर, हाँ: यह हर एक में V4 Pro (प्रीव्यू) से ऊपर है, वह भी Pro के 49B के मुकाबले सिर्फ 13B पैरामीटर सक्रिय करते हुए। लंबी बहु-चरणीय रीज़निंग में बढ़त Pro के पास रहती है। V4 Pro अब VM0 पर उपलब्ध नहीं है।

क्या DeepSeek V4 Flash विज़न सपोर्ट करता है?

नहीं। यह केवल टेक्स्ट और कोड लेता है। स्क्रीनशॉट, चार्ट या PDF आधारित चरण Claude Sonnet 4.6 या GPT 5.6 Luna जैसे मल्टीमॉडल मॉडल को भेजें।

VM0 पर DeepSeek V4 Flash कौन-सा फ्रेमवर्क इस्तेमाल करता है?

Codex। VM0 इसे DeepSeek की Responses API से रूट करता है, जिसे फ़िलहाल DeepSeek के मॉडलों में केवल V4 Flash सपोर्ट करता है। इसे VM0 क्रेडिट में बिल होने वाले Built-in मॉडल के रूप में चलाएँ, या अपनी DeepSeek API की चाबी लाएँ।

विकल्प

VM0 पर DeepSeek V4 Flash का उपयोग

VM0 पर DeepSeek V4 Flash तक पहुँचने के दो तरीके

VM0, DeepSeek V4 Flash को VM0 क्रेडिट में बिल होने वाले Built-in मॉडल के रूप में और DeepSeek API key के साथ ब्रिंग-योर-ओन के ज़रिए भी सपोर्ट करता है। Built-in रास्ता VM0 Managed रूटिंग और नीचे बताए गए प्राइस टियर का उपयोग करता है; ब्रिंग-योर-ओन रास्ते में अपस्ट्रीम वेंडर सीधे आपसे शुल्क लेता है और VM0 क्रेडिट रूपांतरण पूरी तरह छूट जाता है।

VM0 की सिफ़ारिश

VM0, DeepSeek V4 Flash को एक core agent model के बजाय एक cost-saving विकल्प के रूप में रखता है। इसका उपयोग गैर-core काम पर unit cost को optimise करने के लिए करें, जैसे bulk classification, pre-filters, latency-critical छोटे जवाब, या pinned legacy agents, जबकि जो steps run तय करते हैं उन पर Claude Opus 4.7, Claude Opus 4.6, या Claude Sonnet 4.6 को बनाए रखें।

क्रेडिट और $ प्राइस टियर

VM0 हर Built-in मॉडल को चार चरणों वाले क्रेडिट स्केल — $, $$, $$$, $$$$ — पर रखता है, जो मॉडल पिकर में बैज के रूप में और zero model ls की price tier पंक्ति में दिखता है। DeepSeek V4 Flash $ पर है। यही टियर तय करता है कि आपके VM0 क्रेडिट बैलेंस से कितना कटेगा; ऊपर की तालिका में दिया वेंडर लिस्ट प्राइस वह है जो अपस्ट्रीम प्रोवाइडर वसूलता है, इससे पहले कि VM0 उसे क्रेडिट में बदले।

July 31, 2026 से VM0 पर उपलब्ध।