DeepSeek V4.1 Flash نے Pro کو پیچھے کیا، 14 ستمبر سے API خود بدل جائے گی

DeepSeek نے 10 ستمبر 2026 کو V4.1 Flash جاری کیا، مگر 14 ستمبر کو deepseek-v4-pro کی درخواستیں خودکار طور پر نئی ماڈل پر منتقل کرنے کا منصوبہ اب نافذ نہیں ہوگا۔ کمپنی کے تازہ API changelog کے مطابق V4 Pro کی سروس 14 ستمبر کے بعد بھی جاری رہے گی اور اس کی بلنگ کا طریقہ تبدیل نہیں ہوگا۔
اس لیے موجودہ Pro integration آج خود نہیں بدلے گی؛ یہ 10 ستمبر کے ابتدائی اعلان کے مقابلے میں اہم تبدیلی ہے۔ V4.1 Flash کا اجرا، اس کا نیا deepseek-flash identifier اور کمپنی کے benchmark میں Pro سے بہتر نتیجہ برقرار ہیں، لیکن Pro پر برتری آزاد عمومی نتیجہ نہیں اور خودکار migration والا حصہ واپس لیا جا چکا ہے۔
14 ستمبر کا منصوبہ کیسے بدلا

ابتدائی منصوبے میں 14 ستمبر 04:00 UTC، یعنی پاکستان میں صبح 9 بجے، کے بعد تمام deepseek-v4-pro درخواستیں V4.1 Flash پر بھیجنا اور Flash کے نرخ لگانا شامل تھا۔ DeepSeek نے 11 ستمبر کو صارفین کے مطالبے کا حوالہ دیتے ہوئے یہ فیصلہ بدل دیا؛ اب Pro identifier اصل Pro سروس کے لیے برقرار رہے گا اور اس کے موجودہ نرخ ہی لاگو ہوں گے۔
IT Home کی 11 ستمبر کی رپورٹ بھی Pro سروس اور بلنگ برقرار رہنے کی تصدیق کرتی ہے، جبکہ اس کی درج کردہ چینی قیمتوں میں فی دس لاکھ tokens V4 Pro کا off-peak cache-hit input 0.15 یوآن، cache-miss input 4.5 یوآن اور output 13.5 یوآن ہے؛ peak میں یہ نرخ بالترتیب 0.30، 9 اور 27 یوآن ہیں۔ اسی جدول میں V4.1 Flash کے مساوی off-peak نرخ 0.02، 1 اور 4 یوآن، جبکہ peak نرخ 0.04، 2 اور 8 یوآن دیے گئے ہیں۔
نتیجتاً Pro استعمال کرنے والی پاکستانی ٹیم کا backend یا bill محض تاریخ بدلنے سے Flash پر منتقل نہیں ہوگا۔ تاہم جس ٹیم نے ابتدائی اعلان کے بعد deployment، budget forecast یا fallback rules تبدیل کیے تھے، اسے اپنی configuration دوبارہ دیکھنی ہوگی کیونکہ اب دونوں ماڈل الگ انتخاب اور الگ قیمت رکھتے ہیں۔
V4.1 Flash میں کیا نیا ہے

V4.1 Flash ایک 552 ارب parameter والی Mixture-of-Experts ماڈل ہے۔ اس کی Causal Encoder–Decoder ساخت input یا prefill کے دوران فی token 8 ارب اور output یا decode کے دوران 16 ارب parameters فعال کرتی ہے؛ DeepSeek اسے نئی architecture family کی سب سے چھوٹی ماڈل قرار دیتا ہے۔
DeepSeek کے 10 ستمبر کے اجرا نوٹ میں native multimodal input، deepseek-flash API identifier، پچھلی نسل کے مقابلے میں ایک چوتھائی HBM اور ایک آٹھواں مستقل SSD cache footprint، اور off-peak قیمت کو peak قیمت کا نصف رکھنے کی تفصیل موجود ہے۔ اسی صفحے پر اب بھی Pro routing کا پرانا منصوبہ درج ہے، مگر بعد کا API changelog اسے منسوخ کر چکا ہے۔
Multimodal support کا مطلب یہ ہے کہ ماڈل API میں متن کے ساتھ تصاویر بھی لے سکتی ہے۔ البتہ یہ سہولت موجودہ image preprocessing، MIME handling یا mixed prompts کے بالکل یکساں نتائج کی ضمانت نہیں؛ یہ compatibility کسی production integration کے اپنے input اور output contract پر منحصر ہوگی۔
کون سے identifiers اب کس ماڈل تک جاتے ہیں
نئے کام کے لیے V4.1 Flash کا مستقل identifier deepseek-flash ہے۔ سابق deepseek-v4-flash اور deepseek-v4-flash-vision-exp ماڈل retire ہو چکی ہیں، البتہ ان کے پرانے identifiers عارضی compatibility کے تحت V4.1 Flash تک route ہوتے ہیں۔ DeepSeek نے اس عبوری routing کے خاتمے کی تاریخ نہیں دی۔
deepseek-v4-pro اس فہرست سے مختلف ہے: تازہ فیصلے کے تحت یہ 14 ستمبر کے بعد بھی V4 Pro API سروس اور اسی کی بلنگ برقرار رکھتا ہے۔ اس identifier کو Flash alias سمجھنا اب غلط ہوگا، اور Pro سے Flash پر جانا ہو تو application کو واضح طور پر deepseek-flash منتخب کرنا ہوگا۔
Pro کو پیچھے چھوڑنے کے دعوے کی حد

DeepSeek کا کہنا ہے کہ اس کی داخلی اور بیرونی testing میں V4.1 Flash نے performance، cost، speed اور total completion time میں V4 Pro سے بہتر نتیجہ دیا۔ دستیاب بنیادی مواد اس تقابل کو کمپنی کے benchmark اور testing claim کے طور پر پیش کرتا ہے؛ کوئی ایسی آزاد، عمومی جانچ سامنے نہیں آئی جو ہر coding agent، اردو workload یا multimodal pipeline میں اسی برتری کی ضمانت دے۔
یہ امتیاز خاص طور پر اس لیے اہم ہے کہ کمپنی نے پہلے benchmark نتیجے کو Pro بند کرنے اور traffic منتقل کرنے کی بنیاد بنایا، پھر صارفین کے مطالبے پر Pro برقرار رکھنے کا فیصلہ کیا۔ اب developers کے پاس دونوں endpoints موجود ہیں، اس لیے latency، output consistency، tool calls اور مجموعی token cost کا فیصلہ اپنے workload کے نتائج سے کرنا ہوگا۔
اب migration checklist کیا ہونی چاہیے
لازمی cutover منسوخ ہونے کے بعد فوری خطرہ خاموش backend تبدیلی نہیں، بلکہ ابتدائی اعلان کی بنیاد پر کی گئی configuration ہے۔ مختصر جانچ میں یہ نکات کافی ہیں:
- Model mapping دیکھیں: یقینی بنائیں کہ deepseek-v4-pro کو مقامی proxy یا routing layer میں Flash سے زبردستی map نہیں کیا گیا۔
- پرانے Flash aliases شناخت کریں: deepseek-v4-flash اور deepseek-v4-flash-vision-exp اب بھی V4.1 Flash تک جاتے ہیں، مگر یہ عارضی راستے ہیں۔
- قیمت الگ log کریں: Pro اور Flash کے cache-hit، cache-miss، output، peak اور off-peak usage کو ایک ہی rate کے تحت جمع نہ کریں۔
- اختیاری migration آزمائیں: اگر Flash کی کم قیمت مطلوب ہو تو structured output، tool arguments، اردو متن اور multimodal requests کے وہی regression fixtures دونوں identifiers پر چلائیں۔
- Fallback واضح رکھیں: response metadata اور مانگا گیا model identifier الگ محفوظ کریں تاکہ proxy یا provider-level تبدیلی قابل شناخت رہے۔
موجودہ تصدیق شدہ صورت حال یہ ہے کہ V4.1 Flash API پر دستیاب ہے، پرانے Flash identifiers عارضی طور پر اسی تک route ہوتے ہیں، اور V4 Pro کو 14 ستمبر کے بعد برقرار رکھنے کا فیصلہ ہو چکا ہے۔ آئندہ تبدیلی کے لیے DeepSeek نے کوئی نئی تاریخ نہیں دی اور کہا ہے کہ اگر Pro سروس میں تبدیلی ہوئی تو الگ اطلاع جاری کی جائے گی۔
یہ بھی پڑھیں:
ہمارا نیوز لیٹر سبسکرائب کریں
ویب 3، AI اور کرپٹو کی تازہ خبریں براہ راست اپنے اِن باکس میں پائیں۔