عملی رہنما

Claude Fable 5.1 آیا: cache reads 75٪ سستے، Mythos پھر بھی محدود

|مصنف: QUASA ادارتی ٹیم|6 منٹ مطالعہ| 1
Claude Fable 5.1 آیا: cache reads 75٪ سستے، Mythos پھر بھی محدود

Anthropic نے یکم ستمبر 2026 کو Claude Fable 5.1 جاری کیا۔ Claude Platform کی سرکاری specification کے مطابق یہ فعال model Claude API، Amazon Bedrock، Google Cloud اور Microsoft Foundry پر دستیاب ہے؛ input اور output کی قیمت بالترتیب 10 اور 50 ڈالر فی ملین tokens، cache read کی قیمت 0.25 ڈالر اور Opus 5 کے بنیادی نرخ 5 اور 25 ڈالر ہیں۔ اسی دستاویز میں ایک ملین token context، 128,000 token زیادہ سے زیادہ output اور Fable 5 سے منتقلی کی تین breaking changes بھی درج ہیں۔

اس release میں 75٪ کمی صرف cache reads پر لاگو ہوتی ہے، پورے API bill پر نہیں۔ Axios کی آزاد رپورٹ Fable 5.1 کو عام دستیابی والا model قرار دیتی ہے، جبکہ Mythos 5.1 vetted cybersecurity اور life-sciences partners تک محدود ہے۔ بیشتر پاکستانی API ٹیموں کے لیے حقیقی انتخاب اسی لیے Fable 5.1 اور نصف بنیادی token نرخ رکھنے والے Opus 5 کے درمیان ہے۔

75٪ کمی invoice میں کب نظر آئے گی

Fable 5.1 نے نئے input یا generated output کو سستا نہیں کیا۔ رعایت اس context پر ملتی ہے جو پہلے cache میں لکھا جا چکا ہو اور بعد کی requests میں دوبارہ پڑھا جائے؛ cache لکھنے، نئے tokens، output اور tool activity کے charges الگ رہتے ہیں۔

اس لیے مجموعی بچت کا تعین cache reads کے پرانے bill میں حصے سے ہوگا۔ اگر باقی استعمال اور نرخ یکساں رہیں تو cache reads کا 20٪ حصہ مجموعی bill کو تقریباً 15٪ کم کرے گا، جبکہ 60٪ حصہ تقریباً 45٪ کمی دے سکتا ہے۔ یہ تصدیق شدہ نرخوں سے نکلا مشروط حساب ہے، Anthropic کے کسی مخصوص پاکستانی workload کی پیمائش نہیں۔

مختصر اور ہر بار بدلنے والے prompts میں cache-hit ratio کم رہتا ہے، اس لیے headline discount کا invoice پر اثر معمولی ہوسکتا ہے۔ مستقل system prompts، بار بار پڑھے جانے والے codebase context اور طویل agent sessions میں cache کا حصہ بڑا ہو تو فرق زیادہ نمایاں ہوگا۔

مختلف context sizes کا قابل نقل حساب

Claude Fable 5.1 میں ایک لاکھ cached tokens کے 100 بار استعمال سے cache-read لاگت 2.50 ڈالر بنتی ہے

حساب کا طریقہ سیدھا ہے: cached tokens کو read count سے ضرب دیں، حاصل کو دس لاکھ سے تقسیم کریں اور پھر 0.25 ڈالر سے ضرب دیں۔ context window بڑی ہونا بذات خود بچت نہیں؛ اہم یہ ہے کہ اس کا کتنا حصہ cache hit کے ذریعے کتنی بار پڑھا گیا۔

  • 100,000 tokens، 100 reads: مجموعی cache reads 10 ملین tokens ہوں گے۔ Fable 5.1 پر قیمت 2.50 ڈالر بنتی ہے، جبکہ ایک ڈالر فی ملین کے سابق Fable 5 rate پر یہی حصہ 10 ڈالر تھا؛ مشروط بچت 7.50 ڈالر ہے۔
  • 500,000 tokens، 20 reads: کل پھر 10 ملین cached tokens پڑھے جاتے ہیں، اس لیے cache-read charge بھی 2.50 ڈالر رہتا ہے۔ بڑا context کم reads کے ساتھ وہی نتیجہ دے سکتا ہے۔
  • ایک ملین tokens، 50 reads: 50 ملین cache reads کی قیمت 12.50 ڈالر بنتی ہے، جو سابق rate پر 50 ڈالر ہوتی۔ 37.50 ڈالر کا یہ فرق صرف read component کا ہے؛ cache write، uncached input اور output شامل نہیں۔

یہ مثالیں یہ بھی دکھاتی ہیں کہ Fable 5.1 کو صرف cache discount کی وجہ سے Opus 5 سے سستا کہنا درست نہیں۔ اگر request میں نئے input اور output کا تناسب زیادہ ہے تو Fable کے دوگنے بنیادی نرخ cache کی بچت کو پیچھے چھوڑ سکتے ہیں۔

Benchmark مضبوط ہے، مگر عمومی فیصلہ نہیں

Terminal-Bench-Science میں Claude Fable 5.1 کا 52.6٪ اور Fable 5 کا 24.7٪ تقابلی نتیجہ

Anthropic کے release اور benchmark notes میں Terminal-Bench-Science 0.1 پر Fable 5.1 کا score 52.6٪، اسی setup میں Fable 5 کا 24.7٪ اور Opus 5 کا 29.0٪ درج ہے۔ فی model standard error تقریباً ±3.5 سے ±4.5 points ہے؛ public leaderboard پر Opus 5 اور Fable 5 کے نتائج بالترتیب 30.0٪ اور 21.4٪ تھے، جنہیں کمپنی اپنے setup کے نتائج سے statistical noise کے اندر قرار دیتی ہے۔

یہ benchmark command-line ماحول میں scientific research tasks کی pass rate ناپتا ہے۔ production safeguards فعال تھے، اور بعض مداخلت والے tasks میں صفر score دیا گیا یا fallback models نے کام مکمل کیا؛ نتیجہ کسی ایک model کی بلاشرط کارکردگی نہیں سمجھا جا سکتا۔ 52.6٪ ایک مخصوص evaluation میں واضح برتری ہے، مگر یہ ہر coding task میں دوگنی کامیابی، دوگنی رفتار یا نصف لاگت کا وعدہ نہیں۔

Claude کے Pro، Max، Team اور Enterprise paid plans پر Fable 5.1 دستیاب ہے، لیکن availability اور شامل usage ایک ہی چیز نہیں۔ plan limits اور usage credits کے باعث subscription میں دکھائی دینے والا model لازماً لامحدود یا بلااضافی خرچ استعمال نہیں دیتا؛ API billing الگ token rates کے مطابق چلتی ہے۔

Fable 5.1 کب Opus 5 کی اضافی قیمت کے قابل ہے

Opus 5 عمومی نقطۂ آغاز ہے کیونکہ اس کے input اور output rates Fable 5.1 کے نصف ہیں۔ اگر دونوں models کسی ٹیم کے اپنے evaluation میں قابل قبول نتیجہ دیں تو output-heavy generation، عام coding اور مختصر analysis کے لیے Opus کا مالی فائدہ براہ راست ہے۔

Fable 5.1 تب معقول انتخاب بنتا ہے جب Opus 5 زیادہ effort کے باوجود طویل agentic execution، پورے codebase پر تبدیلی، پیچیدہ debugging یا کئی مرحلوں والی research میں مطلوبہ success rate حاصل نہ کرے۔ یہاں درست metric فی token قیمت نہیں بلکہ کامیاب task کی مجموعی لاگت ہے، جس میں retries، tool calls، وقت اور انسانی review بھی شامل ہیں۔

  • Opus 5: ایسے کام جن میں دونوں models کا معیار قریب ہو یا output volume بڑا ہو۔
  • Fable 5.1: ایسے مشکل، طویل کام جن میں داخلی eval اس کی اضافی صلاحیت سے retries یا ناکامی واقعی کم دکھائے۔
  • Cache-heavy Fable: مستحکم context بار بار پڑھا جائے اور cache reads bill کا بڑا حصہ ہوں۔
  • Mythos 5.1: عمومی متبادل نہیں، کیونکہ رسائی vetted programs اور invitation سے مشروط ہے۔

Migration کی تین breaking changes

Claude Fable 5.1 migration میں forced tools اور thinking blocks سے متعلق تین compatibility تبدیلیاں

Fable 5 سے صرف model ID بدل دینا ہر integration کے لیے محفوظ منتقلی نہیں۔ forced tool use اب error واپس کر سکتا ہے، پرانے models Fable 5.1 کے thinking blocks نہیں پڑھ سکتے، اور conversation کے ابتدائی turns میں ترمیم محفوظ thinking blocks کو invalid کر دیتی ہے۔

پہلی تبدیلی ان agents کو متاثر کرتی ہے جو ہر response میں لازماً ایک مخصوص tool call منگواتے ہیں۔ باقی دونوں multi-model routing، conversation replay اور ایسی cached histories کے لیے اہم ہیں جنہیں middleware دوبارہ لکھتا ہے: Fable 5.1 سے کسی پرانے model پر switch ہونے کے بعد thinking state کو قابل انتقال فرض نہیں کیا جا سکتا۔

موجودہ صورت حال میں Fable 5.1 عام API اور درج شدہ cloud platforms پر دستیاب، cache-heavy workloads کے لیے حقیقی unit saving والا model ہے۔ اس کے باوجود uncached input اور output پر Opus 5 کی قیمت نصف ہے، benchmark مخصوص conditions سے بندھا ہے اور Mythos 5.1 محدود رسائی میں ہے؛ وسیع Mythos availability کے لیے Anthropic نے کوئی عمومی تاریخ نہیں دی۔

یہ بھی پڑھیں:

شیئر کریں:

ہمارا نیوز لیٹر سبسکرائب کریں

ویب 3، AI اور کرپٹو کی تازہ خبریں براہ راست اپنے اِن باکس میں پائیں۔

0