GPT‑6.1 Sol یا Claude Sonnet 5.5؟ ایک تیز، دوسرا فی کام سستا

|مصنف: QUASA ادارتی ٹیم|7 منٹ مطالعہ
GPT‑6.1 Sol یا Claude Sonnet 5.5؟ ایک تیز، دوسرا فی کام سستا

Artificial Analysis کے ہائی کوشش والے تقابل میں Claude Sonnet 5.5 نے GPT‑6.1 Sol سے تیز جواب دیا، جبکہ Sol کا اوسط فی آزمائشی کام خرچ کم رہا: آؤٹ پٹ رفتار بالترتیب ۱۰۷ اور ۵۳ ٹوکن فی سیکنڈ، پہلے ٹوکن تک انتظار ۱۱٫۵ اور ۶۱٫۴ سیکنڈ، اور فی کام خرچ ۱٫۱۲ اور ۰٫۳۲ ڈالر تھا۔ صارف کے سامنے فوری جواب اہم ہو تو Sonnet کو وزن دیں؛ اسی نوعیت کے طویل کاموں کا بجٹ اہم ہو تو Sol کو۔

OpenAI کے GPT‑6.1 Sol نرخوں میں فی دس لاکھ عام اِن پٹ ٹوکن ۲ ڈالر، کیش سے پڑھے گئے ٹوکن ۰٫۱۰ ڈالر اور آؤٹ پٹ ٹوکن ۱۰ ڈالر ہیں۔ Anthropic کے Claude Sonnet 5.5 نرخوں میں عام اِن پٹ اور آؤٹ پٹ کی قیمتیں یہی، مگر کیش ریڈ ۰٫۲۰ ڈالر ہے؛ کمپنی اپنے پچھلے Sonnet 5 کے مقابلے میں اس ماڈل کی آؤٹ پٹ رفتار ۳۰ فیصد سے زیادہ بتاتی ہے۔ یکساں بنیادی نرخوں کے باوجود پیدا ہونے والے ٹوکن اور کیش ہٹ بل بدل دیتے ہیں۔

یکساں فہرستی قیمت سے یکساں بل کیوں نہیں بنتا؟

فی کام خرچ نکالنے کے لیے اِن پٹ کو ایک ہی ڈھیر سمجھنا کافی نہیں۔ نئے اِن پٹ، دوبارہ پڑھے گئے محفوظ سیاق، پہلی بار کیش میں لکھے گئے حصے اور آؤٹ پٹ کے ٹوکن الگ نرخوں سے گنے جاتے ہیں۔ استدلال پر خرچ ہونے والے قابلِ بل آؤٹ پٹ ٹوکن بھی نتیجے میں شامل ہوتے ہیں؛ جواب مختصر دکھائی دے تب بھی ماڈل کی اندرونی محنت بل بڑھا سکتی ہے۔

آزاد آزمائش میں Sol نے فی کام کم آؤٹ پٹ ٹوکن استعمال کیے، جو اس کے کم اوسط خرچ کی ایک اہم وجہ ہے۔ Sonnet کا تیز ٹوکن بہاؤ یہ فرق خود بخود ختم نہیں کرتا، کیونکہ رفتار وقت بتاتی ہے اور ٹوکن کی تعداد بل۔ کیش ریڈ کی رعایت بھی پورے پرامپٹ پر لاگو نہیں ہوتی: صرف وہی حصہ سستا پڑتا ہے جسے نظام واقعی کیش سے دوبارہ پڑھتا ہے۔

رفتار اور معیار کا نتیجہ کس حد تک لے سکتے ہیں؟

آؤٹ پٹ رفتار سے مراد پہلے ٹوکن کے بعد آنے والے ٹوکنوں کی رفتار ہے۔ پہلے ٹوکن تک انتظار الگ تجربہ ہے؛ مختصر گفتگو میں صارف کو یہی وقفہ زیادہ نمایاں محسوس ہو سکتا ہے۔ طویل خودکار کام میں اوزار کی کالز، متعدد مراحل اور مجموعی ٹوکن استعمال بھی دورانیہ بناتے ہیں، اس لیے تیز آؤٹ پٹ ہمیشہ اتنے ہی تناسب سے تیز مکمل کام نہیں بناتی۔

تقابل میں Sol کے لیے ہائی کوشش اور Sonnet کے لیے ہائی کوشش کے ساتھ ڈیفالٹ فال بیک کی ترتیب تھی۔ اسی مشترک معیار اشاریے میں Sol آگے تھا، مگر کسی خاص اردو معاون، کوڈ میں تبدیلی یا دستاویز سے جواب کے معیار کا فیصلہ اس ایک اشاریے سے نہیں نکلتا۔ اگر جواب دوبارہ چلانا پڑے یا انسان کو بڑی اصلاح کرنا پڑے تو اصل فی کامیاب کام خرچ بڑھتا ہے۔

مختصر گفتگو: ایک ہی ماہ میں قیمت برابر

پہلا منظرنامہ فرضی ہے۔ ماہانہ دس ہزار مختصر درخواستیں فرض کریں؛ ہر ایک میں دو ہزار نئے اِن پٹ ٹوکن اور تمام قابلِ بل آؤٹ پٹ، بشمول استدلالی ٹوکن، پانچ سو ہوں۔ کیش استعمال نہ ہو اور دونوں ماڈل ایک جیسے ٹوکن خرچ کریں تو اِن پٹ پر ۴۰ اور آؤٹ پٹ پر ۵۰ ڈالر، یعنی دونوں کا بنیادی ماہانہ بل ۹۰ ڈالر ہوگا۔ یہ سرکاری نرخوں سے نکلا حساب ہے، کسی چلتی مصنوعات کا مشاہدہ نہیں۔

اس ساخت میں Sol کی کم آزمائشی فی کام لاگت خودکار طور پر منتقل نہیں ہوتی، کیونکہ فرض کیے گئے ٹوکن برابر ہیں۔ صارف کے سامنے آنے والی گفتگو میں Sonnet کی کم پہلی تاخیر اور زیادہ آؤٹ پٹ رفتار فیصلہ کن ہو سکتی ہے، بشرطیکہ جواب کا معیار ضرورت پوری کرے۔ مختصر جواب میں پہلے ٹوکن کا انتظار نمایاں ہوگا؛ لمبے جواب میں ٹوکن بہاؤ کا فرق بھی محسوس ہوگا۔

طویل خودکار کام: ٹوکن استعمال فرق بڑھاتا ہے

دوسرا منظرنامہ بھی مشروط حساب ہے۔ فرض کریں ماہ کے دس ہزار کام ساخت اور کوشش کی ترتیب میں آزاد آزمائش کے کاموں جیسے ہیں۔ وہاں درج اوسط فی کام خرچ کو دس ہزار سے ضرب دیں تو Sol کے لیے ۳٬۲۰۰ اور Sonnet کے لیے ۱۱٬۲۰۰ ڈالر بنتے ہیں۔ یہ کسی عام خودکار نظام کے متوقع بل کی پیش گوئی نہیں، کیونکہ اوزار، دوبارہ کوششیں اور جواب کی لمبائی ہر مصنوعات میں الگ ہوگی۔

یہ فرق دکھاتا ہے کہ فی ٹوکن نرخوں کا برابر ہونا خریداری کے فیصلے کے لیے ناکافی ہے۔ کم خرچ کوشش اسی وقت فائدہ دیتی ہے جب مطلوبہ کام درست مکمل ہو۔ اگر زیادہ مہنگا ماڈل ناکام کوششیں کم کرے تو فی کامیاب کام کا حساب بدل سکتا ہے؛ اگر دونوں کی تکمیل قریب ہو تو کم ٹوکن استعمال والا ماڈل بجٹ میں واضح جگہ بنائے گا۔

بار بار آنے والا سیاق: کیش کا ماہانہ اثر

تیسرا منظرنامہ فرضی اور کیش ہٹ سے مشروط ہے۔ ماہانہ دس ہزار درخواستیں بیس وقفوں میں بانٹیں، ہر وقفے میں پانچ سو درخواستیں ہوں۔ ہر درخواست کے شروع میں یکساں بیس ہزار ٹوکن، اس کے بعد ایک ہزار نئے اِن پٹ اور پانچ سو قابلِ بل آؤٹ پٹ ٹوکن فرض کریں۔ ہر وقفے کی پہلی درخواست مشترک حصے کو کیش میں لکھے اور باقی اسے کامیابی سے دوبارہ پڑھیں۔ یوں ماہ بھر میں بیس کیش رائٹس اور نو ہزار نو سو اسی کیش ریڈ ہوں گے۔

نئے اِن پٹ کے ۲۰ ڈالر، آؤٹ پٹ کے ۵۰ ڈالر اور کیش رائٹس کا مجموعی ۱ ڈالر دونوں کے لیے یکساں ہے۔ مشترک حصے کے کیش ریڈ Sol پر ۱۹٫۹۶ اور Sonnet پر ۳۹٫۹۲ ڈالر پڑتے ہیں؛ اس فرض کے تحت مجموعی ٹوکن بل بالترتیب ۹۰٫۹۶ اور ۱۱۰٫۹۲ ڈالر بنتا ہے۔ یہاں فرق ایک ہی محفوظ حصے کو بار بار پڑھنے کے نرخ سے آیا ہے؛ حساب میں دونوں کا آؤٹ پٹ استعمال برابر رکھا گیا ہے۔

Anthropic کی پرامپٹ کیشنگ ہدایات کے مطابق پہلے سے طے شدہ کیش کی مدت پانچ منٹ ہے اور ہر کامیاب ریڈ اس کی مدت تازہ کرتا ہے؛ ایک گھنٹے کی مدت زیادہ مہنگی کیش رائٹ لیتی ہے۔ اوپر کے حساب میں ہر وقفے کی درخواستوں کے درمیان کیش برقرار رہنے کی شرط ہے، اس لیے پورے مہینے میں ایک ہی رائٹ کافی نہیں سمجھی گئی۔ سیاق بدلنے، وقفہ لمبا ہونے یا کیش ہٹ نہ ملنے پر عدد بدلیں گے؛ کیش کی بچت کی شرائط اسی فرق کو سمجھنے میں مدد دیتی ہیں۔

بڑے سیاق پر قیمت کی حد

طویل دستاویز یا بڑی گفتگو کے لیے دستیاب سیاق کی گنجائش کے ساتھ اس کی قیمت کی حد بھی اہم ہے۔ OpenAI کی GPT‑6.1 Sol ماڈل دستاویزات کے مطابق اس کا سیاق دس لاکھ پچاس ہزار ٹوکن ہے، مگر دو لاکھ بہتر ہزار سے زیادہ اِن پٹ ٹوکن والی درخواست پر پوری درخواست کے اِن پٹ اور کیش نرخ دگنے اور آؤٹ پٹ نرخ ڈیڑھ گنا ہو جاتے ہیں۔ چھوٹی درخواست کے معیاری نرخ سے ایسی بڑی درخواست کا بل نکالنا کم تخمینہ دے گا۔

پاکستانی ٹیم کے لیے فوری، بار بار دکھائے جانے والے جواب میں Sonnet کی ناپی گئی تاخیر اہم ہے؛ طویل خودکار کام میں Sol کا ناپا گیا فی کام خرچ؛ اور مشترک سیاق میں حقیقی کیش ہٹ۔ اوپر کے تینوں ماہانہ حساب امریکی ڈالر میں صرف فرض کیے گئے ٹوکن دکھاتے ہیں۔ اصل انتخاب میں جواب کا قابلِ قبول معیار بھی خرچ کے ساتھ رکھنا ہوگا، کیونکہ سستی کوشش اور سستا کامیاب کام ہمیشہ ایک ہی چیز نہیں ہوتے۔

یہ بھی پڑھیں:

شیئر کریں:

ہمارا نیوز لیٹر سبسکرائب کریں

ویب 3، AI اور کرپٹو کی تازہ خبریں براہ راست اپنے اِن باکس میں پائیں۔

0