Gemini Notebook-এ prompt গুনে quota নয়—জটিলতাও সীমা কমাবে

Google ২৮ আগস্ট জানিয়েছে, Gemini Notebook-এর consumer account-এ ২ সেপ্টেম্বর ২০২৬ থেকে compute-based usage limit চালু হতে শুরু করবে। Google-এর আনুষ্ঠানিক ঘোষণায় web ও mobile—দুই মাধ্যমেই rollout-এর কথা বলা হয়েছে; নতুন হিসাবে prompt-এর জটিলতা, chat-এর দৈর্ঘ্য, source-এর সংখ্যা ও ব্যবহৃত feature গুরুত্ব পাবে।
ফলে প্রতিটি prompt আর সমান একটি request হিসেবে quota থেকে বাদ যাবে না: বেশি computational resource চাওয়া কাজ available limit দ্রুত কমাতে পারে। 9to5Google-এর স্বাধীন প্রতিবেদন নিশ্চিত করেছে, নির্দিষ্ট দৈনিক feature count-এর জায়গায় পাঁচ ঘণ্টার refresh-সহ এই হিসাব আসবে; একই সঙ্গে একটি weekly limit-ও কার্যকর থাকবে।
একটি prompt আর নির্দিষ্ট এক unit নয়

নতুন ব্যবস্থায় ব্যবহারকারীর লেখা prompt-এর সংখ্যা দেখে অবশিষ্ট কাজের পরিমাণ নির্ভরযোগ্যভাবে অনুমান করা যাবে না। একই দৈর্ঘ্যের দুটি prompt-ও আলাদা পরিমাণ quota নিতে পারে, কারণ হিসাবের মধ্যে প্রশ্নের জটিলতা, চলমান chat কত দীর্ঘ, notebook-এ কত source আছে, কোন model কাজ করছে এবং কোন feature ব্যবহার করা হচ্ছে—এসব শর্ত যুক্ত হবে।
একটি শর্তসাপেক্ষ উদাহরণে পার্থক্যটি স্পষ্ট। অল্প কয়েকটি source থেকে একটি নাম বা তারিখ খুঁজে দেওয়ার অনুরোধের তুলনায় বহু নথির বক্তব্য মিলিয়ে বিরোধ শনাক্ত করা, দীর্ঘ chat-এর আগের context ধরে রাখা এবং বিস্তারিত synthesis তৈরি করা বেশি compute চাইতে পারে। সে ক্ষেত্রে দ্বিতীয় কাজটি quota দ্রুত কমাতে পারে, যদিও ঠিক কত গুণ বেশি কমবে তা বলার মতো কোনো প্রকাশ্য conversion table Google দেয়নি।
একই কারণে prompt ছোট হলেই সেটি সব সময় হালকা হবে—এমন সিদ্ধান্তও নিরাপদ নয়। অল্প কথায় চাওয়া Video Overview, Slide Deck বা অন্য ভারী generation feature একটি দীর্ঘ কিন্তু সরল তথ্যভিত্তিক প্রশ্নের চেয়ে বেশি allowance নিতে পারে। নতুন পদ্ধতিতে দৃশ্যমান prompt count নয়, কাজটি সম্পন্ন করার আনুমানিক computational demand-ই মূল পার্থক্য তৈরি করবে।
পাঁচ ঘণ্টার refresh weekly ceiling মুছে দেবে না

Quota প্রতি পাঁচ ঘণ্টায় refresh হওয়া মানে দৈনিক reset-এর জন্য অপেক্ষা না করেও একই দিনে আবার কাজের সুযোগ পাওয়া। তবে এই refresh একটি সীমাহীন নতুন বরাদ্দ নয়: ব্যবহারকারী পাঁচ ঘণ্টার window-এর limit শেষ করলে পরবর্তী refresh পর্যন্ত অপেক্ষা করতে পারবেন, যতক্ষণ না বিস্তৃত weekly limit পূর্ণ হচ্ছে। Weekly ceiling ছুঁয়ে গেলে শুধু পরের পাঁচ ঘণ্টার সময় পার হওয়াই আবার access পাওয়ার নিশ্চয়তা দেয় না।
Subscription অনুযায়ী allowance-ও আলাদা হবে। কোনো plan না থাকলে standard limit প্রযোজ্য; Google AI Plus-এ standard-এর দ্বিগুণ এবং AI Pro-তে চার গুণ limit থাকবে। AI Ultra-তে subscription-এর ধরন অনুযায়ী AI Pro-এর পাঁচ অথবা ২০ গুণ পর্যন্ত allowance মিলবে। এগুলো আপেক্ষিক multiplier: standard limit-এর নির্দিষ্ট compute পরিমাণ প্রকাশিত না হওয়ায় সেখান থেকে মোট কতটি prompt, chat বা generation করা যাবে তা হিসাব করা সম্ভব নয়।
Refresh-এর এই কাঠামো কাজের ধরন অনুযায়ী ভিন্ন অভিজ্ঞতা তৈরি করতে পারে। একাধিক ছোট প্রশ্ন করা ব্যবহারকারী একটি window-তে তুলনামূলক বেশি request চালাতে পারেন, আর দীর্ঘ context ও ভারী output-নির্ভর workflow একই সময়ে দ্রুত সীমায় পৌঁছাতে পারে। এটি সম্ভাব্য ফল, নিশ্চিত request সংখ্যা নয়—কারণ Google feature-ভিত্তিক unit বা সর্বোচ্চ compute budget প্রকাশ করেনি।
Limit দেখা যাবে, কিছু output পরে তৈরি হবে

Gemini Notebook-এর usage নির্দেশিকা অনুযায়ী, Settings-এর Usage অংশে AI usage ও weekly limit দেখা যাবে। Chat-এর নিচে remaining usage এবং পরবর্তী refresh-এর সময় দেখানো হবে; Studio generation-এর indicator কোনো output তৈরিতে প্রত্যাশিত AI usage তুলনামূলকভাবে কত বেশি হতে পারে, তার সংকেত দেবে।
এই indicator exact compute unit, token count, processing time বা আর্থিক মূল্য দেখাবে—Google এমন দাবি করেনি। Studio-র bar যত বেশি পূর্ণ থাকবে, expected usage cost তত বেশি বোঝাবে। তাই ভারী generation শুরু করার আগে তার আপেক্ষিক চাপ বোঝা গেলেও একটি prompt ঠিক কত quota নেবে, তার পূর্ণ সংখ্যাগত হিসাব আগাম পাওয়া যাবে কি না তা এখনো স্পষ্ট নয়।
AI limit শেষ হলে web ব্যবহারকারীরা Studio panel থেকে Generate later বেছে নিয়ে generation পিছিয়ে দিতে পারবেন। Google-এর ঘোষণায় Video Overview ও Slide Deck-এর উদাহরণ আছে: output সঙ্গে সঙ্গে তৈরি না হয়ে পরে স্বয়ংক্রিয়ভাবে সম্পন্ন হবে, আর notification চালু থাকলে প্রস্তুত হওয়ার খবর পাওয়া যাবে। Help নথি বলছে, এতে কয়েক ঘণ্টা লাগতে পারে এবং সুবিধাটি বর্তমানে কেবল web-এ উপলভ্য।
একটি শর্তসাপেক্ষ workflow-এ, গবেষক chat-এ source বিশ্লেষণ শেষ করার পর limit ফুরিয়ে গেলে Slide Deck-টি পরে তৈরির জন্য রেখে দিতে পারেন। এতে generation বাতিল না করে execution পিছিয়ে দেওয়া যায়; কিন্তু Google বলেনি যে Generate later weekly limit এড়িয়ে যাবে বা output-এর compute cost কমিয়ে দেবে। Mobile account নতুন limit-এর rollout পাবে, তবে deferred generation-এর control web-এই সীমিত থাকবে।
Rollout-এর আগে যে হিসাবগুলো অজানা
২ সেপ্টেম্বর rollout শুরু হলেও সব consumer account-এ পরিবর্তনটি একই মুহূর্তে পৌঁছাবে—এমন সময়সূচি প্রকাশ করা হয়নি। Standard ও weekly limit-এর সংখ্যাগত মান, weekly period কোন মুহূর্তে reset হবে, unused allowance পরের পাঁচ ঘণ্টার window-তে জমা হবে কি না এবং নির্দিষ্ট prompt বা feature কত শতাংশ quota নেবে—এসব তথ্যও এখনো অনুপস্থিত।
তাই নিশ্চিত পরিবর্তন হলো fixed feature-request count থেকে computational demand-ভিত্তিক হিসাবে যাওয়া, পাঁচ ঘণ্টা পরপর quota refresh এবং তার ওপরে weekly ceiling রাখা। কিন্তু একজন শিক্ষার্থী বা গবেষক দিনে ঠিক কতটি প্রশ্ন, synthesis, Video Overview বা Slide Deck তৈরি করতে পারবেন, তার একক উত্তর নেই; rollout-এর পর দৃশ্যমান usage indicator এবং Google-এর পরবর্তী documentation-ই সেই সীমার বাস্তব আচরণ পরিষ্কার করবে।
আরও পড়ুন:
আমাদের নিউজলেটার নিন
সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।