এআই ও অটোমেশন

Claude এখন Anthropic-এর ২৬% AI গবেষণায় নেতৃত্ব দেয়—স্বয়ংক্রিয় নয়

|লেখক: QUASA সম্পাদকীয় দল|4 মিনিটের পাঠ
Claude এখন Anthropic-এর ২৬% AI গবেষণায় নেতৃত্ব দেয়—স্বয়ংক্রিয় নয়

Anthropic ১৭ সেপ্টেম্বর প্রকাশিত আগস্ট ২০২৬-এর স্ন্যাপশটে জানিয়েছে, Claude প্রতিষ্ঠানটির ওজনযুক্ত AI গবেষণা ও উন্নয়নকাজের ২৬%-এ ‘নেতৃত্ব’ দিচ্ছে। এর অর্থ মানুষের নির্দেশনা ছাড়া পরবর্তী Claude বানানো নয়: AP-এর স্বাধীন প্রতিবেদনে ২৬% ফলটির পাশাপাশি মানব তত্ত্বাবধান বজায় থাকা এবং কোনো মাপা অংশে পূর্ণ স্বয়ংক্রিয়তা না থাকার বিষয়টি নিশ্চিত করা হয়েছে।

১৭ সেপ্টেম্বরের প্রকাশনাটি Claude কত কাজ ছুঁয়েছে, কত কাজে প্রধান বাস্তবায়নকারী হয়েছে এবং কত কাজে মানুষকে পুরোপুরি বাদ দিয়েছে—এই তিন অবস্থাকে আলাদা করেছে। ওয়াশিংটন পোস্টের একই দিনের প্রতিবেদনে ২৬% নেতৃত্বের ফলটি মানব তত্ত্বাবধান ও উচ্চস্তরের নির্দেশনার অধীন বলে বর্ণনা করা হয়েছে; প্রতিষ্ঠানটি recursive self-improvement কতটা কাছে, সে হিসাব দেয়নি।

২৬%, ৯০%-এর বেশি ও শূন্য—তিনটি আলাদা পরিমাপ

২৬% কাজের সংখ্যা, কর্মীর সংখ্যা কিংবা গবেষণার ফলের অংশ নয়। এটি নির্ধারিত কাজের শ্রেণিগুলোকে কর্মীদের আনুমানিক সময় অনুযায়ী ওজন দেওয়ার পর AL4 বা ‘AI leads’ স্তরে থাকা অংশ। AL4-এ Claude উচ্চস্তরের নির্দেশনা থেকে একটি কাজের অধিকাংশ ধাপ শুরু থেকে শেষ পর্যন্ত করতে পারে, কিন্তু মানুষ তত্ত্বাবধায়ক হিসেবে থাকেন।

৯০%-এর বেশি হলো আরও বিস্তৃত পরিসর: এতে AL3 বা তার ওপরের সব কাজ রয়েছে। AL3-তে AI ঘনিষ্ঠ মানবনির্দেশনায় কাজের বড় অংশ করতে পারে। ফলে Claude-এর অংশগ্রহণ ৯০%-এর বেশি হলেও তার নেতৃত্বের অংশ ২৬%; সহযোগিতা ও নেতৃত্ব একই দাবি নয়।

পূর্ণ স্বায়ত্তশাসনের ফল শূন্য। আগস্টের স্ন্যাপশটে কোনো মাপা কাজ AL5-এ ছিল না—অর্থাৎ মানুষের অংশগ্রহণ ছাড়াই লক্ষ্য নিয়ে পুরো কাজ চালানোর উদাহরণ সূচকটি পায়নি। তাই ২৬%-কে ‘Claude নিজেকে নিজে বানাচ্ছে’ বলা প্রকাশিত পরিমাপের চেয়ে শক্তিশালী এবং বিভ্রান্তিকর দাবি।

AL0 থেকে AL5: ২৬% কোথায় দাঁড়ায়

Automation Level বা AL স্কেলটি শুধু AI ব্যবহৃত হচ্ছে কি না মাপে না; একটি কাজ কতটা তার হাতে অর্পণ করা হয়েছে, সেটি বোঝায়। ছয়টি স্তর পাশাপাশি রাখলে নেতৃত্ব ও স্বায়ত্তশাসনের ফারাক স্পষ্ট হয়:

  • AL0 — AI নেই: কাজটি মানুষ সম্পন্ন করেন।
  • AL1 — ন্যূনতম সম্পৃক্ততা: AI বিচ্ছিন্ন ও সীমিত সহায়তা দেয়।
  • AL2 — সহায়ক: AI নির্দিষ্ট অংশ করে, তবে কাজটি মূলত মানুষের পরিচালনায় থাকে।
  • AL3 — সহযোগী: ঘনিষ্ঠ মানবনির্দেশনায় AI কাজের বড় অংশ সম্পন্ন করে।
  • AL4 — নেতৃত্বদানকারী: উচ্চস্তরের নির্দেশনা পেয়ে AI অধিকাংশ কাজ শুরু থেকে শেষ পর্যন্ত করে, আর মানুষ তত্ত্বাবধান করেন।
  • AL5 — স্বায়ত্তশাসিত: কোনো মানুষ প্রক্রিয়ায় যুক্ত না থেকেও AI কাজটি চালায়।

শিরোনামের ‘নেতৃত্ব’ তাই সাংগঠনিক কর্তৃত্ব নয়। Claude গবেষণার লক্ষ্য নিজে স্থির করছে বা কোন মডেল তৈরি হবে সে সিদ্ধান্ত নিচ্ছে—২৬% থেকে এমন সিদ্ধান্ত টানা যায় না। সংখ্যাটি শুধু AL4-এর সংজ্ঞা অনুযায়ী কাজ বাস্তবায়নের মাত্রা প্রকাশ করে।

২৬% তৈরির পদ্ধতি এবং তার সীমা

Anthropic-এর প্রকাশিত পদ্ধতিতে জুলাইয়ের প্রতি সপ্তাহে সংশ্লিষ্ট বিভাগগুলোর ২০% কর্মীকে দৈবভাবে নমুনায় নিয়ে Slack ও অভ্যন্তরীণ নথি থেকে প্রায় ১৫ হাজার কাজ শনাক্ত করা হয়; সেগুলো ৫৪২টি শ্রেণিতে সাজানো হয়, যার ৩৭৮টি ছিল সবচেয়ে নির্দিষ্ট ‘লিফ’ শ্রেণি। পরে Claude গবেষণা এজেন্ট প্রমাণ সংগ্রহ করে এবং আলাদা Claude বিচারক প্রতিটি শ্রেণিকে AL0–AL5 রেটিং দেয়।

সব শ্রেণিকে সমান ওজন দেওয়া হয়নি। নমুনাভুক্ত একজন কর্মী এক সপ্তাহে চারটি কাজে যুক্ত থাকলে প্রতিটি কাজ ০.২৫ ইউনিট, আর দশটি কাজে যুক্ত থাকলে প্রতিটি ০.১০ ইউনিট পায়। এটি কাজের গুরুত্বের সরাসরি মাপ নয়; কর্মীরা কোথায় কত সময় দিয়েছেন, তার একটি অপরিশোধিত বিকল্প হিসাব। তাই ২৬% হলো স্থির কাজের ঝুড়ি, Claude-নির্ধারিত রেটিং এবং person-time ওজনের সম্মিলিত ফল।

পরিমাপটি স্বাধীন অডিটও নয়। অভ্যন্তরীণ তথ্য সংগ্রহ, শ্রেণিবিন্যাস ও বিচার—সব পর্যায়েই প্রতিষ্ঠানের নিজস্ব ব্যবস্থা ও মডেল ব্যবহৃত হয়েছে। দায়িত্বপ্রাপ্ত কর্মীদের আলাদা রেটিংয়ের সঙ্গে বিচারক মডেলের হুবহু মিল ছিল ৫৯%, দুই মানব রেটারের মিল ছিল ৩৫%, আর মডেল ও মানুষের রেটিং ৯৭% ক্ষেত্রে এক ধাপের মধ্যে ছিল। এই ফল AL3 ও AL4-এর সীমান্তে বাস্তব শ্রেণিবিন্যাসগত অনিশ্চয়তা থাকার ইঙ্গিত দেয়।

আরেকটি সীমা হলো জুলাইয়ের কাজের কাঠামো স্থির রেখে পরের মাস মাপা। এতে একই ঝুড়িতে স্বয়ংক্রিয়তা কতটা বাড়ছে দেখা যায়, কিন্তু মানুষ নতুন ধরনের কাজে সরে গেলে সেই পরিবর্তন পুরোপুরি ধরা নাও পড়তে পারে। একই মডেল-পরিবার নিজের ব্যবস্থাকে বিচার করায় গবেষণা এজেন্ট ও বিচারক একই ধরনের ভুল করার ঝুঁকিও থাকে।

Recursive self-improvement এখনো প্রমাণিত নয়

পূর্ণ recursive self-improvement বলতে এমন চক্র বোঝায়, যেখানে AI মানুষের সহায়তা ছাড়া নিজের উত্তরসূরি তৈরি করে এবং উন্নত উত্তরসূরি আবার পরবর্তী সংস্করণ নির্মাণ করে। বর্তমান সূচক সেই চক্র মাপে বা প্রমাণ করে না। এটি মানুষের নির্ধারিত কাজের কাঠামোর মধ্যে Claude-এর অংশগ্রহণ ও বাস্তবায়নের মাত্রা দেখায়।

পরিবর্তনের গতি অবশ্যই উল্লেখযোগ্য: ফেব্রুয়ারিতে AL4 অংশ ১%-এর নিচে ছিল, আগস্টে তা ২৬% হয়েছে। কিন্তু এই দুই বিন্দু থেকে AL5 কবে আসবে, বৃদ্ধি একই গতিতে চলবে কি না কিংবা সম্পূর্ণ মডেল-উন্নয়ন চক্র কখন স্বয়ংক্রিয় হবে—কোনোটিই নির্ণয় করা যায় না। এটি সক্ষমতার পূর্বাভাস নয়, Anthropic-এর অভ্যন্তরীণ কাজের একটি সময়ভিত্তিক স্ন্যাপশট।

এখনকার নিশ্চিত চিত্র তাই তিন সংখ্যায় সীমাবদ্ধ: ওজনযুক্ত কাজের ২৬%-এ Claude AL4 নেতৃত্বের স্তরে, ৯০%-এর বেশি কাজে অন্তত AL3 সহযোগী এবং AL5 পূর্ণ স্বায়ত্তশাসনে কোনো মাপা অংশ নেই। পরবর্তী স্ন্যাপশট, হালনাগাদ কাজের ঝুড়ি এবং স্বাধীনভাবে যাচাইযোগ্য মূল্যায়ন ছাড়া এই ফলকে অন্য ল্যাবের সঙ্গে তুলনা করা বা স্বয়ংসম্পূর্ণ AI উন্নয়নের সময়রেখা হিসেবে পড়া যাবে না।

আরও পড়ুন:

শেয়ার করুন:

আমাদের নিউজলেটার নিন

সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।

0