Anthropic-এর ভেতরেই মডেল যাচাই করবে Accenture—পাঁচ বছরে যৌথ $২ বিলিয়ন

Anthropic ও Accenture ১৮ সেপ্টেম্বর ২০২৬-এ Anthropic-এর অভ্যন্তরীণ দল ও নিরাপত্তা সহযোগীদের পাশে কাজ করার জন্য embedded evaluator দল গঠনের অংশীদারত্ব প্রকাশ করেছে। Accenture-এর আনুষ্ঠানিক ঘোষণায় বলা হয়েছে, প্রতিষ্ঠানটির বিশেষায়িত AI ব্যবসা Faculty-এর নেতৃত্বে দলটি মডেল মূল্যায়ন ও red-teaming, alignment assessment এবং safeguard testing করবে।
Reuters-এর প্রতিবেদনে ১৮ সেপ্টেম্বর জানানো হয়, পাঁচ বছরে Anthropic ও Accenture প্রত্যেকে অন্তত $১ বিলিয়ন বিনিয়োগের অঙ্গীকার করেছে—সম্মিলিত ন্যূনতম অঙ্ক $২ বিলিয়ন। এটি সম্পন্ন ব্যয় বা এককালীন নিরীক্ষা-ফি নয়; embedded evaluation-এর সক্ষমতা গড়ার ভবিষ্যৎ বিনিয়োগ-পরিকল্পনা।
এই ব্যবস্থায় Accenture-এর মূল্যায়নকারীরা সাধারণ বাইরের পরীক্ষকের তুলনায় মডেল তৈরির প্রক্রিয়ার অনেক কাছে থাকবেন। কিন্তু গভীর প্রবেশাধিকার মূল্যায়নকে নিজে থেকেই স্বাধীন করে না: Anthropic সরাসরি কাজটির অর্থ দেবে, অথচ পরীক্ষার বিষয়ও হবে Anthropic-এর মডেল, সুরক্ষাব্যবস্থা ও সিদ্ধান্তপ্রক্রিয়া।
Embedded evaluator কীভাবে কাজ করবে
প্রচলিত বাহ্যিক মূল্যায়নে পরীক্ষক সাধারণত নির্দিষ্ট মডেল সংস্করণ, সীমিত ইন্টারফেস বা আগে থেকে সাজানো পরীক্ষার পরিবেশ পান। Embedded evaluator নির্মাতা প্রতিষ্ঠানের ভেতরে কর্মীর সঙ্গে তুলনীয় প্রবেশাধিকার নিয়ে প্রশিক্ষণের সময় মডেলের পরিবর্তন দেখতে, নির্মাণ ও মোতায়েনের সিদ্ধান্ত অনুসরণ করতে এবং সংশ্লিষ্ট কর্মীদের সঙ্গে সরাসরি কথা বলতে পারবেন।
Anthropic-এর নিজস্ব ব্যাখ্যায় এই প্রবেশাধিকারের পাশাপাশি নিরাপত্তা-অঙ্গীকার যাচাই, অদেখা দুর্বলতা শনাক্ত ও ঘটনা জানানোর সুযোগের কথা রয়েছে। একই ব্যাখ্যায় প্রতিষ্ঠানটি স্বীকার করেছে, মূল্যায়নকারীরা কোন তথ্য পাবেন বা পাওয়া ফল কীভাবে জানাবেন—সে বিষয়ে এখনো প্রতিষ্ঠিত মান নেই; অংশীদারত্বটি non-exclusive এবং Accenture-এর কাজের অর্থ সরাসরি Anthropic দেবে।
অতএব পরীক্ষাটি শুধু কোনো মডেলের নির্বাচিত প্রশ্নের উত্তর মাপার মধ্যে সীমাবদ্ধ থাকার কথা নয়। মূল্যায়নকারীরা মডেল গঠনের পর্যায়, ঝুঁকির সংকেত, safeguard প্রয়োগ এবং প্রকাশ বা মোতায়েনের সিদ্ধান্তের ধারাবাহিকতা পর্যবেক্ষণ করতে পারবেন। তবে ঘোষিত কাঠামোয় কোনো নির্দিষ্ট মডেলের নাম, দলের আকার, প্রথম মূল্যায়নের সময়সূচি বা মূল্যায়নকারীর সিদ্ধান্ত কার্যকর করার ক্ষমতা নির্ধারণ করা হয়নি।
প্রবেশাধিকার কেন স্বাধীনতার প্রমাণ নয়
ভেতরের তথ্য পাওয়ার সুবিধা বাহ্যিক পরীক্ষার একটি গুরুত্বপূর্ণ সীমাবদ্ধতা কমাতে পারে। প্রস্তুত করা পরীক্ষার পরিবেশের বাইরে গিয়ে মূল্যায়নকারী দেখতে পারবেন, ঘোষিত নিরাপত্তা-অঙ্গীকার বাস্তব সিদ্ধান্তে মানা হচ্ছে কি না এবং মডেল প্রকাশের আগে শনাক্ত ঝুঁকি কীভাবে সামলানো হচ্ছে।
তবু প্রবেশাধিকার ও স্বাধীনতা আলাদা শর্ত। মূল্যায়নের অর্থদাতা ও পরীক্ষাধীন প্রতিষ্ঠান একই হলে কাজের পরিধি, তথ্যপ্রাপ্তি এবং প্রকাশের অধিকার আগেই স্পষ্ট করা জরুরি। তা না হলে পরীক্ষক অভ্যন্তরীণ প্রক্রিয়া গভীরভাবে দেখেও জনসাধারণের জন্য স্বাধীনভাবে যাচাইযোগ্য প্রমাণ প্রকাশ করতে নাও পারেন।
বর্তমান ঘোষণায় মূল্যায়নকারীরা ঘটনা জানাতে এবং মডেলের সুবিধা ও ঝুঁকি সম্পর্কে জনসাধারণকে আরও তথ্য দিতে পারবেন বলা হয়েছে। কিন্তু পূর্ণ প্রতিবেদন প্রকাশের অধিকার, প্রকাশের আগে Anthropic-এর সম্পাদনা বা ভেটো, কিংবা দুই পক্ষের সিদ্ধান্ত না মিললে Accenture-এর আলাদা মত প্রকাশের নিশ্চয়তা উল্লেখ নেই। ফলে ‘স্বাধীন’ পরিচয়টির কার্যকর অর্থ এখনো ভবিষ্যৎ পরিচালনবিধি ও প্রকাশিত ফলের ওপর নির্ভর করছে।
বিনিয়োগের অঙ্কটি আসলে কী বোঝায়
শিরোনামের মোট অঙ্ক দুই প্রতিষ্ঠানের বহু বছরের প্রত্যাশিত বিনিয়োগ যোগ করে পাওয়া ন্যূনতম পরিমাণ। এটি ইতিমধ্যে ব্যয় করা অর্থ, Accenture-কে দেওয়া এককালীন চুক্তিমূল্য বা কোনো একটি মডেলের নিরীক্ষা-বাজেট নয়। ঘোষণার forward-looking ভাষা লক্ষ্য ও পরিকল্পনা বোঝায়; অর্থ ব্যয় বা ফল অর্জনের নিশ্চয়তা নয়।
দুই পক্ষের অর্থ কোন খাতে, কী অনুপাতে এবং কোন সময়সূচিতে ব্যয় হবে, তার বিভাজন প্রকাশিত হয়নি। Accenture-এর পরিকল্পিত অর্থের পুরোটাই Faculty দলের এই কাজের জন্য কি না, কিংবা Anthropic-এর অংশ evaluator সক্ষমতা, নিজস্ব নিরাপত্তা অবকাঠামো ও অন্য ব্যবস্থার মধ্যে কীভাবে ভাগ হবে—এ তথ্যও অনুপস্থিত। তাই মোট অঙ্কটি অংশীদারত্বের পরিকল্পিত পরিসর দেখায়, নির্দিষ্ট পরীক্ষার মূল্য নয়।
Non-exclusive কাঠামোর অর্থ Anthropic অন্য মূল্যায়নকারী যুক্ত করতে এবং Accenture অন্য AI নির্মাতার সঙ্গে একই ধরনের কাজ করতে পারবে। এটি একক পরীক্ষকের ওপর নির্ভরতা কমানোর সুযোগ তৈরি করে, যদিও ভিন্ন মূল্যায়নকারীর কাজ তুলনা করতে হলে তথ্যপ্রাপ্তি, পরীক্ষার পদ্ধতি ও ফল প্রকাশের জন্য সামঞ্জস্যপূর্ণ নিয়ম প্রয়োজন হবে।
স্বাধীনতা যাচাইয়ে যে তথ্যগুলো এখনো নেই
ঘোষণা থেকে প্রবেশাধিকারের ধারণা পরিষ্কার হলেও দায়বদ্ধতার কাঠামো নির্ধারণ করা যায় না। কাজ শুরু হওয়ার পর নিচের অমীমাংসিত বিষয়গুলোই দেখাবে Accenture শুধু ভেতরের তথ্য পাচ্ছে, নাকি Anthropic-এর অবস্থান থেকে আলাদা সিদ্ধান্তে পৌঁছে তা প্রকাশও করতে পারছে।
- নিয়োগ ও কাজের পরিধি: Faculty দলের সদস্য, পরীক্ষার বিষয় ও লক্ষ্য মডেল কে নির্বাচন করবে; Anthropic কোনো ঝুঁকি বা প্রক্রিয়াকে পরিধির বাইরে রাখতে পারবে কি না।
- তথ্যপ্রাপ্তির সীমা: প্রশিক্ষণ-সংক্রান্ত উপাত্ত, অভ্যন্তরীণ সিদ্ধান্ত, ঘটনার নথি এবং safeguard পরীক্ষার কোন অংশ মূল্যায়নকারীরা দেখতে পারবেন।
- ফল প্রকাশ: পূর্ণ প্রতিবেদন, সংক্ষিপ্তসার নাকি শুধু দুই পক্ষের সম্মত বক্তব্য প্রকাশিত হবে; Anthropic-এর সম্পাদনা বা প্রকাশ বন্ধ করার ক্ষমতা থাকবে কি না।
- মতবিরোধ ও গোপনীয়তা: ঝুঁকির মাত্রা নিয়ে দ্বিমত হলে আলাদা মত কীভাবে নথিভুক্ত হবে এবং বাণিজ্যিক গোপনীয়তার সীমা কে নির্ধারণ করবে।
- ফলাফলের পরিণতি: গুরুতর সমস্যা পাওয়া গেলে মডেল প্রকাশ স্থগিত, safeguard পরিবর্তন বা বাইরের কর্তৃপক্ষকে জানানোর পূর্বনির্ধারিত ব্যবস্থা থাকবে কি না।
এখন পর্যন্ত নিশ্চিত বিষয় হলো অংশীদারত্ব ও বিনিয়োগ-পরিকল্পনা, Faculty-এর নেতৃত্ব এবং মডেল red-teaming, alignment assessment ও safeguard testing-এর কাজ। কাজ শুরুর নির্দিষ্ট সময়, প্রথম লক্ষ্য মডেল, প্রকাশ্য ফল এবং মতবিরোধ সামলানোর নিয়ম এখনো অনির্ধারিত। উদ্যোগটি মূল্যায়নকারীর জন্য অস্বাভাবিক গভীর প্রবেশাধিকারের প্রতিশ্রুতি দিলেও স্বাধীনতার প্রমাণ মিলবে প্রকাশযোগ্য ফল, অর্থায়নের শর্ত এবং দুই পক্ষের মত না মিললে অনুসৃত নিয়ম থেকে।
আরও পড়ুন:
আমাদের নিউজলেটার নিন
সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।