Firecrawl পেল $৭৫ মিলিয়ন—AI-এর জ্ঞান কিনবে, শুধু web scrape নয়

|লেখক: QUASA সম্পাদকীয় দল|5 মিনিটের পাঠ
Firecrawl পেল $৭৫ মিলিয়ন—AI-এর জ্ঞান কিনবে, শুধু web scrape নয়

Firecrawl ২২ সেপ্টেম্বর ২০২৬ $৭৫ মিলিয়নের Series B সংগ্রহের পাশাপাশি Alexandria চালু করেছে। ওয়েবের তথ্য সংগ্রহ ও সাজানোর সেবা হিসেবে পরিচিত প্রতিষ্ঠানটি এখন AI এজেন্টকে লাইভ ওয়েব, নিজস্ব সূচি এবং বাইরের তথ্য সরবরাহকারীর কাছে একটি সংযোগে পৌঁছাতে দিতে চায়। অর্থায়নের খবরটি নিশ্চিত হলেও Alexandria-র ভবিষ্যৎ আয় বা লাভ সম্পর্কে কোনো হিসাব প্রকাশিত হয়নি।

Firecrawl-এর ২২ সেপ্টেম্বরের ঘোষণায় রাউন্ডের নেতৃত্বে Smash Capital এবং অংশগ্রহণকারী হিসেবে Altos Ventures, Nexus Venture Partners, Y Combinator, Freestyle ও Offline Ventures-এর নাম রয়েছে। একই ঘোষণায় প্রতিষ্ঠানটি জানিয়েছে, নতুন অর্থের একটি উল্লেখযোগ্য অংশ মানুষের তৈরি জ্ঞান ও সরাসরি তথ্যপ্রাপ্তির অধিকার কিনতে ব্যয় করতে চায়; Wikimedia Enterprise-সহ কিছু সরবরাহকারীকে তারা ইতিমধ্যে অর্থ দেয়। তাই শিরোনামের ‘জ্ঞান কিনবে’ কথাটি ঘোষিত বিনিয়োগ পরিকল্পনা ও বিদ্যমান চুক্তির ওপর দাঁড়ানো, সবার জন্য চালু কোনো অর্থপ্রদান কর্মসূচির ওপর নয়।

বিনিয়োগের লক্ষ্য শুধু আরও পৃষ্ঠা সংগ্রহ নয়

Firecrawl-এর পুরোনো কাজের কেন্দ্রে ছিল ওয়েবপৃষ্ঠার ঠিকানা নিয়ে সেটি খোলা, প্রয়োজন হলে রেন্ডার করা, তারপর AI ব্যবহারের উপযোগী লেখা বা সাজানো তথ্য ফেরত দেওয়া। এ কাজে সফটওয়্যার ও অবকাঠামো লাগে, কিন্তু প্রতিটি দরকারি তথ্য যে উন্মুক্ত পৃষ্ঠায় পাওয়া যাবে, তার নিশ্চয়তা নেই। এজেন্টের প্রশ্নে আর্থিক রেকর্ড বা বিশেষায়িত সংগ্রহ লাগলে আলাদা উৎসের API, মূল্য ও তথ্যের বিন্যাস সামলাতে হয়।

Alexandria সেই ছড়ানো উৎসে প্রবেশের একটি অভিন্ন পথ তৈরি করার চেষ্টা। রাউন্ডের অর্থ দিয়ে Firecrawl অনুসন্ধান উন্নত করা, নিজস্ব সূচি আরও গভীর করা এবং মূল সরবরাহকারীদের সঙ্গে সরাসরি সংযোগ বাড়ানোর পরিকল্পনা করেছে। একই সঙ্গে তথ্যের মালিকদের অর্থ দেওয়ার কথাও বলেছে। এতে পণ্যটি scraping API থেকে উৎস খোঁজা ও তথ্য সরবরাহের বিস্তৃত সেবায় এগোয়; তবে বড় রাউন্ড পেলেই সেই বাজারে লাভজনক অবস্থান তৈরি হবে, এমন সিদ্ধান্ত এখনই টানা যায় না।

Alexandria কোন তথ্য এক জায়গায় আনে

Alexandria-য় লাইভ ওয়েবের পাশাপাশি Firecrawl-এর Research, Developer ও Government Index আছে। গবেষণার সূচিতে বৈজ্ঞানিক প্রবন্ধের সারসংক্ষেপ, ডেভেলপার সূচিতে ডকুমেন্টেশন, README, ইস্যু ও একীভূত pull request, আর সরকারি সূচিতে আইন ও বিধির মতো উপাদান রাখা হয়। এগুলো একই ধরনের তথ্যের ভিন্ন নাম নয়; উৎস ও প্রশ্নের ধরন আলাদা বলে একটি সাধারণ ওয়েব ফলাফল অন্যটির পুরো বিকল্প হতে পারে না।

বাইরের সরবরাহকারীর তথ্যও এই ব্যবস্থার অংশ। একটি এজেন্ট কোন উৎসে প্রাসঙ্গিক রেকর্ড আছে তা খুঁজতে পারে, সেই উৎস কী দেয় তা বুঝতে পারে এবং একই Firecrawl সংযোগ দিয়ে তথ্য চাইতে পারে। সরবরাহকারীর নিজস্ব API বা চুক্তির শর্ত একেবারে উঠে যায় না; Firecrawl সেগুলোকে এজেন্টের ব্যবহারের জন্য একটি স্তরে সাজিয়ে দেয়। ফলে ডেভেলপারের আলাদা সংযোগ তৈরির কাজ কমতে পারে, কিন্তু তথ্যের মান ও ব্যবহারের অধিকার শেষ পর্যন্ত উৎসভেদে বদলায়।

বিশেষায়িত সূচি, লাইভ পৃষ্ঠা ও লাইসেন্সকৃত সরবরাহকারীকে এক করে দেখলে মডেলটি ভুল বোঝা সহজ। কোম্পানির নিজের সূচিতে রাখা সারসংক্ষেপের খরচ, নতুন ওয়েবপৃষ্ঠার তথ্য সংগ্রহের খরচ এবং সরবরাহকারীর কাছ থেকে রেকর্ড নেওয়ার খরচ এক নয়। Alexandria-র বাণিজ্যিক প্রশ্ন তাই শুধু কত উৎসে পৌঁছায়, তা নয়; কোন প্রশ্নে কোন ধরনের উৎস ব্যবহার হয় এবং তার জন্য কাকে কত দিতে হয়, সেটিও।

Wikimedia চুক্তি অর্থপ্রদানের বাস্তব উদাহরণ

Wikimedia Enterprise-এর ১৭ মার্চ ২০২৬-এর অংশীদারত্ব ঘোষণায় বলা হয়, তখন Firecrawl দিয়ে মাসে প্রায় ২০ থেকে ৩০ লাখ Wikipedia তথ্যের অনুরোধ আসত। প্রতিবার একই পৃষ্ঠা ব্রাউজার দিয়ে সংগ্রহ ও HTML থেকে তথ্য আলাদা করার বদলে বাণিজ্যিক On-demand API দিয়ে সরাসরি তথ্য দেওয়ার পরিকল্পনা সেখানে বর্ণিত ছিল। মার্চের লেখায় পরিবর্তনটি আসন্ন হিসেবে বলা হয়েছিল; সেপ্টেম্বরের Firecrawl ঘোষণায় সরাসরি তথ্যপ্রাপ্তির জন্য অর্থ দেওয়ার কথা বর্তমান ব্যবস্থা হিসেবে এসেছে।

এই উদাহরণে উভয় পক্ষের সম্ভাব্য সুবিধা বোঝা যায়। Firecrawl বারবার পৃষ্ঠা রেন্ডার করার কিছু কাজ এড়াতে পারে, আর Wikimedia Enterprise উচ্চ পরিমাণের স্বয়ংক্রিয় ব্যবহারকে নিজস্ব API ও বাণিজ্যিক সম্পর্কের আওতায় আনতে পারে। তবে সরাসরি সংযোগ মানেই প্রতিটি তথ্য অনুরোধে Firecrawl-এর মোট খরচ কমেছে, এমন প্রমাণ নেই। চুক্তির মূল্য, তথ্য দেওয়ার হার এবং অনুরোধপ্রতি প্রকৃত ব্যয় প্রকাশিত না হওয়ায় এই ব্যবস্থার নিট আর্থিক ফল হিসাব করা যাচ্ছে না।

লাইসেন্সিংয়ে খরচের নতুন স্তর

Alexandria-র প্রযুক্তিগত নির্দেশিকায় উৎসের টুল খুঁজে দেখাকে বিনামূল্যের কাজ বলা হয়েছে; নির্বাচিত টুল চালালে তার তালিকাভুক্ত ক্রেডিট খরচ হয়। কিছু সরবরাহকারীর তথ্য ব্যবহারের আগে প্রতিষ্ঠানের প্রশাসককে আলাদা শর্ত মেনে নিতে হয়। অর্থাৎ উৎসের অস্তিত্ব জানা, তথ্য টেনে আনা এবং সেই তথ্য ব্যবহারের অধিকার পাওয়া একই ধাপ বা একই খরচের বিষয় নয়।

এই ব্যবস্থায় Firecrawl-এর সামনে পাশাপাশি দুটি হিসাব দাঁড়ায়। এক দিকে ওয়েবপৃষ্ঠার সন্ধান, রেন্ডারিং ও তথ্য পরিষ্কারের অবকাঠামো; অন্য দিকে সরবরাহকারী চুক্তি, API ব্যবহার এবং বিভিন্ন উৎসের রেকর্ডকে একটি সেবায় ফেরানোর খরচ। গ্রাহকের ক্রেডিট ব্যবহার থেকে আয় হতে পারে, কিন্তু তার কত অংশ সরবরাহকারীর কাছে যায়, সেই ভাগ প্রকাশিত নয়। তাই তালিকাভুক্ত ক্রেডিট মূল্য দেখে Firecrawl-এর মুনাফা বা প্রতিটি প্রশ্নে তার নিজের ব্যয় বের করা সম্ভব নয়।

আরও সরবরাহকারী যুক্ত হলে উৎসের বিস্তার বাড়তে পারে, সেই সঙ্গে চুক্তি ও রেকর্ড সামঞ্জস্য রাখার কাজও বাড়বে। সরাসরি নেওয়া তথ্য কিছু ক্ষেত্রে বারবার scraping-এর প্রয়োজন কমাতে পারে; অন্য ক্ষেত্রে উচ্চমূল্যের উৎস ব্যবহার নতুন ব্যয় যোগ করতে পারে। কোন প্রভাবটি বড় হবে তা নির্ভর করে ব্যবহারের ধরন, সরবরাহকারীর দাম ও তথ্যের গুণমানের ওপর। ব্যক্তিগত বিশেষজ্ঞ বা প্রকাশকের জন্য স্বয়ংক্রিয় নিবন্ধন ও অর্থপ্রদানের ব্যবস্থা এখনও পরিকল্পনার পর্যায়ে; এখনকার চুক্তিকে সেই ভবিষ্যৎ কর্মসূচির সমান ধরা যায় না।

মানের পরীক্ষা কী দেখায়, কী দেখায় না

Firecrawl-এর নিজস্ব পরীক্ষার বিবরণে একই মডেল ও নির্দেশনা রেখে ৮৪৫টি কাজে Alexandria ব্যবহার করা এজেন্টের উত্তরের মান অন্তর্নির্মিত ওয়েব টুল ব্যবহার করা এজেন্টের চেয়ে ২১ শতাংশ বেশি স্কোর করেছে। উত্তরগুলো AI দিয়ে পরিচয় গোপন রেখে বিচার করা হয়েছিল। এই ফল পরীক্ষার নির্দিষ্ট কাজ ও তুলনামূলক ব্যবস্থার ফল; সব প্রশ্নে ২১ শতাংশ বেশি নির্ভুলতা কিংবা স্বাধীনভাবে যাচাই করা সুবিধা বোঝায় না।

বিশেষায়িত রেকর্ড দরকার এমন কাজে Alexandria-র বাড়তি উৎস কাজে লাগতে পারে, কিন্তু প্রকাশিত সারসংক্ষেপ থেকে উন্নতির কতটা উৎস নির্বাচন, কতটা তথ্যের গুণমান এবং কতটা পরীক্ষার প্রশ্ন বাছাইয়ের ফল, তা আলাদা করা যায় না। প্রকাশিত তথ্য গ্রাহকের নিয়মিত ব্যবহারে খরচ ও উত্তরের মান একসঙ্গে কেমন থাকে, সেই প্রশ্নেরও জবাব দেয় না। আপাতত নিশ্চিত হলো রাউন্ড ও পণ্য চালু হয়েছে এবং নির্দিষ্ট সরবরাহকারীর সঙ্গে অর্থপ্রদানের সম্পর্ক আছে; নতুন অবদানকারীদের নিবন্ধন, বৃহত্তর স্বাধীন মূল্যায়ন এবং লাইসেন্সকৃত তথ্যের ব্যয়ের হিসাব এখনও সামনে আসার অপেক্ষায়।

আরও পড়ুন:

শেয়ার করুন:

আমাদের নিউজলেটার নিন

সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।

0