মনে করুন দুই-তিন বছর আগে কেউ যদি বলত, "একটা চীনা ল্যাব এমন একটা এআই মডেল বানাবে যেটা আমেরিকার শীর্ষ মডেলের সমতুল্য, আর সেই মডেলের ওয়েট আপনি নিজের সার্ভারে নামিয়ে চালাতে পারবেন" — আমরা কি বিশ্বাস করতাম? জেনারেটিভ এআইয়ের প্রথম যুগে দুটো ধারণা প্রায় সমার্থক হয়ে গিয়েছিল: "ফ্রন্টিয়ার মডেল" মানেই "বন্ধ এপিআই"। ChatGPT, Gemini, Claude — এদের কোনোটার মডেল-ওয়েট সাধারণ ব্যবহারকারী বা গবেষকের কাছে পৌঁছানোর সুযোগ ছিল না। কিন্তু ২০২৪-২৫ সালে এই চিত্রটা দ্রুত পাল্টে যাচ্ছে। LLaMA, Mistral, DeepSeek, Qwen, Phi, Gemma — এই ওপেন-ওয়েটওপেন-ওয়েটযে এআই মডেলের প্রশিক্ষিত ওয়েট ফাইল সর্বজনীনভাবে ডাউনলোড ও ব্যবহারের জন্য প্রকাশ করা হয় ফাউন্ডেশন মডেলগুলো গুণগত মানে বন্ধ মডেলের প্রায় সমতুল্য হয়ে উঠেছে এবং বিশ্বজুড়ে গবেষক, স্টার্টআপ ও সরকারের কাছে পৌঁছে গেছে।
২০২৪ সালের জুলাইয়ে মেটা প্রকাশ করে LLaMA 3.1 ৪০৫B — প্রথম ফ্রন্টিয়ার-শ্রেণির ওপেন-ওয়েট মডেল, যা MMLU ও HumanEval-এর মতো বেঞ্চমার্কেবেঞ্চমার্কেএআই মডেলের কর্মক্ষমতা যাচাই ও তুলনা করার জন্য ব্যবহৃত মানসম্মত পরীক্ষা GPT-4-এর কাছাকাছি ফল দেখায়। এর পরপরই ফ্রান্সের Mistral AI বাজারে আনে Mistral Large 2 ও Mixtral 8x22B। চীনের আলিবাবা-র Qwen 2.5 সিরিজ, মাইক্রোসফটের Phi-3 ও Phi-4, এবং গুগলের Gemma 2 — সব মিলিয়ে ওপেন-সোর্স ইকোসিস্টেম এখন সত্যিকার অর্থেই বহুকেন্দ্রিক।
DeepSeek R1 একদিনে যেভাবে বাজার কাঁপিয়ে দিল
২০২৫ সালের ২০ জানুয়ারি চীনের DeepSeek প্রকাশ করে তাদের রিজনিং মডেলরিজনিং মডেলজটিল সমস্যা ধাপে ধাপে চিন্তা করে সমাধান করতে বিশেষভাবে প্রশিক্ষিত এআই মডেল R1 — যা MATH, GSM8K ও কোডিং বেঞ্চমার্কে OpenAI o1-এর সমতুল্য ফল দেখায়। এটুকু হলেও হয়তো এত বড় খবর হতো না। আসল ধাক্কাটা ছিল এর দাবি-কৃত ট্রেনিং খরচ: মাত্র ৫৫ লক্ষ ডলারের কাছাকাছি, যেখানে ফ্রন্টিয়ার মডেলের ট্রেনিং বাজেট সাধারণত দশ কোটি ডলারের উপরে। ভাবুন তো — যে শিল্পে সবাই ধরে নিয়েছিল বিশাল পুঁজি ছাড়া প্রতিদ্বন্দ্বিতা অসম্ভব, সেখানে এই দাবিটাই একটা ভূমিকম্প ছিল। ২৭ জানুয়ারি এই খবরে মার্কিন শেয়ারবাজারে সত্যিকারের কাঁপন ধরে — এক দিনেই NVIDIA-র শেয়ার ১৭ শতাংশ পড়ে, প্রায় ৫৮,৯০০ কোটি ডলার বাজারমূল্য উড়ে যায়।
বেঞ্চমার্কের ব্যবধান কমছে — আর এটা শুধু সময়ের ব্যাপার
MMLU, HumanEval, GSM8K-র মতো স্ট্যান্ডার্ড বেঞ্চমার্কে বন্ধ ও ওপেন মডেলের ব্যবধান ক্রমশ কমছে। অনেক ক্ষেত্রে ডোমেইন-ফাইন-টিউন করা ওপেন মডেল বন্ধ মডেলকে ছাড়িয়েও যাচ্ছে — যেটা কয়েক বছর আগে কল্পনাও করা যেত না। Hugging Face Hub-এ ২০২৪ সালের মধ্যেই ১০ লক্ষের বেশি মডেল হোস্ট হয়েছে, যা বিশ্বের সবচেয়ে বড় মডেল-রিপোজিটরি। ওপেন-সোর্স এআই আর কোনো নিশ পরীক্ষা নয় — এটা এখন মূলধারা।
সার্বভৌম এআই: ভাষা আর ডেটার রাজনীতি কেন গুরুত্বপূর্ণ
ওপেন মডেলগুলোর সবচেয়ে বড় প্রভাব, আমার মতে, সার্বভৌম এআইয়েরসার্বভৌম এআইয়েরকোনো দেশ বা সরকার কর্তৃক নিজস্ব ভাষা ও ডেটা দিয়ে তৈরি ও নিয়ন্ত্রিত এআই মডেল ক্ষেত্রে। প্রতিটি দেশ এখন তাদের নিজস্ব ভাষা, সংস্কৃতি ও ডেটার উপর ফাইন-টিউনফাইন-টিউনপূর্ব-প্রশিক্ষিত মডেলকে নির্দিষ্ট ডেটাসেটে বাড়তি প্রশিক্ষণ দিয়ে বিশেষায়িত করা করা মডেল তৈরিতে নেমেছে:
- ভারত — Sarvam AI, ভারতীয় ভাষায় ফোকাসড।
- সংযুক্ত আরব আমিরাত — Falcon মডেল সিরিজ (TII)।
- সিঙ্গাপুর — SEA-LION, দক্ষিণ-পূর্ব এশীয় ভাষাগুলোর জন্য।
শুধু আদর্শ নয়, ব্যবসার হিসাবেও কেন ওপেন মডেল জিতছে
একটি স্টার্টআপের জন্য OpenAI বা Anthropic-এর এপিআই ব্যবহার মানে প্রতি টোকেনেটোকেনেটেক্সটের ক্ষুদ্রতম একক যার ভিত্তিতে ভাষা মডেলের ব্যবহার খরচ গণনা করা হয় খরচ, ডেটা-প্রাইভেসি শঙ্কা এবং ভবিষ্যৎ মূল্য পরিবর্তনের ঝুঁকি। তুলনায় সেল্ফ-হোস্টেড ওপেন মডেল দেয় নির্ধারিত খরচ, পূর্ণ নিয়ন্ত্রণ ও ফাইন-টিউনিংয়ের স্বাধীনতা। ছোট ব্যবসার জন্য GPU-ভাড়ার খরচও কমছে — AWS, Azure, Google Cloud-এ L4 ও H100 GPU ইনস্ট্যান্স এখন আগের চেয়ে অনেক সাশ্রয়ী। ফলে এটা শুধু আদর্শবাদী "ওপেন-সোর্স ভালো" যুক্তি নয় — সোজা ব্যবসায়িক গণিতও এখন ওপেন মডেলের পক্ষে কথা বলে।
বাংলাদেশের বাংলা এনএলপি গবেষণা কতদূর এগোলো
বাংলাদেশে ওপেন মডেলের প্রভাব সরাসরি দৃশ্যমান বাংলা এনএলপিএনএলপিপ্রাকৃতিক ভাষা প্রক্রিয়াকরণ — কম্পিউটার দিয়ে মানুষের ভাষা বোঝা ও তৈরি করার প্রযুক্তি গবেষণায়। বুয়েট সিএসই ও ব্র্যাক ইউনিভার্সিটির গবেষকরা LLaMA ও Mistral-এর উপর বাংলা ফাইন-টিউনিং চালাচ্ছেন; স্থানীয় বাংলা বেঞ্চমার্ক ডেটাসেট তৈরি হচ্ছে। একাধিক স্থানীয় স্টার্টআপ খরচ কমাতে OpenAI-র এপিআই পরিহার করে সেল্ফ-হোস্টেড Mistral বা Phi-4 ব্যবহার করছে — এটা আমার চোখে বাস্তববাদী সিদ্ধান্ত। বাংলাদেশ সরকারের পর্যায়েও জাতীয় ভাষা-মডেল তৈরির আলোচনা শুরু হয়েছে।
প্রশ্ন আর "ওপেন-সোর্স মডেল কি প্রতিদ্বন্দ্বিতা করতে পারবে" নয় — প্রতিদ্বন্দ্বিতা তারা ইতিমধ্যেই করছে। আমার কাছে আসল প্রশ্ন এখন: কোন দেশ, কোন প্রতিষ্ঠান এই ওপেন ইকোসিস্টেমের উপরে দাঁড়িয়ে নিজেদের বিশেষায়িত মডেল দ্রুততম সময়ে তৈরি করতে পারবে। বাংলাদেশের জন্যও সুযোগটা খোলা আছে।