পাঠ ৪৪ · ৫৭-এর মধ্যে · মডিউল ১০
Home / Courses / Ethics in Computing & AI Safety / AI গভর্নেন্স ও সমন্বয়

AI গভর্নেন্স ও আন্তর্জাতিক সমন্বয়

AI governance & international coordination
৯ মিনিট পড়া উচ্চ · Advanced Python কোডসহ সম্পূর্ণ বাংলায়

এই পাঠে যা শিখবেন

  • AI গভর্নেন্স সমন্বয় কেন একটি যৌথ-কর্ম/সমন্বয় সমস্যা হিসেবে গঠিত
  • সমন্বয়ের সম্ভাব্যতা নিয়ে আশাবাদী ও সংশয়ী — দুটি বাস্তবসম্মত দৃষ্টিভঙ্গি ন্যায্যভাবে
  • Python দিয়ে একটি সত্যিকারের গেম-থিওরি (পেঅফ ম্যাট্রিক্স ও ন্যাশ ইকুইলিব্রিয়াম) হিসাব — কেন সমন্বয়হীনতা একটি স্থিতিশীল ফলাফল হয়ে উঠতে পারে
  • M10-এর বাকি পাঠের (L43-এর ইমার্জেন্স, L45-এর দীর্ঘমেয়াদী বিতর্ক) সাথে এই গভর্নেন্স প্রশ্নের সম্পর্ক

১ · একটি যৌথ-কর্ম সমস্যা

কল্পনা করুন একাধিক প্রতিদ্বন্দ্বী AI ল্যাব বা দেশ প্রত্যেকেই নীতিগতভাবে একমত যে সবার সতর্কভাবে, ধীরে এবং পর্যাপ্ত সেফটি টেস্টিং সহ AI বিকশিত করা উচিত। সমস্যাটি হলো — যদি একজন অ্যাক্টর একতরফাভাবে ধীরে চলেন (অতিরিক্ত সেফটি টেস্টিংয়ে সময় ব্যয় করেন) অথচ বাকিরা তা না করেন, তাহলে সেই সতর্ক অ্যাক্টরটি বাজারে/কৌশলগত অবস্থানে পিছিয়ে পড়তে পারেন, আর কম-সতর্ক প্রতিযোগীরা এগিয়ে যান। এই কাঠামোতে, প্রতিটি অ্যাক্তরের জন্য এককভাবে "দ্রুত এগোনো" যুক্তিসঙ্গত মনে হতে পারে — এমনকি যদি সবাই মিলে "সবাই সতর্কভাবে এগোনো" পছন্দ করতেন। এটিই ধ্রুপদী যৌথ-কর্ম সমস্যাCollective-Action Problemএমন একটি পরিস্থিতি যেখানে প্রতিটি অ্যাক্টরের জন্য এককভাবে যুক্তিসঙ্গত পছন্দ, সবাই মিলে করলে, সবার জন্য একটি খারাপ যৌথ ফলাফল তৈরি করে। বা "রেস-টু-দ্য-বটম" কাঠামো — যা পরিবেশ দূষণ নিয়ন্ত্রণ বা অস্ত্র প্রতিযোগিতার মতো অন্যান্য ক্ষেত্রেও দেখা যায়।

২ · সমন্বয় কি সম্ভব? — দুটি বাস্তবসম্মত দৃষ্টিভঙ্গি

এই প্রশ্নে আন্তরিক, তথ্যভিত্তিক বিশেষজ্ঞদের মধ্যেও মতপার্থক্য আছে। নিচে উভয় পক্ষের যুক্তিসম্মত ফর্ম উপস্থাপন করা হলো — কোনোটিকেই "সঠিক উত্তর" ঘোষণা না করে।

আশাবাদী দৃষ্টিভঙ্গি
ঐতিহাসিকভাবে মানবজাতি বিপজ্জনক প্রযুক্তি নিয়ন্ত্রণে আন্তর্জাতিক সমন্বয়ে সফল হয়েছে — পারমাণবিক অস্ত্র বিস্তার-নিরোধ চুক্তি ও জৈবিক অস্ত্র কনভেনশনের মতো নজির আছে যেখানে প্রতিদ্বন্দ্বী রাষ্ট্রগুলো পারস্পরিক স্বার্থে সীমাবদ্ধতা মেনে নিয়েছে। যথেষ্ট রাজনৈতিক ইচ্ছা ও স্পষ্ট বিপদ-সচেতনতা থাকলে AI-তেও অনুরূপ কাঠামো গড়ে উঠতে পারে।
সংশয়ী দৃষ্টিভঙ্গি
AI উন্নয়ন পারমাণবিক/জৈবিক অস্ত্রের তুলনায় গুণগতভাবে ভিন্ন চ্যালেঞ্জ তৈরি করে — এটি অনেক বেশি বিকেন্দ্রীভূত (রাষ্ট্রের বদলে বেসরকারি কোম্পানি, গবেষণাগার, এমনকি ব্যক্তিও জড়িত), প্রয়োজনীয় সম্পদ (ডেটা, কম্পিউট, দক্ষতা) তুলনামূলক সহজলভ্য হয়ে উঠছে, আর একটি AI সিস্টেমের প্রকৃত সক্ষমতা যাচাই/পরিদর্শন করা একটি ভৌত অস্ত্রভাণ্ডার গণনার চেয়ে কার্যকরভাবে অনেক কঠিন।

এই দুই দৃষ্টিভঙ্গির কোনোটিই অযৌক্তিক নয় — বরং তারা ভিন্ন ঐতিহাসিক নজির ও ভিন্ন প্রযুক্তিগত বাস্তবতার উপর ভিত্তি করে গঠিত। AI Foundations ও Generative AI কোর্সের সেফটি পাঠগুলো এই গভর্নেন্স প্রশ্নটি সংক্ষেপে ছুঁয়ে যায়; M12 (L51-L54) এই কোর্সে নির্দিষ্ট রেগুলেটরি কাঠামো (GDPR, EU AI Act) নিয়ে অনেক গভীরে যাবে।

৩ · সমস্যার গঠনটি একটি গেমে দেখা

এই যৌথ-কর্ম সমস্যার অন্তর্নিহিত প্রণোদনা-গঠনকে একটি সরল, সিন্থেটিক দুই-খেলোয়াড় গেম দিয়ে সত্যিকারে গণনা করে দেখা যায়। ধরা যাক দুটি প্রতিদ্বন্দ্বী অ্যাক্টর (A ও B — যেমন দুটি ল্যাব বা দুটি দেশ) প্রত্যেকে বেছে নেয় "সতর্ক" (বাড়তি সেফটি টেস্টিং, ধীর গতি) অথবা "দ্রুত" (কম সেফটি টেস্টিং, প্রতিযোগিতামূলক গতি)। নিচের কোড সেলে একটি ইলাস্ট্রেটিভ পেঅফ ম্যাট্রিক্স দেওয়া আছে, এবং কোডটি সত্যিকারে পরীক্ষা করে দেখে কোন কোন কম্বিনেশন একটি ন্যাশ ইকুইলিব্রিয়াম (এমন একটি অবস্থা যেখানে কোনো পক্ষেরই একা চাল পাল্টে লাভ নেই)।

Python
# ইলাস্ট্রেটিভ, সিন্থেটিক "নিরাপত্তা বনাম গতি" গেম -- বাস্তব কোনো নির্দিষ্ট কোম্পানি/দেশ নয়
# দুটি অ্যাক্টর (যেমন দুটি প্রতিদ্বন্দ্বী AI ল্যাব বা দুটি দেশ) প্রতিটি বেছে নেয়: "সতর্ক" বা "দ্রুত" গতি

strategies = ["সতর্ক", "দ্রুত"]

# payoff[(A এর চাল, B এর চাল)] = (A এর পেঅফ, B এর পেঅফ) -- ইলাস্ট্রেটিভ ইউটিলিটি ইউনিট
payoff = {
    ("সতর্ক", "সতর্ক"): (6, 6),
    ("সতর্ক", "দ্রুত"): (2, 8),
    ("দ্রুত", "সতর্ক"): (8, 2),
    ("দ্রুত", "দ্রুত"): (4, 4),
}

def is_nash_equilibrium(a_move, b_move):
    a_payoff, b_payoff = payoff[(a_move, b_move)]
    a_alt = [m for m in strategies if m != a_move][0]
    a_alt_payoff = payoff[(a_alt, b_move)][0]
    b_alt = [m for m in strategies if m != b_move][0]
    b_alt_payoff = payoff[(a_move, b_alt)][1]
    return a_payoff >= a_alt_payoff and b_payoff >= b_alt_payoff

print(f"{'চাল A':<10}{'চাল B':<10}{'পেঅফ (A, B)':<16}ন্যাশ ইকুইলিব্রিয়াম?")
for a_move in strategies:
    for b_move in strategies:
        p = payoff[(a_move, b_move)]
        eq = is_nash_equilibrium(a_move, b_move)
        print(f"{a_move:<10}{b_move:<10}{str(p):<16}{'হ্যাঁ' if eq else 'না'}")

    
এই সিন্থেটিক পেঅফ ম্যাট্রিক্সে (সতর্ক, সতর্ক) সবচেয়ে বেশি যৌথ পেঅফ দেয় (৬+৬=১২), তবু কোডটি দেখায় এটি ন্যাশ ইকুইলিব্রিয়াম নয় — কারণ প্রতিটি পক্ষ এককভাবে "দ্রুত"-এ সরে গিয়ে নিজের পেঅফ ৬ থেকে ৮-এ বাড়াতে পারে (অন্য পক্ষ সতর্ক থাকলে)। একমাত্র (দ্রুত, দ্রুত) কম্বিনেশনটিই ন্যাশ ইকুইলিব্রিয়াম — প্রতিটি পক্ষ সেখান থেকে একা সরে গেলে নিজের পেঅফ ৪ থেকে ২-এ কমে যাবে। এটিই সংক্ষেপে যৌথ-কর্ম সমস্যার গাণিতিক সারমর্ম — পারস্পরিকভাবে সেরা ফলাফল (৬,৬) থেকে ফলাফল এমন একটি স্থিতিশীল অবস্থায় (৪,৪) নেমে আসে যা কেউই এককভাবে পছন্দ করে না, তবু কেউ একা সরে যেতে পারেন না।
এই গেমটি একটি ইচ্ছাকৃতভাবে সরলীকৃত, দুই-খেলোয়াড় মডেল — বাস্তব AI গভর্নেন্স পরিস্থিতিতে আরও অনেক অ্যাক্টর, অসম্পূর্ণ তথ্য, বারবার-খেলা (repeated game) গতিশীলতা, এবং সম্ভাব্য চুক্তি/যাচাইকরণ ব্যবস্থা জড়িত থাকে — যা এই সরল ফলাফলকে বাস্তবে পরিবর্তন করতে পারে (এটিই আশাবাদী দৃষ্টিভঙ্গির একটি ভিত্তি)। এই কোড শুধু অন্তর্নিহিত প্রণোদনা-সমস্যাটির গঠন কংক্রিট করে দেখায়, বাস্তব ফলাফলের পূর্বাভাস দেয় না।
মূল কথা · Key takeaway

AI গভর্নেন্স সমন্বয় করা কঠিন কারণ এটি একটি প্রকৃত যৌথ-কর্ম সমস্যা — এককভাবে সতর্ক থাকা প্রতিযোগিতামূলক অসুবিধা তৈরি করতে পারে। ঐতিহাসিক নজির (পারমাণবিক/জৈবিক অস্ত্র চুক্তি) দেখায় সমন্বয় অসম্ভব নয়, তবে AI-এর বিকেন্দ্রীভূত প্রকৃতি ও যাচাইকরণের অসুবিধা একটি বাস্তব, গুরুত্বপূর্ণ পার্থক্য তৈরি করে — দুটি দৃষ্টিভঙ্গিই বিবেচনায় নেওয়া দরকার, একটিকে উড়িয়ে না দিয়ে।

ভাবনার প্রশ্ন

প্রতিটি প্রশ্ন নিজে কিছুক্ষণ ভাবুন — তারপর "→ উত্তর" চাপুন।

প্র ০১ কেন "সবাই একমত যে সতর্ক থাকা উচিত" — এই সহমত থাকা সত্ত্বেও সমন্বয় ব্যর্থ হতে পারে?

কারণ সমস্যাটি নীতিগত একমত্যের অভাব নয় — বরং প্রণোদনার গঠন। প্রতিটি পক্ষ জানে অন্য পক্ষ কী করবে তার উপর নির্ভর করে তাদের নিজের সেরা চাল বদলে যায়। যদি কোনো নির্ভরযোগ্য যাচাইকরণ/প্রয়োগ ব্যবস্থা না থাকে, তাহলে প্রতিটি পক্ষের এই ভয় থাকে যে অন্য পক্ষ প্রতিশ্রুতি ভঙ্গ করে এগিয়ে যাবে — আর এই অবিশ্বাসই সবাইকে "দ্রুত" চালের দিকে ঠেলে দেয়, এমনকি সবাই আন্তরিকভাবে সতর্ক থাকতে চাইলেও।

প্র ০২ পারমাণবিক অস্ত্র চুক্তির নজিরকে AI গভর্নেন্সে প্রয়োগ করার ক্ষেত্রে সংশয়ী দৃষ্টিভঙ্গির মূল যুক্তিটি কী?

মূল যুক্তিটি যাচাইযোগ্যতা ও বিকেন্দ্রীকরণ নিয়ে — একটি পারমাণবিক অস্ত্রভাণ্ডার ভৌতভাবে বড়, ব্যয়বহুল অবকাঠামো দাবি করে যা স্যাটেলাইট/পরিদর্শনের মাধ্যমে তুলনামূলক সহজে সনাক্ত করা যায়, আর মুষ্টিমেয় রাষ্ট্রের হাতে সীমাবদ্ধ। AI উন্নয়নে প্রয়োজনীয় সম্পদ তুলনামূলক সহজলভ্য হয়ে উঠছে ও অনেক বেশি অ্যাক্টর (রাষ্ট্র ছাড়াও কোম্পানি, গবেষণাগার) জড়িত — যা একটি কেন্দ্রীভূত যাচাইকরণ ব্যবস্থা তৈরি করা কার্যকরভাবে অনেক কঠিন করে তোলে।

প্র ০৩ উপরের কোড সেলে যদি (দ্রুত, দ্রুত)-এর পেঅফ (৪, ৪) থেকে বদলে (১, ১) করা হয় (অর্থাৎ পারস্পরিক রেসিংয়ের প্রকৃত মূল্য আরও বেশি ধরা হয়), তাহলে কি (দ্রুত, দ্রুত) এখনও ন্যাশ ইকুইলিব্রিয়াম থাকবে?

হ্যাঁ, তবুও থাকবে। ন্যাশ ইকুইলিব্রিয়াম যাচাই করা হয় প্রতিটি পক্ষ একা সরে গেলে কী হয় তা দিয়ে, দুটি পেঅফের আপেক্ষিক মান দিয়ে নয়। (দ্রুত, দ্রুত)-এ থেকে A একা "সতর্ক"-এ সরে গেলে তার পেঅফ ১ থেকে ২-এ (B এখনও দ্রুত থাকলে) নেমে যাবে — অর্থাৎ একা সরে যাওয়া তখনও অলাভজনক। শুধু (দ্রুত, দ্রুত)-এর পেঅফ কমানো দুই পক্ষকেই আরও খারাপ অবস্থায় ফেলে, কিন্তু কাঠামোগতভাবে "সবাই একা সরে যেতে অনিচ্ছুক" এই সমস্যাটি একইরকম থেকে যায় — এটিই দেখায় কেন শুধু ক্ষতির মাত্রা বাড়িয়ে বলাই যথেষ্ট নয়, কাঠামোগত সমাধান (যাচাইকরণ, প্রয়োগযোগ্য চুক্তি) দরকার।

অনুশীলন

  1. চিন্তা করুন: এমন কোনো ব্যবস্থা কল্পনা করুন যা এই "সতর্ক বনাম দ্রুত" গেমের কাঠামো বদলে দিয়ে (সতর্ক, সতর্ক)-কে একটি স্থিতিশীল ফলাফলে পরিণত করতে পারে। এটি বাস্তবে কী ধরনের নীতি হতে পারে?

    উদাহরণ হতে পারে — একটি স্বাধীন, বিশ্বাসযোগ্য যাচাইকরণ ব্যবস্থা (যাতে "দ্রুত" চাল সহজে ধরা পড়ে ও তার প্রকৃত মূল্য বাড়ে, কার্যত পেঅফ ম্যাট্রিক্সটাই বদলে দিয়ে), অথবা "দ্রুত" চালের জন্য একটি প্রয়োগযোগ্য শাস্তি/জরিমানা ব্যবস্থা (আন্তর্জাতিক চুক্তি বা নিয়ন্ত্রক সংস্থার মাধ্যমে), যা কার্যকরভাবে "দ্রুত" চালের পেঅফ কমিয়ে দেয় যতক্ষণ না (সতর্ক, সতর্ক) প্রতিটি পক্ষের জন্য এককভাবেও সেরা চাল হয়ে ওঠে। এটিই ঠিক পারমাণবিক অস্ত্র চুক্তির যাচাইকরণ/প্রয়োগ ব্যবস্থার যুক্তি।

  2. পরীক্ষা করুন: উপরের কোড সেলে ("সতর্ক", "সতর্ক")-এর পেঅফ (6, 6) থেকে (9, 9)-এ বাড়িয়ে Run চেপে দেখুন — এতে কি কোনো নতুন ন্যাশ ইকুইলিব্রিয়াম তৈরি হয়?

    হ্যাঁ — কোড চালালে দেখা যাবে (সতর্ক, সতর্ক) এখন একটি নতুন ন্যাশ ইকুইলিব্রিয়াম হিসেবে যুক্ত হয়, আর (দ্রুত, দ্রুত)ও ইকুইলিব্রিয়াম থেকেই যায় — অর্থাৎ এখন একসাথে দুটি ইকুইলিব্রিয়াম থাকবে। কারণ (সতর্ক, সতর্ক)-এ থাকা অবস্থায় A একা "দ্রুত"-এ সরে গেলে তার পেঅফ ৯ থেকে কমে ৮-এ নামবে (payoff[("দ্রুত", "সতর্ক")][0] = 8 < 9), তাই একা সরে যাওয়া আর লাভজনক থাকে না। এটি দেখায় (সতর্ক, সতর্ক)-এর প্রকৃত মূল্য যথেষ্ট বাড়ালে সমস্যাটি একটি ধ্রুপদী "রেস-টু-দ্য-বটম" থেকে বদলে একটি কোঅর্ডিনেশন গেমে রূপ নিতে পারে — যেখানে কোন ইকুইলিব্রিয়ামে সবাই পৌঁছাবে তা নির্ভর করে বিশ্বাস ও প্রত্যাশার উপর, শুধু প্রণোদনার উপর নয়।

আরও পড়ুন · ABCL TECH-এ আপনার পরবর্তী পদক্ষেপ

আগের পাঠ
ক্যাপাবিলিটি স্কেলিং ও ইমার্জেন্ট আচরণ