গুগল ডিপমাইন্ড এবং ফেনরিস ক্রিয়েশন্সের দল একটি অস্বাভাবিক পরীক্ষার জন্য একত্রিত হয়েছে — তাদের এজেন্টরা EVE Online-এর একটি স্বায়ত্তশাসিত কপিতে বসবাস করবে, যা প্রকৃত খেলোয়াড়দের থেকে বিচ্ছিন্ন। সাধারণ গেমিং টেস্ট সাধারণত "AI কি জিততে পারে?" প্রশ্নের উত্তর দেয়, কিন্তু এখানে কাজটি অনেক জটিল: কৃত্রিম বুদ্ধিমত্তা কি এমন একটি জগতে শিখতে, মনে রাখতে এবং পরিকল্পনা করতে সক্ষম, যা ভুলের পরে নতুন করে শুরু হয় না?
কেন EVE Online Atari বা StarCraft নয়
অতীতে, ডিপমাইন্ড ইতিমধ্যে গো, Atari এবং StarCraft II-তে সাফল্য পেয়েছে। কিন্তু এই সব শাখার একটি সাধারণ বৈশিষ্ট্য রয়েছে: লক্ষ্যটি যথেষ্ট স্পষ্ট এবং ম্যাচটি সীমিত। খেলা শেষ হলে, আপনি রিস্টার্ট করতে পারেন এবং আগের কাজগুলো ভুলে যেতে পারেন। EVE Online-এ এই বিলাসিতা থাকবে না।
মাল্টিপ্লেয়ার স্পেস গেমটি ২০০৩ সালে প্রকাশিত হয়েছিল এবং তারপর থেকে এটি নিজস্ব একটি জীবন্ত অর্থনীতি তৈরি করেছে, যা খেলোয়াড়রা নিজেরাই পরিচালনা করে। বাণিজ্য রুট চাহিদার প্রভাবে পরিবর্তিত হয়, দাম স্থির থাকে না, সম্পদ সীমিত। খেলোয়াড়রা এখানে শুধু লড়াই করে না — তারা জোট গঠন করে, প্রতিযোগিতা করে এবং কখনও কখনও একে অপরকে প্রতারণা করে। প্রতিটি সিদ্ধান্ত পরিস্থিতিকে প্রভাবিত করে এবং তা বাতিল করা অসম্ভব: বিশ্বের কোনো "রিস্টার্ট বোতাম" নেই। এটিই EVE Online-কে AI-এর জন্য একটি অনন্য চ্যালেঞ্জ করে তোলে।

গবেষকদের জন্য, এই ধরনের একটি পরীক্ষার ক্ষেত্র মানে একটি নির্দিষ্ট খেলায় সেরা পদক্ষেপ খোঁজা থেকে একটি জটিল সিস্টেমের ভিতরে ক্রমাগত অস্তিত্বের দিকে রূপান্তর। একবার একটি সফল কৌশল খুঁজে পাওয়াই যথেষ্ট নয় — বিশ্ব যখন চারপাশে পরিবর্তিত হয় এবং এমনকি নিজের সিদ্ধান্তের প্রভাবেও, তখন কার্যকরভাবে কাজ চালিয়ে যেতে হবে।
AI-এজেন্টদের জন্য কী কী দক্ষতা প্রয়োজন হবে
ডিপমাইন্ড চারটি মূল সমস্যা চিহ্নিত করেছে যা সমাধান করতে হবে যাতে এজেন্টরা সত্যিই EVE Online-এ বসবাস করতে পারে।
ক্রমাগত শিক্ষা
সাধারণ মডেলগুলো প্রায়ই "বিপর্যয়কর বিস্মৃতি"-তে ভোগে: নতুন কিছু শেখার পরে, তারা পুরানো দক্ষতার কিছু অংশ হারিয়ে ফেলে। রিস্টার্ট ছাড়া একটি জগতে, এটি গুরুত্বপূর্ণ হয়ে ওঠে। যদি একজন এজেন্ট, যে বাণিজ্য আয়ত্ত করেছে, জাহাজ চালানো ভুলে যায়, তাহলে আর ফিরে যাওয়ার পথ নেই — তাকে একই সাথে অর্জিত সমস্ত দক্ষতা ধরে রাখতে হবে।
দীর্ঘমেয়াদী স্মৃতি
আধুনিক কনটেক্সট উইন্ডো সীমিত, কিন্তু EVE-তে সাফল্যের জন্য সপ্তাহ ও মাস পুরনো ঘটনা মনে রাখতে হয়। দামের পরিবর্তন, পুরনো দ্বন্দ্ব, মিত্রদের প্রতিশ্রুতি — এই সমস্ত তথ্য বর্তমান আচরণকে প্রভাবিত করে এবং এজেন্টের নজর থেকে বাদ পড়া উচিত নয়।
সপ্তাহ ও মাস ধরে পরিকল্পনা
EVE-তে, একটি লাভজনক কৌশল প্রায় কখনই দ্রুত হয় না। আজ সম্পদ কিনে এক মাস পরে বিক্রি করা; এমন একটি অবস্থান নেওয়া যা কয়েক সপ্তাহ পরেই জোটের জন্য লাভ আনবে — সিস্টেম দীর্ঘমেয়াদী পরিকল্পনাকে উৎসাহিত করে। AI-কে দীর্ঘ দিগন্তে তার কর্মের পরিণতি গণনা করতে হবে।
এজেন্টদের মধ্যে মিথস্ক্রিয়া
সিমুলেশনে একাধিক AI একসাথে কাজ করবে। তাদের সহযোগিতা করতে হবে, প্রতিযোগিতা করতে হবে এবং সম্ভবত একে অপরকে বিভ্রান্ত করতে হবে — যেমনটি প্রকৃত খেলোয়াড়রা করে। তাদের কারোরই ঘটনার সম্পূর্ণ চিত্র থাকবে না, এবং অনেক সিদ্ধান্তের ফলাফল শুধুমাত্র সময়ের সাথে প্রকাশ পাবে।
নিরাপদ পরীক্ষা: প্রথমে স্যান্ডবক্স, তারপর ওপেন ওয়ার্ল্ড
আপাতত প্রকল্পটি সম্পূর্ণ গবেষণামূলক। ডিপমাইন্ড কোনো চূড়ান্ত মেট্রিক্স বা সম্পন্ন মিশনের উদাহরণ প্রকাশ করে না — পরীক্ষাটি প্রাথমিক পর্যায়ে রয়েছে। প্রথম পর্যায়ে, এজেন্টরা সিমুলেশন এবং ঐতিহাসিক ডেটা ব্যবহার করে একটি লোকাল সার্ভারের সাথে বিচ্ছিন্ন পরিবেশে কাজ করে। এই পদ্ধতিটি জীবন্ত বিশ্বের অর্থনীতিকে ঝুঁকির মধ্যে না ফেলে অনুমান পরীক্ষা করার সুযোগ দেয়।

পরবর্তী পরীক্ষার ক্ষেত্র হওয়া উচিত EVE Frontier — মহাবিশ্বের একটি অংশ যেখানে আরও উন্মুক্ত নিয়ম রয়েছে, যেখানে খেলোয়াড়রা বিশ্বের মেকানিক্সকেই প্রভাবিত করতে পারে। দূর ভবিষ্যতে, কোম্পানি EVE Online এবং EVE Vanguard-এ মানুষের পাশাপাশি "পরিণত" এজেন্টদের উপস্থিতি অস্বীকার করে না। ফেনরিস ক্রিয়েশন্স মনে করে যে এই ধরনের সিস্টেম প্রোডাকশনে যাওয়ার আগে পরিবর্তন পরীক্ষা করতে, ভার্চুয়াল অর্থনীতিতে নতুনত্বের প্রভাব মডেল করতে এবং নতুনদের অভ্যস্ত হতে সাহায্য করতে সক্ষম।
তবে, এজেন্টদের মানুষের পরিবর্তে বা নিয়মের বাইরে খেলতে ব্যবহার করা হবে না — এই প্রতিশ্রুতিগুলির প্রতি সম্প্রদায় সতর্ক: এটি আপাতত কেবল ডেভেলপারদের ঘোষণা, নিশ্চিত প্রযুক্তিগত গ্যারান্টি নয়।
খেলোয়াড়রা কী ভাবেন এবং কেন এটি EVE-এর বাইরেও গুরুত্বপূর্ণ
কমিউনিটির প্রতিক্রিয়া মিশ্র ছিল। কেউ কেউ EVE Online-কে এই ধরনের পরীক্ষার জন্য আদর্শ পরিবেশ বলে অভিহিত করেন এবং আনন্দ করেন যে পরীক্ষাগুলো লাইভ সার্ভারের বাইরে নেওয়া হয়েছে: এতে অর্থনীতি অপরিণত মডেলের দ্বারা ক্ষতিগ্রস্ত হবে না। অন্যরা মনে করেন যে স্টুডিওর প্রথমে গেমের দীর্ঘদিনের প্রযুক্তিগত এবং অর্থনৈতিক সমস্যাগুলো সমাধান করা উচিত ছিল, তারপর নিউরাল নেটওয়ার্ক যুক্ত করা। মূল কার্যক্রমের অটোমেশন নিয়ে উদ্বেগও প্রকাশ করা হচ্ছে, যা ইতিমধ্যেই ভঙ্গুর ভারসাম্য নষ্ট করতে সক্ষম।
তবুও, পরীক্ষাটির মূল্য গেমের বাইরেও অনেক বেশি। যদি AI দীর্ঘমেয়াদী স্মৃতি, মাস ধরে পরিকল্পনা করার ক্ষমতা এবং এমন একটি পরিবেশের সাথে খাপ খাইয়ে নেওয়ার দক্ষতা প্রদর্শন করতে পারে যা রিস্টার্ট ছাড়াই পরিবর্তিত হয়, তাহলে এই অর্জনগুলো অর্থনৈতিক মডেলিং, সম্পদ ব্যবস্থাপনা এবং অন্যান্য সিস্টেমে প্রয়োগ করা যেতে পারে যেখানে সিদ্ধান্তের পরিণতি সহজে ফিরিয়ে আনা যায় না। এই ধরনের পরীক্ষার জন্য EVE Online অন্য যেকোনো প্ল্যাটফর্মের চেয়ে প্রায় বেশি উপযুক্ত: এখানে কোনো ছোট রাউন্ড নেই, বরং AI-এর শক্তি পরীক্ষা করার জন্য সমস্ত শর্ত রয়েছে।



