সিগন্যাল, যা ডিল পর্যন্ত পৌঁছায়
বড় ভাষা মডেল-ভিত্তিক মাল্টি-এজেন্ট ট্রেডিং সিস্টেম আর ল্যাবরেটরির খেলনা নয়। যে স্কিমে একজন এজেন্ট নিউজ ফিড পড়ে, দ্বিতীয়জন হাইপোথিসিস যাচাই করে, তৃতীয়জন অর্ডার দেয়, আর চতুর্থজন তাকে থামিয়ে দেয় — তা এখন প্রায়ই স্যান্ডবক্সে নয়, বরং এমন কনট্যুরে দেখা যায় যেখানে আসল সম্পদ ঝুঁকিতে থাকে। আর স্তরগুলোর মধ্যে বার্তা আদান-প্রদান যত নিখুঁতভাবে সাজানো হয়, ঝুঁকিও তত বাড়ে: যে চ্যানেল সিস্টেমকে দ্রুত ও সুসংগত করে, সেটিই একইসঙ্গে বাইরের প্রভাব পৌঁছে দেওয়ার পথ হয়ে ওঠে।
ঠিক এ বিষয়েই সাম্প্রতিক arXiv প্রিপ্রিন্ট:2608.24069 — «Poisoning Agentic Alpha: Adversarial Vulnerabilities Across Roles and Architectures in Multi-Agent Trading Systems»। কাজটি প্রকাশিত হয়েছে ২৫ আগস্ট ২০২৬-এ (v1, প্রায় ৩.৫ MB), আর এর কেন্দ্রীয় থিসিসটি অপ্রত্যাশিতভাবে কঠোর শোনায়: «আউট অফ দ্য বক্স» টেকসই আর্কিটেকচার বলে কিছু নেই। একটিও না।

লেখকেরা ঠিক কী যাচাই করেছেন
নিবন্ধটি নিয়ে কাজ করেছেন দশজন গবেষকের একটি দল: প্রথম লেখক CheolWon Na, তাঁর সঙ্গে Hao Ni, Lukasz Szpruch, Zhangyang Wang, Dhagash Mehta, Saurabh Nagrecha, Alejandro Lopez-Lira, Chanyeol Choi, Yongjae Lee এবং Jee-Hyong Lee। বিষয়টি চারটি ক্ষেত্রের সংযোগস্থলে — কৃত্রিম বুদ্ধিমত্তা, কম্পিউটেশনাল ফাইন্যান্সিয়াল ইঞ্জিনিয়ারিং, ক্রিপ্টোগ্রাফি ও নিরাপত্তা, এবং মাল্টি-এজেন্ট সিস্টেম। এই ধরনের বিষয়-সমাহার নিজেই ইঙ্গিত দেয়: আলোচনাটি মডেলের নিছক দক্ষতা নিয়ে নয়, বরং দক্ষতা যখন প্রতিপক্ষের মুখোমুখি হয় তখন কী ঘটে তা নিয়ে।
দাবিকৃত নতুনত্বটি পদ্ধতিগততার মধ্যে। লেখকেরা তাঁদের কাজটিকে আর্থিক ক্ষেত্রে প্রথম অভিজ্ঞতাভিত্তিক গবেষণা বলে অভিহিত করেছেন, যা ধাপে ধাপে অনুসরণ করে দেখায় কীভাবে একটি প্রতিদ্বন্দ্বিতামূলক সিগন্যাল মাল্টি-এজেন্ট ট্রেডিং সিস্টেমে প্রবেশ করে এবং চূড়ান্ত সিদ্ধান্তের পথে কতটা টিকে থাকতে পারে। «আক্রমণ কি কাজ করতে পারে» নয়, বরং «এটি কতদূর টিকে থাকে এবং কেন কোথাও থেমে যায়»।
চারটি ভূমিকা — আঘাতের জন্য চারটি ইন্টারফেস
প্রচলিত পাইপলাইনটি চারটি কার্যকরী ভূমিকায় বিভক্ত: বিশ্লেষক, গবেষক, ট্রেডার এবং রিস্ক ম্যানেজার। প্রত্যেকের জন্য তার নিজস্ব ইন্টারফেসের সঙ্গে মানানসই একটি আক্রমণ বেছে নেওয়া হয়েছে — অর্থাৎ যে ভূমিকা কাজে যা সত্যিই ব্যবহার করে তা। বিশ্লেষক কাঁচা ডেটা গিলে, গবেষক মধ্যবর্তী সিদ্ধান্ত, ট্রেডার প্রণীত ধারণা, আর রিস্ক ম্যানেজার ইতিমধ্যে প্রস্তুত লেনদেন। প্রতিটি প্রবেশবিন্দুর নিজস্ব বৈশিষ্ট্য আছে, আর এখানে কোনো সার্বজনীন «ওষুধ» লেখা হচ্ছে না।
কাঠামোগত অক্ষ: টপোলজি ও APS মেট্রিক
পরীক্ষার দ্বিতীয় অক্ষটি স্থাপত্য-সংক্রান্ত। চারটি যোগাযোগ টপোলজি তুলনা করা হয়েছে, আর সেগুলো দুই ধরনের আক্রমণে যাচাই করা হয়েছে: ডেটা স্তর ও এজেন্ট স্তর। স্থায়িত্বের পার্থক্য কথায় নয়, বরং ব্যাখ্যা করতে Adversarial Signal Preservation Score (APS) চালু করা হয়েছে — একটি পরিমাপ যা পরে দেখায় যে ক্ষতিকর প্রবণতা শৃঙ্খল ধরে এগোনোর সময় কতটা ভালোভাবে টিকে গেছে। সহজ কথায়, এটি বিষের «টিকে থাকার কাউন্টার»: এটি যত বেশি, সিস্টেমের জন্য তত খারাপ।
পরীক্ষামূলক ভিত্তি সংক্ষিপ্ত এবং স্পষ্টভাবে নিয়ন্ত্রিত হিসেবে পরিকল্পিত: পাঁচটি সম্পদ, দুটি ব্যাকবোন (বেস মডেল) এবং দুটি লক্ষ্য দিক। এমন নকশা স্থাপত্যের প্রভাবকে নির্দিষ্ট মডেলের প্রভাব থেকে আলাদা করতে দেয় — যা গুরুত্বপূর্ণ, যদি সিদ্ধান্তটি সাধারণতার দাবি করে।
গণতান্ত্রিক হুমকি: কেন এটি যতটা মনে হয় তার চেয়ে খারাপ
ট্রেডিং সিস্টেমে প্রতিদ্বন্দ্বিতামূলক আক্রমণ নিয়ে আগের কাজগুলো প্রায়ই ধরে নিত যে আক্রমণকারীর অভ্যন্তরীণ বিষয়ে বিশেষাধিকারপ্রাপ্ত প্রবেশাধিকার আছে: ওয়েট, লুকানো অবস্থা, অভ্যন্তরীণ চ্যানেল। এটি গবেষকের জন্য সুবিধাজনক অনুমান, কিন্তু বাস্তবতার খারাপ মডেল — এমন প্রতিপক্ষ বিরল।
এখানে সম্ভাবনার সীমা সেসব পর্যন্ত সংকুচিত যা এমনিতেই পৃষ্ঠে থাকে: সোর্স ডেটা এবং প্রম্পট, যা এজেন্টরা স্বাভাবিক মোডে গ্রহণ করে। সিস্টেমের «মস্তিষ্কে» কোনো প্রবেশাধিকার নেই। লেখকেরা এমন হুমকি মডেলকে নিম্ন-প্রান্তিক এবং «গণতান্ত্রিক» বলে অভিহিত করেছেন — যে কেউ মডেলকে প্রয়োজনীয় টেক্সট ধরিয়ে দিতে পারে সে-ই এটি পুনরুৎপাদন করতে পারে, তার অভ্যন্তরে ঢোকার দক্ষতা থাকা লাগে না। ভূমিকার সঙ্গে মিলিয়ে এটি ভূমিকা-নির্দিষ্ট প্রতিপক্ষের একটি সেট দেয়: প্রত্যেকের জন্য নিজস্ব মুখোশ ও নিজস্ব ফাঁক।
শৃঙ্খল কোথায় ছিঁড়ে যায়
সিদ্ধান্তগুলো একসঙ্গে করলে তিনটি স্তর ফুটে ওঠে, যেখানে সুরক্ষা সাধারণত দুর্বল হয়ে পড়ে।
ডেটা ও টেক্সট আক্রমণের পৃষ্ঠ হিসেবে। সিস্টেম আগত টেক্সটকে বিশ্বাস করে ঠিক এই কারণেই যে অন্যথায় এটি কাজ করত না। উপকারী সিগন্যাল নষ্ট না করে «ভুল» সংবাদ ফিল্টার করা — শোনার চেয়ে অনেক কঠিন কাজ।
ভূমিকা পরিবর্ধক হিসেবে। প্রতিটি ভূমিকার নিজস্ব বিশ্বাস-অঞ্চল আছে: বিশ্লেষক কাঁচামাল পুনরায় যাচাই করে না, ট্রেডার গবেষককে পুনরায় যাচাই করে না। সঠিক ইন্টারফেসে ঢুকে পড়া বিকৃতি এরপর প্রায় ঘর্ষণহীনভাবে এগিয়ে যায়।
স্থাপত্য নিয়তি হিসেবে। বিভিন্ন টপোলজি বিষাক্ত প্রবণতাকে ভিন্নভাবে «যেতে দেয়» বা «নিভিয়ে দেয়» — APS ঠিক এটিই মাপার জন্য। কিন্তু আরও সফল স্কিমগুলোও অনাক্রম্যতা দেয় না: তারা কেবল সম্ভাবনা কমায় যে সিগন্যাল বিপজ্জনক আকারে ডিল পর্যন্ত পৌঁছাবে।

এ থেকে অনুশীলনকারীদের জন্য যা বেরিয়ে আসে
কাজটি «এটা বসাও — নিরাপদ হয়ে যাবে» এমন কোনো রেসিপি দেয় না। এটি আরও উপকারী কিছু দেয়: একটি মানচিত্র, যা দেখায় ঠিক কোথায় নজর রাখতে হবে।
- ইনপুট ডেটাকে ডিফল্টভাবে অবিশ্বস্ত ধরে নেওয়া। যদি প্রম্পট ও ফিডই আক্রমণকারীর একমাত্র প্রয়োজন হয়, তবে ফিল্টারিং ও সোর্স যাচাই আর শুধু পরিচ্ছন্নতা থাকে না, বরং প্রতিরক্ষা কনট্যুরের মূল হয়ে ওঠে।
- ভূমিকাগুলোর মধ্যে বিশ্বাস-অঞ্চল আলাদা করা। এজন্য নয় যে একটি ভূমিকা অন্যটির চেয়ে «বোকা», বরং এজন্য যে এন্ড-টু-এন্ড বিশ্বাসই সেই পথ, যেটি দিয়ে বিষ চলে।
- প্রোডাকশনের আগে স্থাপত্য মূল্যায়ন করা। কেবল ব্যাকটেস্টে লাভজনকতা নয়, বরং প্রতিদ্বন্দ্বিতামূলক সিগন্যালের চাপে টপোলজি কেমন আচরণ করে তাও পরীক্ষা করা।
- APS-এর মতো টিকে থাকার মেট্রিক নিয়মিত অডিটে চালু করা। কেবল «কাজ করেছে কি না» নয়, বরং কোন ধাপে আক্রমণ শক্তি হারায় আর কোন ধাপে তা ধরে রাখে — তাও দেখা উপকারী।
মূল সিদ্ধান্ত: জন্মগত অনাক্রম্যতা নেই
লেখকদের বক্তব্য অত্যন্ত সরাসরি: বিবেচিত আর্কিটেকচারগুলোর একটিও প্রাথমিকভাবে টেকসই নয়। এটি মাল্টি-এজেন্ট সিস্টেমের বিরুদ্ধে রায় নয়, তাদের প্রবর্তনের বিরুদ্ধে যুক্তিও নয় — বরং এই আলোচনার প্রতি একটি বাস্তববাদী সংশোধনী যে ফ্রেমওয়ার্ক সঠিকভাবে বেছে নিলেই আর ভূমিকা সুন্দরভাবে ভাগ করলেই যথেষ্ট। যে যোগাযোগ এই সিস্টেমগুলোকে গতি ও সিদ্ধান্তের গুণমান দেয়, সেটিই একইসঙ্গে তাদের দুর্বলতা, আর এই দুটি বৈশিষ্ট্য প্রকৃতিগতভাবেই অবিভাজ্য।
প্রিপ্রিন্টের মূল্য এই যে, এটি আলোচনাটিকে «LLM ট্রেডাররা কি দুর্বল» এই সমতল থেকে «কোন নির্দিষ্ট ধাপে এবং কোন সংযোগ-স্কিমে সিগন্যাল ডিল পর্যন্ত টিকে থাকে» এই সমতলে নিয়ে আসে। গবেষণাটিকে পরবর্তী ধাপের ভিত্তি হিসেবে উপস্থাপন করা হয়েছে: এমন এজেন্টিক ট্রেডিং কনট্যুর ডিজাইন করা, যেখানে স্থায়িত্ব শুরু থেকেই অন্তর্ভুক্ত, প্রথম ঘটনার পর পাশ থেকে জোড়া লাগানো নয়।
সুরক্ষার বিষয়ে সুনির্দিষ্ট সুপারিশ লেখকেরা অ্যানোটেশনে দেননি — আর এটাই সৎ। আপাতত একটি তথ্য নথিভুক্ত: আক্রমণকারীর কাছে সস্তা প্রবেশপথ আছে, আর প্রতিরক্ষাকারীর কাছে বিনামূল্যের বেরোনোর পথ নেই। বাকিটা ভবিষ্যতের কাজ, যা এই প্রিপ্রিন্টই — পরিকল্পনা অনুযায়ী — শুরু করে দেওয়ার কথা।



