অটোরিসার্চ রিসার্চ পাইপলাইন: প্রথমে অন্তর্দৃষ্টি, তারপর যাচাই — এবং কোনো হ্যালুসিনেশন নেই

30 আগস্ট 2026১৩ প্রদর্শন

নতুন পদ্ধতিটি হাইপোথিসিস তৈরি এবং পরীক্ষামূলক যাচাইকে একত্রিত করে: সিস্টেমটি অন্তর্দৃষ্টি সংগ্রহ করে, এবং এজেন্টরা সেগুলোকে বাস্তব পরীক্ষা এবং স্বাধীন নিরীক্ষার মাধ্যমে চালায়। RSICD বেঞ্চমার্কে এটি Recall-কে ৩২.৮৪ থেকে ৩৪.৬৯-এ উন্নীত করেছে এবং সন্দেহজনক ফলাফলের সংখ্যা ১১–২৭ থেকে পাঁচে কমিয়ে এনেছে।

অটোরিসার্চ রিসার্চ পাইপলাইন: প্রথমে অন্তর্দৃষ্টি, তারপর যাচাই — এবং কোনো হ্যালুসিনেশন নেই

স্বায়ত্তশাসিত গবেষণা: গতি, কিন্তু নিশ্চয়তা ছাড়া

আধুনিক AI সিস্টেমগুলি স্বায়ত্তশাসিতভাবে দীর্ঘ গবেষণা চক্র পরিচালনা করতে সক্ষম: অনুমান তৈরি করা, পরীক্ষা চালানো, ফলাফল বিশ্লেষণ করা। কিন্তু অনুশীলন যেমন দেখায়, অটোমেশন নিজেই ফলাফলকে বৈজ্ঞানিক করে না। অন্তর্নির্মিত যাচাইকরণ প্রক্রিয়া ছাড়া একটি আর্কিটেকচার সহজেই বিশ্বাসযোগ্য কিন্তু ভিত্তিহীন সিদ্ধান্ত তৈরি করে — যাকে বলা হয় "হ্যালুসিনেশন"।

এই সমস্যাটিই সমাধান করে AutoResearch — একটি দ্বি-পর্যায়ের পাইপলাইন যা ধারণার জন্ম এবং তার যাচাইকরণকে আলাদা করে। এই উন্নয়নটি "AutoResearch: Insight In, Hallucination Out" (arXiv:2608.17906, v2, ২৩ আগস্ট ২০২৬, DOI: 10.48550/arXiv.2608.17906; লেখক — Yiming Ren, Xiang Liu, Qumeng Sun, Xiao Zhang, Jiahao Li, Haoyang Zhang, Junjie Wang) নিবন্ধে বর্ণিত হয়েছে।

ধারণা তৈরি: প্রথমে অন্তর্দৃষ্টি

প্রথম পর্যায়ে, সিস্টেমটি ক্রমাগত নতুন গবেষণা সংকেত সংগ্রহ করে এবং সেগুলিকে ইতিমধ্যে সঞ্চিত জ্ঞানের সাথে মিলিয়ে দেখে। সরাসরি পরীক্ষা শুরু করার পরিবর্তে, AutoResearch স্থানান্তরযোগ্য যান্ত্রিক অন্তর্দৃষ্টি খোঁজে — এমন নিদর্শন যা অন্য একটি কাজে প্রয়োগ করা যেতে পারে। তৈরি প্রক্রিয়ায় একাধিক মডেল অংশ নেয়, এবং তারপর ক্রস-রিভিউ চালু হয়: প্রস্তাবিত ধারণাগুলি পারস্পরিক যাচাইয়ের মধ্য দিয়ে যায়। এই ফিল্টারটি দুর্বল অনুমানগুলিকে সেগুলি কার্যকর হওয়ার আগেই বাদ দেয়। প্রথম পর্যায়ের ফলাফল — একটি যুক্তিসঙ্গত এবং যাচাইযোগ্য গবেষণা পরিকল্পনা, নিছক সাহসী অনুমানের একটি সেট নয়।

ধারণা বাস্তবায়ন: সিদ্ধান্তের আগে যাচাই

দ্বিতীয় পর্যায় — পরিকল্পনাকে বাস্তব পরীক্ষায় রূপান্তর করা। এখানে সমন্বিত এজেন্টরা কাজ করে: তারা কাজগুলিকে পৃথক ধাপে ভাগ করে, পরীক্ষা চালায়, ত্রুটি নির্ণয় করে এবং প্রয়োজনে পদ্ধতি সংশোধন করে। মূল বিষয় — ফলাফল নির্ভরযোগ্য বলে স্বীকৃত হওয়ার আগে একটি স্বাধীন প্রমাণ-ভিত্তিক পর্যালোচনা। এই প্রক্রিয়া সিস্টেমটিকে প্রকৃত আবিষ্কারকে পরিমাপের আর্টিফ্যাক্ট থেকে আলাদা করতে এবং দিকটি চালিয়ে যাওয়া, পুনর্বিবেচনা করা বা সম্পূর্ণ বন্ধ করার সিদ্ধান্ত নিতে সক্ষম করে।

বেঞ্চমার্ক যা দেখিয়েছে

বিকাশকারীরা AutoResearch পরীক্ষা করেছেন বিভিন্ন শ্রেণির কাজে — ক্রস-সার্চ, সিস্টেম অপ্টিমাইজেশন এবং মেশিন লার্নিং। সর্বত্র সিস্টেমটি পরিমাপযোগ্য অগ্রগতি দেখিয়েছে, তবে বিশেষভাবে উল্লেখযোগ্য হল RSICD বেঞ্চমার্ক।

AutoResearch দ্বারা তৈরি ধারণাটি গড় Recall 32.84 থেকে 34.69-এ বৃদ্ধি করেছে। একই সময়ে, অডিট সিস্টেমের কাজে মাত্র পাঁচটি সমস্যাযুক্ত ঘটনা চিহ্নিত করেছে, যেখানে অন্যান্য স্বায়ত্তশাসিত গবেষণা সিস্টেমে সেগুলি ১১ থেকে ২৭টি ছিল। এটি মূল ঘোষিত নীতিকে নিশ্চিত করে: "অন্তর্দৃষ্টি পরীক্ষার আগে যুক্তিযুক্ত হয়, সিদ্ধান্ত — গ্রহণের আগে"।

কেন এটি গুরুত্বপূর্ণ

AutoResearch দেখায় যে স্বায়ত্তশাসনকে বৈজ্ঞানিক কঠোরতার সাথে একত্রিত করা যায়। তৈরি এবং যাচাইয়ের পর্যায়গুলিকে আলাদা করা — একটি সহজ কিন্তু কার্যকর প্যাটার্ন: প্রথমে ধারণাটিকে ক্রস-রিভিউয়ের অধীনে পরিপক্ব হতে দিন, তারপর স্বাধীন মান নিয়ন্ত্রণের সাথে পরীক্ষা চালান। এই পদ্ধতি শুধু ত্রুটির সংখ্যা কমায় না, বরং গবেষণা প্রক্রিয়াটিকেই আরও স্বচ্ছ করে তোলে। যদি এই ধরনের পাইপলাইন ব্যাপকভাবে প্রচলিত হয়, AI গবেষণার ফলাফলের উপর আস্থা উল্লেখযোগ্যভাবে বৃদ্ধি পাবে।

সাধারণ প্রশ্নোত্তর

বিভিন্ন উপাদান

সব উপাদান
অটোরিসার্চ রিসার্চ পাইপলাইন: প্রথমে অন্তর্দৃষ্টি, তারপর যাচাই — এবং কোনো হ্যালুসিনেশন নেই