ঘোষণা এবং শিরোনাম সংখ্যা
১৪ই আগস্ট জিহিপু (জে. কারিগরী মুক্তির সাথে সাথে নতুন মডেলটিকে আন্তর্জাতিক উন্নয়নের সাথে তুলনা করা হয়। সেন্টারটি এর ফলাফল ছিল সাইবারজিম গণনা: ৮৪. ৫% বনাম ৩. ৮% আনথ্রোপিক মাইথোসের ৫ এবং ৮৩%। এই সুবিধাটা কঠিন মনে হয় আর খবরের শিরোনামগুলোতে এই ঘোষণা দেয়া হয়েছে। কিন্তু আপনি যদি আরো গভীরে প্রবেশ করেন, তাহলে দেখা যাবে যে এই জয় হচ্ছে একমাত্র স্থান যেখানে জিএম-৫. ডেভেলপার নিজেই স্বীকার করেছেন - যদিও কিছুটা ফাঁকা।
একটি গুরুত্বপূর্ণ ব্যাখ্যা: এটা সম্পূর্ণ নিরাপত্তা সম্পর্কিত নয়, কিন্তু সোর্স কোডের ব্যাপারে। এই বিষয়টি নিশ্চিত করা হয় যে, যখন সংবাদ পুনরায় প্রদান করা হয়, তখন প্রায়ই তা হারিয়ে যায় এবং নেতৃত্বের মিথ্যা ধারণা তৈরি করে।

সাইবারজিম: কেন একটি সংকীর্ণ পরীক্ষা মডেল তৈরি করে না
সাইবারজিম খুব সহজ: মডেলদের সোর্স কোড দেয়া হয়, আর মডেলকে অবশ্যই এর মধ্যে একটি সমস্যা খুঁজে বের করতে হবে এবং নিশ্চিত করতে হবে। এটা অবশ্যই একটা কার্যকর দক্ষতা, কিন্তু এটা কেবল সাইবার আক্রমণের প্রথম ধাপ। জিয়াপু নিজে সাইবারজিমকে এই তিনটি প্রকাশিত স্থানের সবচেয়ে সংকীর্ণতম অবস্থান বলে অভিহিত করেছেন। অন্য দুটি পরীক্ষা, এক্সপ্লটবিঞ্চ আর এক্সপ্লোয়েটজিম, প্রদর্শন করছে যে সম্পূর্ণ “ক্ষুণ” চক্রের মাধ্যমে, জিএলএম-৫. তাছাড়া সাইবারজিম-এর অবস্থান মাত্র ০. ৭ শতাংশ — একটি একক রান (পিএপি ১,৫০৭ কাজ) এবং কোন ধরনের মতভেদের কথা উল্লেখ করা হয়নি। সহজ করে বলতে গেলে, এর ফলে কোন শ্রেষ্ঠত্ব প্রমাণ করা যায় না; এটা নির্দেশ করে যে মডেলগুলো প্রায় এক সংকীর্ণ কাজের মধ্যে রয়েছে।
এক্সপ্লটবিঞ্চ এবং এক্সপ্লোয়েটজিম: সবকিছুর প্রকৃত অবস্থা
চলো এক্সপ্লোটBon দিয়ে শুরু করি. এখানে জিএলএম-৫. ৩ স্কোর ৫৪%, যা তার পূর্বসূরী (২৪. এই বৃদ্ধি দারুণ, কিন্তু তা প্রতিযোগীদের তুলনায় কম। এক্সপেলোজিম-এর গতিশীলতা আরো বেশি বলছে। দুই ঘন্টার মধ্যে জিএম-৫.৩ সমাপ্ত ১০৫ কাজ; ছয় ঘন্টার মধ্যে ১৩০. মাইথোস ৫ ১৮১ আর ২৪৭ টা কাজ ঠিক একই সময়ে... দূরত্ব হচ্ছে একাধিক। জিয়াপু নিজেই লিখেছেন: "ভবিষ্যতে আবিষ্কারের ক্ষমতা" চেইনের সাথে তুলনা করলে মডেলের দীর্ঘতা আরও বেশি। অন্য কথায়, যদি সাইবারজিম একমাত্র বিষয় হয় যেখানে জিএলএম-৫.৩ নিজেদেরই ধরে রাখে, তাহলে এই মডেলটি আরো জটিল হয়ে উঠছে এবং আরো বেশী উল্লেখযোগ্যভাবে ধারণা লাভ করেছে।

কোডি: মিশ্র এবং অদ্ভুত তুলনা
যেহেতু মডেলটি ডেভেলপারের জন্য একটি টুল হিসাবে স্থাপন করা হয়েছে, এটা আশা করা যায় যে কোড কোডের ক্ষেত্রে শক্ত ফলাফল হবে। বাস্তবে, ব্যাপারটা মিশ্র। মূল টেবিলে জিহিপু জিএলএম-৫. ৩ এর সাথে এনথ্রোপিপি অপসের ৪. ৮ এর তুলনা করেছেন- আর এটা কিছু পরীক্ষাতে জিতল আর অন্যদের ক্ষতি করেছে। পারফর্মেশন চার্টে, একটি ভিন্ন মডেলকে প্রতিদ্বন্দ্বী হিসেবে তালিকাভুক্ত করা হয়েছে- ক্লড ফ্যাক্ট ৫ এবং জিয়াপু-এর অভ্যন্তরীণ পরীক্ষা, যার পেছনে নতুন প্রবেশপথ রয়েছে। এই পদ্ধতি — বিভিন্ন বিভাগে ভিন্ন মডেলের সঙ্গে তুলনা করা — পুরো ছবিটা দেখার অসম্ভব করে তোলে । এছাড়াও জিএলএম-৫. ৩ এর মূল্যায়ন এক এনথ্রোপিক এজেন্টের মধ্যে চলছিল, যার মধ্যে ছিল কাদিড কোড ২. এর মানে আমরা কোন স্বতন্ত্র মডেল দেখতে পাচ্ছি না, কিন্তু "প্রজেক্ট + এনভায়রনমেন্ট" কম্বিনেশনের একটি "প্রজেক্ট + পরিবেশ" কম্বিনেশন, যা চূড়ান্ত মেট্রিককে প্রভাবিত করে।
পদ্ধতিগত গুহাগুলো নিজের দুর্বলতা স্বীকার এবং স্বীকার
জিয়াপু তার রিপোর্টে বেশ কৌতুহলী মন্তব্য করেছেন: এটি একটি সৎ স্বীকারোক্তি যে তুলনার জন্য মূলনীতিটি বর্তমানে দুর্বল এবং বর্তমানে নিম্ন বিন্দু থেকে অগ্রগতি শুরু হচ্ছে। একই সময়ে, তুলনাবিদ্যা প্রশ্ন উত্থাপন করে । এই রিপোর্টের বিভিন্ন বিভাগ বিভিন্ন ধরনের নৃতাত্ত্বিক মডেল ব্যবহার করে — এনথ্রোপিক অপ্টিক প্রতিযোগিতা ৪. এছাড়াও এক্সপেলোজিম এর জন্য বাজেট স্বাভাবিক করা হয়েছে শিল্পিত্ব বিশ্লেষণের মাধ্যমে; কিমি কে৩ আর কোয়ায়েন৩ ম্যাক্সকে নিয়োগ দেয়া হয়, কিন্তু মাইথোস ৫ এর জন্য নয়। এই ধরনের সুবিধাদি ছাড়া প্রতিযোগীরা হয়তো পুরোপুরি সমতুল্য হতে পারে না । তারপরও জিহিপু সঠিক পদক্ষেপ গ্রহণ করছেন: জিএম-৫. ৩ এর ওজন প্রকাশ করা হবে, আর এনথ্রোপিক এর সমতুল্য কাজ এখনো সীমিত প্রবেশাধিকারে রয়ে গেছে। এই বিষয়টি স্বাধীন গবেষকদের দাবির সত্যতা যাচাই করার সুযোগ করে দেয়।
২,৪৩৬: নম্বরটির প্রসঙ্গ প্রয়োজন
রিপোর্টটি চীনা নিরাপত্তা দলের সাথে যৌথ কাজ সম্পর্কে বিস্তারিত জানিয়েছে। মডেলটি প্রকৃত ওপেন সোর্স প্রকল্প বিশ্লেষণ করেছে এবং অবশেষে ২৬৬৯টি রিপোজিটরিতে ২,৪৩৬টি ধাক্কা পেয়েছে। এই সমস্ত উপাদান ইতোমধ্যে ফিল্টার করা হয়েছে এবং এর ফলে যে ফলাফল দেখা গেছে তা এখন অনেক কমে গেছে। ভয়াবহ বন্টনটি এরকম মনে হচ্ছে:
- গুরুতর: ১০৭;
- উচ্চ: ৯৯০;
- মাঝারি: ১,২৮৬;
- কম: ৫৩.
অসাধারণ, কিন্তু একটা ভিনগ্রহন আছে। একই রিলিজে এই ঘটনার সারসংক্ষেপ ১,০৯৭টি 'বিপর্যত ও উচ্চ' খুঁজে পাওয়া গেছে। তবে রিপোর্টটিতে এই ১,০৯৭টি বর্ণনা করা হয়েছে। কিছু সংবাদ মাধ্যম দৃশ্যত দ্বিতীয় সংস্করণকে উপেক্ষা না করেই নকল করেছে। এই বিষয়টি নির্দেশ করছে যে, দ্রুত রিপোর্ট করা হয়েছে। আরেকটা আগ্রহজনক বিষয়: ১৯৮১ সালে সবচেয়ে পুরোনো শোকের তারিখ খুঁজে পাওয়া গেছে এবং গড়ের বয়স ২৬ বছর। অন্য কথায়, লম্বা সময় ধরে বিভিন্ন বিষয় খুঁজে পাওয়ার ক্ষেত্রে মডেলরা শ্রেষ্ঠ, কিন্তু এর সাফল্য নতুনত্ব আবিষ্কারের ক্ষেত্রে। খুব কম স্পষ্ট.

অন্তর্ভুক্ত
GLএম-৫. ৩ ঘোষনা হলো কিভাবে মার্কেটিং এবং বাস্তবতাকে মোকাবেলা করা যায়। একটি সংকীর্ণ মেয়াদে, মডেলটি উপরে নেমে আসে, কিন্তু আরো বিস্তারিত পরীক্ষা আমাদেরকে আবার পৃথিবীতে ফিরিয়ে আনে: সাইবার নিরাপত্তা এবং কোডের নেতাদের পেছনে একটি গুরুতর ফাঁক রয়েছে। একই সময়ে ঝাপু তার খোলা অবস্থার প্রতি শ্রদ্ধা প্রদর্শনের যোগ্য: এটা মডেলের দুর্বল পয়েন্টের ওজন এবং তথ্য প্রকাশ করে। আগের সংস্করণে পরিষ্কার অগ্রগতি হয়েছে, যা ভবিষ্যৎকে সতর্ক আশাবাদের সাথে দেখতে সাহায্য করবে। কিন্তু জিএলএম-৫. ৩ নম্বরের ভিত্তিতে একটি নির্দিষ্ট নম্বরের ভিত্তিতে একজন নিরাপত্তা নেতাকে ফোন করা হবে।



