Perplexity ‘পোর্টেবল কম্পিউটার’ চালু করেছে NVIDIA DGX Spark-এ: লোকাল এজেন্ট, OS-স্যান্ডবক্স এবং শুধুমাত্র ক্লাউড ধাপের জন্য পেমেন্ট

13 সেপ্টেম্বর 2026০ প্রদর্শন

নতুনত্বটি এজেন্সি টুলসেট, প্ল্যানার, টুলস এবং কানেক্টরকে নিজস্ব GPU-তে একটি একীভূত সিস্টেমে একত্রিত করে। লোকাল কাজগুলো টোকেন অনুযায়ী চার্জ করা হয় না, এবং ক্লাউডে একটি ধাপ পাঠানোর আগে সিস্টেম ব্যবহারকারীকে দেখায় কোন ডেটা ডিভাইস ছেড়ে যাবে।

Perplexity ‘পোর্টেবল কম্পিউটার’ চালু করেছে NVIDIA DGX Spark-এ: লোকাল এজেন্ট, OS-স্যান্ডবক্স এবং শুধুমাত্র ক্লাউড ধাপের জন্য পেমেন্ট

এটি কী এবং কেন প্রয়োজন

Perplexity কোম্পানি Portable Computer প্রকাশ করেছে — তাদের এজেন্ট প্ল্যাটফর্ম Computer-এর একটি লোকাল বিল্ড, যা এখন NVIDIA DGX Spark কমপ্যাক্ট স্টেশনে চলে। এটি কোনো প্রিভিউ বা পরীক্ষামূলক বিল্ড নয়, বরং একটি সম্পূর্ণ রিলিজ-মানের সফটওয়্যার: অর্কেস্ট্রেটর, প্ল্যানার, টুল রাউটার এবং ফাইন-টিউন করা মডেলগুলো সরাসরি ডিভাইসে ইনস্টল করা আছে।

প্রোডাক্টটি গণবাজারের জন্য নয়। প্রধান ক্রেতারা — বড় কোম্পানি এবং মাঝারি ব্যবসা, যাদের কাছে ইতিমধ্যেই NVIDIA স্টেশন আছে, পাশাপাশি ভালোভাবে অর্থায়িত AI-নেটিভ স্টার্টআপগুলো। সাধারণ ছোট প্রতিষ্ঠানের জন্য এই ক্রয়টি লাভজনক হওয়ার সম্ভাবনা কম। পজিশনিং থেকে বোঝা যায়, সিস্টেমটি প্রাথমিকভাবে ফাইন্যান্স, আইন, স্বাস্থ্যসেবা, সরকারি খাত, প্রতিরক্ষা এবং সংবেদনশীল বুদ্ধিবৃত্তিক সম্পত্তি নিয়ে কাজ করা ইঞ্জিনিয়ারিং টিমগুলোর জন্য আগ্রহের বিষয়।

লোকাল সিস্টেমটি কীভাবে কাজ করে

প্রয়োজনীয় সবকিছু একটি প্যাকেজেই সরবরাহ করা হয়: লোকাল মডেল, ইনফারেন্স ইঞ্জিন, এজেন্ট হারনেস, টুল স্যান্ডবক্স এবং অ্যাপ্লিকেশন কানেক্টর। ব্যবহারকারী Qwen 3.8 27B এবং PPLX 27B-এর মধ্যে বেছে নিতে পারেন — দ্বিতীয় বিকল্পটি Perplexity-এর নিজস্ব ফাইন-টিউন করা মডেল। শীঘ্রই NVIDIA Nemotron 3.5 Lightning ওপেন মডেল যোগ করার প্রতিশ্রুতি দেওয়া হয়েছে, যার MoE আর্কিটেকচারে ৩০ বিলিয়ন প্যারামিটার রয়েছে। নিজস্ব কিছু ব্যবহার করতে চাইলে, BYO-মডেল এবং নিজস্ব ইনফারেন্স সার্ভার সমর্থিত।

কোড এবং টুল কলগুলো স্যান্ডবক্সের ভিতরে সম্পাদিত হয়, যা অপারেটিং সিস্টেম নিয়ন্ত্রণ করে। এটি প্রসেস, ফাইল সিস্টেম পাথ অ্যাক্সেস এবং নেটওয়ার্ক সংযোগ কঠোরভাবে সীমাবদ্ধ করে। স্যান্ডবক্স হঠাৎ অনুপলব্ধ হলে, টুল এক্সিকিউশন সম্পূর্ণভাবে বন্ধ হয়ে যায় — কোনো নীরবভাবে অনিরাপদ মোডে স্যুইচ করা হয় না।

Gmail, Outlook, Slack এবং GitHub-এর সাথে ইন্টিগ্রেশন লোকাল অর্কেস্ট্রেটরের মাধ্যমে রাউট করা হয়। মডেলটি যাতে কনটেক্সটে ডুবে না যায়, সেজন্য ডেভেলপাররা বেশ কিছু কৌশল প্রয়োগ করেছেন: সিস্টেম প্রম্পট এবং টুল সেট ছোট রাখা হয়, বিশেষায়িত দক্ষতা প্রয়োজন অনুযায়ী লোড হয়, এবং কানেক্টরগুলো সম্পূর্ণ MCP-সংজ্ঞার পরিবর্তে কমপ্যাক্ট CLI-ইউটিলিটি হিসেবে তৈরি। দীর্ঘ রানের সময় পুরনো কনটেক্সট সংকুচিত হয়। এটি গুরুত্বপূর্ণ, কারণ Qwen-এর জন্য 260K টোকেনের উইন্ডো দাবি করা হয়, কিন্তু বাস্তবে প্রায় 100K-এর পরে অবনতি শুরু হয়।

কখন কাজ ক্লাউডে যায়

লোকাল ধাপগুলো টোকেনের জন্য বিল করা হয় না — চার্জ শুধুমাত্র ক্লাউড অপারেশনের জন্য প্রযোজ্য। প্রতিটি কাজ ডিভাইসে শুরু হয়। যদি এজেন্টের ওয়েবে সরাসরি অ্যাক্সেস বা সত্যিকারের জটিল যুক্তির প্রয়োজন হয়, অর্কেস্ট্রেটর থেমে যায় এবং ব্যবহারকারীকে জিজ্ঞেস করে, এই একটি ধাপ বাইরে পাঠানো যাবে কিনা। ১৫টিরও বেশি ক্লাউড মডেল বেছে নেওয়ার সুযোগ রয়েছে।

পাঠানোর আগে হারনেস শুধুমাত্র প্রাসঙ্গিক কনটেক্সট নির্বাচন করে, এটি PII-ক্লাসিফায়ারের মাধ্যমে চালায় এবং দেখায় যে ঠিক কোন ডেটা মেশিন ছেড়ে যাবে। ক্লাউড অ্যাডভাইজার অনুমোদিত ধাপটি পায় এবং টেক্সট নির্দেশনা ফেরত দেয়। লোকাল ফাইল, টুল বা কথোপকথনের ইতিহাসে তার সরাসরি অ্যাক্সেস নেই। ফলাফল একটি হাইব্রিড স্কিম: ব্যক্তিগত অংশ ডিভাইসে থাকে, আর ভারী গণনা বাইরে পয়েন্ট-টু-পয়েন্ট এবং মালিকের নিয়ন্ত্রণে ডেলিগেট করা হয়।

বেনচমার্কের ফলাফল

Perplexity ৫৩টি কম্পিউটার এজেন্ট কাজের Local Knowledge Work Bench সেটে নিজস্ব পরিমাপ উপস্থাপন করে। NVIDIA DGX Spark-এ Qwen 3.8 27B মডেলের সাথে লোকাল বিল্ড ৮২.৬% স্কোর করেছে। তুলনার জন্য: ওপেন হারনেস Pi ৭৭.৬% দেখিয়েছে, এবং একই মডেলে Hermes ৭৪.০%। মডেলটি PPLX 27B-তে পরিবর্তন করলে ফলাফল ৮৫.৪%-এ বেড়ে যায়।

BrowseComp পরীক্ষায় এজেন্ট প্ল্যাটফর্মটি Pi-এর ৫০.২% এবং Hermes-এর ৪৩.৯%-এর বিপরীতে ৬৬.৭% পেয়েছে। এছাড়াও, এটি Pi-এর চেয়ে ৫১% কম সময় এবং ৭০% কম টোকেন খরচ করেছে। আরও লক্ষণীয় ব্যবধান — ডকুমেন্টের ভিজ্যুয়াল বোঝার জন্য ParseBench-100 পরীক্ষায়: যথাক্রমে ৩৪.৬% এবং ১৩.৯%-এর বিপরীতে ৬৫.১%।

Terminal Bench 2.1-এ সম্পূর্ণ লোকাল রান প্রায় শূন্য মার্জিনাল খরচে ৫৯.৬% দিয়েছে। ক্লাউড অ্যাডভাইজার সংযুক্ত করলে ফলাফল ৭৩.০%-এ বেড়ে যায়, এবং একটি রোলআউটের খরচ প্রায় $০.৪১৫। রেফারেন্সের জন্য: একই পরীক্ষায় আলাদা Claude Opus 5 মডেল ৮২.৪% পায়, কিন্তু প্রতি রানে প্রায় $০.৬৫ খরচ হয়। এসকেলেশন শক্তিশালী মডেলগুলোর সাথে ব্যবধান উল্লেখযোগ্যভাবে কমায়, তবে সম্পূর্ণরূপে বন্ধ করে না। কিন্তু লোকাল মোড প্রায় বিনামূল্যই থাকে।

প্রযুক্তিগত প্রয়োজনীয়তা এবং প্রাপ্যতা

NVIDIA DGX Spark-এ ইনস্টলেশনের জন্য GB10 সুপারচিপ, ১২৮ জিবি মেমরি এবং কমপক্ষে ১ টিবি স্টোরেজ প্রয়োজন। Qwen 3.8 27B-ভিত্তিক অর্কেস্ট্রেটর ৩-বিট কোয়ান্টাইজেশনে সরবরাহ করা হয়: ডাউনলোড ১৭.৪ জিবি, প্রয়োজন ৩২ জিবি RAM। NVIDIA Nemotron 3.5 Lightning সংস্করণটি ৪-বিট, ১৯ জিবি জায়গা নেয় এবং ৩৬ জিবি RAM প্রয়োজন। অন্যান্য সিস্টেমে ARM বা x64-এ DGX OS বা Ubuntu ব্যবহার করা যেতে পারে RTX গ্রাফিক্স কার্ড এবং কমপক্ষে ২৪ জিবি ভিডিও মেমরি সহ। ইনস্টলেশন স্ট্যান্ডার্ড apt-রিপোজিটরির মাধ্যমে করা হয়।

শুরুতে, সিস্টেমটি Pro, Max, Enterprise Pro এবং Enterprise Max সাবস্ক্রাইবারদের জন্য Linux-first হিসেবে উপলব্ধ। Windows সংস্করণ সেপ্টেম্বরে প্রত্যাশিত, এবং macOS বর্তমানে রোডম্যাপে নেই। একটি গুরুত্বপূর্ণ বিষয়: চালু করার সময় শুধুমাত্র একটি DGX Spark সমর্থিত, একাধিক ডিভাইসের ক্লাস্টারিং ভবিষ্যতে পরিকল্পনা করা হয়েছে।

মূলত, এটি একটি প্রাইভেট এজেন্ট পরিবেশ তৈরি করার প্রচেষ্টা, যার জন্য ইন্টারনেটের সাথে ধ্রুবক সংযোগের প্রয়োজন নেই এবং প্রতিটি লোকাল কলের জন্য অর্থ দিতে হয় না, তবে প্রয়োজনের সময় শক্তিশালী ক্লাউড মডেল সংযোগ করার ক্ষমতা রাখে।

সাধারণ প্রশ্নোত্তর

বিভিন্ন উপাদান

সব উপাদান
Perplexity ‘পোর্টেবল কম্পিউটার’ চালু করেছে NVIDIA DGX Spark-এ: লোকাল এজেন্ট, OS-স্যান্ডবক্স এবং শুধুমাত্র ক্লাউড ধাপের জন্য পেমেন্ট