ফিড

60 বস্তু

ক্রমবিন্যাস করা হবে
সংবাদ11 সেপ্টেম্বর 2026

এজেন্টিক SQL বিনা বিভ্রমে: স্বায়ত্তশাসনের একীভূত স্কেল এবং LLM বেঞ্চমার্কের সৎ তুলনা

গবেষকরা Text-to-SQL ক্ষেত্রটিকে একটি সমন্বিত লিডারবোর্ড হিসেবে বিবেচনা করার প্রস্তাব দেন, যেখানে SQL কোয়েরি তৈরিতে মডেলের স্বাধীনতার মাত্রা অনুযায়ী ফলাফল বিন্যস্ত থাকে। তারা Spider-এ পরিমাপ পরিচালনা করে দেখান যে, সাফল্য সবসময় অন্যান্য বেঞ্চমার্কে স্থানান্তরিত হয় না, এবং স্বায়ত্তশাসন স্থিতিশীলতা দেয়, তবে উল্লেখযোগ্য গণনামূলক সম্পদের প্রয়োজন হয়।

এজেন্টিক SQL বিনা বিভ্রমে: স্বায়ত্তশাসনের একীভূত স্কেল এবং LLM বেঞ্চমার্কের সৎ তুলনা
পড়ো
সংবাদ10 সেপ্টেম্বর 2026

OpenAI প্রতিশ্রুতি দিয়েছে: তাদের চিপ Jalapeño প্রতিযোগীদের সমাধানের চেয়ে দ্রুত এবং সাশ্রয়ী হবে

কোম্পানিটি দাবি করছে যে, Broadcom-এর সাথে যৌথভাবে তৈরি ইনফারেন্স প্রসেসরটি একাধিক AI মডেলের পরীক্ষায় শক্তি দক্ষতা এবং প্রতিক্রিয়ার গতিতে Nvidia-এর এক্সিলারেটরকে ছাড়িয়ে যায়। বছরের শেষ নাগাদ অল্প পরিমাণে চিপ স্থাপনের পরিকল্পনা থাকলেও, তারা Nvidia-এর সম্পূর্ণ বহর প্রতিস্থাপন করতে চায় না।

OpenAI প্রতিশ্রুতি দিয়েছে: তাদের চিপ Jalapeño প্রতিযোগীদের সমাধানের চেয়ে দ্রুত এবং সাশ্রয়ী হবে
পড়ো
সংবাদ9 সেপ্টেম্বর 2026

FinSkillBench: বিনিয়োগ AI-এজেন্টে প্রস্তুত পদ্ধতিগত দক্ষতা কখনো কখনো মডেল নির্বাচনের চেয়ে বেশি গুরুত্বপূর্ণ

নতুন বেঞ্চমার্ক পোর্টফোলিও অপ্টিমাইজেশন, রিস্ক-ম্যানেজমেন্ট এবং ফান্ডামেন্টাল অ্যানালিসিসে ভাষা এজেন্টদের পরীক্ষা করে। নয়টি মডেলে পূর্ব-সংগৃহীত স্কিল প্যাকেজ গড় ফলাফল উল্লেখযোগ্যভাবে উন্নত করে, আর এজেন্টের নিজে থেকে স্কিল তৈরি করা প্রায় কোনো লাভ দেয় না।

FinSkillBench: বিনিয়োগ AI-এজেন্টে প্রস্তুত পদ্ধতিগত দক্ষতা কখনো কখনো মডেল নির্বাচনের চেয়ে বেশি গুরুত্বপূর্ণ
পড়ো
সংবাদ8 সেপ্টেম্বর 2026

OpenAI কঠোর করছে গোপনীয়তা নীতি: Anthropic-এর ৩০ দিনের সেশন সংরক্ষণের জবাবে নতুন ডেটা সুরক্ষা ব্যবস্থা

OpenAI অটোমেটেড অপব্যবহার পর্যবেক্ষণ চালু করেছে যা ক্লায়েন্টদের ডেটা সংরক্ষণ করে না — এটি Anthropic-এর সাম্প্রতিক ৩০ দিনের জন্য কথোপকথন সংরক্ষণের নীতির সরাসরি জবাব। ক্রমবর্ধমান প্রতিযোগিতার মধ্যে এভাবে কোম্পানিগুলো কর্পোরেট ব্যবহারকারীদের আস্থা অর্জনের লড়াই জোরদার করছে।

OpenAI কঠোর করছে গোপনীয়তা নীতি: Anthropic-এর ৩০ দিনের সেশন সংরক্ষণের জবাবে নতুন ডেটা সুরক্ষা ব্যবস্থা
পড়ো
সংবাদ8 সেপ্টেম্বর 2026

আবহাওয়ার AI মডেল জলবায়ু মডেল হিসেবে পরীক্ষা করা হয়েছে: ArchesWeather এবং ArchesWeatherGen-এর বহু বছরের সিমুলেশন কী দেখিয়েছে

গবেষকরা দুটি নিউরাল নেটওয়ার্ককে দীর্ঘমেয়াদী বায়ুমণ্ডলীয় পরীক্ষার জন্য অভিযোজিত করেছেন, তাদের বাহ্যিক সীমানা শর্ত যোগ করেছেন এবং AIMIP প্রোটোকল অনুযায়ী চালিয়েছেন। দেখা গেছে যে মডেলগুলি, যা মূলত দশ দিন পর্যন্ত পূর্বাভাসের জন্য ডিজাইন করা হয়েছিল, স্থিতিশীল বার্ষিক চক্র প্রদান করে এবং বহু-দশকীয় সিমুলেশনে জলবায়ুবিদ্যা ও পরিবর্তনশীলতা বিশ্বাসযোগ্যভাবে পুনরুত্পাদন করে।

আবহাওয়ার AI মডেল জলবায়ু মডেল হিসেবে পরীক্ষা করা হয়েছে: ArchesWeather এবং ArchesWeatherGen-এর বহু বছরের সিমুলেশন কী দেখিয়েছে
পড়ো
তুলনা8 সেপ্টেম্বর 2026

Wordware বনাম Replit: AI-এজেন্ট এবং ক্লাসিক ডেভেলপমেন্টের জন্য কোন টুলটি বেছে নেবেন?

Wordware আপনাকে প্রোগ্রামিং ছাড়াই AI এজেন্ট তৈরি করতে দেয়, একটি পরিচিত টেক্সট এডিটরের মতো ইন্টারফেস ব্যবহার করে। Replit হলো ডেভেলপারদের জন্য একটি ক্লাউড পরিবেশ যেখানে AI সহকারী কোড লিখতে, ব্যাখ্যা করতে এবং ডিপ্লয় করতে সাহায্য করে। আমরা বিশ্লেষণ করি কোন সার্ভিসটি বিভিন্ন কাজের জন্য উপযুক্ত।

Wordware বনাম Replit: AI-এজেন্ট এবং ক্লাসিক ডেভেলপমেন্টের জন্য কোন টুলটি বেছে নেবেন?
পড়ো
সংবাদ7 সেপ্টেম্বর 2026

নতুন ব্যক্তিত্ব প্রশ্নাবলী CSI BFI-এর বিকল্প হিসেবে মূল্যায়নকে আরও স্থিতিশীল ও ভবিষ্যদ্বাণীমূলক করে তোলে

গবেষকরা Core Sentiment Inventory (CSI) তৈরি করেছেন — একটি টুল যা LLM-এর ব্যক্তিত্বের বৈশিষ্ট্য মূল্যায়ন করে, তাদের গণনামূলক প্রকৃতিকে বিবেচনায় নিয়ে। এটি শব্দচয়নের পরিবর্তনের প্রতি আরও স্থিতিশীল সাড়া দেয়, ইংরেজি এবং চীনা ভাষায় কাজ করে এবং ০.৮৫-এর বেশি পারস্পরিক সম্পর্কসহ মডেলের বাস্তব আচরণ পূর্বাভাস দেয়।

নতুন ব্যক্তিত্ব প্রশ্নাবলী CSI BFI-এর বিকল্প হিসেবে মূল্যায়নকে আরও স্থিতিশীল ও ভবিষ্যদ্বাণীমূলক করে তোলে
পড়ো
সংবাদ3 সেপ্টেম্বর 2026

জেলব্রেক ব্ল্যাক বক্স: কেন মডেল অ্যাক্সেসের সমান সংখ্যায় আক্রমণ তুলনা করবেন

গবেষকরা Fair-ASR প্রোটোকল প্রস্তাব করেছেন, যা টার্গেট মডেলে সমান কুয়েরি বাজেটে LLM-এর উপর আক্রমণ মূল্যায়ন করে, এবং আক্রমণকারীর খরচ আলাদাভাবে হিসাব করে। ১১টি পরিচিত পদ্ধতি পুনর্বিবেচনা করে দেখা গেছে যে তাদের র্যাঙ্কিং বাজেটের উপর ব্যাপকভাবে নির্ভরশীল, এবং সাধারণ টেমপ্লেটগুলি জটিল LLM-ভিত্তিক পদ্ধতির চেয়ে কম নয় — এটি লেখকদের নতুন ReCode আক্রমণ তৈরি করতে অনুপ্রাণিত করেছে।

জেলব্রেক ব্ল্যাক বক্স: কেন মডেল অ্যাক্সেসের সমান সংখ্যায় আক্রমণ তুলনা করবেন
পড়ো
সহায়িকা1 সেপ্টেম্বর 2026

কোন AI ইমেজ জেনারেটর বেছে নেবেন: Stable Diffusion 3.5, Recraft V3, Flux 1.1 Pro নাকি Midjourney 6.1

চারটি জনপ্রিয় টুল তুলনা করা হচ্ছে ছবির মান, গতি, দাম এবং ব্যবহারের সুবিধার ভিত্তিতে। ফটোরিয়ালিজম, সৃজনশীল পরীক্ষা বা দ্রুত জেনারেশনের জন্য কোন সার্ভিসটি উপযুক্ত হবে তা বুঝতে সাহায্য করি।

কোন AI ইমেজ জেনারেটর বেছে নেবেন: Stable Diffusion 3.5, Recraft V3, Flux 1.1 Pro নাকি Midjourney 6.1
পড়ো