التغذية

60 المواد

نوعا ما
الأخبار11 سبتمبر 2026

SQL وكيل بلا أوهام: مقياس موحّد للاستقلالية ومقارنة صادقة لمعايير نماذج اللغات الكبيرة

يقترح الباحثون النظر إلى مجال Text-to-SQL باعتباره لوحة صدارة شاملة، حيث تُوزَّع النتائج وفقًا لدرجة استقلالية النموذج في توليد استعلامات SQL. ويجرون قياسات على Spider ويُظهرون أن النجاحات لا تنتقل دائمًا إلى معايير أخرى، وأن الاستقلالية تمنح متانةً لكنها تتطلب موارد حاسوبية ملحوظة.

SQL وكيل بلا أوهام: مقياس موحّد للاستقلالية ومقارنة صادقة لمعايير نماذج اللغات الكبيرة
اقرأ
الأخبار10 سبتمبر 2026

تعد OpenAI: شريحتها Jalapeño ستكون أسرع وأكثر اقتصادية من حلول المنافسين

تدّعي الشركة أن المعالج المخصص للاستدلال، الذي طُوّر بالتعاون مع Broadcom، يتفوق على مسرعات Nvidia من حيث كفاءة الطاقة وسرعة الاستجابة في اختبارات على عدة نماذج ذكاء اصطناعي. وتخطط لنشر الرقائق بكميات صغيرة قبل نهاية العام، لكنها لا تعتزم استبدال أسطول Nvidia بالكامل.

تعد OpenAI: شريحتها Jalapeño ستكون أسرع وأكثر اقتصادية من حلول المنافسين
اقرأ
الأخبار9 سبتمبر 2026

مهارة التمويل: في وكلاء الذكاء الاصطناعي الاستثماريين، المهارات الإجرائية الجاهزة قد تكون أحيانًا أكثر أهمية من اختيار النموذج

معيار جديد يختبر وكلاء اللغة في تحسين المحفظة الاستثمارية، وإدارة المخاطر، والتحليل الأساسي. على تسعة نماذج، تعمل حزم المهارات المجمعة مسبقًا على تحسين النتائج المتوسطة بشكل ملحوظ، بينما لا يحقق الإنشاء الذاتي للمهارات بواسطة الوكيل أي مكاسب تذكر.

مهارة التمويل: في وكلاء الذكاء الاصطناعي الاستثماريين، المهارات الإجرائية الجاهزة قد تكون أحيانًا أكثر أهمية من اختيار النموذج
اقرأ
الأخبار8 سبتمبر 2026

OpenAI يشدد نهجه تجاه الخصوصية: نظام جديد لحماية البيانات ردًا على تخزين الجلسات لمدة 30 يومًا لدى Anthropic

أعلنت OpenAI عن نظام مراقبة آلي لإساءة الاستخدام لا يحفظ بيانات العملاء، وهو رد مباشر على سياسة Anthropic الأخيرة بالاحتفاظ بالمراسلات لمدة 30 يومًا. بهذا تعزز الشركات المنافسة على ثقة المستخدمين المؤسسيين وسط تزايد المنافسة.

OpenAI يشدد نهجه تجاه الخصوصية: نظام جديد لحماية البيانات ردًا على تخزين الجلسات لمدة 30 يومًا لدى Anthropic
اقرأ
الأخبار8 سبتمبر 2026

نماذج الذكاء الاصطناعي للطقس اختُبرت كمناخية: ماذا أظهرت محاكاة ArchesWeather وArchesWeatherGen متعددة السنوات

قام الباحثون بتكييف شبكتين عصبيتين للتجارب الجوية طويلة الأمد، بإضافة شروط حدودية خارجية لهما، وتشغيلهما وفق بروتوكول AIMIP. وتبين أن النماذج، المصممة أصلاً لتوقعات تصل إلى عشرة أيام، تنتج دورة سنوية مستقرة وتعيد إنتاج المناخ وتقلباته بشكل معقول في عمليات المحاكاة الممتدة لعقود متعددة.

نماذج الذكاء الاصطناعي للطقس اختُبرت كمناخية: ماذا أظهرت محاكاة ArchesWeather وArchesWeatherGen متعددة السنوات
اقرأ
المقارنات8 سبتمبر 2026

Wordware مقابل Replit: أي أداة تختار لوكلاء الذكاء الاصطناعي والتطوير التقليدي؟

يسمح Wordware ببناء وكلاء ذكاء اصطناعي دون برمجة، باستخدام واجهة مألوفة تشبه محرر النصوص. Replit هي بيئة تطوير سحابية للمطورين مع مساعد ذكاء اصطناعي يساعد في كتابة وشرح ونشر الكود. نستعرض أي خدمة تناسب المهام المختلفة.

Wordware مقابل Replit: أي أداة تختار لوكلاء الذكاء الاصطناعي والتطوير التقليدي؟
اقرأ
الأخبار7 سبتمبر 2026

بدلاً من BFI: استبيان الشخصية الجديد CSI يجعل التقييم أكثر استقراراً وقدرة على التنبؤ

طوّر الباحثون "المخزون الأساسي للمشاعر" (CSI) — أداة لتقييم السمات الشخصية لنماذج اللغات الكبيرة (LLM)، تراعي طبيعتها الحاسوبية. وهي أكثر استقرارًا في استجابتها لتغيّرات الصياغة، وتعمل باللغتين الإنجليزية والصينية، وتتنبأ بالسلوك الفعلي للنماذج بمعامل ارتباط يتجاوز 0.85.

بدلاً من BFI: استبيان الشخصية الجديد CSI يجعل التقييم أكثر استقراراً وقدرة على التنبؤ
اقرأ
الأخبار3 سبتمبر 2026

هندسة التجاوز للصندوق الأسود: لماذا نقارن الهجمات عند عدد متساوٍ من الاستدعاءات للنموذج؟

اقترح الباحثون بروتوكول Fair-ASR لتقييم الهجمات على نماذج اللغات الكبيرة (LLM) في ظل ميزانية موحدة لطلبات الاستعلام إلى النموذج المستهدف، مع احتساب تكاليف المهاجم بشكل منفصل. أظهرت مراجعة 11 طريقة معروفة أن ترتيبها يعتمد بشكل كبير على الميزانية، وأن القوالب البسيطة لا تقل عن الأساليب المعقدة القائمة على LLM — مما دفع المؤلفين إلى تطوير هجوم جديد باسم ReCode.

هندسة التجاوز للصندوق الأسود: لماذا نقارن الهجمات عند عدد متساوٍ من الاستدعاءات للنموذج؟
اقرأ