التغذية

178 المواد

نوعا ما
الأخبار11 سبتمبر 2026

بدون الاعتماد على التاريخ: خوارزمية من MIT ترسم كوارث الطقس المستقبلية

طور مهندسون من معهد ماساتشوستس للتكنولوجيا أداة ذكاء اصطناعي تولّد سيناريوهات لطقس متطرف غير موجودة في أرشيفات الرصد. وتقيّم النموذج شدتها المحتملة ومدتها وانتشارها دون تدريب على بيانات الكوارث السابقة.

بدون الاعتماد على التاريخ: خوارزمية من MIT ترسم كوارث الطقس المستقبلية
اقرأ
الأخبار11 سبتمبر 2026

الاكتشافات العلمية الكبرى لا تُخطط لها: لدى وكلاء البحث الذاتيين الكثير من القواسم المشتركة مع اختبار الفازينغ

يؤكد مؤلفو الدراسة الجديدة أن الأنظمة العلمية المستقلة يجب أن تعتمد على إشارات كثيفة للتقدم المرحلي، كما تفعل أدوات التفحيم (fuzzers)، بدلاً من الاعتماد فقط على النتيجة النهائية النادرة. يتيح هذا النهج للوكيل استكشاف فرضيات غير تقليدية وتجنب الإفراط في التكيف مع المعايير المرجعية.

الاكتشافات العلمية الكبرى لا تُخطط لها: لدى وكلاء البحث الذاتيين الكثير من القواسم المشتركة مع اختبار الفازينغ
اقرأ
الأخبار11 سبتمبر 2026

NL2SHACL-Bench: معيار جديد لتقييم توليد أشكال SHACL من المتطلبات النصية

في مقال لمؤتمر ISWC 2026، قدم المؤلفون أداة تقيس قدرة نماذج اللغة الكبيرة (LLM) على تحويل الاستعلامات العادية إلى قيود SHACL صالحة، مع الأخذ في الاعتبار أن القواعد نفسها قد تظهر بأشكال مختلفة. أظهرت الاختبارات على أربعة نماذج أنها تتعامل بسهولة مع بناء الجملة، لكنها غالبًا لا تلتقط دلالات القيود المعقدة.

NL2SHACL-Bench: معيار جديد لتقييم توليد أشكال SHACL من المتطلبات النصية
اقرأ
الأخبار11 سبتمبر 2026

معايرة الهامش مقابل إعادة التدريب: كيف تُبقي المنسي منسيًا

اكتشف الباحثون أن الأساليب القياسية لإزالة التعلم من نماذج اللغات الكبيرة يمكن كسرها بسهولة عند إعادة التدريب على عدد صغير من الأمثلة المنسية. التقنية المقترحة من قبلهم، معايرة الهامش، تضيف عقوبة هامشية غير مشبعة وتقلل بشكل ملحوظ من نجاح هذه الهجمات على نماذج ومجموعات بيانات مختلفة.

معايرة الهامش مقابل إعادة التدريب: كيف تُبقي المنسي منسيًا
اقرأ
الأخبار10 سبتمبر 2026

Telco-GAIA: كيفية اختبار وكيل الذكاء الاصطناعي على بيانات مشغل اتصالات حقيقي

معيار جديد يقترح 100 سيناريو للأسئلة والأجوبة باللغتين الإنجليزية والعربية، مبنية حول بيانات حقيقية للمشغل: الموقع الإلكتروني، وقاعدة بيانات SQL، وأرشيف الويب. أظهر الاختبار على 12 نموذجًا أن حتى أفضل نموذج يحل 71% فقط من المهام، بينما تنخفض النتائج في الفئات البصرية إلى أقل من 30%.

Telco-GAIA: كيفية اختبار وكيل الذكاء الاصطناعي على بيانات مشغل اتصالات حقيقي
اقرأ
الأخبار10 سبتمبر 2026

التخلي عن Prometheus لصالح الذكاء الاصطناعي للعالم المادي: أناندكومار وينيك يؤسسان Accelerated Understanding

أستاذة في معهد كاليفورنيا للتكنولوجيا (كالتك) وزملاؤها أطلقوا شركتهم الناشئة الخاصة، متخلين عن حصتهم في مشروع يدعمه بيزوس. تهدف الشركة الجديدة إلى بناء نماذج تتنبأ بالظواهر الفيزيائية لتطبيقات الروبوتات وأشباه الموصلات والمناخ.

التخلي عن Prometheus لصالح الذكاء الاصطناعي للعالم المادي: أناندكومار وينيك يؤسسان Accelerated Understanding
اقرأ
الأخبار10 سبتمبر 2026

الاستراتيجيات المعرفية دون تلميحات: طريقة تكيفية تحسّن استدلال نماذج اللغات الكبيرة عبر الحالات الداخلية

نهج LRS الجديد أثناء التوليد يصحح بدقة التمثيلات الخفية للنموذج، مستندًا إلى إشارات جودة الخطوات الوسيطة. بفضل هذا، تجد نماذج اللغة الاستدلالية أخطاءها وتصححها بنفسها، وتظهر التجارب زيادة ثابتة في الدقة على عدة معايير قياس.

الاستراتيجيات المعرفية دون تلميحات: طريقة تكيفية تحسّن استدلال نماذج اللغات الكبيرة عبر الحالات الداخلية
اقرأ
الأخبار10 سبتمبر 2026

معيار GIM الجديد: اختبار نماذج اللغة عند تقاطع مهارات معرفية مختلفة

اقترح باحثون نهجًا لتقييم النماذج لا يعتمد على حجم المعرفة أو بمعزل عن الواقع، بل عبر مهام تتطلب في آنٍ واحد التفكير المنطقي، وضبط السياق، والعمل ضمن قيود. تضمّن المعيار 820 مهمة أصلية، كما درس مؤلفوه تأثير إعدادات "التفكير" وغيرها من معايير النماذج على النتائج.

معيار GIM الجديد: اختبار نماذج اللغة عند تقاطع مهارات معرفية مختلفة
اقرأ
الأخبار10 سبتمبر 2026

MindHelper: عندما يقرر الروبوت بنفسه ما إذا كان الوقت قد حان للتدخل — معيار جديد للذكاء الاصطناعي المجسّد

قدّم الباحثون اختبار MindHelper، حيث يتعين على الوكيل مراقبة الشخص باستمرار وتقديم المساعدة فقط في اللحظة المناسبة، مع البقاء جانبًا في بقية الأوقات. يتفوق الإطار المقترح MindClaw بشكل ملحوظ على أساليب VLM المباشرة في دقة التدخل وإنجاز المهام.

MindHelper: عندما يقرر الروبوت بنفسه ما إذا كان الوقت قد حان للتدخل — معيار جديد للذكاء الاصطناعي المجسّد
اقرأ