تخطَّ إلى المحتوى الرئيسي
ToolPotion

Windows Agent Arena

Windows Agent Arena (WAA) هو إطار عمل مفتوح المصدر قابل للتوسع لتقييم وكلاء الذكاء الاصطناعي المتعدد الوسائط على نظام التشغيل Windows. يوفر بيئة واقعية لاختبار سير عمل الوكلاء عبر مهام متنوعة، مما يتيح قياس الأداء السريع والبحث في قدرات وكلاء الذكاء الاصطناعي على أنظمة تشغيل سطح المكتب.

زيارة الرابط
Windows Agent Arena screenshot

الوصف

Windows Agent Arena (WAA) هو إطار عمل مبتكر ومفتوح المصدر مصمم لمعالجة التحديات في تقييم وتطوير وكلاء الذكاء الاصطناعي القادرين على الاستدلال والتخطيط والتصرف داخل نظام تشغيل Windows حقيقي. غالبًا ما تركز المقاييس التقليدية على وسائط أو مجالات محدودة وتستغرق وقتًا طويلاً، حيث تستغرق التقييمات الكاملة أيامًا بسبب الطبيعة التسلسلية للمهام. يوفر WAA بيئة نظام تشغيل Windows قابلة للتكرار وواقعية حيث يمكن لوكلاء الذكاء الاصطناعي التفاعل مع مجموعة واسعة من التطبيقات والأدوات ومتصفحات الويب، مما يعكس تجارب المستخدم البشري.

يدعم الإطار نشر الوكلاء على نطاق واسع، مستفيدًا من البنية التحتية السحابية لـ Azure ML للتنفيذ المتوازي. هذا يسمح بقياس مئات المهام في دقائق بدلاً من أيام. يتضمن WAA أكثر من 154 مهمة متنوعة تغطي أعباء عمل Windows الشائعة مثل تحرير المستندات (LibreOffice Calc/Writer)، وتصفح الإنترنت (Microsoft Edge، Google Chrome)، ومهام النظام (مستكشف الملفات، الإعدادات)، والترميز (Visual Studio Code)، وتشغيل الوسائط (VLC Player)، ووظائف الأدوات المساعدة (Notepad، Clock، Paint). تقييم المهام حتمي، مع قيام نصوص برمجية مخصصة بإنشاء مكافآت في نهاية كل حلقة.

في جوهره، يستخدم WAA حاوية Docker تستضيف جهازًا افتراضيًا لنظام Windows 11. يعمل خادم Python Flask كوسيط، وينفذ الأوامر داخل الجهاز الافتراضي ويعيد الملاحظات. لتحقيق التوازي السحابي القابل للتوسع، يتم استخدام مهام Azure Machine Learning، وتوزيع المهام بالتساوي بين مثيلات الحوسبة وتجميع النتائج. تدعم هذه البنية التحتية التنفيذ المحلي المرن أثناء النمذجة الأولية والقياس السحابي القوي.

لتوضيح قدرات WAA، تم تقديم وكيل Navi. يستخدم Navi الاستدلال المتسلسل (chain-of-thought prompting) للاستدلال على حالة الكمبيوتر، والإجراءات السابقة، وتحديد الخطوة التالية. تتضمن مدخلاته عنوان النافذة الأمامية، وعناوين جميع النوافذ/علامات التبويب المفتوحة، وتمثيل للشاشة يتم معالجته من خلال طرق مختلفة مثل تحليل شجرة UIA، وتحليل شجرة DOM، والتعرف الضوئي على الحروف (OCR)، واكتشاف الأيقونات/الصور، و OmniParser. تظهر النتائج الأولية أنه بينما تحقق النماذج الحالية أداءً أقل من البشر، فإن جودة تمثيل الشاشة تؤثر بشكل كبير على نجاح الوكيل، مع إظهار تحليل شجرة UIA وتسمية الأيقونات في OmniParser لزيادات في الأداء.

WAA هو مورد قيم للباحثين والمطورين الذين يهدفون إلى تطوير مجال وكلاء الذكاء الاصطناعي، وخاصة تلك التي تعمل في بيئات سطح المكتب المعقدة. إنه يسهل الاختبار الصارم، والتحليل المقارن لهياكل الوكلاء، وتوليد رؤى لتطوير الوكلاء المستقبلي.

الميزات الأساسية لـ Windows Agent Arena

  • بيئة نظام تشغيل Windows قابلة للتوسع لوكلاء الذكاء الاصطناعي

  • تفاعل واقعي مع سطح المكتب عبر تطبيقات متنوعة

  • يدعم وكلاء الذكاء الاصطناعي المتعدد الوسائط

  • قياس أداء سير عمل الوكلاء

  • تنفيذ متوازي عبر Azure ML

  • 154 مهمة متنوعة لنظام Windows

  • تقييم حتمي للمهام

  • الاستدلال المتسلسل (Chain-of-thought prompting) للوكلاء

  • طرق متعددة لتمثيل الشاشة (UIA، DOM، OCR، اكتشاف الأيقونات، OmniParser)

  • إطار عمل مفتوح المصدر

  • بيئة بحث قابلة للتكرار

كيفية استخدام Windows Agent Arena؟

  1. إعداد حاوية Docker مع جهاز افتراضي لنظام Windows 11

  2. تكوين جدولة المهام ونشر الوكيل

  3. تحديد مدخلات الوكيل وطرق تحليل الشاشة

  4. تشغيل تقييمات قياس الأداء محليًا أو على Azure ML

  5. تحليل مقاييس أداء الوكيل والسجلات

حالات استخدام Windows Agent Arena

  • قياس أداء وكلاء الذكاء الاصطناعي
  • أبحاث أتمتة سطح المكتب
  • تطوير الوكلاء المتعدد الوسائط
  • أبحاث الذكاء الاصطناعي القابلة للتكرار
  • دراسات التفاعل بين الإنسان والذكاء الاصطناعي

الأسئلة الشائعة من Windows Agent Arena

تقييمات Windows Agent Arena

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل Windows Agent Arena

Surfer 2، الذي طورته شركة H، هو وكيل استخدام كمبيوتر متعدد المنصات مصمم لأتمتة المهام عبر بيئات سطح المكتب والويب والأجهزة المحمولة. يتفوق على وكلاء الذكاء الاصطناعي الحاليين في…

أدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

Agentforce هي منصة وكلاء ذكاء اصطناعي مصممة لبناء ونشر وكلاء ذكاء اصطناعي مستقلين. تتكامل مع نظام Salesforce البيئي، وتقدم دعمًا على مدار الساعة طوال أيام الأسبوع للموظفين…

أدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

CRAB هو إطار عمل شامل لتقييم وكلاء نماذج اللغة متعددة الوسائط. يوفر دعمًا عبر البيئات، ومقيّمًا بيانيًا، وتوليدًا آليًا للمهام، مما يتيح تقييمًا قويًا لقدرات الوكلاء عبر…

MLOps ونشر النماذج

وكلاء الذكاء الاصطناعي

تطبيق وكيل الذكاء الاصطناعي هو منصة لتطوير ونشر وكلاء الذكاء الاصطناعي. يسمح للمستخدمين بإنشاء وكلاء مخصصين لمهام مختلفة، مع الاستفادة من نماذج الذكاء الاصطناعي المتقدمة. توفر…

أدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

SmythOS هو موفر بنية تحتية لوكلاء الذكاء الاصطناعي مفتوح المصدر مصمم لأتمتة على مستوى المؤسسات. يوفر مجموعة كاملة من هندسة الوكلاء، بدءًا من النماذج الأولية المرئية وصولاً إلى…

مميزةأدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

Microsoft Foundry هي منصة مصممة لمساعدة المؤسسات على بناء ونشر وكلاء الذكاء الاصطناعي. تركز على تبسيط دورة حياة التطوير، مما يمكّن المستخدمين من إنشاء حلول ذكاء اصطناعي مخصصة…

أدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

Microsoft Copilot Studio عبارة عن منصة لإنشاء وكلاء الذكاء الاصطناعي وإدارتهم. قم بإنشاء وكلاء مخصصين يتصلون ببيانات عملك، ويستجيبون لمطالبات اللغة الطبيعية، وأتمتة المهام. انشر…

مميزةأدوات بناء وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي

LangChain هي منصة هندسة وكلاء الذكاء الاصطناعي تمكّن المطورين من بناء واختبار ونشر وكلاء ذكاء اصطناعي موثوقين. توفر أدوات للمراقبة والتقييم والنشر، وتدعم دورة حياة تطوير الوكيل…

مميزةأدوات بناء وكلاء الذكاء الاصطناعي