OlympHill
Agent S logo

Agent Sإطار عمل وكيل واجهة الرسومية مفتوح المصدر يتيح لنموذج اللغة الكبيرة استخدام جهاز الكمبيوتر مثل الإنسان عبر واجهة الكمبيوتر الوكيل.

4.6 (5)
Daniel Nikulshynمراجعة بواسطة Daniel Nikulshyn·تم التحديث يوليو 2026

نظرة عامة

Agent S هو إطار عمل وكيل واجهة الرسومية مفتوح المصدر يتيح لنماذج اللغة الكبيرة التفاعل مع أجهزة الكمبيوتر مثل البشر عبر واجهة الكمبيوتر الوكيل. يسمح الإطار للنماذج اللغوية بالتعلم من التجارب السابقة وتنفيذ المهام المعقدة بشكل مستقل على جهاز الكمبيوتر. تم تصميم Agent S لشاشات أحادية الشاشة ويدعم منصات Linux و Mac و Windows. لقد حقق الإطار نتائج متقدمة على مختلف المعايير، بما في ذلك OSWorld و WindowsAgentArena و AndroidWorld. Agent S3، أحدث إصدار، تجاوز أداء الإنسان على OSWorld بنتيجة 72.60%. كما أظهر قدرات قوية على التعميم الصفري اللقطات. يوفر Agent S بنية تحتية مرنة ومعيارية لبناء وكلاء واجهة الرسومية. يتضمن الإطار مكتبة تسمى gui-agents، والتي تسمح للمستخدمين بدمج Agent S بسهولة مع تطبيقاتهم. تدعم المكتبة منصات متعددة وتوفر عملية تثبيت بسيطة. يتم التركيز في تطوير Agent S على تقدم قدرات الوكلاء الرسومية المستقلة. للإطار إمكانيات استخدام في تطبيقات مختلفة، بما في ذلك الأتمتة، بحث الذكاء الاصطناعي، ورؤية الكمبيوتر. ومع ذلك، يجب على المستخدمين توخي الحذر عند تشغيل Agent S، حيث أنه يتحكم في الكمبيوتر عن طريق تشغيل كود Python.

الميزات الرئيسية

  • التفاعل المستقل مع أجهزة الكمبيوتر
  • واجهة الكمبيوتر الوكيل
  • يدعم Linux و Mac و Windows
  • التحكم في الكود باستخدام Python
  • تحسين أداء Best-of-N السلوكي
  • مكتبة gui-agents

التسعير

النموذج
Free
التقييم
4.6 / 5 (5)

حالات الاستخدام

أتمتة سير العمل على سطح المكتب

استخدم وكيلًا مدفوعًا بنموذج اللغة للتنقل عبر الواجهات الرسومية، والنقر على الأزرار، وملء النماذج عبر التطبيقات، والقضاء على التكرار اليدوي للمهام الروتينية للكمبيوتر.

بناء وكلاء استخدام الكمبيوتر المخصصين

يمكن للمطورين الاستفادة من الإطار المفتوح المصدر وواجهة الكمبيوتر الوكيل لتصميم ونشر وكلاء نماذج اللغة التي تتفاعل مع أنظمة التشغيل مثل المستخدم البشري.

بحث على قدرات الوكلاء الرسومية

يوفر إطارًا قابلًا للتكرار للأكاديميين وباحثي الذكاء الاصطناعي لقياس أداء نماذج اللغة في مهام التفاعل مع الكمبيوتر في العالم الحقيقي.

اختبار جودة تطبيقات سطح المكتب

نشر وكيلًا لممارسة سير العمل الرسومية في منتجات البرامج، والتحقق من سلوك واجهة المستخدم عبر السيناريوهات دون الحاجة إلى كتابة كل خطوة يدويًا.

المزايا والعيوب

المزايا

  • يحقق أداءً على مستوى الإنسان على OSWorld
  • قوي في التعميم الصفري اللقطات
  • أبسط وأسرع وأكثر مرونة من الإصدارات السابقة

العيوب

  • يتطلب استخدامًا حذرًا بسبب قدرته على التحكم في الكمبيوتر
  • لا يوجد وضوح بشأن القيود المفروضة على استخدام شاشات متعددة الشاشات

سجل المعارك

عبر 1 معركة في البانثيون.

0
الأول
0
الثاني
0
الثالث

Last battle

المراجعات

4.6

المتوسط من 5 تقييم.

5
3
4
2
3
0
2
0
1
0

سجّل الدخول لكتابة مراجعة.

Yuki Mori

Yuki Mori

Apr 28, 2026

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on the API, and it is genuinely easy to set up caught me off guard. Pricing gets steep at scale is why this isn't a perfect score, still, I'd recommend giving it a real trial.

Leila Hassan

Leila Hassan

Apr 19, 2026

Compared a few options

Evaluated this against two competitors. Where it wins: the onboarding and it saves real time. Where it lags: a few rough edges remain. On balance the feature set — especially the dashboard — justifies the 5 stars for our use case.

HT

Hiroshi Tanaka

Dec 1, 2025

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on the onboarding, and the value for money is strong caught me off guard. The docs could be deeper is why this isn't a perfect score, still, I'd recommend giving it a real trial.

Olga Ivanova

Olga Ivanova

Oct 4, 2025

Years in this space

I've evaluated a lot of these over the years. What stands out here is the dashboard — handled better than most — and the value for money is strong. Pricing gets steep at scale is my one real gripe. Worth the time if this is your use case.

Kwame Mensah

Kwame Mensah

Jul 21, 2025

Years in this space

I've evaluated a lot of these over the years. What stands out here is the core workflow — handled better than most — and the value for money is strong. A few rough edges remain is my one real gripe. Worth the time if this is your use case.

أسئلة وأجوبة

ماهو استخدامات شائعة ل Agent S?

تُصّمم Agent S من أجل المهام التي يحتاج فيها لغة التعلم العميق تشغيل تطبيقات GUI على الحاسوب بمنظور البشر، مثل تلقيم تدابير العمل وتفاعل برامج لاتحتوي على واجهات برمجة تطبيقات API أو أبحاث في العوامل التي يستخدمها الإنسان في إدارة الحواسيب عبر واجهة Agent-Computer Interface.

Asked by Grace Okafor · Apr 25, 2026

هل يمكن استعمال Agent S مجاناً، كما يمكن لي التخزين الداخلي أو تعديله؟

نعم. يتمتع Agent S بنظام مفتوح المصدر، مما يعطيه القدرة على الاستخدام الداخلي والتعديل بما يناسب شروط الترخيص. وهذا يجعل مناسباً لجميع مطوري البرمجيات والباحثين kteří أمل في التحكم الكامل في سلوك العميل والدمج.

Asked by Kwame Mensah · Apr 21, 2026

ما هو Agent S؟ كيفية تفاعله مع الجهاز؟

يتمتع Agent S بنظام GUI مفتوح المصدر يمكنه تشغيل نموذج لغوي ضخم بعمليات مثل المستخدم البشري عليه. يستفيد من واجهة عميل-جهاز ACI، مما يسمح بتصفية التطبيقات البصرية وسيطرة عليها.

Asked by Diego Fernández · Jan 31, 2026

اطرح سؤالاً

بدائل لـ فرームورك تطوير एजنت الذكية

Wildcard AI / agents.json logo

Wildcard AI / agents.json

فرームورك تطوير एजنت الذكية

اصتياد المواصفات المفتوحة والمنصة التي يقودها المجتمع لربط الوكلاء الذكاء الاصطناعي بواجهات برمجة التطبيقات وغيرها من التقنيات الذكية.

5.0 (6)
Freemium
Strands Agents logo

Strands Agents

فرームورك تطوير एजنت الذكية

مفتوح المصدر ودمج SDK للمشاريع السحابية والبيئات الموحدة

5.0 (5)
Freemium
BabyCatAGI logo

BabyCatAGI

فرームورك تطوير एजنت الذكية

اطبكي أذكى بسرعة مع BabyCatAGI

4.8 (6)
Free
Awesome MCP Servers logo

Awesome MCP Servers

فرームورك تطوير एजنت الذكية

خدمة رائعة لخوادم بروتوكول سياقات النموذج

4.8 (5)
Free
Gemma 3 logo

Gemma 3

فرームورك تطوير एजنت الذكية

نموذج ذكاء اصطناعي مفتوح المصدر محسّن لأداء وحدة معالجة الرسومات الفردية، يدعم المدخلات المتعددة الوسائط و أكثر من 140 لغة.

4.8 (5)
Free
Rasa logo

Rasa

فرームورك تطوير एजنت الذكية

منصة مفتوحة المصدر لبناء مساعدي المحادثة والصوت على مستوى الإنتاج

4.8 (5)
Freemium
BabyElfAGI logo

BabyElfAGI

فرームورك تطوير एजنت الذكية

جربة ذكاء صناعي مبتدئة مع إطار وكيل ذاتي تفاعلي ذو بنية وحداتية لصف المهارات للجداول التخطيط والمهام المرنة.

4.8 (4)
Free
Auto-GPT logo

Auto-GPT

فرームورك تطوير एजنت الذكية

عمى الالة ذكية اصطناعية مستقلة قادرة على تنفيذ المهام المعقدة باستخدام نماذج GPT.

4.8 (4)
Free