تخطَّ إلى المحتوى الرئيسي
Vantaige
ChatGPT Agent screenshot

ChatGPT Agent هو الوكيل المستقل الموحد من OpenAI، تم إطلاقه في 17 يوليو 2025، ليحل محل كل من Operator و Deep Research. يقوم بتصفح الويب، وتشغيل التعليمات البرمجية، وملء النماذج، وتجميع الأبحاث داخل ChatGPT في خطط Plus ($20/شهرياً) و Pro ($200/شهرياً).

الميزات:Mobile App

ChatGPT Agent هو الوكيل المستقل الموحد المدمج في ChatGPT، والذي أصدرته OpenAI في 17 يوليو 2025. وقد حل محل منتجين مستقلين سابقين: Operator، الذي كان يتولى تصفح الويب وملء النماذج، و Deep Research، الذي كان يجمع الأبحاث من مصادر متعددة في تقارير. والنتيجة هي "وضع وكيل" (agent mode) واحد يمكن اختياره من واجهة كتابة ChatGPT، وهو متاح للمشتركين في خطط Plus و Pro و Team و Enterprise. عند تنشيطه، يعمل الوكيل على جهاز افتراضي سحابي مزود بمتصفح خاص به، ووحدة تحكم (terminal)، وبيئة لتنفيذ التعليمات البرمجية، مما يتيح له إنجاز مهام متعددة الخطوات بأقل قدر من التدخل من المستخدم.

تشمل القدرات الأساسية التصفح المباشر للويب مع إمكانية النقر وملء النماذج، وتنفيذ التعليمات البرمجية عبر وحدة التحكم، وإنشاء التقويمات والمستندات (بما في ذلك العروض التقديمية القابلة للتحرير)، وتجميع الأبحاث من مصادر متعددة، والتكامل مع ChatGPT Connectors مثل Gmail و GitHub. سجل الوكيل 41.6% في اختبار Humanity's Last Exam باستخدام الأدوات عند الإطلاق (تصل إلى 44.4% مع الاستدلال المتوازي) وتصدر معيار BrowseComp بنسبة 68.9%، مما يضعه بين أقوى وكلاء تصفح الويب المتاحين للجمهور. في خطة Plus، يحصل المستخدمون على 40 مهمة وكيل شهرياً؛ بينما يحصل مستخدمو Pro على 400 مهمة.

ما الذي يفعله ChatGPT Agent فعلياً في يوليو 2025

أطلقت OpenAI أداة ChatGPT Agent في 17 يوليو 2025، وهو نفس اليوم الذي أوقفت فيه منتج Operator المستقل على operator.chatgpt.com. وصفه Sam Altman على منصة X بأنه يجمع بين "روح Deep Research و Operator، ولكنه أقوى من ذلك". أدى هذا الدمج إلى حل شكوى قديمة للمستخدمين: كان بإمكان Operator النقر والتمرير ولكنه لم يكن قادراً على كتابة تقارير مفصلة؛ وكان بإمكان Deep Research تجميع محتوى الويب ولكنه لم يكن قادراً على التفاعل مع الصفحات الموثقة أو عمليات الدفع. يتعامل ChatGPT Agent مع كليهما ضمن نفس سلسلة المحادثة.

من الناحية العملية، يقبل الوكيل تعليمات باللغة الطبيعية مثل "تحليل ثلاثة منافسين وإنشاء عرض تقديمي" أو "التخطيط وشراء المكونات لإعداد إفطار ياباني لأربعة أشخاص". ثم يقوم بفتح علامات تبويب المتصفح، وقراءة محتوى الصفحة، والتنقل عبر القوائم المنسدلة والنماذج، وتشغيل Python عند الحاجة إلى عمليات حسابية، ويعيد كلاً من الملخص والمخرجات القابلة للتنزيل. تحدث الانتقالات من الدردشة القياسية إلى وضع الوكيل في منتصف المحادثة، بحيث يمكنك طرح سؤال متابعة أو تصحيح مسار الوكيل دون إعادة التشغيل. يتكامل الوكيل أيضاً مع ChatGPT Connectors، مما يعني أنه يمكنه سحب أحداث التقويم، أو قراءة سلاسل رسائل Gmail، أو الدفع إلى مستودعات GitHub عند تكوين هذه الاتصالات. تم تعطيل الذاكرة عمداً في وضع الوكيل لمنع نواقل تسريب البيانات، وهي مقايضة أوضحتها OpenAI صراحةً عند الإطلاق.

"أطلقنا اليوم منتجاً جديداً يسمى ChatGPT Agent. يمثل الوكيل مستوى جديداً من القدرات لأنظمة الذكاء الاصطناعي ويمكنه إنجاز بعض المهام المعقدة والرائعة نيابة عنك باستخدام جهاز الكمبيوتر الخاص به. إنه يجمع بين روح Deep Research و Operator، ولكنه أقوى من ذلك." - Sam Altman (@sama)، X/Twitter، 17 يوليو 2025

موقع ChatGPT Agent مقارنة بـ Manus و Anthropic Computer Use

تحدد ثلاثة منتجات فئة الوكلاء متعددي الأغراض اعتباراً من منتصف عام 2026: ChatGPT Agent و Manus و Anthropic Computer Use. الاختلافات بينها معمارية، وليست مجرد اختلافات شكلية.

يستخدم Manus (من تطوير Monica/Butterfly Effect AI، تم إطلاقه في 6 مارس 2025) نظام تنسيق متعدد الوكلاء. فهو يقسم الطلب المعقد إلى مهام فرعية ويعين كل منها لوكيل فرعي متخصص يعمل في بيئة معزولة (sandbox) خاصة به، ويعالجها بالتوازي. بالنسبة لمهام البحث الواسعة، يعني هذا التعامل مع مئات المصادر بشكل متزامن بدلاً من التسلسلي. يختار Manus أيضاً بين نماذج Claude و Qwen لكل مهمة فرعية بناءً على متطلبات القدرة، مما يمنحه مرونة في النماذج يفتقر إليها ChatGPT Agent. في اختبار مباشر وجهاً لوجه مكون من أربع مهام نشرته Nitika Sharma في Analytics Vidhya في يوليو 2025، فاز Manus بمهمتين (إنشاء عرض تقديمي PPT، والبحث عن التسوق)، وفاز ChatGPT Agent بمهمة واحدة (تحليل البيانات)، وفشل كلاهما في جدولة الأحداث. تبلغ تكلفة Manus $16/شهرياً في فئته الأساسية (Basic) مقابل $20/شهرياً لخطة ChatGPT Plus. المقايضة هنا هي أن Manus منتج منفصل يتطلب حساباً جديداً، بينما يتواجد ChatGPT Agent بالفعل داخل المنصة التي يستخدمها 500 مليون شخص شهرياً.

تتخذ Anthropic Computer Use (واجهة برمجة تطبيقات API، تم إطلاقها في أكتوبر 2024 مع Claude 3.5 Sonnet) نهجاً مختلفاً تماماً: فهي مجرد واجهة برمجة تطبيقات (API) بدون منتج استهلاكي مستضاف. يعمل النظام عن طريق التقاط لقطات شاشة واستخدام التفاعل القائم على الإحداثيات، مما يعني أن Claude يحدد إحداثيات البكسل المرئية للزر، ويحسب مكان النقر، ويصدر الأمر. تتيح هذه البنية المعمارية تشغيله على أي تطبيق سطح مكتب محلي أو عن بُعد، وليس فقط صفحات الويب. يقوم المطورون بدمجه بأنفسهم، والتعامل مع التقاط لقطات الشاشة، وتنفيذ الإجراءات، ومنطق الاسترداد في التعليمات البرمجية الخاصة بهم. يتعامل ChatGPT Agent مع كل هذه البنية التحتية للمستخدمين النهائيين تلقائياً ولكنه مقيد بجهاز افتراضي سحابي (VM) بدون وصول إلى الملفات المحلية. سجلت Anthropic Computer Use نسبة 14.9% في OSWorld (وضع لقطة الشاشة) مقابل أفضل نسبة سابقة بلغت 7.8%، وعلى عكس ChatGPT Agent، فإنها تفرض رسوماً لكل رمز (token) من خلال واجهة برمجة التطبيقات (API) بدون حد أقصى للاشتراك الشهري. بالنسبة للمطورين الذين يبنون مسارات أتمتة قابلة للتكرار، يوفر نموذج API مرونة أكبر؛ أما بالنسبة للعاملين في مجال المعرفة الأفراد الذين يريدون تجربة خالية من الإعدادات، فإن ChatGPT Agent يتفوق من حيث الراحة.

يمكنك مقارنة النظام البيئي الأوسع على Vantaige من خلال قراءة قائمة Manus، و قائمة Claude 4، و قائمة Devin للتعرف على طابع هندسة البرمجيات للوكلاء المستقلين.

كيف يبدو واقع حلقة الوكيل يوماً بعد يوم

يوثق الاختبار المستقل الذي أجراه Evan Sunwall في Nielsen Norman Group (يوليو 2025) أحد أوضح التقييمات للتجربة. كان الاختبار: حجز مطعم في Brennan's of Houston لأربعة أشخاص في وقت الظهيرة، مع ملاحظة وجود حساسية من المحار لأحد الضيوف. أكمل ChatGPT Agent المهمة بشكل صحيح، بما في ذلك تحديد وتمرير القيد الغذائي الذي لم يخصصه المستخدم صراحةً لضيف معين. المشكلة: استغرقت العملية حوالي 17 دقيقة. بينما أنهى إنسان يؤدي نفس المهمة في حوالي دقيقتين. واجه الوكيل تأخيراً لمدة 55 ثانية بسبب إعادة توجيه غير متوقعة من Google Maps وأخطأ في النقر على محدد الفتحة الزمنية قبل أن يصحح نفسه. خلص Sunwall إلى أن الوكيل "يقف على أرضية مهتزة" وحذر من أن "التجارب الأكثر تعقيداً ستكون أكثر عرضة للخطأ وأبطأ".

استغرقت مهام حجز الفنادق في مراجعات أخرى ما يصل إلى 25 دقيقة مع انقطاعات متكررة في منتصف المهمة تطلب من المستخدم تقديم معلومات. أي موقع ويب يستخدم CAPTCHA أو حماية الروبوتات من Cloudflare يوقف الوكيل تماماً، مما يقصي نسبة كبيرة من أهداف التجارة الإلكترونية، وحجز التذاكر، والمواقع المليئة بالنماذج. التأكيدات الخاطئة هي نمط تم الإبلاغ عنه: يذكر الوكيل أنه أكمل إجراءً (إضافة عناصر إلى عربة تسوق Etsy، على سبيل المثال) في حين أن الإجراء فشل بصمت.

"كانت العملية بطيئة للغاية. يقف ChatGPT Agent على أرضية مهتزة، والتجارب الأكثر تعقيداً ستكون أكثر عرضة للخطأ وأبطأ." - Evan Sunwall، Nielsen Norman Group، يوليو 2025

في خطة Plus، يعد الحد الأقصى البالغ 40 مهمة شهرياً هو أكبر قيد عملي. وجد تحليل لأكثر من 5,000 جلسة وكيل أن 73% من مستخدمي Plus يستنفدون مخصصاتهم خلال الأسبوع الأول، مما يخلق ما يسميه المراجعون "قلق الرسائل" حول الحفاظ على عمليات التشغيل. قام Aakash Gupta، وهو مختبر ذكاء اصطناعي نشر تقييماً في يوليو 2025، بتقييم الوكيل بـ 6/10، مشيراً إلى أنه "يقصر عن القدرات التحويلية التي اقترحها التسويق المبكر". يمكن أن تمتد كل مهمة إلى العديد من خطوات الوكيل داخلياً، ولكن المشغل الذي يبدأه المستخدم فقط هو الذي يُحسب ضمن المخصص الشهري، وليس فترات التوقف التوضيحية في منتصف المهمة.

جودة المخرجات للمستندات التي تم إنشاؤها هي نقطة احتكاك أخرى. لاحظ العديد من المراجعين أن العروض التقديمية والتقارير التي أنتجها الوكيل كانت "سيئة التنسيق" مقارنة بما يقدمه ChatGPT القياسي عند إعطائه نفس الطلب كموجه مباشر. يعمل الوكيل على تحسين إكمال المهمة بدلاً من الصقل.

لمن تم بناء ChatGPT Agent

حالات الاستخدام الأكثر وضوحاً هي: العاملون في مجال المعرفة الذين يعيشون بالفعل في ChatGPT ويريدون أتمتة عرضية متعددة الخطوات دون تبني أداة جديدة؛ والباحثون الذين يحتاجون إلى تحليل تنافسي، أو لوجستيات السفر، أو تجميع المصادر عبر عشرات الصفحات؛ وفرق العمل في خطط Team أو Enterprise الذين يرغبون في ربط تكاملات Gmail أو GitHub أو التقويم في مسارات عمل ChatGPT الحالية الخاصة بهم. تتيح تطبيقات الأجهزة المحمولة لنظامي iOS و Android الوصول إلى نفس وضع الوكيل، مما يجعله قابلاً للتطبيق لتفويض المهام أثناء التنقل بطريقة لا تتوفر في معظم المنافسين. حقيقة أن وضع الوكيل يتم تنشيطه داخل محادثة حالية، دون تبديل التطبيقات أو الحسابات، يقلل بشكل كبير من حاجز الدخول مقارنة بالأدوات التي تتطلب إعداداً مخصصاً.

يمكن لفرق التجارة الإلكترونية والبائعين المستقلين استخدام الوكيل للبحث في اتجاهات التسعير، وصياغة أوصاف المنتجات، والتنقل في مواقع الموردين للحصول على عروض أسعار. يجد الطلاب والباحثون الذين يستخدمونه في مسارات عمل التعلم أن الجمع بين التوريد المباشر والتجميع المنظم مفيد لمراجعات الأدبيات والتحليل التنافسي. في خطة Pro، أبلغ المستخدمون المتمرسون عن استخدام الوكيل لأتمتة دورات إعداد التقارير الأسبوعية: فهو يسحب البيانات من المصادر المتصلة، ويكتب الملخص، وينسقه للتوزيع، وهو مسار عمل يتناسب تماماً مع النطاق التشغيلي للوكيل.

بالنسبة لمسارات عمل بحثية محددة، يكمل ChatGPT Agent أدوات مثل Browserbase (الذي يتعامل مع البنية التحتية للمتصفح بدون واجهة رسومية للمطورين الذين يرغبون في البناء فوق التصفح الآلي) و Lindy (الذي يركز على أتمتة سير العمل مع تكاملات التطبيقات الوثيقة). تستحق Lindy المقارنة إذا كان هدفك الأساسي هو الأتمتة بدون تعليمات برمجية (no-code) بين أدوات SaaS بدلاً من التنقل المفتوح عبر الويب.

ما لا يمثله ChatGPT Agent

لا يعد ChatGPT Agent بديلاً لمنصات الأتمتة المخصصة عندما تحتاج إلى تنفيذ مهام متكررة أو برمجية أو ذات حجم كبير. مع 40 مهمة شهرياً في خطة Plus، فإنه لا يتوسع ليناسب مسارات عمل الإنتاج. إنه ليس وكيل حوسبة محلي: ليس لديه وصول إلى نظام الملفات الخاص بك، أو التطبيقات المحلية، أو بيئة سطح المكتب. إنه غير مناسب لأي هدف محمي بواسطة CAPTCHA أو Cloudflare (نسبة كبيرة من مواقع الويب الخاصة بالمعاملات). إنه ليس وكيل برمجة بالمعنى الذي يمثله Devin: يحافظ Devin على بيئة هندسة برمجيات مستمرة مع مستودع خاص به، وبيئة تطوير متكاملة (IDE)، وطبقة تخطيط عبر مشاريع متعددة الجلسات، بينما يعيد ChatGPT Agent تعيين السياق بين الجلسات.

إذا كنت بحاجة إلى وكيل يمكنه العمل على الملفات المحلية وتطبيقات سطح المكتب، فإن Anthropic Computer Use (API) أكثر قدرة من الناحية المعمارية. إذا كنت بحاجة إلى تنفيذ مهام متعددة متوازية عبر مئات المصادر في وقت واحد، فإن البنية المعمارية متعددة الوكلاء لـ Manus تتفوق على حلقة تسلسلية واحدة. إذا كان هدفك هو تسليم التعليمات البرمجية المستقلة عبر مشاريع برمجية كاملة، فإن Devin مصمم خصيصاً لهذا النطاق. يعد ChatGPT Agent طبقة راحة عامة الأغراض للمستخدمين المدمجين بالفعل في النظام البيئي لـ ChatGPT. هذا التموضع مفيد حقاً لعشرات الملايين من الأشخاص، لكن حدوده واقعية وملموسة.

تقييمات المستخدمين

لا توجد تقييمات بعد. كن أول من يشارك تجربته!

سجّل الدخول لكتابة تقييم.

مقالات ذات صلة

أدلة ومقالات ذات صلة بـ ChatGPT Agent.