تشغيل Claude Code و Codex و Copilot و Cursor و Grok بالتوازي — من علامة تبويب متصفح واحدة
تشغيل Claude Code و Codex و Copilot و Cursor و Grok بالتوازي — من علامة تبويب متصفح واحدة
ما الذي حدث
ظهر مشروع جديد مفتوح المصدر يُدعى many‑ai‑cli (للمطور ishizakahiroshi) على GitHub. هذا المشروع مكتوب بلغة Go، ويتيح للمطورين إطلاق واجهات سطر الأوامر الرسمية لكل من Claude Code و OpenAI Codex CLI و GitHub Copilot و Cursor (وضع الوكيل لسطر الأوامر) و Grok CLI بشكل متزامن. تنتظر التعديلات أو الإجراءات من كل جلسة الموافقة داخل لوحة تحكم ويب موحدة — مبنية باستخدام xterm.js و WebSockets وتطبيق ويب تقدمي (PWA) يعمل من الهاتف.
المستودع صغير (4 نجوم وقت كتابة هذا المقال) وتجريبي بشكل واضح. لكن الفكرة في الصميم: بدلاً من تشغيل كل مساعد برمجة واحداً تلو الآخر، تقوم بإرسال نفس الموجه إلى خمسة وكلاء بالتوازي ومقارنة مخرجاتهم في الوقت الفعلي.
لماذا تشغيل وكلاء البرمجة بالذكاء الاصطناعي بالتوازي مهم الآن
سوق البرمجة بمساعدة الذكاء الاصطناعي مزدحم. تتأرجح الفرق بين Cursor و Copilot و Codex و Claude Code ولاعبين ناشئين آخرين قبل الالتزام بسير عمل يلامس كود الإنتاج. يحول التنفيذ المتوازي التفضيل الشخصي "أنا أحب ذلك" إلى مقارنة قابلة للملاحظة:
- جودة المخرجات جنباً إلى جنب: ترى من يتعامل مع المتطلبات الغامضة بشكل أفضل، ومن يهلوس بمكتبات API، ومن يكتب كوداً متقناً.
- موافقات واعية بالمخاطر: لأن تغييرات كل وكيل المقترحة تنتظر خلف بوابة موافقة/رفض واحدة، يمكنك رفض التعديلات غير الآمنة مبكراً — وهو شيء تسهل إغفاله في حلقات سطر الأوامر المنفردة.
- مفاضلات السرعة مقابل التكلفة: تشغيلهم معاً يكشف الاختلافات في استخدام الرموز وعدد التكرارات لنفس المهمة.
- يقلل من احتكاك التقييم: تبديل السياقات بين خمس محطات طرفية مؤلم. علامة تبويب متصفح واحدة تجلب المقارنة إلى المؤسسين وقادة التقنية وحتى المستخدمين غير التقنيين الذين يحتاجون لإبداء الرأي.
من ينبغي أن يهتم
المؤسسون وقادة الهندسة
قبل الشراء في خطة مؤسسية أو وكيل مرتبط ببيئة تطوير متكاملة (IDE)، يمكنك اختبار المرشحين تحت الضغط على موجهات داخلية تمثيلية (إعادة هيكلة دالة قديمة، توليد كود نمطي، أو إنشاء هيكل لخدمة مصغرة). لوحات التشغيل المتوازي تجعل هذا الاختبار قابلاً للتكرار وسريعاً.
المطورون ومهندسو المنصات
يمكنك العبث بالمشروع نفسه، أو توسيعه بنقاط نهاية نماذج مخصصة، أو استخدامه لبناء مجموعة معايير داخلية. تُظهر بنية WebSocket + PWA أيضاً كيفية جعل أدوات الوكيل ملائمة للجوال لسيناريوهات الموافقة أثناء المناوبة.
المسوقون ومنشئو المحتوى التقني
العرض التوضيحي الحي ذو المخرجات المتوازية هو وسيلة عالية المصداقية لتوضيح الاختلافات بين المساعدين في فيديو، درس تعليمي، أو عرض تقديمي — وهو أكثر إقناعاً بكثير من لقطات الشاشة المنتقاة.
حالات استخدام عملية
- مباراة النماذج اليومية: كل صباح، قم بتشغيل نفس تحدي البرمجة عبر الوكلاء لاكتشاف التراجعات أو التحسينات بعد تحديثات API.
- مراجعة الكود بأمان أولاً: اسمح للوكلاء باقتراح تغييرات ولكن أجبر بشرياً على الموافقة على كل تعديل من الهاتف، حتى عندما تكون المحطة الطرفية غير قابلة للوصول.
- جلسات قرار الفريق: اعرض لوحة تحكم واحدة خلال جلسة تخطيط السبرنت وقيم بشكل جماعي أي وكيل يكتب أنظف تجهيزات اختبار.
- تحليل تكلفة المزودين المتعددين: تتبع استهلاك الرموز لكل وكيل جنباً إلى جنب لإعلام تخصيص الميزانية لأعباء عمل Anthropic API أو OpenAI.
محدوديات ومخاطر يجب مراقبتها
هذه أداة تجريبية ما قبل الإصدار الأول بدون معايير منشورة، والمستودع ليس معتمداً على نطاق واسع بعد. ضع هذه النقاط في الاعتبار:
- استقرار غير موثق: كود Go ولوحة تحكم WebSocket حديثان. توقع حالات شاذة حول الجلسات المتزامنة وخصائص سطر الأوامر الخاصة بكل وكيل.
- تكلفة API يمكن أن تتضاعف بسرعة: تشغيل خمسة وكلاء على موجه واحد يحرق رموزاً من خمسة مزودين بالتوازي. لا يوجد حارس ميزانية مدمج حتى الآن.
- سطح الأمان: تعريض جلسات سطر الأوامر عبر واجهة ويب (حتى محلياً) يتطلب تهيئة شبكة دقيقة. تضيف واجهة الموافقة طبقة، لكن الإعدادات الافتراضية قد تحتاج إلى تحصين قبل الاستخدام الإنتاجي.
- توفر سطر أوامر الوكلاء يتغير: تعتمد الأداة على بقاء سطر الأوامر الرسمي لكل مزود متوافقاً. تغيير جذري في OpenAI Codex CLI أو Grok CLI يمكن أن يكسر الجلسة بصمت حتى يقوم المجتمع بتصحيحها.
- لا توجد مقاييس تقييم مدمجة: تعرض لوحة التحكم المخرجات والتعديلات ولكنها لا تسجل الصحة، أو زمن الاستجابة، أو التكلفة. أنت تقدم حكمك الخاص.
كيف تقيم أدوات البرمجة بالذكاء الاصطناعي عند استخدام مشغل متوازي
أداة مثل many‑ai‑cli تلغي تبديل السياق، لكنك لا تزال بحاجة إلى إطار تقييم قوي. بدونه، يصبح المخرج المتوازي مجرد "علامات تبويب أكثر". استخدم هذه المعايير:
- الصحة: هل يترجم الكود/يعمل ويلبي الموجه تماماً؟
- جودة الكود وأسلوبه: تحقق من الالتزام باتفاقيات مشروعك وأنماط اللغة المتقنة.
- كفاءة الرموز: قس الرموز المستهلكة لكل حل صحيح — وكيل يشبه الهمس يحرق نافذة سياق ضخمة قد يكلف أكثر من نموذج مطول لكن رخيص.
- قدرة التصحيح الذاتي: إذا رفضت اقتراحاً، كيف يتكيف الوكيل في التكرار التالي؟
- إعدادات الأمان الافتراضية: هل تتجنب تنفيذ أوامر خطيرة ما لم يُسمح بها صراحة؟
عندما تقارن أدوات مثل Claude Code و OpenAI Codex CLI و GitHub Copilot و Cursor جنباً إلى جنب باستخدام تلك المعايير، تظهر الأنماط بسرعة — غالباً في ظهيرة واحدة من الاختبار.
الأسئلة الشائعة
هل أحتاج إلى مفاتيح API مدفوعة لجميع الوكلاء الخمسة؟
نعم. يتطلب كل سطر أوامر وصولاً موثقاً إلى خدمته المعنية. خطط لسقف ميزانية قبل إطلاق العديد من الجلسات المتوازية، لأن التكاليف تتراكم في الوقت الفعلي.
هل يمكنني تشغيل هذا بأمان من هاتفي دون تعريض جهازي؟
يستخدم تطبيق الويب التقدمي (PWA) WebSockets ويمكن تقديمه عبر شبكة محلية أو من خلال نفق محصن. يوفر المشروع واجهة الموافقة، لكن النشر الآمن هو مسؤوليتك. تعامل معه مثل أي وصول طرفي عن بُعد.
هل هذا بديل لبيئة تطوير متكاملة (IDE) مخصصة بمساعد برمجة؟
لا. إنه طبقة تقييم ومقارنة، وليس تكاملاً مع بيئة تطوير متكاملة. إنه يكمل أدوات مثل GitHub Copilot داخل المحرر أو Cursor IDE بمنحك بيئة محايدة لقياس أداء الوكلاء قبل إدخالهم في سير عمل المحرر اليومي.
ماذا لو أردت فقط مقارنة وكيلين، وليس الخمسة جميعاً؟
الهندسة معيارية. يمكنك تهيئة فقط سطور الأوامر التي تهتم بها، مما يقلل التعقيد والتكلفة. ابدأ بالزوج الأكثر صلة بمجموعتك التقنية وتوسع لاحقاً.