تجدر الإشارة إلى أن كلا من OpenAI وAnthropic مفتوحان المصدر لعملاء CLI للتشفير على GitHub، مما يسمح للمطورين بفحص التنفيذ مباشرة، في حين أنهم لا يفعلون الشيء نفسه مع ChatGPT أو واجهة الويب Claude.

نظرة رسمية داخل الحلقة

يركز منشور بولين على ما يسميه “حلقة الوكيل”، وهو المنطق الأساسي الذي ينظم التفاعلات بين المستخدم ونموذج الذكاء الاصطناعي والأدوات البرمجية التي يستدعيها النموذج لأداء أعمال الترميز.

كما كتبنا في ديسمبر، في قلب كل عميل للذكاء الاصطناعي توجد دورة متكررة. يأخذ الوكيل المدخلات من المستخدم ويقوم بإعداد مطالبة نصية للنموذج. يقوم النموذج بعد ذلك بإنشاء استجابة، والتي إما تنتج إجابة نهائية للمستخدم أو تطلب استدعاء أداة (مثل تشغيل أمر shell أو قراءة ملف). إذا طلب النموذج استدعاء أداة، يقوم الوكيل بتنفيذه، وإلحاق الإخراج بالموجه الأصلي، والاستعلام عن النموذج مرة أخرى. تتكرر هذه العملية حتى يتوقف النموذج عن طلب الأدوات وينتج بدلاً من ذلك رسالة مساعدة للمستخدم.

يجب أن تبدأ عملية التكرار هذه في مكان ما، ويكشف منشور بولين كيف تقوم Codex بإنشاء الموجه الأولي الذي يتم إرساله إلى واجهة برمجة تطبيقات الاستجابة الخاصة بـ OpenAI، والتي تتعامل مع الاستدلال النموذجي. تم إنشاء الموجه من عدة مكونات، لكل منها دور معين يحدد أولويته: النظام أو المطور أو المستخدم أو المساعد.

يأتي حقل التعليمات إما من ملف تكوين محدد من قبل المستخدم أو من التعليمات الأساسية المجمعة مع واجهة سطر الأوامر (CLI). يحدد حقل الأدوات الوظائف التي يمكن أن يستدعيها النموذج، بما في ذلك أوامر shell وأدوات التخطيط وإمكانيات البحث على الويب وأي أدوات مخصصة مقدمة من خلال خوادم بروتوكول سياق النموذج (MCP). يحتوي حقل الإدخال على سلسلة من العناصر التي تصف أذونات وضع الحماية وتعليمات المطور الاختيارية وسياق البيئة مثل دليل العمل الحالي وأخيرًا الرسالة الفعلية للمستخدم.

شاركها.
اترك تعليقاً