Skip to main content

ما الذي نجح، لا ما الذي حدث فقط

الذاكرة تُخبر وولفيش بما حدث. حلقة التغذية الراجعة تُخبره بما نجح. وحدة basalganglia تُسجِّل نتيجة كل استدعاء أداة — هل نجح، وهل وافقت على العمليات المُعلَّمة أو رفضتها، وما الذي حُظر تمامًا. بمرور الوقت، يبني هذا تفضيلات سلوكية مُتعلَّمة بدون برمجة صريحة.

الموقع

تُكتب إدخالات التغذية الراجعة في ملف واحد لكل يوم، بالإلحاق فقط. نتائج كل يوم تتراكم في ملف ذلك اليوم، والملفات القديمة تُحفظ. الملفات الخام لا تدخل الموجه أبدًا — بل تُغذّي خلاصة مُدمجة (أدناه) وتبقى قابلة للبحث بالكامل على القرص.

خمسة أنواع من النتائج

كيف تُسجَّل التغذية الراجعة

بعد كل استدعاء أداة، تُلحق basalganglia.recordOutcome() إدخالًا:
كل إدخال يلتقط:
  • الطابع الزمني — متى حدث
  • اسم الأداة — أي قدرة استُدعيت
  • النتيجة — success أو failed أو denied أو approved أو blocked
  • المعاملات المقتطعة — ما تم تمريره (بحد أقصى ~200 حرف؛ النسخة الكاملة تعيش في brain/conversations/*.json)
  • التفصيل — سبب الرفض، أو الخطأ، أو معاينة المخرج، بحسب النتيجة

أمثلة على إدخالات التغذية الراجعة

كيف تؤثر التغذية الراجعة على السلوك

كانت ملفات التغذية الراجعة الخام تُلصق في كل موجه — عشرات الآلاف من رموز النصوص، معظمها ضوضاء. هذا انتهى. basalganglia.getPreferences() الآن يطوي آخر 7 أيام في خلاصة تفضيلات محدودة الحجم (~500 رمز، بسقف صارم عند 2,400 حرف) من ثلاثة أجزاء مُقيَّدة الحجم:
  1. سطر الموثوقية — إجمالي استدعاءات الأدوات، معدل النجاح، الأدوات الأكثر استخدامًا
  2. سطر المرفوضات الأخيرة — الأدوات التي رفضتها (لا تُكرَّر إلا إذا طُلبت مجددًا)
  3. التصحيحات الأخيرة — أحدث الإخفاقات والرفضات مع سببها، حتى لا يدخل المُخطِّط طريقًا مسدودًا معروفًا (بحد أقصى 12، الأحدث أولًا)
الاستدعاءات الناجحة عمدًا لا تُعدَّد — تلك كانت مصدر الفيضان. تنتهي الخلاصة بمؤشر: السجل الكامل خطوة بخطوة لأي يوم على بُعد استدعاء wolffish_recall واحد، وmemory_search مع sources: "feedback" يبحث في كل إدخال سُجِّل على الإطلاق.
الخلاصة تشغل واحداً من موضعي الذاكرة المحيطة الوحيدين في موجه النظام — والآخر هو كعب التغطية <memory_map>. ومنذ الإصدار 1.0.233 صار هذا الموضع الأول من نصيب الدليل العمليّ للمراجعة الذاتيّة متى وُجد؛ وتبقى الخلاصة احتياطَ الانطلاقة حتى تجري أولُ مراجعة ليلية. كل شيء آخر يُسترجع عند الطلب. ملف اليوم مُستبعد من الخلاصة (أفعال اليوم مرئية أصلًا في الخيط الحي)، ما يُبقي الكتلة ثابتة البايتات عبر حلقة أدوات الدور الواحد، فيتمكن المزودون من إعادة استخدام بادئة الموجه المُخزَّنة مؤقتًا.

الواجهة

يُتيح basalganglia طريقتين:

ما يتعلمه نموذج اللغة

بمرور الوقت، تظهر أنماط من التغذية الراجعة المتراكمة:
بعد عدة نتائج success على التزامات بتنسيق conventional (feat:، fix:، chore:)، يتعلم نموذج اللغة استخدام هذا التنسيق دائمًا. إذا سبق أن رُفض (denied) التزام غير conventional، فذلك التصحيح يركب في الخلاصة.
إذا وافقت باستمرار على دفع git إلى فروع الميزات، يتعلم وولفيش أن هذه عمليات منخفضة المخاطر. إذا رفضت باستمرار الدفع القسري، يُعلِّمه سطر الأدوات المرفوضة تجنُّب اقتراحها — أو تعليمها بشكل أبرز.
بعد نتيجة failed من أسلوب معين (مثلاً: البحث في موقع داخلي غير مُفهرَس)، يُخبر التصحيح — بتفاصيل خطئه — نموذج اللغة بتجربة أساليب بديلة في المرة القادمة (مثلاً: سؤالك عن الرابط مباشرة).
إذا نجحت أوامر pnpm دائمًا لكن أمر npm رُفض مرة، يتعلم نموذج اللغة تفضيل مدير الحزم الخاص بك من النتائج — وليس فقط من preferences.md.

ينمو معك

هذه هي الآلية التي تجعل وولفيش تكيفيًا بمرور الوقت. إنه لا يتذكر الحقائق فقط (هذا ما تفعله ملفات المعرفة) — بل يتذكر ما نجح عمليًا. هذا المزيج يُنشئ وكيلًا:
  1. يعرف تفضيلاتك (المعرفة) — ما قلت أنك تريده
  2. يعرف ما ينجح فعلًا (التغذية الراجعة) — ما أنتج نتائج جيدة
  3. يتجنب الأخطاء السابقة (التصحيحات) — ما الذي لم ينجح سابقًا
  4. يراجع المحادثات كاملةً (المراجعة الذاتية) — دروسٌ ليلية تتقطّر في دليلٍ عمليّ، تُرسيها تقييماتُك للأدوار من 0 إلى 10
حلقة التغذية الراجعة هي الأقوى لأنماط استخدام الأدوات. إذا وجدت وولفيش يقترح أسلوبًا لا تحبه باستمرار، ارفضه مرة صراحة واشرح السبب. الرفض + السبب يُسجَّل، ويظهر في قائمة التصحيحات، ويُشكِّل السلوك المستقبلي.

فحص وتعديل التغذية الراجعة

ملفات التغذية الراجعة هي Markdown عادي. يمكنك:
  • قراءتها لفهم لماذا يتصرف وولفيش بطريقة معينة
  • حذف إدخالات لـ “إلغاء تعلُّم” نمط (مثلاً: حذف رفضات قديمة لم تعد سارية)
  • إضافة إدخالات لتغذية السلوك (مثلاً: إضافة رفض لـ rm -rf / حتى لو لم يحدث أبدًا)
حذف جميع الملفات في مجلد basalganglia يُعيد تعيين جميع التفضيلات السلوكية المُتعلَّمة. سيظل لدى وولفيش ملفات المعرفة والأحداث، لكنه يفقد إحساسه بما نجح وما لم ينجح. هذه صفحة بيضاء لنظام المكافآت فقط.

التغذية الراجعة مقابل المعرفة