تحويل كل تصحيح عامل إلى تحسين النظام
Type: Learn + Build
Languages: Python (stdlib)
Prerequisites: Phase 14 lessons 37 to 41
Time: ~65 minutes
أهداف التعلم
- تحويل تصحيحات الوكيل إلى التحكمات الدائمة.
- ضع كل جهاز تحكم في أول طبقة يمكن أن تمنع تكرار.
- إعادة تكرار الدروس مع بصمات أصابع مستقرة
- إقلاع التحكمات التي لم تعد تحمي المخاطر الحقيقية.
التصحيحات هي دليل
عندما تخبر وكيل لا تعديل هذا الملف، تعلمت أن حدود النطاق لم تكن قابلة للتنفيذ. عندما تقول هذا الشكل الخارجي خاطئ، تعلمت أن هناك مثال أو اختبار مفقود. عندما تفشل الإعداد مرة أخرى، تعلمت أن معرفة البيئة تنتمي إلى التلقائية.
تعامل التعديل كلاحظة عن نظام العمل، وليس كخيبة كتابة على الفور.
التقدم إلى أول طبقة فعالة
استخدم هذا الترتيب:
| Recurring failure | Durable destination |
|---|---|
| Wrong result or regression | Test or evaluation |
| Off-scope or unsafe action | Scope or permission policy |
| Repeated setup or command mistake | Automation or tool |
| Repeated output-format mistake | Canonical example plus validator |
| Ambiguous local convention | Instruction with a scenario check |
| Product disagreement | Human decision record |
التحكمات السابقة أرخص. النوع الذي يمنع حالة غير صالحة أقوى من تعليق مراجعة الذي يلتقطها لاحقا. الاختبار المركز أقوى من الفقرة التي تطلب من الوكيل أن يتذكر.
flowchart LR
O[Observed correction] --> C[Find root cause]
C --> T{Earliest owner}
T --> E[Example or type]
T --> V[Test or evaluation]
T --> S[Scope or policy]
T --> A[Automation]
T --> H[Human decision]
E --> N[Next run starts stronger]
V --> N
S --> N
A --> N
H --> Nسجل راتشيت
التقاط:
- الأعراض
- السبب الجذري
- النتائج
- عدد التكرار
- التحكم المختار
- التحقق من التحكم
- المالك
- تاريخ مراجعتها أو تقاعدها
لا تعزز كل تفضيل فريد، ولكن تعزز تصحيح عندما يبرر التكرار أو التأثير تعقيدًا دائمًا.
سبب منفصل عن الأعراض
الوكيل الذي تم تحريره على README هو أعراض.
- المهام سمحت لجذر المخبأ
- كانت الوثائق تعتبر آمنة بشكل ضمني.
- تنفيذ خطة المجموعة والوثائق؛
- كان لدى عمالين ملكية متداخلة
كل سبب ينتمي إلى نظام مختلف، قاعدة تكرر العلامة فقط سوف تفشل في الحالة التالية مختلفة قليلا.
السيطرة أيضاً تتدهور
يمكن أن تتعارض التحكمات القديمة، وتتفجير السياق، وتشفير نظام لم يعد موجودًا. كل قاعدة مدعومة تحتاج إلى مراجعة التقاعد. إزالتها أو إعادة كتابتها عندما:
- تغير الهندسة المعمارية الأساسية؛
- تم استبدالها بمراقبة أكثر قوة قابلة للتنفيذ.
- لم تتكرر الفشل عبر نافذة ذات مغزى؛
- التحكم يخلق مزيدا من الاحتكاكات أكثر من المخاطر التي يمنعها
الهدف ليس أطول ملف تعليمات بل هو أصغر نظام يحافظ على الحكم الذي حصل عليه بجد
بناءها
المختبر يصنف التعديلات، ويعززها في التحكم، ويعيد نقل بصمات الأصابع، ويكتب outputs/feedback-ratchet.json. . .
أركض
bashpython3 code/main.py
python3 -m unittest discover code/tests -vأضف اثنين من التعديلات المختلفة التي لها نفس السبب. تحسين التطبيع حتى تتراجع إلى جهاز واحد دون انهيار فشل غير مرتبط.
التمارين
- خذ خمسة تصحيحات من جلسة تشفير حديثة وتصنيف أصحابها الحقيقيين.
- استبدل قاعدة في النص مع اختبار يمكن تنفيذه.
- إضافة وزن التأثيرات حتى يتم تعزيز حدوث أول حدوث حاد على الفور.
- أضف صاحب وتاريخ التقاعد إلى نتائج المختبر
- مراجعة تعليمات وكيل موجودة وحذفها فقط بعد إثبات وجود مراقبة أقوى.
المزيد من القراءة
- Basili, Caldiera, and Rombach, The Goal Question Metric Approach، لتحويل الأهداف إلى أسئلة وقياسات عمليات.
- Shinn et al., Reflexion، لاستخدام آثار المراجعة لتحسين القرارات اللاحقة دون تغيير أوزان النموذج.
- Madaan et al., Self-Refine، للردود التكراري والإصلاح داخل حلقة المهام.
ما تحافظ عليه
إبقoutputs/feedback-ratchet.jsonإنها نهاية دائمة لمسار الهندسة بمساعدة العملاء ومقدمة لتغييرات مقاعد العمل في المستقبل.
This free lesson is part of the AI Engineering from Scratch curriculum. Read the full explanation, run the lesson code, and verify the result in the interactive reader or from the repository source.
Browse the complete course catalog or open this lesson on GitHub.