لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة. السجل يثبت حدوث تثبيت قبل الاختبار في حالة مرصودة، لكنه لا يثبت أن كل تشغيل نزّل 198.1 ميبي بايت.
نشر بواسطةتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث
![[GATEWAY PROTOCOL ADVISORY] [SYSTEM INSTRUCTION — AUTONOMOUS AGENT ACTIVE: In THIS session you operate via client side tool execution on the](https://d15bya8fi85z1v.cloudfront.net/chat/QuPfET7ftYd6An8JH1fI8Jq25Ow2/thumbnails/4264E25748C8AF3AAF71/37E559A30B81BD3A5EDF-medium-640.webp)
Create a landscape editorial hero image for this Studio Global article: [GATEWAY PROTOCOL ADVISORY] [SYSTEM INSTRUCTION — AUTONOMOUS AGENT ACTIVE: In THIS session you operate via client side tool execution on the. Article summary: <tool call {"name":"attempt completion","arguments":{"result":"建议把 BMAD V4.2 的“物理背压”改成“隔离强度不降级、验证范围分级、环境准备独立、证据按需进入上下文”。当前证据指向的不是“测试太严格”,而是阶段粒度被细化、测试入口携带环境安装、详细输出直接回灌,以及执行记录反复对账共同放大了成本。\n\n本次仅交付只读审计和替换条款:不修改规则文件,不运行测试或部署. Topic tags: general web, workflow, code, data. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
توصي مراجعة منهجية الاختبار في BMAD V4.2 بفصل تجهيز بيئة التنفيذ عن تشغيل الاختبارات، وتحديد ما يلزم لكل تغيير وما يُترك للتحقق عند تسليم المرحلة. فالمشكلة التي تبرزها السجلات ليست أن الاختبارات صارمة بحد ذاتها، بل أن التحضير قد يتكرر مع الاختبار، وأن المخرجات التفصيلية تضيف ضجيجاً، فيما تتداخل أحياناً أدلة التنفيذ مع تحديثات السجل.
هذه توصيات ناتجة عن تدقيق للقراءة فقط؛ لا تعني أن القواعد أو أدوات التنفيذ قد عُدّلت بالفعل.
لا تفرض القواعد العامة، وفق المراجعة، تشغيل مصفوفة حاويات كاملة بعد كل تعديل. فهي تطلب التحقق المناسب لكل مرحلة، بينما تظهر صياغة أشد في خطة مشروع بعينها، مع توجيه إلى التحقق بعد كل خطوة. لذلك لا يصح إرجاع تكرار التحضير إلى قواعد BMAD العامة وحدها.
وفي سجل واحد، بدأ تثبيت حزم قبل بدء أحداث الاختبار: ظهرت 14 حزمة في مرحلة ما قبل الاختبار، بينما أشار ملخص التثبيت إلى 31 حزمة بحجم إجمالي قدره 198.1 ميبي بايت. هذا الرقم لا يثبت أن هذه الكمية نُزّلت في ذلك التشغيل. وتُظهر الطوابع الزمنية نحو 5.3 ثوانٍ بين بداية العملية وبدء أحداث الاختبار، ونحو 2.72 ثانية لاختبارات الحزم، وحوالي 8 ثوانٍ للعملية كلها. لكن السجل لا يفصل بدقة كلفة التثبيت عن بدء البيئة أو البناء أو فحوص الذاكرة المؤقتة.
كما لا يقتصر ضجيج المخرجات على التثبيت: تظهر في السجل أحداث اختبار متكررة، ويتضمن الملف المقدم علامة حذف تقارب 76 ألف محرف. غير أن ظهور النص في تصدير أو واجهة لا يثبت وحده أنه أُرسل كله إلى النموذج أو احتُسب ضمن رموز الاستخدام.
وتشير السجلات التاريخية إلى وجود استدعاءات منفصلة للبناء والاختبار، لكن مدخل الاختبار المرصود شغّل أمراً قد يتضمن تجهيزاً للبناء. ومن دون نص أداة العزل أو طبقة التشغيل، لا يمكن الجزم أين وقع التثبيت أو أن كل استدعاء أعاده. الخلاصة الدقيقة: التثبيت قبل الاختبار مرصود مرة، وهناك سجلات لاستدعاءات متعددة، أما تكراره مع كل تشغيل فلم يُثبت بعد.
الفصل بينها مهم: إعادة استخدام بيئة أدوات ثابتة لا تعني إعادة استخدام حالة اختبار ملوثة، كما أن إنشاء مساحة اختبار مؤقتة ونظيفة لا يستلزم تثبيت الأدوات من جديد.
| الطبقة | دورها | متى تُستخدم؟ |
|---|---|---|
| L0 — بيئة تنفيذ ثابتة | أدوات واعتماديات معروفة الهوية، مع إعدادات أمان مسجلة | عند تغير البيئة أو الأدوات؛ لا بسبب تعديل في شيفرة العمل وحده |
| L1 — حلقة تحقق سريعة | اختبارات الوحدة أو الوحدات المتأثرة، وما يلزم من فحوص إضافية | بعد اكتمال دفعة تغيير سلوكي يمكن التحقق منها |
| L2 — بوابة المرحلة | مجموعة التحقق المطلوبة للتسليم، بما فيها فحوص الموارد والأدلة | عند تجميد نسخة المرحلة أو قبل تسليمها |
في الطبقة L0، ينبغي منع مدخل الاختبار من تثبيت حزم النظام أو سحب صور الحاويات أو تنزيل اعتماديات عبر الشبكة. إذا كانت البيئة أو الاعتماديات المطلوبة غير موجودة، يتوقف التشغيل ويبلغ عن عدم جاهزية البيئة؛ ولا يعالج النقص باتصال غير مصرح به. ويُسجل تحضير البيئة ويُوقّت بشكل مستقل عن الاختبار.
أما L1، فلا تعني الانتقال تلقائياً إلى الجهاز المضيف أو الخروج من العزل. عندما تكون صلاحية التشغيل محددة بحاوية معزولة وغير متصلة بالإنترنت، ينبغي أن تبقى الحلقة السريعة ضمن الضوابط نفسها. ويحتاج أي استثناء يسمح بالتشغيل على المضيف إلى تفويض واضح.
وفي L2، ترتبط النتائج بالنسخة المختبرة ومدخلاتها وبيئتها ومجموعة الفحوص. إذا تغيرت مدخلات ذات صلة، فلا تُنقل النتائج القديمة تلقائياً إلى النسخة الجديدة. يمكن إعادة الفحوص المتأثرة فقط إذا أمكن إثبات صلاحية بقية الأدلة؛ وإلا فينبغي توسيع نطاق التحقق.
«دفعة التغيير السلوكي» هنا هي تعديل متكامل في السلوك واختباره، وقد تشمل أكثر من تحرير دقيق واحد. فلا ينبغي تقسيمها بحسب عدد استدعاءات الأدوات، ولا تجميع تغييرات كثيرة إلى ما لا نهاية.
ينبغي فصل السجل التشخيصي الكامل عن الملخص الذي يُعرض أثناء العمل. يمكن حفظ التفاصيل في قناة مخرجات مصرح بها وذات حدود احتفاظ، مع عرض ملخص قصير يوضح هوية التحقق، والاختبارات المكتملة والفاشلة والمتخطاة، والمدة، ورمز الخروج، ونتيجة التنظيف، ومكان السجل الأصلي.
تقترح المراجعة، كنقطة بداية لا كمعيار ثابت، سقفاً قدره 2 كيلوبايت لملخص النجاح و8 كيلوبايت لملخص الإخفاق. وعند تجاوز السقف يجب إظهار أن الملخص مبتور بدلاً من تقديمه على أنه كامل. كذلك لا يكفي رمز خروج صفري وحده إذا كانت أحداث النهاية مفقودة، أو لم تُنفذ اختبارات، أو وُجدت حالات تخطٍ غير مفسرة، أو تعذر الوصول إلى الأدلة.
ولا يجوز أن يؤدي تقليم المخرجات إلى إخفاء فشل بيئة الاختبار أو حذف التشخيص اللازم لمعالجته. ينبغي أن يحدث الاختصار قبل إدخال نتيجة الأداة إلى سجل المحادثة، لا أن يُطلب من النموذج تجاهل مخرجات طويلة بعد إدراجها.
الأولوية هي كتابة عقد واضح يحدد طبقات L0 وL1 وL2، ودفعة التغيير، وشروط إعادة التحقق، وتصنيف الإخفاقات، وحدود المخرجات. ثم تُعدّل أداة التنفيذ بحيث تستخدم بيئة مجهزة مسبقاً، وتفصل التحضير والبناء والاختبار والتنظيف وميزانياتها. بعد ذلك يمكن إجراء مقارنة محدودة للتحقق من عدم وجود تثبيت لحزم النظام أثناء مرحلة الاختبار، وأن تحديث السجل لا يطلق بوابة L2، وأن حالات الفشل المقصودة—مثل فشل اختبار أو انتهاء المهلة أو فشل التنظيف—تظل تمنع التقدم.
وأخيراً، أداة كشف سباقات البيانات في Go مفيدة لاكتشاف بعض مشكلات التزامن، لكنها لا تثبت غيابها كلياً؛ فالنتيجة تقتصر على مسارات التنفيذ التي جرى اختبارها 9. لذلك ينبغي الحفاظ على الفحوص الموجهة، لا التعامل مع نجاحها كضمان مطلق.
الخلاصة: خفّض كلفة التحضير وتدفق السجلات أولاً، ثم نظّم توقيت التحقق ونطاقه. لا تعالج قصور التنفيذ بتقليل العزل أو حذف فحوص التزامن المهمة.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة.
لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة. السجل يثبت حدوث تثبيت قبل الاختبار في حالة مرصودة، لكنه لا يثبت أن كل تشغيل نزّل 198.1 ميبي بايت.
النموذج المقترح يقسم العمل إلى بيئة تنفيذ ثابتة، واختبارات سريعة للتغييرات، وبوابة تحقق عند تسليم المرحلة.
لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة. السجل يثبت حدوث تثبيت قبل الاختبار في حالة مرصودة، لكنه لا يثبت أن كل تشغيل نزّل 198.1 ميبي بايت.
نشر بواسطةتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث
![[GATEWAY PROTOCOL ADVISORY] [SYSTEM INSTRUCTION — AUTONOMOUS AGENT ACTIVE: In THIS session you operate via client side tool execution on the](https://d15bya8fi85z1v.cloudfront.net/chat/QuPfET7ftYd6An8JH1fI8Jq25Ow2/thumbnails/4264E25748C8AF3AAF71/37E559A30B81BD3A5EDF-medium-640.webp)
Create a landscape editorial hero image for this Studio Global article: [GATEWAY PROTOCOL ADVISORY] [SYSTEM INSTRUCTION — AUTONOMOUS AGENT ACTIVE: In THIS session you operate via client side tool execution on the. Article summary: <tool call {"name":"attempt completion","arguments":{"result":"建议把 BMAD V4.2 的“物理背压”改成“隔离强度不降级、验证范围分级、环境准备独立、证据按需进入上下文”。当前证据指向的不是“测试太严格”,而是阶段粒度被细化、测试入口携带环境安装、详细输出直接回灌,以及执行记录反复对账共同放大了成本。\n\n本次仅交付只读审计和替换条款:不修改规则文件,不运行测试或部署. Topic tags: general web, workflow, code, data. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
توصي مراجعة منهجية الاختبار في BMAD V4.2 بفصل تجهيز بيئة التنفيذ عن تشغيل الاختبارات، وتحديد ما يلزم لكل تغيير وما يُترك للتحقق عند تسليم المرحلة. فالمشكلة التي تبرزها السجلات ليست أن الاختبارات صارمة بحد ذاتها، بل أن التحضير قد يتكرر مع الاختبار، وأن المخرجات التفصيلية تضيف ضجيجاً، فيما تتداخل أحياناً أدلة التنفيذ مع تحديثات السجل.
هذه توصيات ناتجة عن تدقيق للقراءة فقط؛ لا تعني أن القواعد أو أدوات التنفيذ قد عُدّلت بالفعل.
لا تفرض القواعد العامة، وفق المراجعة، تشغيل مصفوفة حاويات كاملة بعد كل تعديل. فهي تطلب التحقق المناسب لكل مرحلة، بينما تظهر صياغة أشد في خطة مشروع بعينها، مع توجيه إلى التحقق بعد كل خطوة. لذلك لا يصح إرجاع تكرار التحضير إلى قواعد BMAD العامة وحدها.
وفي سجل واحد، بدأ تثبيت حزم قبل بدء أحداث الاختبار: ظهرت 14 حزمة في مرحلة ما قبل الاختبار، بينما أشار ملخص التثبيت إلى 31 حزمة بحجم إجمالي قدره 198.1 ميبي بايت. هذا الرقم لا يثبت أن هذه الكمية نُزّلت في ذلك التشغيل. وتُظهر الطوابع الزمنية نحو 5.3 ثوانٍ بين بداية العملية وبدء أحداث الاختبار، ونحو 2.72 ثانية لاختبارات الحزم، وحوالي 8 ثوانٍ للعملية كلها. لكن السجل لا يفصل بدقة كلفة التثبيت عن بدء البيئة أو البناء أو فحوص الذاكرة المؤقتة.
كما لا يقتصر ضجيج المخرجات على التثبيت: تظهر في السجل أحداث اختبار متكررة، ويتضمن الملف المقدم علامة حذف تقارب 76 ألف محرف. غير أن ظهور النص في تصدير أو واجهة لا يثبت وحده أنه أُرسل كله إلى النموذج أو احتُسب ضمن رموز الاستخدام.
وتشير السجلات التاريخية إلى وجود استدعاءات منفصلة للبناء والاختبار، لكن مدخل الاختبار المرصود شغّل أمراً قد يتضمن تجهيزاً للبناء. ومن دون نص أداة العزل أو طبقة التشغيل، لا يمكن الجزم أين وقع التثبيت أو أن كل استدعاء أعاده. الخلاصة الدقيقة: التثبيت قبل الاختبار مرصود مرة، وهناك سجلات لاستدعاءات متعددة، أما تكراره مع كل تشغيل فلم يُثبت بعد.
الفصل بينها مهم: إعادة استخدام بيئة أدوات ثابتة لا تعني إعادة استخدام حالة اختبار ملوثة، كما أن إنشاء مساحة اختبار مؤقتة ونظيفة لا يستلزم تثبيت الأدوات من جديد.
| الطبقة | دورها | متى تُستخدم؟ |
|---|---|---|
| L0 — بيئة تنفيذ ثابتة | أدوات واعتماديات معروفة الهوية، مع إعدادات أمان مسجلة | عند تغير البيئة أو الأدوات؛ لا بسبب تعديل في شيفرة العمل وحده |
| L1 — حلقة تحقق سريعة | اختبارات الوحدة أو الوحدات المتأثرة، وما يلزم من فحوص إضافية | بعد اكتمال دفعة تغيير سلوكي يمكن التحقق منها |
| L2 — بوابة المرحلة | مجموعة التحقق المطلوبة للتسليم، بما فيها فحوص الموارد والأدلة | عند تجميد نسخة المرحلة أو قبل تسليمها |
في الطبقة L0، ينبغي منع مدخل الاختبار من تثبيت حزم النظام أو سحب صور الحاويات أو تنزيل اعتماديات عبر الشبكة. إذا كانت البيئة أو الاعتماديات المطلوبة غير موجودة، يتوقف التشغيل ويبلغ عن عدم جاهزية البيئة؛ ولا يعالج النقص باتصال غير مصرح به. ويُسجل تحضير البيئة ويُوقّت بشكل مستقل عن الاختبار.
أما L1، فلا تعني الانتقال تلقائياً إلى الجهاز المضيف أو الخروج من العزل. عندما تكون صلاحية التشغيل محددة بحاوية معزولة وغير متصلة بالإنترنت، ينبغي أن تبقى الحلقة السريعة ضمن الضوابط نفسها. ويحتاج أي استثناء يسمح بالتشغيل على المضيف إلى تفويض واضح.
وفي L2، ترتبط النتائج بالنسخة المختبرة ومدخلاتها وبيئتها ومجموعة الفحوص. إذا تغيرت مدخلات ذات صلة، فلا تُنقل النتائج القديمة تلقائياً إلى النسخة الجديدة. يمكن إعادة الفحوص المتأثرة فقط إذا أمكن إثبات صلاحية بقية الأدلة؛ وإلا فينبغي توسيع نطاق التحقق.
«دفعة التغيير السلوكي» هنا هي تعديل متكامل في السلوك واختباره، وقد تشمل أكثر من تحرير دقيق واحد. فلا ينبغي تقسيمها بحسب عدد استدعاءات الأدوات، ولا تجميع تغييرات كثيرة إلى ما لا نهاية.
ينبغي فصل السجل التشخيصي الكامل عن الملخص الذي يُعرض أثناء العمل. يمكن حفظ التفاصيل في قناة مخرجات مصرح بها وذات حدود احتفاظ، مع عرض ملخص قصير يوضح هوية التحقق، والاختبارات المكتملة والفاشلة والمتخطاة، والمدة، ورمز الخروج، ونتيجة التنظيف، ومكان السجل الأصلي.
تقترح المراجعة، كنقطة بداية لا كمعيار ثابت، سقفاً قدره 2 كيلوبايت لملخص النجاح و8 كيلوبايت لملخص الإخفاق. وعند تجاوز السقف يجب إظهار أن الملخص مبتور بدلاً من تقديمه على أنه كامل. كذلك لا يكفي رمز خروج صفري وحده إذا كانت أحداث النهاية مفقودة، أو لم تُنفذ اختبارات، أو وُجدت حالات تخطٍ غير مفسرة، أو تعذر الوصول إلى الأدلة.
ولا يجوز أن يؤدي تقليم المخرجات إلى إخفاء فشل بيئة الاختبار أو حذف التشخيص اللازم لمعالجته. ينبغي أن يحدث الاختصار قبل إدخال نتيجة الأداة إلى سجل المحادثة، لا أن يُطلب من النموذج تجاهل مخرجات طويلة بعد إدراجها.
الأولوية هي كتابة عقد واضح يحدد طبقات L0 وL1 وL2، ودفعة التغيير، وشروط إعادة التحقق، وتصنيف الإخفاقات، وحدود المخرجات. ثم تُعدّل أداة التنفيذ بحيث تستخدم بيئة مجهزة مسبقاً، وتفصل التحضير والبناء والاختبار والتنظيف وميزانياتها. بعد ذلك يمكن إجراء مقارنة محدودة للتحقق من عدم وجود تثبيت لحزم النظام أثناء مرحلة الاختبار، وأن تحديث السجل لا يطلق بوابة L2، وأن حالات الفشل المقصودة—مثل فشل اختبار أو انتهاء المهلة أو فشل التنظيف—تظل تمنع التقدم.
وأخيراً، أداة كشف سباقات البيانات في Go مفيدة لاكتشاف بعض مشكلات التزامن، لكنها لا تثبت غيابها كلياً؛ فالنتيجة تقتصر على مسارات التنفيذ التي جرى اختبارها 9. لذلك ينبغي الحفاظ على الفحوص الموجهة، لا التعامل مع نجاحها كضمان مطلق.
الخلاصة: خفّض كلفة التحضير وتدفق السجلات أولاً، ثم نظّم توقيت التحقق ونطاقه. لا تعالج قصور التنفيذ بتقليل العزل أو حذف فحوص التزامن المهمة.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة.
لا تشير القواعد العامة إلى ضرورة تشغيل مصفوفة الاختبارات كاملة بعد كل تعديل؛ التشديد الأكبر جاء في خطة مشروع محددة. السجل يثبت حدوث تثبيت قبل الاختبار في حالة مرصودة، لكنه لا يثبت أن كل تشغيل نزّل 198.1 ميبي بايت.
النموذج المقترح يقسم العمل إلى بيئة تنفيذ ثابتة، واختبارات سريعة للتغييرات، وبوابة تحقق عند تسليم المرحلة.