هل تفضّل لوحة التحكم؟ تتوفر الإمكانية نفسها في Simulations
(
/dashboard/simulations)، بما في ذلك إنشاء السيناريوهات بالذكاء الاصطناعي — راجع
محاكاة مكالمة. تغطي هذه الصفحة
المسار البرمجي.- اختبارات تحقق سريعة قبل النشر بعد كل تعديل على الموجّه
- مجموعات اختبار الانحدار المرتبطة بالتكامل المستمر CI (اربط webhook
test-call.completed← وأفشل عملية البناء إذا انخفضت النتيجة) - اختبار الضغط على حدود التزامن
تشغيل واحد: تنفيذ منفرد
تكون الاستجابة كائن تشغيل مكالمة اختبار
بحالة
status="queued". استعلم دوريًا إلى أن تصبح status هي completed أو
failed؛ وبعد تعيين call_id، حمّل النص المفرغ عبر
GET /v1/calls/{call_id}/transcript.
الدُفعات: سيناريوهات متوازية
شغّل N سيناريوهات بالتزامن — مفيد لمجموعات اختبار الانحدار التي تغطي كل حالة طرفية معروفة بالتوازي:run_ids لمعرّفات عمليات التشغيل الفرعية. اجلب
حالة الدفعة:
run_count على 20؛ وتفصل stagger_seconds بين عمليات الإنشاء
لتجنب إرهاق الوكيل (0–60 ثانية).
وصّلها بـ CI
أنشئ مجموعة بوابة إصدار في صفحة المحاكاة (/dashboard/simulations) — اختر الوكيل، وأضف السيناريوهات يدويًا أو
انقر إنشاء سيناريوهات باستخدام الذكاء الاصطناعي لصياغتها استنادًا إلى
موجّه الوكيل (مع تمرير اختياري للحالات الطرفية)، ثم جمّعها في مجموعة.
تثبّت المجموعة سيناريوهاتها ووكيلها، إضافةً إلى حد أدنى لمعدل النجاح وقاعدة
اختيارية لعدم وجود أي إخفاقات حرجة. تصبح عمليات التشغيل الناجحة خط الأساس
المعتمد؛ وتُعاد انتقالات النجاح→الإخفاق اللاحقة باعتبارها حالات تراجع.
استخدم مفتاح API للمؤسسة في CI.
يشغّل هذا البرنامج النصي المجموعة، ويستعلم دوريًا حتى يكتمل التقييم والمقارنة،
ويخرج برمز غير صفري ما لم يكن الحكم pass:
POST /v1/orgs/{org_id}/suites/{suite_id}/run الرمز 202 مع
معرّف التشغيل. ويعيد GET /v1/orgs/{org_id}/suites/{suite_id}/runs/{run_id}
القيم status وverdict وpass_rate وcritical_failure_count وقائمة
regressions لخط الأساس. تربط كلتا نقطتي النهاية مؤسسة عنوان URL
بمؤسسة مفتاح API.
الأنماط
سجل تراجع لكل موجّه
احتفظ بملف JSON من صفوف{name, scenario_prompt, expected_outcome}.
مع كل تغيير في الموجّه، شغّل المجموعة الكاملة كدفعة؛ وقارن النصوص المفرغة
والدرجات بعملية التشغيل السابقة.
اختبار دخاني لكل إصدار
دفعة واحدة تضم خمسة سيناريوهات للمسار السليم تشغّلها بعد كل نشر. حساسة لزمن الاستجابة، لذا أبقِstagger_seconds: 0.
قياس الأداء المرجعي لزمن الاستجابة
شغّل سيناريوهات متطابقة مقابل مستويات منتجات مختلفة (spark،
bolt، storm-base). قارن درجات call.graded وقيمة
duration_seconds من سجل كل مكالمة ناتجة.
الخطوات التالية
مرجع مكالمات الاختبار
كل معلمة استعلام، ورمز حالة، وبنية دفعة.
التقييم بالذكاء الاصطناعي
قيّم تلقائيًا كل تشغيل اختبار لتتبّع الجودة بمرور الوقت.
تقارير المشكلات
علّم اختبارات محددة للمراجعة البشرية.
خطاف الويب test-call.completed
بث النتائج إلى CI / Slack / PagerDuty.