Skip to main content
هل تفضّل لوحة التحكم؟ تتوفر الإمكانية نفسها في Simulations (/dashboard/simulations)، بما في ذلك إنشاء السيناريوهات بالذكاء الاصطناعي — راجع محاكاة مكالمة. تغطي هذه الصفحة المسار البرمجي.
يعني التكرار على وكيل ذكاء اصطناعي التكرار على موجّهه وأدواته وطريقة تعامله مع الحالات الطرفية. تُجري واجهة test-calls البرمجية مكالمات فعلية (من روبوت إلى روبوت أو عبر حلقة SIP) مع وكيل باستخدام موجّه سيناريو توفره — ينتج عن كل تشغيل سجل مكالمة فعلي يتضمن نصًا مفرغًا وتقييمًا وفوترة، لكي ترى بدقة كيف يتصرف الوكيل وكم تبلغ تكلفته. استخدمها من أجل:
  • اختبارات تحقق سريعة قبل النشر بعد كل تعديل على الموجّه
  • مجموعات اختبار الانحدار المرتبطة بالتكامل المستمر CI (اربط webhook test-call.completed ← وأفشل عملية البناء إذا انخفضت النتيجة)
  • اختبار الضغط على حدود التزامن

تشغيل واحد: تنفيذ منفرد

الحقول: تكون الاستجابة كائن تشغيل مكالمة اختبار بحالة status="queued". استعلم دوريًا إلى أن تصبح status هي completed أو failed؛ وبعد تعيين call_id، حمّل النص المفرغ عبر GET /v1/calls/{call_id}/transcript.

الدُفعات: سيناريوهات متوازية

شغّل N سيناريوهات بالتزامن — مفيد لمجموعات اختبار الانحدار التي تغطي كل حالة طرفية معروفة بالتوازي:
تحمل الاستجابة قائمة run_ids لمعرّفات عمليات التشغيل الفرعية. اجلب حالة الدفعة:
يقتصر run_count على 20؛ وتفصل stagger_seconds بين عمليات الإنشاء لتجنب إرهاق الوكيل (0–60 ثانية).

وصّلها بـ CI

أنشئ مجموعة بوابة إصدار في صفحة المحاكاة (/dashboard/simulations) — اختر الوكيل، وأضف السيناريوهات يدويًا أو انقر إنشاء سيناريوهات باستخدام الذكاء الاصطناعي لصياغتها استنادًا إلى موجّه الوكيل (مع تمرير اختياري للحالات الطرفية)، ثم جمّعها في مجموعة. تثبّت المجموعة سيناريوهاتها ووكيلها، إضافةً إلى حد أدنى لمعدل النجاح وقاعدة اختيارية لعدم وجود أي إخفاقات حرجة. تصبح عمليات التشغيل الناجحة خط الأساس المعتمد؛ وتُعاد انتقالات النجاح→الإخفاق اللاحقة باعتبارها حالات تراجع. استخدم مفتاح API للمؤسسة في CI. يشغّل هذا البرنامج النصي المجموعة، ويستعلم دوريًا حتى يكتمل التقييم والمقارنة، ويخرج برمز غير صفري ما لم يكن الحكم pass:
يعيد POST /v1/orgs/{org_id}/suites/{suite_id}/run الرمز 202 مع معرّف التشغيل. ويعيد GET /v1/orgs/{org_id}/suites/{suite_id}/runs/{run_id} القيم status وverdict وpass_rate وcritical_failure_count وقائمة regressions لخط الأساس. تربط كلتا نقطتي النهاية مؤسسة عنوان URL بمؤسسة مفتاح API.

الأنماط

سجل تراجع لكل موجّه

احتفظ بملف JSON من صفوف {name, scenario_prompt, expected_outcome}. مع كل تغيير في الموجّه، شغّل المجموعة الكاملة كدفعة؛ وقارن النصوص المفرغة والدرجات بعملية التشغيل السابقة.

اختبار دخاني لكل إصدار

دفعة واحدة تضم خمسة سيناريوهات للمسار السليم تشغّلها بعد كل نشر. حساسة لزمن الاستجابة، لذا أبقِ stagger_seconds: 0.

قياس الأداء المرجعي لزمن الاستجابة

شغّل سيناريوهات متطابقة مقابل مستويات منتجات مختلفة (spark، bolt، storm-base). قارن درجات call.graded وقيمة duration_seconds من سجل كل مكالمة ناتجة.

الخطوات التالية

مرجع مكالمات الاختبار

كل معلمة استعلام، ورمز حالة، وبنية دفعة.

التقييم بالذكاء الاصطناعي

قيّم تلقائيًا كل تشغيل اختبار لتتبّع الجودة بمرور الوقت.

تقارير المشكلات

علّم اختبارات محددة للمراجعة البشرية.

خطاف الويب test-call.completed

بث النتائج إلى CI / Slack / PagerDuty.