> ## Documentation Index
> Fetch the complete documentation index at: https://docs.thunderphone.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 实验（A/B 测试）

> 在真实通话中并行运行两种智能体配置，并根据成功率选出胜者。

A/B 测试通过数据而非直觉来回答“新提示词是否真的更好”：来电会在智能体**变体**之间分配，每通电话照常评分，您可以比较各变体的成功率。

有两个界面：

* **按智能体** —— 在每个智能体构建器的 **A/B** 选项卡（`/dashboard/agents/<id>?tab=variants`）中配置和优化测试。在这里创建变体并开启测试。
* **跨智能体概览** —— **Experiments** 页面（`/dashboard/experiments`，位于 Quality & Testing 下）会将每个智能体的测试汇总到一张表中。

## 设置测试

在 Experiments 页面中，点击**设置 A/B 测试**并选择一个智能体——您将进入该智能体的 A/B 选项卡，可在此创建变体配置（其中一个标记为**对照组**）并启用分流测试。有关构建器本身，请参阅[构建智能体](/zh/guides/build-an-agent)。

## 查看概览

对于每个已设置测试的智能体，Experiments 表会显示：

* **状态** —— Active（已开启分流测试）或 Paused。
* **变体** —— 每个变体均显示为标签，对照组会带有标识。
* **领先者** —— 目前成功率最高的变体及其百分比。在变体产生已评分通话前，此处会显示*数据尚不足*——不要仅凭几通电话就判定胜者。
* **通话** —— 测试中所有变体的通话总数。

未设置测试的智能体会列在下方，您只需点击一次即可开始测试。点击任意行即可跳转到该智能体的 A/B 选项卡，以优化或结束测试。

<Tip>
  每通电话都会记录由哪个变体处理，因此您可以在[通话记录](/zh/guides/review-calls)中筛选并抽查各方的转录文本。
</Tip>

<Note>
  相比在[动态配置 webhook](/zh/guides/dynamic-call-config)中手动实现 A/B 分配，建议优先使用此内置功能——您可免费获得分配、各变体统计数据和评分。
</Note>

## 后续步骤

<CardGroup cols={2}>
  <Card title="构建智能体" icon="robot" href="/zh/guides/build-an-agent">
    在智能体的 A/B 选项卡中创建变体。
  </Card>

  <Card title="模拟" icon="flask" href="/zh/guides/test-agents">
    在真实流量投票前，使用 AI 呼叫方进行发布前测试。
  </Card>
</CardGroup>
