> ## Documentation Index
> Fetch the complete documentation index at: https://docs.thunderphone.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 實驗（A/B 測試）

> 在真實通話中並行執行兩種智慧體設定，讓成功率決定勝出者。

A/B 測試以資料而非直覺回答「新提示詞是否真的更好？」：系統會將來電分配給不同的智慧體**變體**，照常為每通電話評分，然後比較各變體的成功率。

有兩個介面：

* **各智慧體**——在每個智慧體的建置器中，於其 **A/B** 分頁（`/dashboard/agents/<id>?tab=variants`）設定及調整測試。你可在此建立變體並啟用測試。
* **跨智慧體總覽**——**實驗**頁面（`/dashboard/experiments`，位於「品質與測試」下）會將所有智慧體的測試彙整於同一個表格中。

## 設定測試

在「實驗」頁面中，按一下**設定 A/B 測試**並選擇一個智慧體——你會前往該智慧體的 A/B 分頁，在此建立變體設定（其中一個會標示為**對照組**）並啟用分流測試。建置器本身請參閱[建立智慧體](/zh-Hant/guides/build-an-agent)。

## 查看總覽

對於每個正在進行測試的智慧體，「實驗」表格會顯示：

* **狀態**——啟用中（已開啟分流測試）或已暫停。
* **變體**——以標籤顯示所有變體，並標示對照組。
* **領先者**——目前成功率最高的變體及其百分比。在變體取得已評分的通話前，這裡會顯示*資料尚不足*——不要只憑幾通電話就判定贏家。
* **通話**——測試中所有變體的通話總數。

未設定測試的智慧體會列在下方，讓你按一下即可開始測試。按一下任何列，即可前往該智慧體的 A/B 分頁以調整或結束測試。

<Tip>
  每通電話都會記錄由哪個變體處理，因此你可以在[通話紀錄](/zh-Hant/guides/review-calls)中篩選並抽查各組的逐字稿。
</Tip>

<Note>
  建議優先使用此內建功能，而非在[動態設定 Webhook](/zh-Hant/guides/dynamic-call-config)中自行實作 A/B 分配——你可直接取得分配、各變體統計資料及評分功能。
</Note>

## 後續步驟

<CardGroup cols={2}>
  <Card title="建立智慧體" icon="robot" href="/zh-Hant/guides/build-an-agent">
    在智慧體的 A/B 分頁中建立變體。
  </Card>

  <Card title="模擬測試" icon="flask" href="/zh-Hant/guides/test-agents">
    在真實來電投票前，先透過人工智慧來電者進行上線前測試。
  </Card>
</CardGroup>
