語音智能體基準景觀是我們發布的一個資料集:一個針對語音智能體、語音助理、語音啟用工具使用、電腦操作、語音辨識和會議理解的公開基準的結構化地圖。本頁面是其發布記錄。
產品介紹
- 13 個基準,每個一行,存於一個機器可讀的檔案(data/benchmarks.jsonl)中,並附有文件化的欄位合約(data/schema.json)。
- 每一行記錄了基準的主要焦點;是否涵蓋語音輸入、語音輸出、多輪互動、工具使用、目標完成、電腦或瀏覽器操作、會議或長篇材料以及即時操作;資料是否公開;程式碼和資料授權(分開記錄);儲存庫、資料集卡和論文地址;上次驗證日期;以及佐證註記。
- 值為「是」、「否」、「部分」或「不清楚」。「部分」表示該能力出現在套件的一部分或被間接評估;它不描述品質。
- 每一行至少有一個第一方來源,列於來源稽核中。當前版本中的事實於 2026 年 9 月 1 日根據維護者的公開儲存庫、資料集卡和論文進行了驗證。
它不是什麼
- 不是排行榜。它不包含任何分數,也不對任何事物進行排名。收錄不代表背書。其建構方式的原因見語音智能體基準景觀是如何建構的。
- 不是評估框架。沒有可以對模型執行的東西;該儲存庫提供資料、其綱要、一個驗證器和一個查詢工具。
- 不是 Cue 的基準。Google DeepMind 案例研究中描述的私有 227 樣本產品基準不屬於其中一部分。
發布位置
| 位置 | 位址 | 用途 |
|---|---|---|
| GitHub | Sophon-LLC/voice-agent-benchmark-landscape | 記錄來源:資料、結構、來源稽核、貢獻規則、測試 |
| Zenodo | doi.org/10.5281/zenodo.22227265 | 附有 DOI 的封存版本;概念 DOI 永遠解析至最新版本 |
| Hugging Face | chatjesus/voice-agent-benchmark-landscape | 資料集的鏡像 |
版本
| 版本 | 日期 | 記錄 | 授權 | 版本 DOI |
|---|---|---|---|---|
| v1.0.2 | 2026年9月1日 | 13 | MIT | 10.5281/zenodo.22227266 |
v1.0.2 的 Zenodo 記錄包含資料集的 SHA-256 (1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4),以便將下載的副本與封存的副本進行核對。
如何引用
儲存庫的 CITATION.cff 檔案將作者標示為 Sophon LLC。若需精確重現,請引用版本 DOI;若為持續發展的專案,請引用概念 DOI:
Sophon LLC。《語音智能體基準景觀》,版本 1.0.2。2026 年 9 月 1 日。https://doi.org/10.5281/zenodo.22227266
更正
更正時需遵循儲存庫的 CONTRIBUTING.md 檔案,指明列、欄位、建議值以及第一方來源。變更會以新版本和新的 DOI 發布。