Voice Agent Benchmark Landscapeは、当社が公開するデータセットです。音声エージェント、音声アシスタント、音声によるツール使用、コンピュータ操作、音声認識、会議理解のための公開ベンチマークを構造化したマップです。このページはその公開記録です。
製品概要
- 13のベンチマークがそれぞれ1行で、文書化されたフィールド規約(data/schema.json)を持つ機械可読ファイル(data/benchmarks.jsonl)に収録されています。
- 各行には、ベンチマークの主な焦点、音声入力・音声出力・複数ターンの対話・ツール使用・目標達成・コンピュータまたはブラウザ操作・会議または長文資料・リアルタイム操作をカバーしているか、データが公開されているか、コードとデータのライセンス(別々に記録)、リポジトリ・データセットカード・論文のアドレス、最終検証日、および裏付けのメモが記録されています。
- 値は「yes」「no」「partial」「unclear」です。「partial」は、その機能がスイートの一部に現れるか、間接的に評価されることを意味し、品質を記述するものではありません。
- すべての行には、ソース監査に記載された一次情報源が少なくとも1つあります。現在のリリースの事実は、2026年9月1日に、メンテナーの公開リポジトリ、データセットカード、および論文から検証されました。
本データセットが対象としないもの
- リーダーボードではありません。スコアは含まず、何もランク付けしません。収録は推奨を意味するものではありません。そのように構築された理由は音声エージェントベンチマークランドスケープの構築方法に記載されています。
- 評価フレームワークではありません。モデルに対して実行するものはありません。リポジトリにはデータ、そのスキーマ、バリデータ、およびクエリツールが同梱されています。
- Cueのベンチマークではありません。Google DeepMindのケーススタディで説明されている、227サンプルの非公開の本番環境用ベンチマークは、これに含まれていません。
公開場所
| 提供場所 | アドレス | 役割 |
|---|---|---|
| GitHub | Sophon-LLC/voice-agent-benchmark-landscape | 正典ソース:データ、スキーマ、ソース監査、コントリビューションルール、テスト |
| Zenodo | doi.org/10.5281/zenodo.22227265 | DOI付きのアーカイブ版リリース。コンセプトDOIは常に最新バージョンに解決されます。 |
| Hugging Face | chatjesus/voice-agent-benchmark-landscape | データセットのミラー |
バージョン
| バージョン | 日付 | レコード | ライセンス | バージョンDOI |
|---|---|---|---|---|
| v1.0.2 | 2026年9月1日 | 13 | MIT | 10.5281/zenodo.22227266 |
v1.0.2のZenodoレコードにはデータセットのSHA-256(1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4)が含まれているため、ダウンロードしたコピーをアーカイブ版と照合して確認できます。
引用方法
リポジトリのCITATION.cffでは、著者をSophon LLCとして記載しています。正確な再現性が重要な場合はバージョンDOIを、進化するプロジェクトについてはコンセプトDOIを引用してください。
Sophon LLC. Voice Agent Benchmark Landscape, version 1.0.2. 1 September 2026. https://doi.org/10.5281/zenodo.22227266
訂正
修正は、リポジトリのCONTRIBUTING.mdに従い、行、フィールド、提案する値、および一次情報源を明記します。変更は、新しいDOIを持つ新しいバージョンとして公開されます。