Voice Agent Benchmark Landscape to publikowany przez nas zbiór danych: ustrukturyzowana mapa publicznych benchmarków dla agentów głosowych, asystentów głosowych, użycia narzędzi za pomocą mowy, działań na komputerze, rozpoznawania mowy i rozumienia spotkań. Ta strona jest jego zapisem publikacji.
Czym jest
- 13 benchmarków, po jednym wierszu każdy, w pliku do odczytu maszynowego (data/benchmarks.jsonl) z udokumentowanym kontraktem pól (data/schema.json).
- Każdy wiersz rejestruje główny cel benchmarku; czy obejmuje on wprowadzanie głosowe, generowanie mowy, interakcję wieloturową, użycie narzędzi, realizację celów, działania na komputerze lub w przeglądarce, materiały ze spotkań lub w długiej formie oraz działanie w czasie rzeczywistym; czy dane są publiczne; licencje na kod i dane, zapisane osobno; adresy repozytorium, karty zbioru danych i publikacji; datę ostatniej weryfikacji; oraz notatki z dowodami.
- Wartości to tak, nie, częściowo lub niejasne. „Częściowo” oznacza, że dana zdolność pojawia się w części zestawu lub jest oceniana pośrednio; nie opisuje to jakości.
- Każdy wiersz ma co najmniej jedno źródło własne, wymienione w audycie źródeł. Fakty w bieżącym wydaniu zostały zweryfikowane 1 września 2026 r. na podstawie publicznych repozytoriów, kart zbiorów danych i publikacji autorów.
Czym nie jest
- Nie jest to ranking. Nie zawiera żadnych wyników i niczego nie klasyfikuje. Umieszczenie na liście nie oznacza poparcia. Powody, dla których został tak zbudowany, opisano w artykule Jak powstał Voice Agent Benchmark Landscape.
- Nie jest to framework ewaluacyjny. Nie ma nic do uruchomienia na modelu; repozytorium dostarcza dane, ich schemat, walidator i narzędzie do zapytań.
- Nie jest to benchmark Cue. Prywatny, 227-próbkowy benchmark produkcyjny opisany w studium przypadku Google DeepMind nie jest jego częścią.
Gdzie jest opublikowany
| Gdzie | Adres | Rola |
|---|---|---|
| GitHub | Sophon-LLC/voice-agent-benchmark-landscape | Źródło zapisu: dane, schemat, audyt źródeł, zasady współtworzenia, testy |
| Zenodo | doi.org/10.5281/zenodo.22227265 | Zarchiwizowane wydania z numerami DOI; koncepcyjny numer DOI zawsze prowadzi do najnowszej wersji |
| Hugging Face | chatjesus/voice-agent-benchmark-landscape | Kopia lustrzana zbioru danych |
Wersje
| Wersja | Data | Rekordy | Licencja | DOI wersji |
|---|---|---|---|---|
| v1.0.2 | 1 września 2026 | 13 | MIT | 10.5281/zenodo.22227266 |
Rekord Zenodo dla wersji v1.0.2 zawiera sumę kontrolną SHA-256 zbioru danych (1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4), aby można było zweryfikować pobraną kopię z wersją zarchiwizowaną.
Jak cytować
Plik CITATION.cff w repozytorium wskazuje Sophon LLC jako autora. Należy cytować DOI wersji, gdy ważna jest dokładna odtwarzalność, a koncepcyjny numer DOI dla projektu w trakcie rozwoju:
Sophon LLC. Voice Agent Benchmark Landscape, version 1.0.2. 1 September 2026. https://doi.org/10.5281/zenodo.22227266
Sprostowania
Zgłoszenie poprawki musi wskazywać wiersz, pole, proponowaną wartość i źródło od producenta, zgodnie z plikiem CONTRIBUTING.md w repozytorium. Zmiany są publikowane jako nowa wersja z nowym numerem DOI.