Dokumentacja · Dowody

Voice Agent Benchmark Landscape: zapis i cytowanie

Czym jest, a czym nie jest zbiór danych, gdzie jest opublikowany, jego wersje, licencja i numery DOI oraz jak go cytować. Utrzymywany przez Sophon LLC.

Opublikowano · Zaktualizowano

Voice Agent Benchmark Landscape to publikowany przez nas zbiór danych: ustrukturyzowana mapa publicznych benchmarków dla agentów głosowych, asystentów głosowych, użycia narzędzi za pomocą mowy, działań na komputerze, rozpoznawania mowy i rozumienia spotkań. Ta strona jest jego zapisem publikacji.

Czym jest

  • 13 benchmarków, po jednym wierszu każdy, w pliku do odczytu maszynowego (data/benchmarks.jsonl) z udokumentowanym kontraktem pól (data/schema.json).
  • Każdy wiersz rejestruje główny cel benchmarku; czy obejmuje on wprowadzanie głosowe, generowanie mowy, interakcję wieloturową, użycie narzędzi, realizację celów, działania na komputerze lub w przeglądarce, materiały ze spotkań lub w długiej formie oraz działanie w czasie rzeczywistym; czy dane są publiczne; licencje na kod i dane, zapisane osobno; adresy repozytorium, karty zbioru danych i publikacji; datę ostatniej weryfikacji; oraz notatki z dowodami.
  • Wartości to tak, nie, częściowo lub niejasne. „Częściowo” oznacza, że dana zdolność pojawia się w części zestawu lub jest oceniana pośrednio; nie opisuje to jakości.
  • Każdy wiersz ma co najmniej jedno źródło własne, wymienione w audycie źródeł. Fakty w bieżącym wydaniu zostały zweryfikowane 1 września 2026 r. na podstawie publicznych repozytoriów, kart zbiorów danych i publikacji autorów.

Czym nie jest

  • Nie jest to ranking. Nie zawiera żadnych wyników i niczego nie klasyfikuje. Umieszczenie na liście nie oznacza poparcia. Powody, dla których został tak zbudowany, opisano w artykule Jak powstał Voice Agent Benchmark Landscape.
  • Nie jest to framework ewaluacyjny. Nie ma nic do uruchomienia na modelu; repozytorium dostarcza dane, ich schemat, walidator i narzędzie do zapytań.
  • Nie jest to benchmark Cue. Prywatny, 227-próbkowy benchmark produkcyjny opisany w studium przypadku Google DeepMind nie jest jego częścią.

Gdzie jest opublikowany

GdzieAdresRola
GitHubSophon-LLC/voice-agent-benchmark-landscapeŹródło zapisu: dane, schemat, audyt źródeł, zasady współtworzenia, testy
Zenododoi.org/10.5281/zenodo.22227265Zarchiwizowane wydania z numerami DOI; koncepcyjny numer DOI zawsze prowadzi do najnowszej wersji
Hugging Facechatjesus/voice-agent-benchmark-landscapeKopia lustrzana zbioru danych

Wersje

WersjaDataRekordyLicencjaDOI wersji
v1.0.21 września 202613MIT10.5281/zenodo.22227266

Rekord Zenodo dla wersji v1.0.2 zawiera sumę kontrolną SHA-256 zbioru danych (1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4), aby można było zweryfikować pobraną kopię z wersją zarchiwizowaną.

Jak cytować

Plik CITATION.cff w repozytorium wskazuje Sophon LLC jako autora. Należy cytować DOI wersji, gdy ważna jest dokładna odtwarzalność, a koncepcyjny numer DOI dla projektu w trakcie rozwoju:

Sophon LLC. Voice Agent Benchmark Landscape, version 1.0.2. 1 September 2026. https://doi.org/10.5281/zenodo.22227266

Sprostowania

Zgłoszenie poprawki musi wskazywać wiersz, pole, proponowaną wartość i źródło od producenta, zgodnie z plikiem CONTRIBUTING.md w repozytorium. Zmiany są publikowane jako nowa wersja z nowym numerem DOI.

Coś na tej stronie jest nie tak? feedback@sophoninc.com