Die Voice Agent Benchmark Landscape is 'n datastel wat ons publiseer: 'n gestruktureerde kaart van openbare benchmarks vir stemagente, gesproke assistente, spraak-geaktiveerde gereedskapgebruik, rekenaaraksie, spraakherkenning en vergaderingbegrip. Hierdie blad is die rekord van publikasie daarvan.
Wat dit is
- 13 benchmarks, een ry elk, in 'n masjienleesbare lêer (data/benchmarks.jsonl) met 'n gedokumenteerde veldkontrak (data/schema.json).
- Elke ry teken die benchmark se primêre fokus aan; of dit gesproke invoer, gesproke uitvoer, multibeurt-interaksie, gereedskapgebruik, doelwitvoltooiing, rekenaar- of blaaieraksie, vergadering- of langvormmateriaal, en intydse werking dek; of die data publiek is; die kode- en datalisensies, apart aangeteken; die bewaarplek-, datastelkaart- en verhandelingsadresse; die datum waarop dit laas geverifieer is; en bewysnotas.
- Waardes is ja, nee, gedeeltelik of onduidelik. Gedeeltelik beteken die vermoë verskyn in 'n deel van die suite of word indirek geëvalueer; dit beskryf nie kwaliteit nie.
- Elke ry het ten minste een eerstepartybron, gelys in die bronoudit. Feite in die huidige vrystelling is op 1 September 2026 geverifieer vanaf die instandhouers se openbare bewaarplekke, datastelkaarte en verhandelinge.
Wat dit nie is nie
- Nie 'n ranglys nie. Dit bevat geen tellings nie en rangskik niks. Insluiting impliseer nie onderskrywing nie. Hoekom dit so gebou is, is in Hoe die Voice Agent Benchmark Landscape gebou is.
- Nie 'n evalueringsraamwerk nie. Daar is niks om teen 'n model te laat loop nie; die bewaarplek verskaf die data, die skema daarvan, 'n valideerder en 'n navraaginstrument.
- Nie Cue se benchmark nie. Die private 227-monster-produksiebenchmark wat in Google DeepMind se gevallestudie beskryf word, is nie deel daarvan nie.
Waar dit gepubliseer word
| Waar | Adres | Rol |
|---|---|---|
| GitHub | Sophon-LLC/voice-agent-benchmark-landscape | Bron van rekord: data, skema, bronoudit, bydraereëls, toetse |
| Zenodo | doi.org/10.5281/zenodo.22227265 | Geargiveerde vrystellings met DOI's; die konsep-DOI lei altyd na die nuutste weergawe. |
| Hugging Face | chatjesus/voice-agent-benchmark-landscape | Spieël van die datastel. |
Weergawes
| Weergawe | Datum | Rekords | Lisensie | Weergawe-DOI |
|---|---|---|---|---|
| v1.0.2 | 1 September 2026 | 13 | MIT | 10.5281/zenodo.22227266 |
Die Zenodo-rekord vir v1.0.2 bevat die datastel se SHA-256 (1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4) sodat jy 'n afgelaaide kopie teen die geargiveerde een kan kontroleer.
Hoe om te siteer
Die bewaarplek se CITATION.cff noem Sophon LLC as die outeur. Siteer die weergawe-DOI wanneer presiese herhaalbaarheid saak maak en die konsep-DOI vir die ontwikkelende projek:
Sophon LLC. Voice Agent Benchmark Landscape, version 1.0.2. 1 September 2026. https://doi.org/10.5281/zenodo.22227266
Regstellings
'n Korreksie noem die ry, die veld, die voorgestelde waarde en 'n eerstepartybron, volgens die bewaarplek se CONTRIBUTING.md. Veranderinge word as 'n nuwe weergawe met 'n nuwe DOI uitgereik.