Voice Agent Benchmark Landscape është një set të dhënash që ne publikojmë: një hartë e strukturuar e benchmark-eve publikë për agjentët zanorë, asistentët e folur, përdorimin e veglave të aktivizuara me zë, veprimet në kompjuter, njohjen e të folurit dhe kuptimin e mbledhjeve. Kjo faqe është regjistri i publikimit të tij.
Çfarë është
- 13 benchmark-e, secili në një rresht, në një skedar të lexueshëm nga makina (data/benchmarks.jsonl) me një kontratë fushe të dokumentuar (data/schema.json).
- Çdo rresht regjistron fokusin kryesor të benchmark-ut; nëse mbulon hyrjen e folur, daljen e folur, ndërveprimin me shumë kthesa, përdorimin e veglave, përmbushjen e qëllimit, veprimet në kompjuter ose shfletues, materialin e mbledhjeve ose të gjatë, dhe funksionimin në kohë reale; nëse të dhënat janë publike; licencat e kodit dhe të dhënave, të regjistruara veçmas; adresat e depozitorit, kartës së setit të të dhënave dhe punimit; datën e verifikimit të fundit; dhe shënimet e provave.
- Vlerat janë po, jo, pjesërisht ose e paqartë. Pjesërisht do të thotë që aftësia shfaqet në një pjesë të paketës ose vlerësohet në mënyrë indirekte; nuk përshkruan cilësinë.
- Çdo rresht ka të paktën një burim të palës së parë, të listuar në auditimin e burimeve. Faktet në versionin aktual u verifikuan më 1 shtator 2026 nga depozitorët publikë, kartat e seteve të të dhënave dhe punimet e mirëmbajtësve.
Çfarë nuk është
- Nuk është një tabelë renditjeje. Nuk përmban rezultate dhe nuk rendit asgjë. Përfshirja nuk nënkupton miratim. Pse u ndërtua në atë mënyrë është në Si u ndërtua Voice Agent Benchmark Landscape.
- Nuk është një kornizë vlerësimi. Nuk ka asgjë për t'u ekzekutuar kundër një modeli; depozitori ofron të dhënat, skemën e tyre, një vërtetues dhe një vegël kërkimi.
- Nuk është benchmark-u i Cue. Benchmark-u privat i prodhimit me 227 mostra i përshkruar në studimin e rastit të Google DeepMind nuk është pjesë e tij.
Ku publikohet
| Ku | Adresa | Roli |
|---|---|---|
| GitHub | Sophon-LLC/voice-agent-benchmark-landscape | Burimi i regjistrit: të dhënat, skema, auditimi i burimeve, rregullat e kontributit, testet |
| Zenodo | doi.org/10.5281/zenodo.22227265 | Publikime të arkivuara me DOI; DOI-ja e konceptit gjithmonë çon te versioni më i fundit. |
| Hugging Face | chatjesus/voice-agent-benchmark-landscape | Kopje pasqyrë e setit të të dhënave. |
Versionet
| Versioni | Data | Regjistrime | Licenca | DOI i versionit |
|---|---|---|---|---|
| v1.0.2 | 1 shtator 2026 | 13 | MIT | 10.5281/zenodo.22227266 |
Regjistrimi në Zenodo për v1.0.2 përmban SHA-256 të setit të të dhënave (1d36c7b3f73565147fb7afff076c611c5fddc331e3ec47dc867625b75b70bbf4) në mënyrë që një kopje e shkarkuar të mund të kontrollohet me atë të arkivuar.
Si ta citoni
Skedari CITATION.cff i depos përcakton si autor Sophon LLC. Citoni DOI-në e versionit kur ka rëndësi riprodhueshmëria e saktë dhe DOI-në e konceptit për projektin në zhvillim:
Sophon LLC. Voice Agent Benchmark Landscape, version 1.0.2. 1 shtator 2026. https://doi.org/10.5281/zenodo.22227266
Korrigjime
Një korrigjim përcakton rreshtin, fushën, vlerën e propozuar dhe një burim të dorës së parë, duke ndjekur CONTRIBUTING.md të depos. Ndryshimet publikohen si një version i ri me një DOI të ri.