Prípadová štúdia Google DeepMind o Cue je jediným externým dôkazom o našom produkte, takže sa cituje, nami aj ostatnými. Tento príspevok uvádza, čo stránka hovorí, aby sa citáty dali voči nej overiť. Stránka sa nachádza na deepmind.google/models/gemma/gemmaverse/cue-ai; jej údaje sú označené ako aktuálne k máju 2026.
Čo merala
- Medián latencie kroku doladenia diktovania v Cue klesol z 876 ms na 488 ms po tom, čo sa tento krok presunul z cloudového modelu na Gemma 4 E4B bežiaci lokálne cez Ollama. Stránka to nazýva 44-percentným znížením.
- Meranie sa uskutočnilo na Apple Silicon (séria M) cez Ollama, na základe benchmarku 227 reálnych hlasových vzoriek pokrývajúcich anglický a zmiešaný jazykový vstup.
- Diktovanie na používateľa vzrástlo približne o 30 percent, merané u aktívnych beta používateľov počas štyroch týždňov pred a po tom, čo sa lokálny model stal predvoleným.
- Marginálne náklady na inferenciu kroku doladenia klesli na nulu, čo stránka uvádza ako dôvod, prečo je diktovanie neobmedzené v každej úrovni, vrátane bezplatnej.
Čo kde beží, podľa stránky
- Používateľ podrží klávesovú skratku a hovorí. Zvuk sa prepíše na surový text pomocou cloudovej služby prevodu reči na text.
- Surový text sa odošle do Gemma 4 bežiaceho lokálne na počítači používateľa cez Ollama, so systémovým zadaním s približne 400 tokenmi, ktoré obnovuje interpunkciu, segmentuje vety a odstraňuje výplnkové slová.
- Ak Ollama nie je spustená, desktopová aplikácia to pri štarte zistí a presmeruje krok doladenia na cloudový model.
- Režim agenta aplikácie Cue sa spolieha na cloudový model. Stránka uvádza skoré hodnotenia volania funkcií modelu Gemma 4 pre samostatné úlohy a opisuje ich ako skoré.
Takže „local“ na tej stránke znamená jeden krok jednej funkcie. Prepis je cloudový, agent je cloudový a doladenie je štandardne lokálne s cloudovou zálohou.
Ako ho citujeme
Domovská stránka z neho používa dva údaje: 488 ms, pokles z 876 ms, a vetu, že Cue je „a voice-activated AI agent that lives on the user's desktop.“ Obe sa na stránke nachádzajú v tomto znení. Domovská stránka tiež ukazuje 45-sekundový úsek z prezentácie tímu Gemma, v ktorom rečník hovorí, že zapojenie používateľov vzrástlo o 30 percent; písomná prípadová štúdia uvádza používanie funkcie. Uvádzame písomný údaj a pri úseku poznamenávame rozdiel.
Čo nepodporuje
- Nejde o recenziu produktu a neobsahuje žiadne tvrdenie o presnosti prepisu alebo úspešnosti úloh agenta.
- Benchmark s 227 vzorkami, ktorý opisuje, je interný pre Cue a nie je zverejnený. Náš verejný dataset, Voice Agent Benchmark Landscape, je niečo iné: mapa verejných benchmarkov iných autorov, bez skóre.
- Údaje v ňom sú z mája 2026. Verzia aplikácie Cue vydaná po tomto dátume nie je na stránke opísaná.
Stránka s číslami zaznamenáva, ako sa údaj o latencii používa na domovskej stránke, a stránka s dôkazmi uvádza prípadovú štúdiu spolu so všetkým ostatným, čo bolo o našich produktoch publikované.