Študija primera, ki jo je Google DeepMind opravil o aplikaciji Cue, je edini zunanji dokaz o našem izdelku, zato jo navajamo mi in drugi. Ta objava pojasnjuje, kaj stran navaja, da lahko navedke preverite. Stran je na naslovu deepmind.google/models/gemma/gemmaverse/cue-ai; njeni podatki so označeni kot veljavni na dan maj 2026.
Kaj so merili
- Mediana zakasnitve koraka izpopolnitve diktata v aplikaciji Cue se je zmanjšala z 876 ms na 488 ms, potem ko se je korak preselil z modela v oblaku na model Gemma 4 E4B, ki se izvaja lokalno prek Ollama. Stran to imenuje 44-odstotno zmanjšanje.
- Meritev je bila opravljena na strojni opremi Apple Silicon (serija M) prek Ollama, na benchmarku 227 resničnih glasovnih vzorcev, ki so zajemali angleški in mešanojezični vnos.
- Uporaba diktata na uporabnika se je povečala za približno 30 odstotkov, merjeno med aktivnimi beta uporabniki v štirih tednih pred in po tem, ko je lokalni model postal privzet.
- Mejni strošek sklepanja koraka izpopolnitve je padel na nič, kar stran navaja kot razlog, da je diktat neomejen v vseh paketih, vključno z brezplačnim.
Kaj se kje izvaja, glede na stran
- Uporabnik drži bližnjico na tipkovnici in govori. Zvok se prepiše v surovo besedilo s storitvijo za pretvorbo govora v besedilo v oblaku.
- Surovo besedilo se pošlje modelu Gemma 4, ki se izvaja lokalno na uporabnikovem računalniku prek Ollama, s sistemskim pozivom približno 400 žetonov, ki obnovi ločila, segmentira stavke in odstrani mašila.
- Če Ollama ne teče, namizna aplikacija to zazna ob zagonu in korak izpopolnitve preusmeri na model v oblaku.
- Način agenta v aplikaciji Cue se zanaša na model v oblaku. Stran poroča o zgodnjih ocenah klicanja funkcij modela Gemma 4 za samostojne naloge in jih opisuje kot zgodnje.
Izraz »local« na tej strani torej pomeni en korak ene funkcije. Priprava prepisa poteka v oblaku; agent deluje v oblaku; izpopolnitev je privzeto lokalna, z zasilno možnostjo v oblaku.
Kako ga citiramo
Domača stran uporablja dva podatka iz študije: 488 ms z 876 ms in stavek, da je Cue »a voice-activated AI agent that lives on the user's desktop.« Oba sta na strani navedena z istimi besedami. Domača stran prikazuje tudi 45-sekundni odlomek pogovora ekipe Gemma, v katerem govornik pravi, da se je vključenost povečala za 30 odstotkov; pisna študija primera navaja uporabo funkcij. Objavimo pisni podatek in ob odlomku zabeležimo razliko.
Česa študija ne podpira
- To ni mnenje o izdelku in ne podaja trditev o natančnosti prepisovanja ali uspešnosti nalog agenta.
- Benchmark z 227 vzorci, ki ga opisuje, je interni za Cue in ni objavljen. Naš javni nabor podatkov, Voice Agent Benchmark Landscape, je nekaj drugega: pregled javnih benchmarkov drugih avtorjev, brez rezultatov.
- Podatki v študiji so iz maja 2026. Različica aplikacije Cue, izdana po tem datumu, na tej strani ni opisana.
Stran s podatki beleži, kako se podatek o zakasnitvi uporablja na domači strani, stran z dokazi pa navaja študijo primera poleg vsega drugega, kar je bilo objavljeno o naših izdelkih.