Narek v aplikaciji Cue ima korak izpopolnitve: surov prepis z mašili in manjkajočimi ločili se spremeni v besedilo, ki se bere tako, kot je govorec nameraval. Kje se ta korak izvaja, je bilo odločeno na podlagi meritve, in ta meritev je javna. Ta objava sledi študiji primera podjetja Google DeepMind, s podatki, veljavnimi od maja 2026, in ne dodaja ničesar, česar stran ne navaja.
Prvotna zasnova
Korak je bil zasnovan za uporabo modela v oblaku, z lokalnim modelom kot rezervno možnostjo, ob predpostavki, da bo večji model izpopolnil besedilo natančneje. Navedeni cilj ekipe za ta korak je bilo besedilo, ki se bere kot uporabnikovo in ne kot modelovo: z obnovljenimi ločili, razdeljenimi stavki, odstranjenimi mašili, brez vsiljevanja hišnega sloga.
Meritev
Ekipa je izvedla benchmark koraka na 227 resničnih glasovnih vzorcih, ki so pokrivali angleščino, druge jezike in mešani jezikovni vnos. Na podlagi tega benchmarka je bil model Gemma 4 E4B, ki se izvaja lokalno prek Ollama na Apple Silicon, izbran kot model prve izbire. Mediana zakasnitve koraka izpopolnitve je padla z 876 ms na 488 ms, kar stran opisuje kot znotraj proračuna, ki ga je ekipa določila za korak, ki mora delovati hitreje od tipkanja.
Obrat
Po benchmarku je bila arhitektura obrnjena: lokalni model je postal privzet, model v oblaku pa rezervna možnost. Namizna aplikacija ob zagonu preveri, ali se Ollama izvaja; če se ne, se korak izpopolnitve preusmeri na model v oblaku in narek se nadaljuje.
Kaj se je spremenilo za uporabnike, po navedbah strani
- Uporaba nareka na uporabnika se je povečala za približno 30 odstotkov med aktivnimi beta uporabniki v štirih tednih pred in po preklopu; uporabniki, ki so narekovali kratka sporočila, so začeli narekovati daljša.
- Mejni strošek sklepanja za ta korak je padel na nič, in stran to navaja kot razlog, da je narek neomejen v vseh paketih, vključno z brezplačnim.
Meja trditve
Premaknjen je bil le korak izpopolnitve. Transkripcija se pred korakom izpopolnitve izvede s storitvijo za pretvorbo govora v besedilo v oblaku, način agenta v aplikaciji Cue pa se zanaša na model v oblaku. Stran poroča o zgodnjih ocenah klicanja funkcij modela Gemma 4 za samostojne naloge agenta in jih imenuje zgodnje. Naša domača stran zato navaja, da se izpopolnitev izvaja na uporabnikovem računalniku, in ne omenja, da bi se agent izvajal lokalno; stran Platforme beleži enako mejo.