Studija slučaja tvrtke Google DeepMind o aplikaciji Cue jedini je vanjski dokaz o nekom našem proizvodu, pa ga citiramo mi i drugi. Ovaj članak iznosi što stranica kaže kako bi se citati mogli provjeriti. Stranica se nalazi na deepmind.google/models/gemma/gemmaverse/cue-ai; njezini su podaci označeni kao aktualni u svibnju 2026.
Što je mjereno
- Medijan latencije koraka dotjerivanja diktata aplikacije Cue pao je s 876 ms na 488 ms nakon što je korak prešao s modela u oblaku na model Gemma 4 E4B koji se izvršava lokalno putem aplikacije Ollama. Stranica to naziva smanjenjem od 44 posto.
- Mjerenje je provedeno na čipu Apple Silicon (serija M) putem aplikacije Ollama, na benchmarku od 227 stvarnih glasovnih uzoraka koji pokrivaju unos na engleskom i mješovitim jezicima.
- Korištenje diktata po korisniku poraslo je za oko 30 posto, mjereno među aktivnim beta korisnicima u četiri tjedna prije i nakon što je lokalni model postao zadani.
- Marginalni trošak inferencije koraka dotjerivanja pao je na nulu, što stranica navodi kao razlog zašto je diktat neograničen na svakoj razini, uključujući i besplatnu.
Što se gdje izvršava, prema stranici
- Korisnik drži tipkovnički prečac i govori. Zvuk se transkribira u sirovi tekst pomoću usluge pretvaranja govora u tekst u oblaku.
- Sirovi tekst šalje se modelu Gemma 4 koji se izvršava lokalno na korisnikovom računalu putem aplikacije Ollama, sa sistemskim upitom od oko 400 tokena koji vraća interpunkciju, segmentira rečenice i uklanja poštapalice.
- Ako Ollama nije pokrenut, desktop aplikacija to otkriva pri pokretanju i preusmjerava korak dotjerivanja na model u oblaku.
- Cueov način rada agenta oslanja se na model u oblaku. Stranica izvještava o ranim evaluacijama pozivanja funkcija modela Gemma 4 za samostalne zadatke i opisuje ih kao rane.
Dakle, „local” na toj stranici znači jedan korak jedne značajke. Transkripcija je u oblaku; agent je u oblaku; dotjerivanje je zadano lokalno s rezervnom opcijom u oblaku.
Kako ga citiramo
Početna stranica koristi dva podatka iz njega: 488 ms, što je pad s 876 ms, i rečenicu da je Cue „a voice-activated AI agent that lives on the user's desktop.” Oba se na stranici nalaze u tim riječima. Početna stranica također prikazuje segment od 45 sekundi iz govora tima Gemma u kojem govornik kaže da je angažman porastao za 30 posto; pisana studija slučaja navodi korištenje značajki. Mi navodimo pisani podatak i bilježimo razliku pored segmenta.
Što ne podržava
- To nije recenzija proizvoda i ne iznosi tvrdnje o točnosti transkripcije ili uspješnosti zadataka agenta.
- Benchmark s 227 uzoraka koji opisuje privatan je za Cue i nije objavljen. Naš javni skup podataka, Voice Agent Benchmark Landscape, nešto je drugo: mapa javnih benchmarkova drugih autora, bez rezultata.
- Njegovi podaci datiraju iz svibnja 2026. Verzija aplikacije Cue objavljena nakon tog datuma nije opisana na stranici.
Stranica s podacima bilježi kako se brojka o latenciji koristi na početnoj stranici, a stranica s dokazima navodi studiju slučaja uz sve ostalo što je objavljeno o našim proizvodima.