Blog

Što studija slučaja tvrtke DeepMind kaže o aplikaciji Cue, a što ne

Google DeepMind objavio je 2026. studiju slučaja o aplikaciji Cue: što je mjereno, što se gdje izvršava, kako to citiramo i tvrdnje koje studija ne podržava.

Objavljeno

Studija slučaja tvrtke Google DeepMind o aplikaciji Cue jedini je vanjski dokaz o nekom našem proizvodu, pa ga citiramo mi i drugi. Ovaj članak iznosi što stranica kaže kako bi se citati mogli provjeriti. Stranica se nalazi na deepmind.google/models/gemma/gemmaverse/cue-ai; njezini su podaci označeni kao aktualni u svibnju 2026.

Što je mjereno

  • Medijan latencije koraka dotjerivanja diktata aplikacije Cue pao je s 876 ms na 488 ms nakon što je korak prešao s modela u oblaku na model Gemma 4 E4B koji se izvršava lokalno putem aplikacije Ollama. Stranica to naziva smanjenjem od 44 posto.
  • Mjerenje je provedeno na čipu Apple Silicon (serija M) putem aplikacije Ollama, na benchmarku od 227 stvarnih glasovnih uzoraka koji pokrivaju unos na engleskom i mješovitim jezicima.
  • Korištenje diktata po korisniku poraslo je za oko 30 posto, mjereno među aktivnim beta korisnicima u četiri tjedna prije i nakon što je lokalni model postao zadani.
  • Marginalni trošak inferencije koraka dotjerivanja pao je na nulu, što stranica navodi kao razlog zašto je diktat neograničen na svakoj razini, uključujući i besplatnu.

Što se gdje izvršava, prema stranici

  • Korisnik drži tipkovnički prečac i govori. Zvuk se transkribira u sirovi tekst pomoću usluge pretvaranja govora u tekst u oblaku.
  • Sirovi tekst šalje se modelu Gemma 4 koji se izvršava lokalno na korisnikovom računalu putem aplikacije Ollama, sa sistemskim upitom od oko 400 tokena koji vraća interpunkciju, segmentira rečenice i uklanja poštapalice.
  • Ako Ollama nije pokrenut, desktop aplikacija to otkriva pri pokretanju i preusmjerava korak dotjerivanja na model u oblaku.
  • Cueov način rada agenta oslanja se na model u oblaku. Stranica izvještava o ranim evaluacijama pozivanja funkcija modela Gemma 4 za samostalne zadatke i opisuje ih kao rane.

Dakle, „local” na toj stranici znači jedan korak jedne značajke. Transkripcija je u oblaku; agent je u oblaku; dotjerivanje je zadano lokalno s rezervnom opcijom u oblaku.

Kako ga citiramo

Početna stranica koristi dva podatka iz njega: 488 ms, što je pad s 876 ms, i rečenicu da je Cue „a voice-activated AI agent that lives on the user's desktop.” Oba se na stranici nalaze u tim riječima. Početna stranica također prikazuje segment od 45 sekundi iz govora tima Gemma u kojem govornik kaže da je angažman porastao za 30 posto; pisana studija slučaja navodi korištenje značajki. Mi navodimo pisani podatak i bilježimo razliku pored segmenta.

Što ne podržava

  • To nije recenzija proizvoda i ne iznosi tvrdnje o točnosti transkripcije ili uspješnosti zadataka agenta.
  • Benchmark s 227 uzoraka koji opisuje privatan je za Cue i nije objavljen. Naš javni skup podataka, Voice Agent Benchmark Landscape, nešto je drugo: mapa javnih benchmarkova drugih autora, bez rezultata.
  • Njegovi podaci datiraju iz svibnja 2026. Verzija aplikacije Cue objavljena nakon tog datuma nije opisana na stranici.

Stranica s podacima bilježi kako se brojka o latenciji koristi na početnoj stranici, a stranica s dokazima navodi studiju slučaja uz sve ostalo što je objavljeno o našim proizvodima.

Svi članci