Případová studie Google DeepMind o Cue je jediným externím důkazem o našem produktu, takže je citována námi i ostatními. Tento příspěvek uvádí, co stránka říká, aby bylo možné citace s ní porovnat. Stránka se nachází na deepmind.google/models/gemma/gemmaverse/cue-ai; její údaje jsou označeny jako aktuální k květnu 2026.
Co se měřilo
- Medián latence kroku doladění diktování v Cue klesl z 876 ms na 488 ms poté, co se tento krok přesunul z cloudového modelu na Gemma 4 E4B běžící lokálně přes Ollama. Stránka to nazývá 44procentním snížením.
- Měření bylo provedeno na Apple Silicon (řada M) přes Ollama na benchmarku 227 reálných hlasových vzorků pokrývajících angličtinu a vícejazyčný vstup.
- Diktování na uživatele vzrostlo přibližně o 30 procent, měřeno u aktivních uživatelů beta verze ve čtyřech týdnech před a po tom, co se lokální model stal výchozím.
- Mezní náklady na inferenci kroku doladění klesly na nulu, což stránka uvádí jako důvod, proč je diktování neomezené ve všech tarifech, včetně toho bezplatného.
Co kde běží, podle stránky
- Uživatel podrží klávesovou zkratku a mluví. Zvuk je převeden na surový text cloudovou službou pro převod řeči na text.
- Surový text je odeslán do Gemma 4 běžícího lokálně na počítači uživatele přes Ollama, se systémovým zadáním o délce přibližně 400 tokenů, které obnovuje interpunkci, segmentuje věty a odstraňuje výplňková slova.
- Pokud Ollama neběží, desktopová aplikace to při spuštění zjistí a krok doladění přesměruje na cloudový model.
- Režim agenta v Cue se spoléhá na cloudový model. Stránka uvádí raná hodnocení volání funkcí modelu Gemma 4 pro samostatné úkoly a popisuje je jako raná.
Takže „local“ na té stránce znamená jeden krok jedné funkce. Přepis je cloudový, agent je cloudový a doladění je ve výchozím nastavení lokální, s cloudovou zálohou.
Jak ji citujeme
Naše domovská stránka z ní používá dva údaje: 488 ms (pokles z 876 ms) a větu, že Cue je „a voice-activated AI agent that lives on the user's desktop.“ Obojí je na stránce uvedeno těmito slovy. Domovská stránka také ukazuje 45sekundový úsek z přednášky týmu Gemma, v němž řečník říká, že zapojení uživatelů vzrostlo o 30 procent; písemná případová studie uvádí využití funkce. Uvádíme údaj z písemné studie a vedle úryvku na rozdíl upozorňujeme.
Co nepodporuje
- Nejedná se o recenzi produktu a neobsahuje žádné tvrzení o přesnosti přepisu nebo úspěšnosti agenta při plnění úkolů.
- Benchmark o 227 vzorcích, který popisuje, je interní pro Cue a není zveřejněn. Náš veřejný dataset, Voice Agent Benchmark Landscape, je něco jiného: přehled veřejných benchmarků jiných stran, bez jakýchkoli skóre.
- Údaje v ní jsou z května 2026. Verze Cue vydaná po tomto datu není na stránce popsána.
Stránka s čísly a údaji zaznamenává, jak se údaj o latenci používá na domovské stránce, a stránka s důkazy uvádí případovou studii vedle všeho ostatního, co bylo o našich produktech publikováno.