O caso de estudo de Google DeepMind sobre Cue é a única proba externa sobre un produto noso, polo que se cita, tanto por nós como por outros. Esta publicación expón o que di a páxina, para que as citas se poidan comprobar con ela. A páxina está en deepmind.google/models/gemma/gemmaverse/cue-ai; as súas cifras indícanse como actuais a maio de 2026.
O que mediu
- A mediana da latencia do paso de puído do ditado de Cue baixou de 876 ms a 488 ms despois de que o paso se trasladase dun modelo na nube a Gemma 4 E4B executado localmente a través de Ollama. A páxina cualifica iso como unha redución do 44 por cento.
- A medición realizouse en Apple Silicon (serie M) a través de Ollama, sobre un benchmark de 227 mostras de voz reais que abranguen entradas en inglés e en varios idiomas.
- O ditado por usuario aumentou aproximadamente un 30 por cento, medido entre os usuarios activos da beta nas catro semanas antes e despois de que o modelo local se convertese no predeterminado.
- O custo marxinal de inferencia do paso de puído caeu a cero, o que a páxina sinala como a razón pola que o ditado é ilimitado en todos os niveis, incluído o gratuíto.
O que se executa onde, segundo a páxina
- O usuario mantén premido un atallo de teclado e fala. O son transcríbese a texto en cru mediante un servizo de conversión de voz a texto na nube.
- O texto en cru envíase a Gemma 4, que se executa localmente na máquina do usuario a través de Ollama, cunha indicación de sistema duns 400 tokens que restaura a puntuación, segmenta as frases e elimina as palabras de recheo.
- Se Ollama non está a executarse, a aplicación de escritorio detéctao ao iniciarse e desvía o paso de puído a un modelo na nube.
- O modo axente de Cue depende dun modelo na nube. A páxina informa de avaliacións temperás das chamadas a funcións de Gemma 4 para tarefas autónomas e cualifícaas de temperás.
Polo tanto, «local» nesa páxina refírese a un paso dunha funcionalidade. A transcrición está na nube, o axente está na nube e o puído é local por omisión cunha alternativa na nube.
Como o citamos
A páxina de inicio usa dúas cifras súas: 488 ms, unha baixada desde 876 ms, e a frase de que Cue é “a voice-activated AI agent that lives on the user's desktop.” Ambas aparecen na páxina con esas mesmas palabras. A páxina de inicio tamén mostra un fragmento de 45 segundos dunha charla do equipo de Gemma na que o relator di que a participación aumentou un 30 por cento; o estudo de caso escrito fala do uso da funcionalidade. Nós publicamos a cifra escrita e sinalamos a diferenza ao lado do fragmento.
O que non avala
- Non é unha recensión dun produto e non fai ningunha afirmación sobre a precisión da transcrición nin sobre o éxito do axente nas tarefas.
- O benchmark de 227 mostras que describe é privado de Cue e non está publicado. O noso conxunto de datos público, o Voice Agent Benchmark Landscape, é outra cousa: un mapa dos benchmarks públicos doutras persoas, sen puntuacións.
- As súas cifras están datadas en maio de 2026. Unha versión de Cue publicada despois desa data non está descrita na páxina.
A páxina de cifras rexistra como se usa o número da latencia na páxina de inicio, e a páxina de probas recolle o estudo de caso xunto con todo o demais que se publicou sobre os nosos produtos.