Blog

O que di o caso de estudo de DeepMind sobre Cue, e o que non

Google DeepMind publicou un caso de estudo sobre Cue en 2026: o que mediu, o que se executa onde, como o citamos e as afirmacións que non apoia.

Publicado o

O caso de estudo de Google DeepMind sobre Cue é a única proba externa sobre un produto noso, polo que se cita, tanto por nós como por outros. Esta publicación expón o que di a páxina, para que as citas se poidan comprobar con ela. A páxina está en deepmind.google/models/gemma/gemmaverse/cue-ai; as súas cifras indícanse como actuais a maio de 2026.

O que mediu

  • A mediana da latencia do paso de puído do ditado de Cue baixou de 876 ms a 488 ms despois de que o paso se trasladase dun modelo na nube a Gemma 4 E4B executado localmente a través de Ollama. A páxina cualifica iso como unha redución do 44 por cento.
  • A medición realizouse en Apple Silicon (serie M) a través de Ollama, sobre un benchmark de 227 mostras de voz reais que abranguen entradas en inglés e en varios idiomas.
  • O ditado por usuario aumentou aproximadamente un 30 por cento, medido entre os usuarios activos da beta nas catro semanas antes e despois de que o modelo local se convertese no predeterminado.
  • O custo marxinal de inferencia do paso de puído caeu a cero, o que a páxina sinala como a razón pola que o ditado é ilimitado en todos os niveis, incluído o gratuíto.

O que se executa onde, segundo a páxina

  • O usuario mantén premido un atallo de teclado e fala. O son transcríbese a texto en cru mediante un servizo de conversión de voz a texto na nube.
  • O texto en cru envíase a Gemma 4, que se executa localmente na máquina do usuario a través de Ollama, cunha indicación de sistema duns 400 tokens que restaura a puntuación, segmenta as frases e elimina as palabras de recheo.
  • Se Ollama non está a executarse, a aplicación de escritorio detéctao ao iniciarse e desvía o paso de puído a un modelo na nube.
  • O modo axente de Cue depende dun modelo na nube. A páxina informa de avaliacións temperás das chamadas a funcións de Gemma 4 para tarefas autónomas e cualifícaas de temperás.

Polo tanto, «local» nesa páxina refírese a un paso dunha funcionalidade. A transcrición está na nube, o axente está na nube e o puído é local por omisión cunha alternativa na nube.

Como o citamos

A páxina de inicio usa dúas cifras súas: 488 ms, unha baixada desde 876 ms, e a frase de que Cue é “a voice-activated AI agent that lives on the user's desktop.” Ambas aparecen na páxina con esas mesmas palabras. A páxina de inicio tamén mostra un fragmento de 45 segundos dunha charla do equipo de Gemma na que o relator di que a participación aumentou un 30 por cento; o estudo de caso escrito fala do uso da funcionalidade. Nós publicamos a cifra escrita e sinalamos a diferenza ao lado do fragmento.

O que non avala

  • Non é unha recensión dun produto e non fai ningunha afirmación sobre a precisión da transcrición nin sobre o éxito do axente nas tarefas.
  • O benchmark de 227 mostras que describe é privado de Cue e non está publicado. O noso conxunto de datos público, o Voice Agent Benchmark Landscape, é outra cousa: un mapa dos benchmarks públicos doutras persoas, sen puntuacións.
  • As súas cifras están datadas en maio de 2026. Unha versión de Cue publicada despois desa data non está descrita na páxina.

A páxina de cifras rexistra como se usa o número da latencia na páxina de inicio, e a páxina de probas recolle o estudo de caso xunto con todo o demais que se publicou sobre os nosos produtos.

Todas as entradas