O ditado de Cue ten un paso de puído: a transcrición en cru, coas súas palabras de recheo e a puntuación ausente, convértese nun texto que se le como o falante pretendía. Onde se executa ese paso decidiuse mediante unha medición, e a medición é pública. Esta publicación segue o estudo de caso de Google DeepMind, con cifras actuais a maio de 2026, e non engade nada que a páxina non declare.
O deseño orixinal
O paso foi construído para usar un modelo na nube, cun modelo local como alternativa, baixo a suposición de que un modelo máis grande puiría con máis precisión. O obxectivo declarado do equipo para o paso era un texto que soase como o usuario en lugar de como un modelo: puntuación restaurada, frases segmentadas, recheos eliminados, sen impoñer un estilo da casa.
A medición
O equipo probou o paso nun benchmark de 227 mostras de voz reais que abranguían inglés, outros idiomas e entradas en varios idiomas. Nese benchmark, Gemma 4 E4B, executándose localmente a través de Ollama en Apple Silicon, foi elixido como o modelo de primeira opción. A mediana da latencia do paso de puído baixou de 876 ms a 488 ms, o que a páxina describe como dentro do orzamento que o equipo establecera para un paso que ten que sentirse máis rápido que escribir.
A inversión
Despois do benchmark, a arquitectura foi invertida: o modelo local converteuse no predeterminado e o modelo na nube na alternativa. A aplicación de escritorio comproba ao iniciarse se Ollama está en execución; se non o está, o paso de puído diríxese a un modelo na nube e o ditado continúa.
O que cambiou para os usuarios, segundo a páxina
- O ditado por usuario aumentou arredor dun 30 por cento entre os usuarios activos da beta nas catro semanas antes e despois do cambio; os usuarios que ditaran mensaxes curtas comezaron a ditar outras máis longas.
- O custo marxinal de inferencia do paso caeu a cero, e a páxina dá esa como a razón pola que o ditado é ilimitado en todos os niveis, incluído o gratuíto.
O límite da afirmación
Só se moveu o paso de puído. A transcrición realízaa un servizo de conversión de voz a texto na nube antes do paso de puído, e o modo axente de Cue depende dun modelo na nube. A páxina informa de avaliacións temperás da chamada de funcións de Gemma 4 para tarefas de axente autónomas e cualifícaas de temperás. Polo tanto, a nosa páxina de inicio di que o puído se executa na máquina do usuario e non di nada sobre que o axente se execute localmente; a páxina de plataformas rexistra o mesmo límite.