Blog

Apa yang kajian kes DeepMind katakan tentang Cue, dan apa yang tidak

Google DeepMind menerbitkan kajian kes tentang Cue pada tahun 2026: apa yang diukur, apa yang berjalan di mana, bagaimana kami memetiknya, dan dakwaan yang tidak disokongnya.

Diterbitkan pada

Kajian kes Google DeepMind tentang Cue ialah satu-satunya bukti luar mengenai produk kami, jadi ia dipetik, oleh kami dan oleh orang lain. Catatan ini menerangkan apa yang halaman itu katakan, supaya petikan tersebut boleh disemak berbandingnya. Halaman itu berada di deepmind.google/models/gemma/gemmaverse/cue-ai; angkanya ditandakan sebagai terkini pada Mei 2026.

Apa yang diukur

  • Kependaman median bagi langkah penggilapan imlak Cue menurun daripada 876 ms kepada 488 ms selepas langkah itu beralih daripada model awan kepada Gemma 4 E4B yang berjalan secara setempat melalui Ollama. Halaman itu memanggilnya pengurangan 44 peratus.
  • Pengukuran diambil pada Apple Silicon (siri-M) melalui Ollama, menggunakan benchmark 227 sampel suara sebenar yang merangkumi input bahasa Inggeris dan bahasa campuran.
  • Imlak bagi setiap pengguna meningkat kira-kira 30 peratus, diukur merentas pengguna beta aktif dalam empat minggu sebelum dan selepas model setempat menjadi lalai.
  • Kos inferens marginal bagi langkah penggilapan jatuh kepada sifar, yang dinyatakan oleh halaman itu sebagai sebab imlak tidak terhad pada setiap peringkat, termasuk peringkat percuma.

Apa yang berjalan di mana, menurut halaman itu

  • Pengguna menekan kekunci pintas dan bercakap. Audio ditranskripsikan kepada teks mentah oleh perkhidmatan pertuturan-ke-teks awan.
  • Teks mentah dihantar ke Gemma 4 yang berjalan secara setempat pada mesin pengguna melalui Ollama, dengan gesaan sistem kira-kira 400 token yang memulihkan tanda baca, membahagikan ayat dan membuang kata-kata pengisi.
  • Jika Ollama tidak berjalan, aplikasi desktop akan mengesannya semasa permulaan dan menghalakan langkah penggilapan ke model awan.
  • Mod ejen Cue bergantung pada model awan. Halaman tersebut melaporkan penilaian awal bagi panggilan fungsi Gemma 4 untuk tugas serba lengkap, dan menyifatkannya sebagai awal.

Jadi, “local” di halaman itu bermaksud satu langkah bagi satu ciri. Transkripsi adalah berasaskan awan; ejen adalah berasaskan awan; penggilapan adalah setempat secara lalai dengan sandaran awan.

Cara kami memetiknya

Halaman utama menggunakan dua angka daripadanya: 488 ms turun daripada 876 ms, dan ayat bahawa Cue ialah “a voice-activated AI agent that lives on the user's desktop.” Kedua-duanya ada pada halaman tersebut dalam perkataan itu. Halaman utama juga menunjukkan segmen 45 saat daripada ceramah pasukan Gemma di mana penceramah mengatakan penglibatan meningkat 30 peratus; kajian kes bertulis mengatakan penggunaan ciri. Kami mencetak angka bertulis dan menyatakan perbezaan di sebelah segmen tersebut.

Perkara yang tidak disokongnya

  • Ini bukan ulasan produk dan tidak membuat dakwaan tentang ketepatan transkripsi atau kejayaan tugas ejen.
  • Benchmark 227 sampel yang diterangkannya adalah peribadi untuk Cue dan tidak diterbitkan. Set data awam kami, Voice Agent Benchmark Landscape, ialah perkara yang berbeza: peta benchmark awam orang lain, tanpa skor.
  • Angkanya bertarikh Mei 2026. Versi Cue yang dikeluarkan selepas tarikh itu tidak diterangkan oleh halaman tersebut.

Halaman angka merekodkan cara nombor kependaman digunakan pada halaman utama, dan halaman bukti menyenaraikan kajian kes di samping semua perkara lain yang telah diterbitkan tentang produk kami.

Semua catatan