Studi kasus Google DeepMind tentang Cue adalah satu-satunya bukti dari pihak luar mengenai produk kami, sehingga dikutip, oleh kami dan oleh pihak lain. Tulisan ini menjelaskan apa yang dikatakan halaman tersebut, agar kutipannya dapat diperiksa. Halaman tersebut ada di deepmind.google/models/gemma/gemmaverse/cue-ai; angkanya ditandai sebagai data terkini per Mei 2026.
Apa yang diukur
- Latensi median dari langkah penyempurnaan dikte Cue turun dari 876 md menjadi 488 md setelah langkah tersebut beralih dari model cloud ke Gemma 4 E4B yang berjalan secara lokal melalui Ollama. Halaman tersebut menyebutnya sebagai penurunan 44 persen.
- Pengukuran dilakukan pada Apple Silicon (seri M) melalui Ollama, pada benchmark yang terdiri dari 227 sampel suara nyata yang mencakup input bahasa Inggris dan bahasa campuran.
- Dikte per pengguna naik sekitar 30 persen, diukur di antara pengguna beta aktif dalam empat minggu sebelum dan sesudah model lokal menjadi default.
- Biaya inferensi marjinal dari langkah penyempurnaan turun menjadi nol, yang menurut halaman tersebut adalah alasan mengapa dikte tidak terbatas di setiap tingkatan, termasuk tingkatan gratis.
Apa yang berjalan di mana, menurut halaman tersebut
- Pengguna menahan tombol pintas dan berbicara. Audio ditranskripsikan menjadi teks mentah oleh layanan speech-to-text di cloud.
- Teks mentah dikirim ke Gemma 4 yang berjalan secara lokal di mesin pengguna melalui Ollama, dengan prompt sistem sekitar 400 token yang memulihkan tanda baca, membagi kalimat, dan menghapus kata-kata pengisi.
- Jika Ollama tidak berjalan, aplikasi desktop akan mendeteksinya saat dijalankan dan mengarahkan langkah penyempurnaan ke model cloud.
- Mode agen Cue mengandalkan model cloud. Halaman tersebut melaporkan evaluasi awal dari pemanggilan fungsi Gemma 4 untuk tugas-tugas mandiri, dan menggambarkannya sebagai evaluasi awal.
Jadi, “local” di halaman tersebut berarti satu langkah dari satu fitur. Transkripsi berbasis cloud; agennya berbasis cloud; penyempurnaannya bersifat lokal secara default dengan fallback ke cloud.
Cara kami mengutipnya
Halaman beranda menggunakan dua angka dari laporan tersebut: 488 md turun dari 876 md, dan kalimat bahwa Cue adalah “a voice-activated AI agent that lives on the user's desktop.” Keduanya ada di halaman tersebut dengan kata-kata yang sama. Halaman beranda juga menampilkan segmen 45 detik dari pembicaraan tim Gemma di mana pembicara mengatakan keterlibatan naik 30 persen; studi kasus tertulis menyebutkan penggunaan fitur. Kami mencetak angka yang tertulis dan mencatat perbedaannya di samping segmen tersebut.
Apa yang tidak didukungnya
- Ini bukan ulasan produk dan tidak membuat klaim tentang akurasi transkripsi atau keberhasilan tugas agen.
- Benchmark 227 sampel yang dijelaskannya bersifat pribadi untuk Cue dan tidak dipublikasikan. Kumpulan data publik kami, Voice Agent Benchmark Landscape, adalah hal yang berbeda: sebuah peta benchmark publik milik pihak lain, tanpa skor.
- Angka-angkanya bertanggal Mei 2026. Versi Cue yang dirilis setelah tanggal tersebut tidak dijelaskan oleh halaman ini.
Halaman angka mencatat bagaimana angka latensi digunakan di halaman beranda, dan halaman bukti mencantumkan studi kasus tersebut di samping semua hal lain yang telah dipublikasikan tentang produk kami.