Imlak Cue mempunyai langkah penggilapan: transkrip mentah, dengan kata-kata pengisi dan tanda baca yang hilang, diubah menjadi teks yang berbunyi seperti yang dimaksudkan oleh penutur. Tempat langkah itu dijalankan diputuskan oleh satu pengukuran, dan pengukuran itu adalah umum. Siaran ini mengikuti kajian kes Google DeepMind, dengan angka terkini setakat Mei 2026, dan tidak menambah apa-apa yang tidak dinyatakan oleh halaman tersebut.
Reka bentuk asal
Langkah ini dibina untuk menggunakan model awan, dengan model setempat sebagai sandaran, atas andaian bahawa model yang lebih besar akan menggilap dengan lebih tepat. Matlamat pasukan yang dinyatakan untuk langkah ini ialah teks yang berbunyi seperti pengguna dan bukan seperti model: tanda baca dipulihkan, ayat dibahagikan, kata pengisi dibuang, tanpa memaksakan gaya syarikat.
Pengukuran
Pasukan ini membuat benchmark langkah tersebut pada 227 sampel suara sebenar yang merangkumi bahasa Inggeris, bahasa lain dan input berbilang bahasa. Pada benchmark itu, Gemma 4 E4B, yang berjalan secara setempat melalui Ollama pada Apple Silicon, dipilih sebagai model pilihan pertama. Latensi median langkah penggilapan jatuh daripada 876 ms kepada 488 ms, yang digambarkan oleh halaman itu sebagai dalam bajet yang telah ditetapkan oleh pasukan untuk langkah yang perlu terasa lebih pantas daripada menaip.
Pembalikan
Selepas benchmark, seni bina itu diterbalikkan: model setempat menjadi lalai dan model awan menjadi sandaran. Aplikasi desktop memeriksa semasa permulaan sama ada Ollama sedang berjalan; jika tidak, langkah penggilapan dihalakan ke model awan dan imlak diteruskan.
Apa yang berubah untuk pengguna, menurut halaman tersebut
- Imlak bagi setiap pengguna meningkat kira-kira 30 peratus merentas pengguna beta aktif dalam empat minggu sebelum dan selepas pertukaran; pengguna yang telah mengimlakkan mesej pendek mula mengimlakkan mesej yang lebih panjang.
- Kos inferens marginal langkah itu jatuh kepada sifar, dan halaman itu menyatakan ini sebagai sebab imlak tidak terhad pada setiap peringkat, termasuk yang percuma.
Sempadan dakwaan
Hanya langkah penggilapan yang beralih. Transkripsi dilakukan oleh perkhidmatan pertuturan-ke-teks awan sebelum langkah penggilapan, dan mod ejen Cue bergantung pada model awan. Halaman itu melaporkan penilaian awal panggilan fungsi Gemma 4 untuk tugas ejen serba lengkap dan menyatakannya sebagai awal. Oleh itu, halaman utama kami menyatakan bahawa penggilapan berjalan pada mesin pengguna dan tidak menyatakan apa-apa tentang ejen yang berjalan secara setempat; halaman platform merekodkan sempadan yang sama.