Bloq

DeepMind keys tədqiqatının Cue haqqında dedikləri və demədikləri

Google DeepMind 2026-cı ildə Cue haqqında keys tədqiqatı dərc etdi: nəyi ölçdüyü, nəyin harada işlədiyi, bizim ona necə istinad etdiyimiz və dəstəkləmədiyi iddialar.

Dərc olunub:

Google DeepMind-ın Cue haqqında keys tədqiqatı məhsullarımızdan biri haqqında yeganə kənar sübutdur, buna görə də həm bizim, həm də başqaları tərəfindən ona istinad edilir. Bu məqalə səhifədə deyilənləri təqdim edir ki, sitatları onunla yoxlamaq mümkün olsun. Səhifə bu ünvandadır: deepmind.google/models/gemma/gemmaverse/cue-ai; onun rəqəmləri 2026-cı ilin may ayına olan vəziyyətə görə qeyd olunub.

Nə ölçüldü

  • Cue-nun diktə cilalama addımının median gecikməsi, addım bulud modelindən Ollama vasitəsilə lokal olaraq işləyən Gemma 4 E4B-yə keçdikdən sonra 876 ms-dən 488 ms-ə düşdü. Səhifədə bu, 44 faiz azalma adlandırılır.
  • Ölçmə Ollama vasitəsilə Apple Silicon (M-seriyası) üzərində, ingilis və qarışıq dilli daxiletməni əhatə edən 227 real səs nümunəsindən ibarət benchmark üzrə aparılıb.
  • Lokal modelin standart hala gəlməsindən əvvəlki və sonrakı dörd həftə ərzində aktiv beta istifadəçiləri arasında ölçüldükdə, istifadəçi başına diktə təxminən 30 faiz artdı.
  • Cilalama addımının marjinal inferensiya xərci sıfıra düşdü və səhifədə bu, diktənin pulsuz plan da daxil olmaqla hər səviyyədə limitsiz olmasının səbəbi kimi göstərilir.

Səhifəyə görə nə harada işləyir

  • İstifadəçi qısayol düyməsini basıb saxlayır və danışır. Səs bulud nitqdən-mətnə xidməti tərəfindən xam mətnə transkripsiya edilir.
  • Xam mətn Ollama vasitəsilə istifadəçinin cihazında lokal olaraq işləyən Gemma 4-ə göndərilir. Bu zaman durğu işarələrini bərpa edən, cümlələri seqmentləşdirən və artıq sözləri silən təxminən 400 tokenlik sistem sorğusundan istifadə olunur.
  • Ollama işləmirsə, desktop tətbiqi bunu işə salınarkən aşkar edir və cilalama mərhələsini bulud modelinə yönləndirir.
  • Cue-nun agent rejimi bulud modelinə əsaslanır. Səhifədə Gemma 4-ün müstəqil tapşırıqlar üçün funksiya çağırma qabiliyyətinin ilkin qiymətləndirmələri barədə məlumat verilir və onların ilkin olduğu təsvir edilir.

Beləliklə, həmin səhifədə “local” sözü bir funksiyanın bir addımı deməkdir. Transkripsiya bulud əsaslıdır; agent bulud əsaslıdır; cilalama standart olaraq yerlidir, lakin ehtiyat variant kimi buluddan istifadə edir.

Ondan necə sitat gətiririk

Ana səhifə ondan iki rəqəm istifadə edir: 876 ms-dən 488 ms-ə enmə və Cue-nun “a voice-activated AI agent that lives on the user's desktop.” olduğu cümlə. Hər ikisi səhifədə bu sözlərlə yer alır. Ana səhifə həmçinin Gemma komandasının çıxışının 45 saniyəlik bir seqmentini göstərir. Həmin seqmentdə natiq cəlb olunmanın 30 faiz artdığını deyir; yazılı keys-stadidə isə funksiya istifadəsi deyilir. Biz yazılı rəqəmi dərc edir və fərqi seqmentin yanında qeyd edirik.

Nəyi dəstəkləmir

  • Bu, məhsul rəyi deyil və transkripsiya dəqiqliyi və ya agentin tapşırıq uğuru barədə heç bir iddia irəli sürmür.
  • Onun təsvir etdiyi 227 nümunəlik benchmark Cue üçün özəldir və dərc edilməyib. Bizim açıq məlumat toplusumuz olan Voice Agent Benchmark Landscape fərqli bir şeydir: başqalarının açıq benchmarklarının xəritəsidir və heç bir bal ehtiva etmir.
  • Onun rəqəmləri may 2026-cı il tarixinə aiddir. Həmin tarixdən sonra buraxılmış Cue versiyası səhifədə təsvir edilmir.

Rəqəmlər səhifəsində ana səhifədə gecikmə rəqəminin necə istifadə edildiyi qeyd olunur və sübutlar səhifəsində keys-stadi məhsullarımız haqqında dərc edilmiş hər şeyin yanında sadalanır.

Bütün yazılar