Blogg

Hvað tilviksrannsókn DeepMind segir um Cue, og hvað hún segir ekki

Google DeepMind birti tilviksrannsókn um Cue árið 2026: hvað hún mældi, hvað keyrir hvar, hvernig við vitnum í hana og þær fullyrðingar sem hún styður ekki.

Birt

Tilviksrannsókn Google DeepMind um Cue er eina utanaðkomandi sönnunin um vöru frá okkur, svo það er vitnað í hana, af okkur og öðrum. Þessi færsla útlistar hvað síðan segir, svo hægt sé að bera tilvitnanirnar saman við hana. Síðan er á deepmind.google/models/gemma/gemmaverse/cue-ai; tölur hennar eru merktar sem gildandi í maí 2026.

Hvað hún mældi

  • Median leyndartími fínpússunarskrefs Cue í upplestri lækkaði úr 876 ms í 488 ms eftir að skrefið færðist úr skýjalíkani yfir í Gemma 4 E4B sem keyrir staðbundið í gegnum Ollama. Síðan kallar það 44 prósenta lækkun.
  • Mælingin var gerð á Apple Silicon (M-seríu) í gegnum Ollama, yfir benchmark með 227 raunverulegum raddsýnum sem náðu yfir ensku og blandað tungumálainntak.
  • Upplestur á hvern notanda jókst um u.þ.b. 30 prósent, mælt meðal virkra beta-notenda í fjórar vikur fyrir og eftir að staðbundna líkanið varð sjálfgefið.
  • Jaðarkostnaður við ályktun fínpússunarskrefsins fór niður í núll, sem síðan gefur upp sem ástæðu þess að upplestur er ótakmarkaður á öllum þrepum, þar með talið því ókeypis.

Hvað keyrir hvar, samkvæmt síðunni

  • Notandinn heldur inni flýtilykli og talar. Hljóð er afritað yfir í hráan texta með skýjaþjónustu fyrir tal-í-texta.
  • Hrái textinn er sendur til Gemma 4 sem keyrir staðbundið á vél notandans í gegnum Ollama, með kerfiskvaðningu upp á um 400 tóka sem endursetur greinarmerki, skiptir í setningar og fjarlægir fylliorð.
  • Ef Ollama er ekki í gangi nemur borðtölvuforritið það við ræsingu og beinir fínpússunarskrefinu yfir á skýjalíkan.
  • Fulltrúahamur Cue byggir á skýjalíkani. Síðan greinir frá frummati á fallakalli Gemma 4 fyrir afmörkuð verkefni og lýsir því sem bráðabirgðamati.

Þannig að „local“ á þeirri síðu þýðir eitt skref í einum eiginleika. Afritun er í skýinu; fulltrúinn er í skýinu; fínpússunin er „local“ sjálfgefið með varaúrræði í skýinu.

Hvernig við vitnum í það

Forsíðan notar tvær tölur úr henni: 488 ms úr 876 ms, og setninguna að Cue sé „a voice-activated AI agent that lives on the user's desktop.“ Hvort tveggja er á síðunni með þessum orðum. Forsíðan sýnir einnig 45 sekúndna bút úr fyrirlestri Gemma-teymisins þar sem fyrirlesarinn segir að þátttaka hafi aukist um 30 prósent; skriflega tilviksrannsóknin segir notkun á eiginleikum. Við birtum skriflegu töluna og tökum fram muninn við hliðina á bútnum.

Hvað það styður ekki

  • Það er ekki vöruumsögn og setur enga fullyrðingu fram um nákvæmni afritunar eða árangur í verkefnum fulltrúa.
  • Það 227 sýna benchmark sem það lýsir er einkaeign Cue og er ekki gefið út. Opinbera gagnasafnið okkar, Voice Agent Benchmark Landscape, er annað: kort af opinberum benchmark-prófum annarra, án nokkurra skora.
  • Tölur þess eru dagsettar í maí 2026. Útgáfa af Cue sem gefin er út eftir þá dagsetningu er ekki lýst á síðunni.

Tölusíðan skráir hvernig biðtímatalan er notuð á forsíðunni og sönnunarsíðan telur upp tilviksrannsóknina ásamt öllu öðru sem hefur verið gefið út um vörur okkar.

Allar færslur