現在、2つの情報源があります。1つは第三者によるもの、もう1つは当社によるものです。当社の製品に関するその他すべての情報は、ストアでの評価(数値に関するページで集計)か、当社自身の説明のいずれかです。
Google DeepMind:Cueに関するケーススタディ
アドレス:deepmind.google/models/gemma/gemmaverse/cue-ai。Google DeepMindのGemmaverseで公開。数値は2026年5月現在のものです。
内容:
- Cueは「a voice-activated AI agent that lives on the user's desktop.」です。
- Cueの音声入力の推敲ステップは、クラウドモデルから、Ollamaを通じてローカルで実行されるGemma 4 E4Bに移行しました。これにより、Apple Silicon上で英語および多言語混合入力をカバーする227サンプルの実音声ベンチマークで測定した結果、当該ステップの遅延時間の中央値は876msから488msに減少しました。
- この切り替えの前後4週間で、アクティブなベータ版利用者の1ユーザーあたりの音声入力数は約30%増加しました。
- 推敲ステップの限界推論コストはゼロになり、無料プランを含むすべてのプランで音声入力が無制限になりました。
- 音声は、ローカルでの推敲ステップの前に、クラウドの音声テキスト変換サービスによって文字起こしされます。Ollamaが実行されていない場合、アプリは推敲ステップをクラウドモデルに転送します。
- Cueのエージェントモードは、クラウドモデルに依存しています。
記載されていないこと:これは製品レビューではなく、文字起こしの精度に関する主張もしていません。また、記述されている227サンプルのベンチマークはCue独自のものです。このページの内容と、当社の引用の仕方との対照については、DeepMindのケーススタディがCueについて述べていることに記載しています。
音声エージェントベンチマークランドスケープ
当社によるものです。音声エージェント、音声アシスタント、音声によるツール使用、コンピューター操作、音声認識、会議理解に関する13の公開ベンチマークを構造的にまとめたもので、DOIを付与してMITライセンスの下で公開しています。これにはスコアは含まれず、Cueの非公開ベンチマークも含まれていません。記録、バージョン、引用形式は専用ページにあります。
外部による裏付けのない製品
2026年9月15日時点で、Cue OfficeとPPT AIには社外から公開された裏付けがありません。PDF AI、PDF Scanner Max、Evolveにはストアでの評価があり、その件数とともに数値に関するページに掲載されています。