Tài liệu · Bằng chứng

Bằng chứng đã công bố về các sản phẩm của chúng tôi

Những gì đã được công bố về các sản phẩm của chúng tôi, bởi ai, mỗi nguồn nói gì và không nói gì. Mỗi nguồn một mục, kèm theo địa chỉ.

Công bố · Cập nhật

Hiện có hai nguồn. Một là của bên thứ ba; một là của chúng tôi. Mọi thứ khác về các sản phẩm của chúng tôi hoặc là điểm xếp hạng trên cửa hàng, được thống kê trên trang các con số, hoặc là mô tả của chính chúng tôi.

Google DeepMind: nghiên cứu tình huống về Cue

Địa chỉ: deepmind.google/models/gemma/gemmaverse/cue-ai. Được xuất bản trong Gemmaverse của Google DeepMind; các con số được cập nhật đến tháng 5 năm 2026.

Nội dung trang viết:

  • Cue là “a voice-activated AI agent that lives on the user's desktop.”
  • Bước trau chuốt chính tả của Cue đã chuyển từ một mô hình đám mây sang Gemma 4 E4B chạy cục bộ thông qua Ollama; độ trễ trung vị của bước đó đã giảm từ 876 ms xuống 488 ms, được đo trên Apple Silicon qua một benchmark giọng nói thật gồm 227 mẫu bao gồm cả đầu vào tiếng Anh và đa ngôn ngữ.
  • Lượng chính tả trên mỗi người dùng đã tăng khoảng 30 phần trăm trong số những người dùng beta đang hoạt động trong bốn tuần trước và sau khi chuyển đổi.
  • Chi phí suy luận biên của bước trau chuốt đã giảm xuống không, và tính năng chính tả không bị giới hạn ở mọi cấp độ, bao gồm cả cấp miễn phí.
  • Giọng nói được chuyển thành văn bản bởi một dịch vụ chuyển giọng nói thành văn bản trên đám mây trước bước trau chuốt cục bộ; nếu Ollama không chạy, ứng dụng sẽ chuyển bước trau chuốt đến một mô hình đám mây.
  • Chế độ tác nhân của Cue dựa trên một mô hình đám mây.

Nội dung trang không viết: đây không phải là một bài đánh giá sản phẩm, trang không đưa ra khẳng định nào về độ chính xác của việc chuyển ngữ, và benchmark 227 mẫu mà trang mô tả là riêng tư của Cue. Những gì trang này nói, so với cách chúng tôi trích dẫn, có trong Những gì nghiên cứu của DeepMind nói về Cue.

Tổng quan Benchmark Tác nhân Giọng nói

Của chúng tôi. Một bản đồ có cấu trúc gồm 13 benchmark công khai cho tác nhân giọng nói, trợ lý nói, sử dụng công cụ bằng giọng nói, hành động trên máy tính, nhận dạng giọng nói và hiểu cuộc họp, được phát hành dưới giấy phép MIT kèm theo một DOI. Nó không chứa điểm số và không bao gồm benchmark riêng tư của Cue. Hồ sơ, các phiên bản và định dạng trích dẫn có trên trang riêng của nó.

Các sản phẩm không có bằng chứng bên ngoài

Cue Office và PPT AI không có bằng chứng nào được công bố từ bên ngoài công ty tính đến ngày 15 tháng 9 năm 2026. PDF AI, PDF Scanner Max và Evolve có điểm xếp hạng trên cửa hàng, được liệt kê trên trang các con số cùng với số lượng của chúng.

Có gì đó sai trên trang này? feedback@sophoninc.com