常见问题
没找到答案?到 GitHub 提一个 issue。
安装与权限
顺口说收费吗?
不收费。顺口说以 MIT 许可证开源,个人和公司都可以免费使用。用云端识别或文本模型时,费用由你自己的服务商账户按量结算。
支持哪些系统?
主要面向 macOS 13 及以上的 Apple 芯片 Mac。按 Fn 口述、Fn + 左 Shift 翻译、组合键取消和可靠粘贴这些新增功能只在 macOS 上可用。
发布页同时提供 Windows x64 安装包,沿用上游 Handy 的能力,需要改用其他快捷键。
打开时提示“无法验证开发者”或“已损坏”
安装包没有经过 Apple 公证。确认安装包来自 GitHub 上的本仓库后,在终端运行 xattr -cr /Applications/Sayso.app,再打开即可。
需要哪些权限?
麦克风用来录音,辅助功能用来把文字粘贴到当前输入框,输入监控用来识别 Fn 这样的全局快捷键。首次运行时会逐项提示。如果授权后快捷键仍然没反应,退出并重新打开顺口说。
按 Fn 时会切换输入法或弹出表情面板
打开「系统设置 → 键盘」,把「按下 🌐 键时」改成「不执行任何操作」。顺口说的首页会检测这项设置,不对时会给出提示。
怎么更新到新版本?
在「设置 → 关于」里点「检查更新」。有新版本时点「下载新版本」,浏览器会下载 GitHub 上最新的安装包,覆盖安装即可,设置、历史和模型都会保留。
0.2.0 之后的每个 macOS 版本都用同一张证书签名,覆盖安装后麦克风、辅助功能和输入监控权限保持不变;从 0.2.0 及更早版本升级时需要重新授权一次。
识别与隐私
我的声音会上传吗?
默认不会。本地识别用 Qwen3-ASR 0.6B 在本机离线运行,音频不离开这台 Mac。只有在「模型 → 语音识别」里主动切到云端识别时,音频才会上传到你选择的服务商。
本地识别失败时不会悄悄改用云端。
文本模型会拿到什么?
开启口述整理或使用翻译时,识别出的文字和命中的词典词条会发给你配置的文本模型(默认 DeepSeek deepseek-flash,也可以用阿里云百炼或任意 OpenAI 兼容接口)。把口述整理设为「关闭」且不用翻译,文字就不出本机。
不配置 API Key 能用吗?
能。用本地识别并关闭整理,就是完全离线的用法,口述会直接插入识别结果(仍会应用词典替换)。翻译需要文本模型。
API Key 存在哪里?
目前以明文保存在 ~/Library/Application Support/com.sayso.desktop/settings_store.json,只有你的账户能读取。之后计划改为存进钥匙串。
本地模型有多大?
推荐的 Qwen3-ASR 0.6B 约 811 MB,离线识别 30 种语言,自动判断语种。也可以导入已有的 sherpa-onnx SenseVoice int8 文件夹,不用重新下载。
使用
口述和翻译怎么触发?
Fn 口述,Fn + 左 Shift 翻译。默认的触发方式是「短按切换 + 按住说话」:短按一次开始、再按一次结束,或者按住说、松开结束。
先按住 Fn 再加上 左 Shift,能把正在进行的口述转成翻译。录音时按 Esc 或点 ✕ 取消,点 ✓ 结束。
翻译失败会怎样?
不会把原文插进去。悬浮条会显示原因,并提供「重试」和「复制原文」。
词典有什么用?
每个词条有标准写法、常见误识别、固定译法和备注。识别后按字面替换误识别,并把命中的词条提示给文本模型;翻译时使用固定译法。支持按行导入导出。
和 Handy 是什么关系?
顺口说从开源项目 Handy(MIT)分叉。录音、全局热键、不抢焦点的悬浮窗、可靠粘贴和模型管理沿用上游;翻译模式、文本模型整理、词典和云端识别是新加的。