Skip to content
Star

Pro 功能介绍

说点啥 Pro 版在开源版的基础上,提供了更多专业功能和增强特性,满足高级用户的需求。

功能概览

Pro 版包含以下独有功能,按用途分为四组,与下文各节一一对应:

识别与录音

  • 热词管理: 多供应商热词适配(注入识别引擎、识别后替换读音近似词、注入润色 Prompt),提升专有名词识别准确率
  • 畅说模式: 自动起停录音,连续口述多段文本无需手动控制
  • 输入框上下文辅助: AI 后处理可参考光标附近文本,提升衔接与术语一致性

文本处理

  • 离线繁体转换: 自动将识别结果转换为繁体中文
  • 正则后处理: 使用正则表达式进行文本后处理
  • 应用专属 Prompt: 按前台应用自动切换 AI 后处理 Prompt
  • AI 助手: 通过唤醒词触发语音指令,支持预设关键词与模糊匹配

个性化

  • 个性化 UI 取色: 更丰富的颜色自定义选项
  • 全向光标滑动: 增强的光标控制,支持四向滑动

数据

  • WebDAV 自动备份: 定时将配置备份到云端,多设备同步(见 配置备份

热词管理 Pro

管理自定义热词,提升专有名词、品牌名、人名等特殊词汇的识别准确率。

生效方式

热词有三个可组合的生效开关:

  • 注入识别引擎(「向识别引擎注入热词」):热词按供应商能力参与识别,部分本地模型也已支持
  • 识别后替换读音近似词:识别结束后,基于音素匹配把近似发音替换为目标热词
  • 注入润色 Prompt(「向润色 Prompt 注入热词」):AI 润色时把已启用热词及别名以结构化词表追加到 Prompt 末尾,方便模型把听错的专有名词改回标准写法;与识别后替换相互独立,可能增加 Token 消耗。子开关「仅注入读音相近的热词」可只注入与本次识别文本读音相近的热词(仅中文与英语),避免 Prompt 过长

其中「注入识别引擎」与「识别后替换读音近似词」的组合效果:

注入热词识别后替换实际效果
热词按供应商能力参与识别;识别后不做近音替换
热词参与识别,识别后再由目标词与别名进行近音兜底替换
不向识别引擎提供热词,但识别后仍执行近音替换
识别前后均不应用热词

默认情况下「向识别引擎注入热词」开启。供应商是否支持热词及实际效果仍取决于对应引擎。

其他能力:

  • 目标词 + 别名: 每个热词最多 3 个别名位,其中目标词固定作为第 1 个别名,可额外添加 2 个别名
  • 别名参与音素匹配: 目标词和额外别名都会参与识别后的音素匹配,命中后统一替换为目标词
  • 热词统计: 支持查看热词触发频率与命中情况,便于按场景持续优化词库
  • AI 助手联动: AI 助手中的关键词可自动同步到热词列表,减少重复维护

使用方法:

  1. 打开说点啥 Pro 设置
  2. 进入 设置 → 智能 → 语音识别设置 → 识别结果优化(Pro)
  3. 开启「向识别引擎注入热词」,让热词按供应商能力参与识别
  4. 打开「热词管理」,添加或从剪贴板批量导入热词
  5. 长按热词胶囊可编辑别名(格式:目标词 | 别名 2 | 别名 3)
  6. 按需开启「识别后替换读音近似词」与「向润色 Prompt 注入热词」
  7. 在热词管理页查看触发频率与命中情况,按结果调整词表

热词数量不宜过多(根据不同供应商说明),过多会影响识别性能

从纠正中学习热词

开启后,完成一次语音输入并手动修正识别结果,Pro 会尝试从改动中提取适合作为热词的内容。

  1. 进入 设置 → 智能 → 语音识别设置 → 识别结果优化(Pro)
  2. 开启「从纠正中学习热词」
  3. 可选开启「使用LLM分析纠正」;此项需要已配置可用的 LLM
  4. 在修改版 Fcitx5 / Trime、最新版 IME Bridge,或使用无障碍写入的悬浮球中完成语音输入,然后改正错词
  5. 回到「待确认的自学习热词」确认或删除候选项

默认情况下,新候选需要手动确认;同一修正再次被学习到时会自动确认。若同时开启「自动采纳学习结果」与「使用LLM分析纠正」,LLM 判断为热词的内容可在第一次学习时直接加入;本地规则提取的候选仍需再次出现或手动确认。

配套版本

修改版 Fcitx5 / Trime 通过可选 AIDL 功能实现热词学习; 其他第三方输入法与悬浮球可通过最新版 LSPosed/LSPatch IME Bridge 模块或悬浮球无障碍调用方式触发热词学习。

隐私与误学习

密码、邮箱、网址、电话及禁止个性化学习的输入框不会触发学习。开启 AI 学习后,只会把改动片段和少量上下文发送给所选 LLM,不会发送整个输入框; LLM 不可用时自动退回本地规则; 可能存在误学习的情况,可以配合手动确认避免把临时改写或常用词误添加为热词。

示例与统计

别名示例:

  • 纠正近音词:目标词「音素」,额外别名「因素」「严肃」。如果识别结果中出现「因素」,会被替换为「音素」。
  • 快捷短语输入:目标词 xxxx@qq.com,额外别名「主邮箱」。说出「主邮箱」并被识别出来后,会替换为真实邮箱地址。

使用建议

「识别后替换读音近似词」仅适用于中文与英语,对于其他语言可能无法正常工作。适合专有名词和高频易错词。对于普通常用词,过度添加可能导致相近发音被误替换。

便捷能力:

  • 一键清空 + 撤销:支持批量清空热词,并可在提示条中点击“撤销”恢复
  • 选词菜单快速添加:在任意应用选中文本,选择「添加热词到「说点啥」」即可一键加入热词列表

供应商支持

供应商支持状态最大数量
Volcengine100 tokens(双向流式) / 5000 个
DashScope10000 tokens
Soniox8000 tokens
SiliconFlow几乎无限(Sensevoice 和 Telespeech 不支持)
StepAudio仅热词数组,不支持上下文注入
OpenAI取决于模型
Gemini几乎无限
GLM ASR100 个
MiMo支持上下文注入
ElevenLabs-
Qwen3-ASR建议 100 个以内
FunASR Nano建议 100 个以内
其他本地模型❌/视模型而定取决于引擎能力

本地热词说明

选择 Qwen3-ASR 或 FunASR Nano 时,保存热词后可能需要重新准备本地模型,新的热词才会完整生效。

畅说模式 Pro

自动起停录音的连续口述模式:激活后检测到说话自动开始录音,静音后自动结束并识别,无需反复点击。

功能特点

  • 自动开始: 激活后检测到语音自动开始录音
  • 自动停止: 检测到静音后自动结束录音并识别
  • 连续对话: 支持连续多次识别,无需反复点击
  • 跟随判停设置: 判停窗口与灵敏度跟随「语音识别设置 → 录音判停设置」,无独立参数

使用方法

  1. 打开说点啥 Pro 键盘面板
  2. 键盘面板上点击畅说模式开关(需要在 设置 → 界面设置 → 键盘界面 → 自定义键盘布局 中添加畅说模式按钮)
  3. 通过按钮激活畅说模式,开始说话;检测到语音自动开始本段录音,静音后自动停止并上屏
  4. 判停窗口(默认 1200 毫秒)与判停灵敏度(默认 4)在 设置 → 智能 → 语音识别设置 → 录音判停设置 中调整

悬浮球也支持畅说模式,适合在第三方输入法或当前应用内连续口述多段文本。开启后会持续本地监听并按静音自动分段,识别结果按段提交。并且可在悬浮球菜单中通过按钮切换开关。

注意

  • 畅说模式需要麦克风始终处于监听状态,会增加电池消耗
  • 在极其嘈杂的环境中可能误触发,建议切换回长按模式
  • 启用畅说模式时可能需要一两个词的时间才能触发开始录音;会尽量利用触发前的本机音频,减少开头音频被丢弃的情况

输入框上下文辅助 Pro

在主键盘中使用 AI 后处理时,可把光标附近的输入框文本作为参考发送给 LLM,帮助模型理解上下文衔接、术语和语气。启用「输入法 Hook 模块」后,悬浮球录音也可使用当前输入框上下文辅助 AI 后处理。模块安装与隐私边界见 IME Bridge 模块

使用方法

  1. 打开 设置 → 智能 → AI 功能设置
  2. 开启「使用输入框上下文辅助(Pro)」
  3. 在主键盘中录音并启用 AI 后处理;如需在悬浮球中使用,请同时开启 设置 → 输入 → 更多输入方式 → 高级功能 → 输入法 Hook 模块

隐私说明

该功能会把光标附近文本发送给当前 LLM 供应商作为参考。请只在信任所选供应商和当前输入内容适合发送时开启。

适用范围

输入框上下文适用于主键盘录音后的 AI 后处理,也适用于已启用 IME Bridge 的悬浮球录音。MiMo 多模态 ASR 也可结合 Pro 上下文信息提升专有名词和场景词理解。

离线繁体转换 Pro

自动将简体中文识别结果转换为繁体中文,适合繁体中文用户使用。

功能特点

  • 智能转换: 使用先进的离线简繁转换算法
  • 无缝集成: 转换自动进行,不影响识别速度
  • 全局生效: 支持所有 ASR 供应商和输入场景

使用方法

  1. 打开说点啥 Pro 设置
  2. 进入 设置 → 输入 → 输入设置 → Pro 功能 → 识别结果转为繁体
  3. 可选转换规则:
    • 标准繁体: 常规简繁转换
    • 台湾用语: 适合台湾地区的用词习惯
    • 香港用语: 适合香港地区的用词习惯

提示

繁体转换会在所有文本处理(包括 AI 后处理)完成后应用,确保最终结果为繁体中文。

正则后处理 Pro

使用正则表达式对识别结果进行自定义文本处理,实现复杂的文本转换需求。

功能特点

  • 正则匹配: 支持完整的 Java 正则表达式语法
  • 多规则链: 按顺序应用多个正则规则
  • 规则模板: 一键添加常用模板,并自动补全规则备注
  • 规则备注: 备注仅用于列表展示,不影响匹配与替换逻辑

使用方法

  1. 打开说点啥设置
  2. 进入 设置 → 智能 → 语音识别设置 → 识别结果优化(Pro)
  3. 开启功能开关,点击 新建规则(或使用 常用模板 一键添加)
  4. 填写规则信息:
    • 匹配正则: 正则表达式
    • 替换内容: 替换文本(支持 $1$2 等捕获组)
    • 匹配选项: 忽略大小写、多行模式等
    • 备注(列表显示): 给规则起个名字,方便管理(不影响规则效果)
  5. 点击保存,规则会按顺序应用

提示

默认情况下,正则后处理在 AI 后处理之后应用,可以用来规范 AI 输出的格式。若开启「在 AI 后处理前执行正则」,正则处理后的文本会作为 AI 后处理输入,适合先清理固定噪声再交给 AI 改写。

应用专属 Prompt Pro

此功能仅在 Pro 版中可用

为不同应用配置不同的 AI 后处理 Prompt:例如在聊天软件用“通用后处理”,在笔记软件用“基础润色”,在任务工具用“提取待办事项”。

使用方法

  1. 打开 设置 → 智能 → AI 功能设置
  2. 点击「应用专属 Prompt(Pro)」进入配置页
  3. 开启「启用应用专属 Prompt」
  4. 点击「添加应用」,选择目标应用并为其指定 Prompt

注意

该功能需要开启说点啥的无障碍服务,用于识别“当前前台应用”以自动选择 Prompt;不会读取聊天内容等屏幕文本。

AI 助手 Pro

通过唤醒词触发语音指令,让 AI 直接执行翻译、写作、编辑、总结等任务。

功能特点

  • 唤醒词触发:在语音开头说出唤醒词即可进入 AI 助手流程
  • 预设模式:可同时启用多个预设(如翻译/写作/编辑),按关键词自动匹配
  • 模糊匹配:唤醒词与预设关键词支持模糊匹配,降低口误导致的触发失败
  • 可自定义:支持自定义唤醒词、关键词与提示词

使用方法

  1. 打开 设置 → 智能 → AI 功能设置
  2. 开启「启用 AI 助手(Pro)」
  3. 配置唤醒词与预设关键词
  4. 说出“唤醒词 + 指令”即可触发(例如:点点,帮我翻译成英文)

个性化 UI 取色 Pro

在开源版 Material3 动态取色的基础上,提供更丰富的颜色自定义选项。

功能扩展

开源版支持:

  • Material3 动态颜色主题

Pro 版额外支持:

  • 内置多种主题色: 不受系统壁纸限制,自由选择主题色
  • AMOLED 纯黑模式: 深色场景下使用更纯粹的黑色背景
  • Monet 开关: 可选择是否跟随系统壁纸动态取色
  • Key color 自定义: 选择默认色、内置色或自定义色作为主题基准

使用方法

  1. 打开说点啥设置
  2. 进入 设置 → 界面设置 → 主体界面 → 主题模式(Pro)
  3. 根据需要配置:
    • 外观: 跟随系统 / 浅色 / 深色 / AMOLED 纯黑
    • Monet: 是否使用壁纸动态取色
    • Key color: 默认、内置颜色或自定义颜色
    • 颜色风格 / 色彩规格: 调整主题色板风格

说明

选择自定义 Key color 后,会覆盖单纯的 Material3 动态颜色;恢复默认 Key color 可回到默认主题行为。

全向光标滑动 Pro

在空格键上实现全向滑动控制

使用方法

  1. 开启 设置 → 输入 → 输入设置 → Pro 功能 → 光标滑动模式
  2. 在键盘面板上,在空格位置开始上滑触发光标滑动功能
  3. 麦克风按钮会变成四个方向的箭头图标,表示可以滑动
  4. 从光标当前位置,向上/下/左/右滑动以移动光标,输入框中的光标会跟随手指位置移动而相应移动

空格上滑即可进入滑动模式;AI 编辑面板也可以进入该模式。

WebDAV 自动备份 Pro

自动备份说点啥的所有设置到 WebDAV 云端存储,支持多设备同步。在 设置 → 系统 → 配置备份 → 自动备份(Pro) 中开启,备份间隔由「间隔数值 + 单位(小时/天)」组成,最小 6 小时;页面会显示下次预计备份时间与上次备份状态。

配置详情与故障排查见 配置备份

如何获取 Pro 版

Pro 版应用统一通过 Google Play 商店 分发,购买与激活方式见 Pro 版购买方式,功能差异见 Pro 版与开源版对比

Released under the Apache 2.0 License.