github joewongjc/type4me v2.10.0
v2.10.0: 多模型接入与语音输入体验升级

7 hours ago

新功能

  • 小米 MiMo 文本处理服务:新增 MiMo 服务商,可在设置中配置凭证并选择常用模型。
  • 百炼 Qwen-Audio 3.1 流式识别:支持新一代实时识别模型,扩展语言提示选项;原有百炼配置继续可用。
  • StepFun 实时识别区域选择:可选择中国或全球服务区域;现有配置继续默认使用中国区。

StepFun 实时语音识别的区域选择设置

  • Grok 实时识别模型:固定使用 Grok Voice Transcribe 2.0,并在录音信息和历史记录中显示模型名称。
  • 菜单栏切换文本处理引擎:新增处理引擎子菜单,可直接切换已配置的 LLM;麦克风、识别引擎和翻译目标等当前选项也会正确显示系统勾选标记。

改进与修复

  • 语音改口支持所有输入模式:无论文字来自哪种输入模式,都可在符合现有定位和写入安全检查时追踪并修改。
  • 改口文本读取权限检查:读取无障碍文本前再次确认前台应用和焦点元素归属,避免切换应用时读取排除应用的内容。
  • 火山引擎热词生效:将直传热词放入服务端定义的请求字段,去重并遵守请求容量限制,避免配置的热词被服务端忽略。
  • 短录音识别更干净:抑制 Gemini 短录音中的纯热词回声,同时保留用户真实说出的单个热词。
  • 历史质量统计更清晰:在识别引擎统计中突出差评比例,并在下方显示差评条数。

识别质量统计中的差评比例和记录条数

  • 应用内更新说明支持格式和图片:更新说明可按 Markdown 排版,并显示其中的图片,阅读更清晰。

应用内格式化显示带图片的更新说明

Don't miss a new type4me release

NewReleases is sending notifications on new releases.