新功能
- Gemini 3.5 Transcribe 实时语音识别:新增 Gemini Live API 流式识别,支持 Smart / Verbatim、语言提示和热词。
- 阶跃星辰实时语音识别:新增开放平台 WebSocket 实时 ASR;连接准备期间会缓存音频并在就绪后补发。
- 浅色主题与原生毛玻璃录音条:录音浮窗新增浅色主题,并通过 macOS 原生 behind-window 材质呈现真实桌面透光效果。
- 首页就地管理模式:在首页“我的模式”卡片中直接管理快捷键与模式排序。
- 紧凑型实时文本:Compact 指示条可在固定宽度内显示实时识别文本,并在处理完成后恢复紧凑高度。
- 历史识别信息与质量反馈:可显示实际使用的模式、服务商和模型,并标记识别不佳的记录、查看汇总统计。
改进与修复
- 语音润色问句:将润色规则与原始口述文本分离发送,避免模型误将问句和命令当成请求并直接回答或执行。
- Deepgram 与历史信息:支持自定义 Deepgram 模型和兼容端点的正确鉴权,历史记录和用量详情稳定显示实际 ASR 模型。
- 设置交互:统一 Tooltip、液态玻璃标签切换和内联分段控件的动画与无障碍降级;剪贴板留存设置拆分为更易理解的常规输入与取消行为控制。




