Chinese Brief
中文案例导读
myuan19 / VoiceInput 公开的多模态生成与理解案例,来源为 公开代码库,复核于 2026-06-27T09:24:23Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
CASE EVIDENCE / A RECORD
myuan19 / VoiceInput 公开的多模态生成与理解案例,来源为 公开代码库,复核于 2026-06-27T09:24:23Z。
原始记录:myuan19 VoiceInput 用 Qwen3.7 Max 做语音转文字后的文本润色模型
Chinese Brief
myuan19 / VoiceInput 公开的多模态生成与理解案例,来源为 公开代码库,复核于 2026-06-27T09:24:23Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
任务
VoiceInput 是一个 Windows 托盘语音输入工具,用户录音后调用 DashScope ASR,并在配置中提供文本润色模型菜单;README 的配置表明确把 qwen3.7-max 列入默认启用的 enabled_polish_models,源码 config.py 也把 qwen3.7-max 和日期快照作为 Qwen 润色模型选项。
公开仓库提供可下载 Releases、托盘录音、自动粘贴、历史记录和配置文件等完整桌面工具产物;用户可在配置中启用/选择 qwen3.7-max 对 ASR 文本进行润色后输出到当前光标位置。
Qwen3.7 Max 在该工具中承担语音识别后文本整理/润色的 LLM 角色,把原始转写内容改写为更适合直接粘贴使用的文本;DashScope API Key 与模型菜单共同构成可核验的模型调用路径。
个人开源桌面工具;证据能核验模型绑定、任务和公开产物,但没有公开生产用量或商业客户数据。