
如何用FluidVoice语音控制Mac启动App、运行快捷指令、自动化工作流【免费下载链接】FluidVoiceFastest and only macOS Dictation app with on-device STT and custom trained AI enhancement model. Windows pre-build available! A local Wispr Flow alternative. DM us on X exclusive model access! - https://x.com/fluidvoiceapp项目地址: https://gitcode.com/GitHub_Trending/fl/FluidVoiceFluidVoice 是一款开源免费的 macOS 语音输入DictationApp内置端侧语音识别STT与自定义训练的 AI 增强模型支持命令模式Command Mode用纯语音启动应用、运行快捷指令并自动化工作流是本地运行的 Wispr Flow 替代方案。下面带你从零上手让声音成为你控制 Mac 的遥控器 ️一、FluidVoice 是什么为什么值得装简单说你说它听它写它执行。️全局语音输入任意 App 的输入框里说话文字自动打出来通过辅助功能 API 直接插入不依赖剪贴板端侧 STT 本地 AI 增强语音识别模型跑在本地Fluid Intelligence 还能在本地润色文本——自动加标点、修大小写、整理格式数据不出你的 Mac⚡Command Mode语音操控 Mac 的智能体模式可执行终端命令、用osascript驱动备忘录/日历/信息等原生应用自动完成前置检查与结果验证✍️Write Mode选中任意文本即可语音重写或在任何文本框里直接口述新内容多模型可选Nemotron Speech 3.5、Parakeet Flash、Apple Speech、Whisper 等支持数十种语言核心功能实现集中在 Sources/Fluid/Services/ 目录比如语音智能体逻辑在 CommandModeService.swift。二、5 分钟完成 FluidVoice 语音输入安装与首次启动要求macOS 15.0、Apple Silicon MacIntel 机型可用 Whisper 模型、约 1 GB 磁盘空间放语音模型。第 1 步安装二选一brew install --cask fluidvoice或到最新 Release 页面手动下载 dmg 安装。第 2 步授权两个关键权限启动后 FluidVoice 会请求麦克风和**辅助功能Accessibility**权限——前者用于录音后者用于把文字打进其他 App。两者都必须同意否则只识别不输入。第 3 步跟随引导完成设置欢迎页的 Quick Setup 会逐项帮你确认语音模型就绪 → 麦克风权限 → 辅助功能 → AI 增强配置 → 实测验证全部打勾即完成 ✅第 4 步选择你的语音模型引导流程采用语言优先设计先选语言再挑模型。追求极致低延迟选 Parakeet Flash英文约 250 MB多语言通用选 Parakeet TDT v3不想下载任何模型就直接用系统自带的 Apple Speech。第 5 步可选让 Mac 开机自启在Preferences中开启 Launch at Startup配合菜单栏图标常驻随时可语音唤起启动项逻辑见 SettingsStoreLaunchAtStartup.swift。三、全局快捷键一个键唤醒语音录音FluidVoice 支持在任意 App 中用全局快捷键触发录音这是日常最高频的用法打开Settings → Hotkey点击录制框按下你想要的组合键例如⌥ 空格选择激活模式定义见 HotkeyActivationMode.swiftToggle点击切换按一下开始录音再按一下结束Hold按住说话按住才录音松手即停类似按键通话Automatic自动单击切换 长按通话两种手势都支持开始说话——屏幕顶部刘海区域会实时浮现转写文字松开后文本自动插入你正在输入的位置默认热键为右侧 Option/Alt键。想改键位快捷键的按键码解析与显示实现可参考 HotkeyShortcut.swift热键注册逻辑在 GlobalHotkeyManager.swift。 小贴士录音延迟、音频管线等进阶调优项在设置中也可调整参考配置项见 audio-pipeline-optimization-settings 对应的音频管线优化设置组。四、Command Mode用声音运行快捷指令与自动化工作流这是 FluidVoice 最魔法的能力——不碰键盘鼠标用嘴指挥 Mac。工作原理语音 → 智能体 → 终端/系统指令按下热键用自然语言说出任务例如打开备忘录新建一条笔记明天 3 点开会把下载文件夹里所有的 .png 图片移到桌面新建的 Images 文件夹创建一个 12 月 25 日下午 3 点的日历事件背后的 CommandModeService.swift 驱动 LLM 以自主 macOS 终端智能体模式工作先做前置检查文件是否存在、工具是否已安装→执行→结果验证全程最多 20 轮自动决策原生 App 自动化通过osascript完成备忘录、提醒事项、日历、信息等都能被语音直接驱动安全机制检测到rm、mv、sudo等危险命令时会自动暂停在 Command Mode 窗口等你确认后才执行判断逻辑见 isDestructiveCommand命令过程会实时同步到刘海Notch浮层每一步检查中 / 执行中 / 已完成一目了然完成后给出带 ✓ 或 ✗ 的明确结论。一个典型工作流示例️ 说检查 Downloads 里的 screenshot.png 是否存在如果存在就复制到桌面然后确认复制成功FluidVoice 会依次执行ls检查 →cp复制 →ls验证最终回复✓ 已成功将 screenshot.png 复制到桌面。整条链路无需打开终端。注意Command Mode 需要配置一个 AI 模型OpenAI、Groq、本地 Ollama/LM Studio 等密钥安全存储在 macOS Keychain 中在AI Settings中选择命令模式专属的 Provider 与模型即可。五、锦上添花自定义词典与历史记录教语音引擎认识你的专有名词遇到总被听错的词人名、产品名、代码术语打开 Custom Dictionary用语音训练几次让它学会正确拼写或直接手动添加替换规则回顾每一次语音操作History 面板保存所有转写记录可搜索、查看 AI 润色前后对比、一键复制还支持 ZIP 导出本地音频历史存储实现见 TranscriptionHistoryStore.swift六、常见问题速答Q数据会上传到云端吗不会本地优先原则。除非你主动选择云端 AI Provider 做增强否则语音、文本全程留在本机。默认仅收集匿名周报用量信号且可随时在Settings → Share Detailed Anonymous Analytics关闭。QIntel Mac 能用吗可以1.5.1 版本通过 Whisper 模型支持 Intel Mac其他模型需 Apple Silicon。Q和 macOS 自带听写有什么区别自带听写只能说话变文字。FluidVoice 多出了全局热键 实时刘海预览、AI 本地润色、Command Mode 语音执行命令、Write Mode 语音重写、每 App 独立提示词等能力。总结步骤操作耗时1brew install --cask fluidvoice安装1 分钟2授予麦克风 辅助功能权限30 秒3选语言、选模型、设置全局热键3 分钟4打开 Command Mode用声音下达第一条指令30 秒装好 FluidVoice 后你的 Mac 就有了顺风耳打字用它、开会记纪要用它、跑命令也可以用它。从启动 App 到自动化工作流一句语音就够了 更多细节欢迎阅读项目 README.md 与源码目录 Sources/Fluid/。【免费下载链接】FluidVoiceFastest and only macOS Dictation app with on-device STT and custom trained AI enhancement model. Windows pre-build available! A local Wispr Flow alternative. DM us on X exclusive model access! - https://x.com/fluidvoiceapp项目地址: https://gitcode.com/GitHub_Trending/fl/FluidVoice创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考