返回首页

2026年7月23日

FluidVoice 本地听写值不值得试:Mac 兼容性与数据路径决策指南

从 macOS 版本、Intel/Apple Silicon、语言模型、权限、存储和云端增强边界出发,判断 FluidVoice 是否适合你的 Mac;不把未经实测的速度或准确率当结论。

  • 本地 AI
  • 语音 AI
  • 人工智能
FluidVoice 本地听写、可选本地增强与云端增强的数据路径决策图
Original Wesbase decision flow

安装前,先过六项检查

  1. macOS 是 15 或更高版本吗? 目前官方资料和 Homebrew cask 都把 macOS 15+ 作为要求。不是的话,先等待要求变化或选择其他路径,不要把“未来支持”当成现在可用。
  2. 你的 Mac 是 Apple Silicon 还是 Intel? Apple Speech 和 Whisper 有 Intel 路径;Nemotron、Parakeet、Cohere 和 Fluid Intelligence 路径按文档要求 Apple Silicon。
  3. 所选模型支持你的目标语言吗? 不要先安装再猜。不同模型的语言范围不同,未知组合应先核对。
  4. 你愿意开放麦克风和辅助功能权限吗? 麦克风用于听写,辅助功能权限用于 Smart Typing 把文字输入到应用中。
  5. 你能接受模型占用的磁盘空间吗? 每个语音模型约 1 GB,可选 Fluid Intelligence 约 3.5 GB,都是近似值。
  6. 你需要云端润色或后处理吗? 如果需要,就要明确选择提供商、添加 API key,并把“本地听写”和“云端增强”当成两段不同的数据路径。

如果前四项有一项过不了,结论是等待或放弃;如果只有云端边界不合适,可以只使用本地路径;如果你需要的是实时对话而不是把语音输入到文本框,可以先看实时语音和听写的区别

一张兼容性与风险矩阵

判断维度官方资料支持的检查对读者意味着什么仍然未知的部分
系统版本当前平台是 macOS;官方要求 macOS 15+;v1.6.5 发布于 2026-07-21 03:02 UTC低于 macOS 15 不应按当前要求安装后续版本是否降低或提高要求
芯片架构Apple Speech、Whisper 可用于 Apple Silicon + Intel;Nemotron、Parakeet、Cohere、Fluid Intelligence 要求 Apple SiliconIntel 用户的模型选择更窄,应先按 Whisper 或 Apple Speech 核对各路径的实际速度、占用和稳定性
语言与模型TDT v3 列 25 种语言;TDT v2 和 Parakeet Flash 列英语;Cohere 列 14 种语言含普通话;Whisper 按模型最多 99 种;Apple Speech 取决于系统语言支持先选语言,再选模型,不能把“支持多语言”推广给所有模型具体版本、输入环境和语言组合的实际效果
权限麦克风和辅助功能权限是文档化听写/输入要求不愿授权的用户不适合这条路径权限提示、拒绝后的行为和不同应用的实际差异
存储每个语音模型约 1 GB;可选 Fluid Intelligence 约 3.5 GB需要把模型空间纳入安装预算实际下载大小、缓存、升级和卸载行为
数据路径文档称语音、音频、转写文本留在 Mac,除非用户明确选择云端 AI 提供商本地优先是一个有条件的路径说明,不是万能隐私保证云端请求的保留、地区路由和不同提供商的具体处理
分析设置隐私说明称匿名分析默认开启且可在设置关闭,同时另一处又称其为 opt-in安装后应主动检查设置,不要只读一句隐私摘要当前版本实际开关状态和后续文档是否统一
许可证项目说明 2026-02-23 起适用 GPLv3分发、修改和集成前应读许可证你的具体使用方式是否满足许可证要求,需要专业意见

本地、可选本地增强和云端,不是一条路

1. 本地语音与转写

按项目文档,语音、音频和转写文本留在 Mac,除非用户明确选择云端 AI 提供商。这个表述支持你判断“是否存在本地优先路径”,但不支持“任何情况下都没有数据离开 Mac”的绝对承诺。

FluidVoice 列出的模型包括 Nemotron Speech 3.5、Nemotron 3.5 Multilingual、Parakeet Flash(Beta)、Parakeet TDT v3/v2、Cohere Transcribe、Apple Speech,以及 Whisper Tiny/Base/Small/Medium/Large。模型名称多,不代表每个模型都适合你的芯片或语言,也不代表它们之间存在本文可以证明的质量排名。

2. 可选的本地 Fluid Intelligence

项目把 Fluid Intelligence 描述为一个本地运行时,用于智能格式化、上下文相关的大小写和后处理,并提示约 3.5 GB 的模型下载。它是独立的可选路径,不应和基础语音转写混为一谈;文档还说明该组件由另一方私下维护。

这意味着你可以把问题拆成两层:先问基础听写是否满足设备、语言和权限条件,再问是否需要额外的本地后处理。后者增加空间和一个独立维护边界,但本文没有实测其速度、质量或资源占用。

3. 明确配置的云端提供商

官方资料列出 OpenAI、Groq 和自定义提供商。使用这些路径需要用户添加 API key;README 说明 key 存在 macOS Keychain,并要求用户为 key 访问选择“Always allow”。因此,云端增强不是隐形的“本地功能”,而是一个需要你主动配置的边界。

如果你在评估其他本地、托管和 API 路径,可以参考本地、托管、API 与部署边界的判断方法。重点不是看到“支持 API”就结束,而是继续问:什么内容会发送、供应商如何保留、请求走哪个地区、费用如何计算,以及能否关闭。

4. Audio History 与匿名分析

Audio History 被描述为可选的本地录音历史,带预算控制和 ZIP 导出;该功能描述没有说有云端存储。但“文档如此描述”和“你在当前版本开启后的实际行为”仍不是同一件事,重要录音应先用低风险内容验证。

分析设置存在更直接的文档冲突:隐私部分说匿名分析默认开启,可以在 Settings 关闭;同一 README 的其他措辞又把分析称为 opt-in。项目列出的是高层应用、配置、使用和成功/错误数据,并称不包含语音、原始音频、转写、选中文本、提示词、回答、终端命令、窗口标题、文件路径、剪贴板、已输入内容和个人隐私信息。由于默认状态表述不一致,安装后应以当前设置为准,并把这个开关列入复查清单。

适合谁,不适合谁?

适合谁

  • 使用 macOS 15+,并愿意先核对芯片、语言和模型组合的人。
  • 需要麦克风输入和 Smart Typing,并能接受麦克风、辅助功能权限的人。
  • 希望优先评估本地语音路径,同时愿意把可选本地增强和云端增强分开判断的人。
  • 能把首次试用限制在低风险文本,并接受性能与准确率需要自行验证的人。

不适合谁

  • 使用低于 macOS 15,或必须使用文档未明确支持的架构、语言组合的人。
  • 不愿授予麦克风或辅助功能权限的人。
  • 没有足够磁盘空间,且不愿管理多个本地模型的人。
  • 需要先得到“最快”“最准”“最省电”结论,或把厂商文档当作独立测试的人。
  • 不能接受可选云端提供商、API key 或分析设置需要主动复查的人。

如果你的语音需求发生在手机购买决策中,而不是 Mac 听写,可以顺便看AI 手机的设备、权限、地区和隐私检查。同一个“AI 语音”标签,在不同设备上的执行路径并不自动相同。

安装前清单

  • macOS 版本为 15 或更高。
  • 已确认 Apple Silicon 或 Intel,并选定对应模型路径。
  • 已确认目标语言和具体模型,而不是只看应用支持多语言。
  • 能接受麦克风权限和辅助功能权限。
  • 为语音模型预留每个约 1 GB 的近似空间;需要时再计算约 3.5 GB 的 Fluid Intelligence。
  • brew install --cask fluidvoice 或最新 GitHub release 选择安装来源。
  • 阅读当前许可证说明;涉及分发、修改或集成时,不把本文当法律意见。
  • 决定是否需要 Fluid Intelligence 或云端提供商,不要默认全部开启。
  • 若使用 OpenAI、Groq 或自定义提供商,明确 API key 的存储和访问边界。
  • 安装后检查匿名分析开关,尤其注意 README 中默认状态的矛盾表述。
  • 用低风险、可复核的短文本验证 Audio History、权限提示和模型下载行为。

FAQ

Intel Mac 能使用 FluidVoice 吗?

可以看到有限的官方路径:Apple Speech 和 Whisper 被列为 Apple Silicon 与 Intel 可用,且 Intel 从 1.5.1 起支持 Whisper。Nemotron、Parakeet、Cohere 和 Fluid Intelligence 则按文档要求 Apple Silicon。不要把 Intel 能运行 Whisper 推广成 Intel 能运行所有模型。

FluidVoice 支持中文吗?

官方资料列出 Cohere Transcribe 的 14 种语言,其中包括普通话;Whisper 按模型大小最多覆盖 99 种语言。TDT v3、TDT v2、Parakeet Flash 和 Apple Speech 的适用范围不同,所以应先确定模型,再核对目标语言和当前版本说明。

“本地优先”是否等于完全没有数据离开 Mac?

不是可以直接做出的结论。项目文档把语音、音频和转写文本留在 Mac 作为默认边界描述,但云端提供商是可选配置;分析设置的默认状态又存在文档不一致。把“文档化本地路径”“主动配置云端路径”和“实际设置状态”分开检查。

它比云端听写更快或更准确吗?

本文没有本机实测,也没有合格的云端对照实验,不能这样排名。速度、准确率、CPU/GPU/RAM 占用、电池、稳定性、模型下载和更新成功率都属于未知。

什么时候应重新检查?

至少在新版本、模型列表、语言支持、权限流程、云端提供商或隐私说明发生变化时重查。当前官方 release snapshot 是 v1.6.5,但“有新版本”本身不是质量证据;它只是一个需要重新核对边界的触发器。

最后的选择

如果你是 macOS 15+,已经确认架构和语言,能授予必要权限,也有空间保存模型,那么 FluidVoice 可以进入低风险试用名单。先验证自己的输入流程,再决定是否加上本地 Fluid Intelligence 或云端增强。

如果你卡在系统版本、芯片、语言、权限或磁盘空间,先等待或换路径;如果你需要绝对明确的隐私审计、固定性能或独立 benchmark,当前官方资料不足以支持直接采用。选择“暂不安装”并不等于否定项目,而是承认兼容性和数据路径已经能判断,实际体验和若干安全边界仍不能凭文档替代验证。

本文的更新触发器是:新版本发布;Homebrew cask 版本或安装元数据发生变化;文档化的平台可用性或 Mac 架构要求发生变化;Fluid Intelligence 的可用性或许可边界发生变化;以及模型与语言清单、许可证、云端提供商、分析设置说明或 Audio History 数据路径发生变化。届时应重新跑一遍矩阵,而不是只改标题或沿用旧结论。

来源与延伸阅读

  1. https://github.com/altic-dev/FluidVoice
  2. https://github.com/altic-dev/FluidVoice/releases/tag/v1.6.5
  3. https://formulae.brew.sh/cask/fluidvoice