Wispr Flow(wisprflow.ai)是旧金山 Wispr 公司的 AI 语音输入工具。注意它的形态:wisprflow.ai 这个网站只是产品门户(介绍、定价、文档、下载入口),真正的产品是安装在 Mac、Windows、iPhone 和 Android 上的客户端——按住快捷键(桌面端)或浮动按钮(手机端)说话,松开后,去除口头禅、补好标点、按当前应用语境调整过语气的文本会直接写进光标所在的任意输入框:邮件、Slack、iMessage、Notion、终端、代码编辑器或 ChatGPT 对话框,无需任何插件。它要解决的问题是:系统内置听写只是把语音逐字转成文字——包括每个「嗯」和每一次改口——之后还得手工清理;Flow 把「转写」和「编辑」合并成了一步。与多数同类产品的可核实差异在于:四个平台共用一个账号和同一套个性化数据,官方称支持 100+ 种语言(含中文与粤语)。截至 2026-09-17,公司刚于 2026 年 8 月完成 2.8 亿美元 B 轮融资(估值 20 亿美元),并预览了自研语音模型 Canto,自我定位正从听写工具扩展为「语音交互层」。
站点速览
- 网址:https://wisprflow.ai(产品门户;实际使用需安装客户端)
- 类型:AI 语音输入/听写客户端 + 会议记录功能(Notetaker)
- 费用:Free $0(桌面端每周 2,000 词、iPhone 每周 1,000 词);Pro 15 美元/用户/月(年付折合 12 美元);Growth 23 美元/用户/月(年付折合 18 美元);Enterprise 定制报价,见官方定价页(截至 2026-09-17)
- 注册要求:浏览官网与文档无需注册;使用必须创建账号(Google / Apple / Microsoft / SSO / 邮箱);美国用户须满 13 岁、其他地区须满 16 岁,未满 18 岁需监护人同意,见服务条款
- 界面语言:应用界面与官网基本只有英文;听写识别支持 100+ 种语言
- 上线时间:2024 年 10 月(macOS 首发;Windows 2025 年 3 月、iOS 2025 年 6 月、Android 2026 年 2 月,见 TechCrunch 报道)
站点背景
Wispr 由 Tanay Kothari(CEO)与 Sahaj Garg(CTO)创立,两人是斯坦福大学同学,前者曾在 Stanford AI Lab 发表研究、入选 2023 年 Forbes 30 Under 30,后者此前是光子计算公司 Luminous Computing 的第五号员工(官方媒体资料)。媒体与 Wikipedia 词条均记载公司 2021 年创立,最初做的不是软件,而是一种非侵入式可穿戴设备——通过读取神经肌肉信号,让用户「默念」就能输入文字;今天的 Flow 原本是那套硬件的软件层。约三年后,团队判断当时的 AI 还撑不起硬件体验,于 2024 年 7 月放弃硬件、转向软件,数月后发布了 Mac 版(TechCrunch 2025-06 报道)。
融资节奏在语音赛道里相当激进(均以官方公告或一手报道为准):
- 2025 年 6 月:3,000 万美元 A 轮,Menlo Ventures 领投,NEA、8VC 等参投,累计融资 5,600 万美元(TechCrunch)。
- 2025 年 11 月:2,500 万美元 A 轮扩展,Notable Capital 领投,累计 8,100 万美元(TechCrunch 2026-02 报道回溯确认)。
- 2026 年 8 月 17 日:2.8 亿美元 B 轮,估值 20 亿美元,Menlo Ventures 领投,累计融资 3.61 亿美元(官方公告;Reuters 报道经 Wikipedia 转述核实)。
B 轮同日,公司预览了首个自研语音模型 Canto:官方称在噪声、风声、重口音等最困难的环境下,词错误率从 30% 以上降至 5–10%,日常听写中需要手工修改的比例预计减少 30–35%——此前 Flow 使用的是按语言动态挑选的第三方语音识别引擎组合。规模方面,官方口径为:累计已有超过 600 亿词经 Flow 输入,财富 500 强公司几乎都有员工在用,企业客户超过 1 万家;2026 年初的官方长文称日活用户数十万、月增长约 40%(The Master Plan)。
这篇长文也交代了公司的路线:第一步做好可靠的语音输入,第二步让语音驱动操作(voice to action),第三步进入可穿戴设备,最终目标是成为「让这些设备有用的操作系统」——官方的 About 页面已把公司称为「The Voice Interface Company」,并新设了由首席科学家 Ariya Rastrow(Alexa 创始团队成员)领导的 Wispr Advanced Interfaces Lab。

截至 2026-09-17,官网首页顶栏仍在宣传「Wispr Flow Notetaker is now available on Windows and Mac」——Notetaker 是公司 2026 年 8 月推出的第二条产品线。
核心能力:从说话到可以直接发送的文本
Flow 的基本交互在所有平台上保持一致:按住、说话、松开,文本写入光标处。它与系统内置听写的差别不在「听得清」,而在后处理(官方对比页):
- 识别改口与自我修正:说「我们 5 点见……其实 6 点」,内置听写会全写下来的,Flow 只输出「6 点见」。
- 自动排版:按内容自动生成列表、段落和邮件结构,而不是一整段文字墙。
- 按应用切换语气:邮件里正式、聊天里随意,基于当前应用语境自动调整(个性化风格目前仅在英语听写时生效)。
- 个人词典与 Snippets:人名、术语会被自动学习,也可手动添加;常用文本(邮箱、地址、链接)可以设置语音口令即说即贴。
- 耳语与噪声环境:官方 FAQ 称低声耳语也能识别,建议麦克风靠近嘴边,并明确不建议用 AirPods 等蓝牙耳麦(音频压缩会降低准确率)。
- 开发者场景:在 IDE 里能识别 camelCase、snake_case,支持在 Cursor、Windsurf 中语音标记文件。

官方对比页给出的「zero-edit rate」(说出来即可直接发送、无需任何修改的比例)自测数据为:Flow 90%、OpenAI 71%、ElevenLabs 63%、Siri 52%。需要注意这是 Wispr 自己发布、未经第三方复现的 benchmark 口径,只能作为官方主张引用。

产品形态上,桌面端是系统级的悬浮语音条,按热键触发;iOS 端以第三方键盘形式工作,Android 端则是可按住说话的浮动气泡(TechCrunch)。四条产品线共用一个账号,词典与设置跨设备同步。
第二条产品线 Notetaker 于 2026 年 8 月上线(9 月 15 日扩展至 Windows):它不派机器人加入会议,而是在本机直接录制,因此适用于任何会议软件乃至线下谈话;提供说话人识别、跨会议问答,并可通过 MCP 把会议笔记接进 Claude、ChatGPT 等工具。免费档有每周会议数量限额,Pro 提高额度,Growth 标注为无限访问。
多语言与中文支持
对华语读者这部分值得单独说明。官方称支持 100+ 种语言,语言在每次听写会话开始时检测,也可以在设置里固定常用语言(多语言文档):
- 简体中文与繁体中文是两个互斥选项(选一个会自动取消另一个),粤语(粵語)则是独立的语言选项;iOS 会按系统地区预填——中国大陆、新加坡默认简体,台港澳默认繁体。
- 在官方研究博客(2026-01,CTO 署名)中,达到「与英语同等调优水平」的第一梯队语言是法、德、印地、意、葡、西、泰七种;中文(普通话)与粤语在第二梯队,官方表述为「准确的听写」,未承诺英语级水准,并直言「非英语的转写准确率尚不如英语」。
- 中英混说是官方承认的最难组合:句中混说时英文词可能被写成中文字符(或反之),官方建议固定单一语言使用;句内快速切换语言不受支持。
- Android 端目前只有自动检测,不能手动选择语言;应用界面无论听写语言为何基本都是英文。
定价
截至 2026-09-17,官方定价页的档位如下(页面按访问地区本地化货币——中国大陆直连时显示人民币,如 Pro 年付折合 ¥44/用户/月;下表为美元标价):

| 档位 | 月付 | 年付(折月) | 主要内容 |
|---|---|---|---|
| Free | $0 | $0 | 任意应用听写、100+ 语言、词典与 Snippets;桌面端每周 2,000 词、iPhone 每周 1,000 词;Notetaker 有每周限额 |
| Pro | 15 美元/用户 | 12 美元/用户 | 无限听写、更长 Notetaker 历史、团队共享词典与 Snippets、集中计费、用量分析、优先支持、新功能抢先 |
| Growth | 23 美元/用户 | 18 美元/用户 | 无限 Notetaker 访问、SAML SSO、签署 BAA 的组织级 HIPAA、多域名、管理员控制全团队模型训练开关 |
| Enterprise | 定制 | 定制 | SCIM 用户 provisioning、审计日志与 MDM、模型训练强制关闭、定制合同与 PO 开票、专属 SLA |
补充条款层面值得知道的几点:学生与教师凭教育邮箱可享 Pro 五折,非营利组织有折扣;付款走 Stripe;订阅可随时取消,但退款仅在法律要求时提供(服务条款)。
账号体系与开放能力
使用 Flow 必须注册账号(支持 Google、Apple、Microsoft、SSO 或邮箱),免费档不需要信用卡。团队从 Pro 档起提供共享词典、共享 Snippets 与集中计费;企业功能集中在 Growth 与 Enterprise 档。开放能力方面有一个明确的边界:官方安全 FAQ 写明API 已经停用(「the API has been sunsetted」),没有公开的开发者 API;目前唯一的集成出口是 Notetaker 的 MCP 支持,可以把会议记录接进 Claude、ChatGPT 等 AI 工具。docs.wisprflow.ai 提供浏览器内的即时体验入口,不安装客户端也能试两句。另请注意条款约定:免费账号连续 12 个月未使用可被终止;美国用户默认接受强制个人仲裁并放弃集体诉讼(注册后 30 天内可邮件退出)。
隐私与数据政策
语音输入工具处理的是用户最敏感的一类数据,Flow 的数据政策有几个必须看清的要点(Data Controls、隐私政策、安全与合规 FAQ,均截至 2026-09-17):
- 转写始终在云端完成,官方明示没有离线模式,也不是端到端加密——音频必须在服务端解密才能转写。传输 TLS 1.2+、存储 AES-256,数据全部在美国处理与存储,欧盟/英国用户通过标准合同条款(SCC)跨境。
- 个人与试用账号默认允许将听写音频、转写文本和你的修改用于模型改进;退出方式是设置里的「Improve the model for everyone」开关(Settings > Data and Privacy)。企业与签了 HIPAA BAA 的账号默认不参与训练,且企业账号没有开启选项。
- 「Dictation Cloud Storage」是另一个独立开关,控制服务器端是否保存转写与音频历史;两个开关全关即官方所称的 Zero Data Retention。但要注意:Snippets 与个人词典无论如何都会云端同步,听写词数等使用统计也始终会收集。
- 生成文本时可能调用 OpenAI 或 Anthropic 的模型;官方称与所有第三方 AI 提供商签有零保留协议——对方不得用数据训练,共享数据 30 天内删除。会议音频不用于训练(除非明确披露并由用户开启);Google 日历、Gmail 等 Google 数据绝不用于训练。
- 可选的「Context Awareness」会读取当前应用窗口的文本以拼准人名术语;「Auto-add to Dictionary」会监测你粘贴框里的改词动作。两者都可关闭。
- 合规认证的口径需要留意:官网首页与定价页宣称「SOC 2 Type II、HIPAA、ISO 27001 认证」,但官方安全 FAQ(2026-09-07)披露,此前由 Accorp Partners 与 Gradient 出具的 SOC 2 Type II 和 ISO 27001 证书已于 2026 年 3 月因原审计方(Delve)的平台完整性问题被主动作废;目前的新审计由 A-LIGN 执行,SOC 2 Type I 已于 2026 年 4 月完成,SOC 2 Type II 与 ISO 27001 Stage 2 仍在进行中(官方说明)。处理敏感或受监管数据的用户应以 FAQ 口径为准。
适用场景
- 文字量大的知识工作者:邮件、文档、聊天回复占日常工作大头的岗位,官方称重度用户六个月后 72% 的字符经语音输入(媒体资料,官方口径)。
- 给 AI 工具写提示词:口语能提供比打字更多的上下文,官网与多家媒体都把「对 ChatGPT/Claude/Cursor 说话」列为主打场景。
- 开发者:语音写注释、文档,与 Cursor、Windsurf 联动标记文件。
- 无障碍需求:RSI、腕管、关节炎、诵读困难、ADHD 等打字困难人群(Wikipedia 收录的用户群体);官方提供残障人士 40% 折扣(Google Play 列表)。
- 移动与双手占用场景:通勤、散步时回消息、记想法。
- 有合规要求的机构:签署 BAA 后可用于医疗场景(签署后 Notetaker 与云端存储会被关闭)。
局限
- 必须联网:转写全部在云端完成,离线完全不可用;第三方评测(Android Police,经 Wikipedia 转述)也把「需要网络连接」列为主要限制。
- 默认参与模型训练:个人与试用账号的音频、转写默认可用于模型改进,注重隐私的用户需要在设置里手动关闭——这个默认值与「隐私优先」的营销口径存在张力。
- 中文支持可用但非强项:中文不在官方的第一梯队调优语言里,中英混说是官方承认的最差场景,个性化写作风格仅英语生效,界面无中文。
- 合规认证处于过渡期:旧 SOC 2 Type II / ISO 27001 证书已作废,新认证尚未全部签发(见上一节),营销页的表述滞后于官方 FAQ。
- 桌面端资源占用:How-To Geek 的对比评测(经 Wikipedia 转述)提到资源占用偏高、有启动延迟,个别应用中出现标点与语法问题。
- 条款偏向平台:退款原则上不提供;美国用户强制仲裁、放弃集体诉讼;免费账号 12 个月不活跃可终止;免费额度按周清零(桌面 2,000 词),只够轻度体验。
- Android 端功能较窄:只有自动检测,不能手动固定语言。
同类参考
- 系统内置听写(Apple Dictation / Google 语音输入):免费、系统级、可离线(部分设备),但只做逐字转写、不做清理与排版——Flow 官方对比页的主要比较对象。
- Superwhisper:Mac/iOS 上的同类 AI 听写工具,TechCrunch 列举的直接竞对之一,提供本地模型选项。
- MacWhisper:基于 Whisper 模型的本地转写路线,隐私模型与云端方案不同(Wispr 官网设有对比页)。
- Aqua、Talktastic、BetterDictation:TechCrunch 报道中列举的同赛道产品。
参考资料
- Wispr Flow 官网首页(核查日期:2026-09-17)
- Wispr Flow 定价页(核查日期:2026-09-17)
- Why Flow 官方对比页(核查日期:2026-09-17)
- About / 媒体资料 - Wispr(核查日期:2026-09-17)
- Our Series B, and what it means for you - Wispr Blog(2026-08-17)(核查日期:2026-09-17)
- The Master Plan - Wispr Blog(核查日期:2026-09-17)
- Supporting languages - Wispr Research(2026-01-19)(核查日期:2026-09-17)
- Use Flow with multiple languages - Wispr Help Center(核查日期:2026-09-17)
- Terms of Service - Wispr Flow(2026-08-19 更新)(核查日期:2026-09-17)
- Privacy Policy - Wispr Flow(2026-08-19 更新)(核查日期:2026-09-17)
- Data Controls - Wispr Flow(2026-08-18 更新)(核查日期:2026-09-17)
- Security and compliance FAQ - Wispr Help Center(2026-09-07)(核查日期:2026-09-17)
- Our path to a new, independent audit - Wispr Blog(核查日期:2026-09-17)
- Wispr Flow releases iOS app in a bid to make dictation feel effortless - TechCrunch(2025-06-03)(核查日期:2026-09-17)
- Wispr Flow raises $30M from Menlo Ventures - TechCrunch(2025-06-24)(核查日期:2026-09-17)
- Wispr Flow launches an Android app for AI-powered dictation - TechCrunch(2026-02-23)(核查日期:2026-09-17)
- Wispr Flow - Wikipedia(核查日期:2026-09-17)







