说话的同时,逐字成稿
Echo 是一款完全在 Mac 本地运行的实时语音转文字应用。
毫秒级流式出稿,停顿后大模型定稿,全程离线——音频不出你的电脑。
为什么选 Echo
隐私优先的本地识别,配上不妥协的转写体验。
全本地识别
识别引擎全程离线运行,无云端上传、无账号,语音隐私只属于你。
流式逐字出稿
边说边出字,毫秒级延迟的流式草稿;停顿后主模型定稿,保证正文准确率。
两种声音来源
麦克风(可选输入设备),或系统声音——为在线会议、网课、视频生成实时字幕。
智能断句 · 说话人识别
按停顿与段落自动切段,声纹模型区分说话人 A B C D E。
历史会话与导出
每次录音自动保存,随时回看、复制,一键导出 .txt 文稿或 .srt 字幕。
可选 AI 成稿
默认关闭。自行配置任意 OpenAI 兼容接口(密钥存系统钥匙串),录音结束一键整稿成文。
双引擎,快与准兼得
流式引擎先出毫秒级草稿,大模型随后定稿——两个引擎都在你的 Mac 上运行。
声音进入本机
麦克风或系统声音以 16kHz 采集,能量 VAD 判断语句起止,全部数据留在设备内。
毫秒级逐字出稿
流式 Zipformer 引擎边听边写,屏幕上先看到浅色草稿文字,延迟以毫秒计。
Qwen3-ASR 定稿
停顿约 0.8 秒后,Qwen3-ASR 0.6B 给出定稿:自动标点、数字归一化,草稿转为正文。
追求极致响应?可切换「极速」引擎跳过定稿,草稿即正文。
首次启动自动下载识别模型(此后完全离线),下载带完整性校验,不附带任何用户标识。
典型场景
从会议记录到口述写作,一台 Mac 全部搞定。
会议与访谈
打开系统声音采集,自动生成全程记录;说话人区分让每个人的发言一目了然。
系统声音 · 说话人 A–E写作与口述
对着麦克风说,停顿即成文;再让可选的 AI 改写把口语整理成稿。
麦克风 · 可选 AI 整稿视频与网课
为本地播放的视频加上实时字幕,课后导出 .srt 或文字稿复习。
系统声音 · 导出 .srt隐私不是功能,是底线
Echo 在 App Store 的隐私标签为「未收集数据」: 无云端上传、无账号体系、无任何分析与广告组件。
- 语音音频全部在本机识别,绝不上传
- 转写文本仅保存在设备本地,由你完全掌控
- 仅有的两处联网:首次下载模型、你主动开启的 AI 改写(直连你指定的服务)
App Store 隐私标签
未收集数据
Data Not Collected
开发者不从此 App 收集任何数据。
四步上手
无需注册,打开就能用。
-
1
启动
首次启动自动下载识别模型,完成后即可完全离线使用。
-
2
选声源
选择麦克风或系统声音(后者需在系统设置开启屏幕录制权限)。
-
3
说话出字
按下开始,边说边看逐字浮现的草稿,停顿后自动定稿。
-
4
回看导出
录音自动存入历史会话,随时复制或导出 .txt / .srt。