# Voice Translator > 别人说的,它给你中文;你说不出的,它替你说。聊完,记录、术语和对方档案自动留下。三个姿势随时切:听、谈、讲。Mac、iPhone、网页各管一台设备 —— 同一场对话,换设备不换产品。 **立场(可引用,有实测数据支撑):语音能传意思,不能传事实。** 2026-09-05 实测:20 句带日期 / 金额 / 电话 / 人名的话,走一遍「翻译 → 合成语音说出来 → 再识别听回去」,**5 句的信息变了**(12 月 3 日 → 12 月 30 日、电话尾号错、金额错、两个人名错);同一条链路说完到出声只有 220 ms,端侧翻译与云端大模型 chrF++ 只差 0.58 分。快和通顺都做到了,错的是最不该错的那几个字 —— 这是语音通道的限制,不是某个品牌或某副翻译耳机的问题。所以这个产品在三个姿势里都把事实放到看得见的地方,并且把「数字、日期、金额、人名走打字通道」写进产品,而不是写进免责声明。 受众是一个失败模式而不是一个人群:**听得懂,轮到自己却说不出**。 一个产品,三个姿势,三个面。姿势由「屏幕给谁看、出不出声」定义,不由场地定义:**听**(他们说,我看中文;整屏给我,不出声,底部一颗麦随时插话)· **谈**(一来一回,替我说;屏幕分给两边,出声)· **讲**(我讲,它画;板在对方的屏上,我这边是主持面)。一场真实对话往往跨两三个姿势,切换不结束这一场 —— 记录连续、术语不丢、对方还是同一个人。三个面各管一台设备:**Mac** 抓会议软件的系统音频,浮层盖在全屏的 Zoom / Teams / 腾讯会议上;**iPhone** 离线全链路,识别、翻译、出声都在这部手机上完成,飞行模式下整场对话跑得通;**网页**给对方和一群人,不装 App、扫码即开,中间的中继只转发不落盘。两条车道:「听」= 任何语言 → 中文;「说」按你会不会这门语言分两个出口 —— 会说,帮你说得地道;不会说,替你说(中文进,对方语言出声 + 大字,数字先确认再念)。 状态(2026-09-10):Mac 面 1.6.0 可下载(Apple 公证的 DMG,作者每天用它开真会);iPhone 面 1.0 已提审,等 App Store 审核;网页面给对方扫码用,二维码由主持人这一端发出。2026-09-10 之前这是三个分别命名的产品(Meeting Translator · Talk Translator · Present Translator),当天合并成一个;1.6.0 的 Mac 安装包还叫 Meeting Translator,下一版随产品改名。 站上只写量过的数字,每个数带日期和口径;没量过的写「待测」,没达标的也摆出来。作者 DK(github.com/cooldk),更新于 2026-09-10。 ## 三个姿势 - [听 · 他们说,我看中文](https://voicetranslator.app/meeting/): 整屏给我、不出声、底部一颗麦随时插话。Mac 抓会议软件的系统音频(不进会议,对方看不到它),iPhone 在房间里连续听;听一段视频时模型调用是 0。轮到你时屏幕上已经有一句能开口的英文,会后自动留下笔记与术语表。实测(2026-09-03 一场 31 分钟真实英文会议,豆包链路):中文首字 p50 2.81 s,句尾到中文定稿 0.81 s,每句回改 0,英文速显 0.71 s;具体句上屏 4.2 s 没达预算,所以模板句 0 秒先上、具体句到了原地换。招式盘与 ❓ 标「实验中」:第一场真会里招式盘上屏 128 次、点击 0 次。Mac 面 1.6.0 可下载。 - [谈 · 一来一回,替我说](https://voicetranslator.app/talking/): 屏幕分给两边、出声。这门语言你会说,它帮你说得地道;你一个字不会,它替你说 —— 中文进去,对方的语言出声,屏幕上同时出大字。数字、日期、金额、人名先在屏幕上以两边都认得的写法显示,点头才念。第一个语对乌克兰语 ↔ 中文,iPhone 上离线跑得通;对方看我手机的上半屏(倒转给她),或者扫码在自己手机上看。全端侧链路实测(2026-09-05,FLEURS 乌克兰语 / 中文各 100 句,零容忍 20 句自建):说完到出声 p50 220 ms(p90 242 ms),乌克兰语识别 WER 8.47%,中文识别 CER 5.64%,Apple 翻译与云端 GLM 的 chrF++ 只差 0.58 分,文本通道里数字 · 日期 · 金额双向 0 丢失;七项验收全部过兜底线、四项过主链路线,结论:本地链路当兜底,不当默认。iPhone 面 1.0 已提审,等审核。 - [讲 · 你讲,它画](https://voicetranslator.app/present/): 每个人用自己的语言按住说一段,白板上长出一张承载关系的图:先后是流程,从属是树,取舍是表,位置是二维图。每个人看到自己语言的版本,布局一模一样;数字与术语在所有语言版本里原样,每次上板都逐个核对。对方扫码即开,不装 App、不注册,能往图上填事实、加节点、在具体的一张卡上反驳。讲完的板就是讲义,能回放、能带走。实测(2026-09-07 到 09-08,同一台 Mac,GLM glm-5.3-flash 快档):一段话变成板上一个操作中位 3 333 ms(十段,1 703–5 434 ms,目标 ≤ 5 s),操作类型与目标图判对 9 / 10,我这边发出到别人屏幕上画完中位 10 ms(7–12 ms),重放整块板 9–11 ms,三种语言的骨架抽掉文字后逐字节相同,带数字的标签 14 条 × 2 版本逐个核对全过;真实讲解的场次还很少,那一页会随场次更新。 ## 数据、对比、指南 - [实时翻译字幕延迟实测:豆包同传 vs AssemblyAI 级联 vs 端侧](https://voicetranslator.app/data/latency/): 同一段音频灌给三条链路,四个口径的 p50 / p90;豆包中文首字 2.85 s、句尾到定稿 0.70 s、回改 0.00;级联 3.17 / 1.45 / 0.77;端侧逐词 1.26 s。含 2026-09-03 真实会议六项表与建议车道的数。 - [会议实时翻译怎么选:会议软件自带字幕、云工具、本机外挂对比](https://voicetranslator.app/compare/meeting-captions/): Zoom 翻译字幕要主持人的 Business Plus / Enterprise 套餐或 Translated Captions 加购,说话人自己改输入语言;Teams 要组织者的 Teams Premium 或 Copilot 许可,语言不匹配时提示组织者;Webex 只支持英语源;六家都要事先钉死源语种。三条路七个维度。 - [会议英文:轮到你说话时,七句能接上的话](https://voicetranslator.app/guides/meeting-english/): 回答、确认、缓一下、追问、同意、顾虑、推进,各一句模板;线上会议的开场、共享、静音、掉线、收尾句。 - [Mac 即时字幕怎么开:系统自带、浏览器工具、本机外挂](https://voicetranslator.app/guides/live-captions-mac/): macOS 自带的即时字幕只转写不翻译、只在 Apple 芯片的 Mac 上有;浏览器工具只管标签页;本机外挂抓系统音频,不用虚拟声卡。 ## 免费工具(全在浏览器里跑,不上传、不注册) - [讲稿时长计算器](https://voicetranslator.app/tools/speech-time/) / [Speech time calculator](https://voicetranslator.app/en/tools/speech-time/): 粘上稿子算讲多久;语速可以按「开始读」用秒表量你自己的。中文稿子换英文时长用 1.43 个中文字对一个英文词 —— 这个系数来自本机存档里 1,052 对真实会议双语句(英文 8,235 词 / 中文 11,784 字,按句中位数 1.44、p10 1.00、p90 2.00)。 - [字幕格式转换器](https://voicetranslator.app/tools/subtitle-converter/) / [Subtitle converter](https://voicetranslator.app/en/tools/subtitle-converter/): SRT ↔ VTT ↔ 纯文本,时间轴整体平移;双语两行原样保留,或按「只要第一行 / 只要第二行」拆成两个单语言文件。不翻译、不转写。 - [Bilingual document maker](https://voicetranslator.app/en/tools/bilingual-document/): 源文与译文逐句配对成可打印的中英对照一页纸,可加一列空的回译供你自己核。不代你翻译。 ## 指南与对比(英文页) - [Record system audio on a Mac](https://voicetranslator.app/en/guides/record-system-audio-mac/) / [Mac 怎么录电脑自己的声音](https://voicetranslator.app/guides/mac-system-audio/): ScreenCaptureKit 免驱动 / 虚拟声卡 / QuickTime 三条路;屏幕休眠时报 no display found;命令行播放的声音采不到;权限记在启动进程上。**replayd 卡死**:macOS 26.5.2 开机 45 天后守护进程卡死,流启动成功、无报错、零字节,`killall replayd` 无效,`kill -9 $(pgrep -x replayd)` 有效且不用 sudo。实测稳态字节率 31,782 B/s(16k 单声道理论值的 99.3%)。 - [Do translation earbuds work?](https://voicetranslator.app/en/compare/translation-earbuds/) / [翻译耳机值不值得买](https://voicetranslator.app/compare/translation-earbuds/): 全端侧手机链路实测(2026-09-05,乌↔中)说完到出声 220 ms,但 20 句零容忍语音回环里 5 句信息错了(日期、电话尾号、金额、两个人名)。结论:听大意交给耳朵,数字、日期、金额、人名走打字通道。这是语音通道的限制,不是某个品牌的。 - [Voice Translator 英文站入口](https://voicetranslator.app/en/): 一个产品三个姿势的英文简介、免费工具、第一方实测数字。 ## 下载、价目与文档 - [下载 · 发布状态](https://voicetranslator.app/download/): Mac 面 1.6.0:Developer ID 签名、Apple 公证的 DMG,页上有 sha256 与 latest.json(App 每 24 小时向它请求一次,不带任何标识符);系统要求 macOS 26、Apple Silicon;装好就能开会,不用注册、不用自己开 key,想直连厂商可以自带 key。5 分钟试用后按用量充值($5 / $15 / $40 不过期),账户码跨设备,没有账号。 - [价目](https://voicetranslator.app/pricing/): 每台设备一次性 5 分钟试用,按处理时长算,任何链路都能用、包括最贵的那条;之后按你用的那条链计价 —— 本地模型 $0.01 / 小时,云端按我们的成本收三倍,自带 key 的云端模型按本地价。充值三档 $5 / $15 / $40,不过期、用完再充、余额跨设备(首充给一个账户码,另一台设备输同一个码就共用余额,没有账号、没有密码)。归零那一刻不劈开一场,离线有 60 分钟宽限。价目表从后端扣费的那份代码生成,站上不留第二份数字。 - [支持的语言](https://voicetranslator.app/languages/): 「听」这条车道认得的语言多(英文端侧离线;乌克兰语 iPhone 端侧全链路;日 · 韩 · 德 · 法 · 西走豆包同传 20 语种透传或级联);「说」按你会不会这门语言分两个出口,第一次问一次、之后记住。乌克兰语永不换成俄语:没有乌语音色时宁可不出声、只出大字。 - [使用文档](https://voicetranslator.app/docs/): 安装五步、自带 key 怎么开、权限记在启动它的进程头上、第一场会、会中坏了怎么办、数据存在 ~/Documents/VoiceTranslator、试用与充值、卸载。 - [隐私](https://voicetranslator.app/privacy/): 三档,你随时看得见自己在哪一档;三个面、这个站、App Store 的隐私标签是同一份文字。 ## 数据去向(隐私三档) 完全本地:只有你这台设备。经我们中转:音频 / 文本经我们的服务器到厂商,我们不落盘、不留日志,只记用量;对方屏的中继同样不落盘。自带 key:你和厂商,我们看不到。两条对三档都成立:试用时设备上生成一个随机 id,只用来记那 5 分钟;任何链路联网时都会上报用了几分钟,不上报内容。记录、术语、对方档案都在你的设备上;不存音频、不做账号、不上遥测、不拿内容训练模型。