SyncTrans 1.0.0 发布已经一周,我们被问到最多的问题恰恰是最简单的一个: 真正用起来是什么样子?这篇文章在一版正式发布的构建上完整走一遍会话—— 场景是一场用英语进行、客户说中文的会议,两个人在桌前共用一台 MacBook。 下面的每一步都是 1.0.0 今天真实的行为;更长的参考版本在 使用指南里。
设置:五个画面,全部可跳过
安装就是常见的把 DMG 拖进「应用程序」。首次启动会打开一个五步 设置:语言、方案、显示与音频、模型组合,以及一个连接服务的就绪 画面。开始点击之前,有两件事值得知道。 第一,每一步都有能直接用的默认值,整个设置都可以跳过——没有 任何一步是门槛,每个选择之后都会在设置里重新出现。第二,设置只 跑一次;哪怕在最后一步打断它,下次启动也会直接进主窗口, 不会让你再走一遍。
这场会话里,我们在方案那一步选了托管云端。这个选择不需要账号: 就绪画面会为访客会话领取免费的初始额度并启动服务,所以从打开 应用到说出第一句话,真的只有几分钟。之后在同一台 Mac 上注册账号 还会另得一份免费赠额,这是设计好的行为,不是什么漏洞。
语言:一种主语言、一种目标语言、两个说话人
这场会议的语言对很简单:中文为主,英语为目标。真正干活的那项 设置在「设置 → 声音」里——麦克风通道上的第二语言选项。设好 之后,来自同一只内置麦克风的已完成的轮次,会按说话时所用的语言 归到说中文的人或说英语的人名下。没有第二只麦克风,开口前也没有 按钮要按;记录自己就能把两个人分得清清楚楚。两种语言必须不同, 这是唯一可能配错的地方,而应用会直接指出来,而不是接受一对 相同的语言。
对话本身
开始只要一个按钮:开始翻译,或 ⌘R。第一次收音会 触发 macOS 的麦克风权限提示;允许一次,它就再也不出现了。如果你 下意识点了拒绝——我们第一次试的时候就点了——失败并不会无声无息: 工具栏里的状态胶囊会翻转为「需要注意」,对话上方还会出现一条 横幅,带着一个能直达对应隐私面板的打开声音设置按钮。 修好它花了不到一分钟,会话状态分毫未损。
会话进行中,每句说了半截的话会显示为一条暗色的草稿行,稍后 被落定的那一轮替换。草稿从不翻译,也从不进入历史,这一点比 听起来更重要:它意味着记录里永远只会有应用真正认可的句子。 当有人说到一半没了下文、断句逻辑还在等待时,草稿行末尾的 完成当前句子按钮(⌘Return)会立刻把这一轮送进 同一条流水线落定。
朗读方面,英语用托管音色,中文译文用第二个音色,两个都是 在选择器里按名字挑的,带试听按钮——从头到尾没有任何标识符。 隔着桌子共用一副耳机时,左右声道分离把英语送到左耳、中文送到 右耳;两只耳朵是各自独立的播放通道,所以重叠的译文会同时 读出来,而不是排队。
会后:那份记录
一切都已经存好了——每一轮都在发生的当下写进当前项目,所以 停止会话不会丢任何东西。导出之前我们在历史里修正了一个听错的 产品名;这个改动只修改记录,而且刻意不会在你背后把翻译重跑 一遍。导出得到的是一份双语对照的 Markdown 文件,每一轮都带 说话人和时间,直接进了会议纪要。纯文本和带时间的 SRT 是另外 两种格式,而这三种都不涉及任何上传——无论是哪个引擎产生的, 历史都留在这台 Mac 上。
我们会对第一次用的人说什么
一场顺滑的会话和一场一头雾水的会话,差别大多在三个习惯上。 人还没到齐就先看一下状态胶囊——它的四行(麦克风、识别、 翻译、朗读)会指名出问题的环节,而不是留给你猜。在麦克风 浮层里确认实时输入;每只设备旁边的电平表能在任何人说出重要 内容之前,让你看到会议室那只麦克风有没有反应。还有,先把 这场会议赖以进行的那两三个名字放进术语表,因为那些正是通用 模型每一轮都会重新发明一遍的词。
SyncTrans 1.0.0 需要 macOS 14 或更高版本,你可以 在这里下载。 这篇走查的完整任务版是 使用指南, 详细的功能说明在 功能页面上。
有问题或要报 bug? 反馈板 是找到我们最快的途径。