·
未登录
使用帮助
意见反馈
👤未登录
暗色
界面语言
Poly 实时智译平台
👥 声纹分人 🌐 100+ 语种 🔁 多语翻译 ☁️ 云端同步 🛡️ 断线保护
新建
选择模式开始
开始 →
🎙️
实时转写
多人对话实时转文字,自动按声纹分人,可同时翻译多语。
多人分人转写
开始 →
📝
快速笔记
说话转文字,出字快、不分说话人,一键复制到任何应用。
口述转文字 · 不分人
开始 →
💬
面对面翻译
分屏 / 并排 / 建群三种场景,双语实时互译。
双人多人互译 · 仅手机
开始 →
📤
导入转写
上传音视频文件,自动转文字并翻译。
音视频转写
开始 →
所有文本与说话人标签都可点击直接编辑 · 支持导出 Markdown / JSON,两种都能再导入回来
v0.4
🤖 AI 摘要
意见反馈
润色文字
范围
程度
使用帮助
境外使用须知

本平台服务器部署于中国境内。如需避免会话内容上传,可在对话顶部将「数据开启」切换为「数据关闭」。关闭后该场会话仅驻留于当前页面,不写入本机、不同步至服务器;离开或刷新页面即永久清除,且无法恢复。

1
新建对话

点「+ 新建一场对话」选模式:实时转写(多人会议,自动分说话人)、快速笔记(不分人,出字更快)、面对面翻译(手机专属,两人双语)、导入转写(上传音视频文件)。常用的「模式+语言」可存成快捷方式,下次一点就开始。

面对面翻译进去后,点右上角齿轮可在 分屏 / 并排 / 建群 三种版式之间切换。

2
选择语言与翻译

支持 100+ 语种识别,最多可加 4 种目标语言实时翻译。在「高级设置」里填上人名、术语等自定义词汇,能明显提升识别准确率。

3
开始录制

点底部录制按钮,等界面显示「🎤 可以说话了」再开口,抢在提示前说会漏掉开头。中途断网不用停,联网后文字会自动补齐。

4
文字输入

不方便出声时,点底栏左侧的键盘图标,录音条就变成输入框,回车发送;再点一次切回录音。发出的内容和语音记录排在一起,带一个键盘标识以便区分。

5
编辑、标记与润色

文字和说话人姓名点一下就能改;长按任意条目(电脑端右键)可标记待办 / 决议 / 重点,也能拆分、合并。

✨ 润色:把识别得不准的文字整理干净。右键单条润色,或从底栏「⋯」选择润全部还是一部分。原文一直留着,随时可还原。

6
AI 摘要与导出

一键生成会议摘要。导出 Markdown 适合发给别人,导出 JSON 是完整备份、换设备能原样恢复,两种都能从侧栏「导入」读回来。内容也会自动同步,换台设备登录同一账号就能接着看。

🔐 云同步与数据
  • 云同步是自动的:打开即在后台把你在各台设备上的数据同步到一起(手机上记的,换电脑打开也能看到别的设备同步过来的数据),平时无需干预。侧边栏「Poly 实时智译平台」旁的圆点就是同步状态灯,点它可以立刻同步一次——绿=已同步、蓝=同步中、琥珀=出错、空心=离线。
  • 数据存在哪:对话、分组、标记这些内容,除了在本机留一份,还会自动同步保存到服务器,并按你的账号单独隔离存放。断网时可以照常记录,联网后自动补传。
  • 状态点一直是黄色 / 提示同步失败:通常为登录状态已过期。请先点击侧边栏顶部的状态点,系统将立即重试一次;若仍显示黄色,请退出后重新登录,登录完成即可恢复同步。期间本机记录不会丢失,恢复后将自动补传至服务器。
🌐 界面语言
  • 中英文随时切换:点设置齿轮 → 「界面语言」,选「中文」或「EN」,全站文字立即切换,无需刷新。手机端齿轮在首页右上角,电脑端在左侧栏底部。
  • 面对面翻译不受它影响:分屏、并排、建群这三种场景下,每一侧显示什么语言,由那一侧自己选定的语言决定。把界面语言改成英文,不会改变对面的人看到的语言。
  • 在哪改这一侧的语言:点该侧的地球图标(🌐)即可,改动只影响那一侧。
⚠️ 已知限制(请知悉)
  • 说话人区分可能存在偏差:受 Azure 实时声纹分离技术限制,系统对说话人身份的自动识别可能出现偏差;如有需要,可点击姓名直接修正。
  • 发言被拆分或合并:多人对话时,同一发言人的内容可能被拆分为多段,不同发言人的内容也可能被合并为一段。
  • 译文存在轻微延迟:译文将在整句结束后显示,此为正常现象,并非卡顿。
  • 首次连接可能需要数秒:受网络状况影响,首次接通略慢,接通后即恢复正常速度。
  • 未登录时不会同步:未登录、或登录已过期时,内容只留在当前浏览器,换设备或清除缓存就会丢失。请先登录再开始记录。
  • 多设备同时编辑以最后保存的为准:同一条内容在两台设备上先后修改时,系统按「后保存的覆盖先保存的」合并,可能覆盖掉另一台上的改动。同一场对话建议尽量固定在一台设备上编辑。
  • 共享房间凭码读写:建群是凭房间码进入的,拿到码的人都能查看和修改该房间的内容。请勿把房间码发到公开场合。
  • 重要内容仍建议导出备份:云端同步不等于永久归档,涉及合同、决议等重要内容,请通过【导出】另存一份。

导入

从备份恢复记录,或上传音视频文件自动转写

恢复备份
音视频转写
点击选择或拖拽备份文件
支持 Poly 导出的 .json 与 .md
点击选择或拖拽音视频文件
音频 MP3 / WAV / OGG / M4A · 最大 60MB
视频 MP4 / MOV / AVI / MKV · 只取音轨,最长约 32 分钟
第 1 步 / 共 2 步

新建会话

开始后不可更改,均支持语音识别与文字输入,但分屏仅能识别。

识别模式 · 共 3 种
👥
实时转写 多人 · 分人

多人对话实时转写,自动按声纹分人,可改人名/改文本。可同时翻译成多种语言。

📝
快速记笔记 不分人 · 出字快

说话直接转文字,可同时翻译成多种语言。多人一起说也能记,但不区分谁说的 —— 省掉分人这一步,出字比实时转写更快。

🗣️
面对面翻译 双人双语 / 多人多语 · 仅手机

下一步可选三种场景:分屏(双人双语,上下分屏、对面的人正着读)、并排(多人双语,同向阅读)、建群(多人多语联机,各人一台设备)。

常用设置 · 一键开始
第 2 步 / 共 2 步

面对面翻译 · 选择场景

选好后仍可在会话内的设置中切换。

分屏仅支持语音识别;并排 / 建群可文字输入。

分屏 双人双语

屏幕上下分为两半,上半自动旋转 180°,供对面者正向阅读。中间设一个共用麦克风,发言内容按语种自动归入对应一侧。仅支持语音识别,无文字输入。

并排 多人双语

不分上下,全部发言按时间自上而下排列,原文与译文成对显示,便于回看整段记录。

建群 多人多语联机

多人凭同一房间码加入同一会话,各自选择所用语言;任何人发言,其他人均可看到并自动译为各自的语言。

第 2 步 / 共 2 步

语言设置 / 翻译

可选择多种识别语言,单语言是最快最准的。

识别语言(最多 4 种)
智能检测 多语混说 · 即开即用
手动选择 指定 1-4 种语言
翻译(不选 = 仅识别不翻译)
高级设置
添加人名、产品名、专业术语,识别时会优先匹配这些词

请输入

本地存储

确认