Skip to content

视频字幕 ​

在 YouTube、X、Udemy、Disney+ 视频,以及 Teams、Zoom、Google Meet 网页会议中一起看原字幕与译文,也可以只显示一种语言。

会议字幕与人工字幕 ​

视频翻译设置 → 通用 中新增两个默认开启的选项,关闭后会自动保存:

  • 会议平台自动开启双语字幕:在 Google Meet、Teams 和 Zoom 网页会议中尝试开启平台可用的字幕,并使用视频翻译服务显示译文。关闭此选项后仍可手动开启平台字幕并翻译;关闭视频字幕翻译或隐藏 FluentRead 字幕时会恢复原生字幕显示。
  • 优先使用人工字幕:YouTube、Udemy、Disney+ 有可读取的目标语言人工字幕时,优先显示这份字幕,无需为对应句子调用翻译服务;不可读取、轨道缺失或该时段没有字幕时,继续翻译原字幕。原语言字幕保持原样,不会切换成目标语言轨道。

会议支持浏览器中的网页版本,Zoom 使用 /wc/ 网页客户端;桌面客户端不受浏览器扩展控制。平台、主持人或账号需允许字幕,FluentRead 无法代替平台生成未提供的会议字幕,也不会开启录制或转录。Teams 会沿会议的更多操作及语言菜单寻找明确的字幕开启项;若平台改版或控件不可用,请先手动开启原生字幕。

Udemy 与 Disney+ 读取网站显示的字幕和可用字幕轨道,原文与译文在播放器画面内显示,全屏时随画面移动。字幕下方可以切换双语、仅译文、仅原文或关闭;翻译失败时可以重试。受版权、地区、账号或播放器限制而未向页面提供字幕轨道时,人工字幕优先会回退到原生字幕文字翻译。此功能不绕过媒体访问限制,也不为没有字幕的视频生成音频字幕。

扩展菜单中的 视频字幕 面板可以快速开关翻译、切换 双语 / 仅译文 / 仅原文。翻译服务、字幕外观和本地 AI 模型集中在底部的 视频翻译设置 中,修改后自动保存。

播放器内的字幕菜单用一行 双语 / 译文 / 原文 / 关闭 选择当前看哪种字幕;选择 关闭 会停用 FluentRead 字幕并保留网站自带字幕,再选择任一显示方式即可恢复。观看首页保持紧凑单列,字幕来源以简短状态显示。校时、下载与重新识别放在 字幕选项 中,点左上角返回或按 Esc 回到显示方式。

X 播放器自动收起控制栏时,已打开的字幕菜单会保持显示;显示方式和 AI 字幕状态会随操作更新,方便连续调整。点击菜单外部、右上角关闭按钮或按 Esc 可关闭菜单。方向键可在菜单中移动焦点,不会触发播放器快进。

X 菜单会显示字幕来源:原生字幕、已恢复的本地字幕或 AI 字幕,以及已读取的字幕条数。暂未检测到字幕时会说明下一步;没有时间轴时,下载按钮暂不可用。原生字幕优先于自动恢复的 AI 缓存;手动生成 AI 字幕后则使用这一份时间轴,避免两种来源来回切换。

已有字幕的视频 ​

  1. 确认 FluentRead 的 视频字幕翻译 已开启。
  2. 打开 YouTube 或 X 视频,找到播放器控制栏全屏按钮前的 FluentRead 图标;在 X 中,它位于画中画和全屏按钮之间,控制栏重新显示或切换全屏后会保持这个位置。
  3. 打开字幕菜单,选择 双语 / 译文 / 原文。

字幕来自视频已有的字幕轨道或网页显示的字幕。没有可用字幕时,不能保证直接生成译文。字幕翻译服务默认跟随网页服务,也可以在视频设置中单独选择。

字幕本身已经是目标语言时(例如目标为简体中文,字幕是简体或繁体中文),FluentRead 不再请求翻译,只显示原文一行;选择 译文 时这句会显示在译文位置。

读取到 YouTube 或 X 的字幕时间轴后,FluentRead 会优先翻译当前句,并提前翻译最多八条不同的后续原文;机器翻译通常预取未来 10 秒,AI 服务预取未来 30 秒,倍速播放时相应扩大时间范围。原生轨道加载后立即开始预取,重复条目和已结束字幕不会挤占后续句子的名额;拖动进度后会更新预取窗口。

YouTube 全屏时也可以打开播放器字幕菜单。已预翻译的原文与译文会在同一次更新中一起显示;换句、字幕空档或拖动进度时会清除上一句译文。刚打开视频、跳到尚未翻译的位置或服务未及时返回时,先保留原文,译文完成后仅在对应句子仍有效时补上。

YouTube 逐词滚动字幕会根据当前播放时间和新出现的句子匹配预取译文,不必等上一行滚走。没有可用字幕时间轴时,也会在连续输出期间提交当前文字;实际译文出现速度仍取决于所选翻译服务。

如果字幕比声音慢或快,可以直接在播放页面的 FluentRead 字幕菜单 → 字幕时间中点击 − 或 +,每次提前或延后 0.5 秒。负数表示提前,正数表示延后,最多调整 ±10 秒;有偏移时左侧会出现重置按钮,点一下恢复为 0。设置自动保存并用于之后打开的视频,原文与译文一起调整,视频播放进度和下载字幕的时间戳保持原样。当前字幕没有可用时间轴时,这一行会暂时收起。

X 视频没有字幕时 ​

桌面 Chrome / Edge 扩展可以尝试本地 AI 字幕:

  1. 在 X 播放器的字幕菜单中点击 生成 AI 字幕。
  2. 首次使用时,菜单内会列出 Tiny(约 100 MB,速度快,默认推荐)和 Base(约 150 MB,更准确);确认后开始下载模型,完成后自动生成字幕。也可以提前在视频设置的本地 AI 模型卡片中下载。
  3. 等待识别完成,进度显示在按钮上;生成过程中可以停止。识别完成即恢复时间轴,先显示当前原文,再按播放位置翻译附近字幕,无须等待全片翻译。只看原文时不请求翻译服务。

本地识别会优先使用可用的 GPU 加速;浏览器不支持或加速失败时自动改用 CPU,无需手动切换。

音频识别在本机进行,识别出的字幕文字仍交给所选翻译服务。首次下载需要网络,生成时间取决于视频长度和电脑性能。目前单段视频最长支持 20 分钟;部分媒体格式或受限制的视频无法读取。

调整显示和保存字幕 ​

在视频字幕外观设置中修改字号、背景、位置和显示宽度。X 字幕按视频实际画面定位,竖屏视频中的长字幕会在画面内换行;调整播放器大小或切换全屏时会同步更新位置,播放控件出现时会尽量避让。

字幕选项 → 下载字幕 中的 原文 / 译文 / 双语 可下载 SRT 字幕,结果提示显示在按钮下方。双语文件在同一条字幕里先放原文、后放译文;译文与原文相同时只保留一行。X 已完整识别的字幕会在本机缓存一段时间,重复打开同一视频通常无需重新识别。缓存命中后立即恢复字幕时间轴,译文逐步显示;返回视频设置时会刷新缓存数量。需要重新识别时,打开 字幕选项 → 重新识别此视频,无需清除其他视频的缓存或重新下载已有模型。模型确认前保留当前字幕,取消仍可继续观看。

识别与翻译分别处理:翻译服务失败不会丢失已识别的原文和时间轴。菜单会显示“这句翻译失败”,并提供 重试;也可以切换到原文,或在设置中更换翻译服务。

没有字幕或时间不准 ​

先确认视频本身有字幕,再尝试打开原生字幕。若使用 X 本地 AI 识别,检查模型是否下载完成,必要时明确指定视频原语言。

识别可能听错人名、专有名词或背景音,译文也可能有误。重要细节请结合音频和原字幕核对。

让语言更近,让世界更大。 · 隐私政策