找回密码
 立即注册
搜索
查看: 10|回复: 3

字幕编辑工具 Subtitle Edit v5.2.0

[复制链接]

131

主题

0

回帖

427

积分

中级会员

积分
427
发表于 2026-9-16 15:36:25 | 显示全部楼层 |阅读模式
一、工具简介:Subtitle Edit 由 Nikolaj 开发、完全免费开源(GPL 协议)的专业字幕软件,2010 年持续更新,主流版本 v4 稳定版、v5 跨平台 Beta(Win/macOS/Linux),是影视、自媒体最常用字幕工具。
二、核心功能:
1.  海量字幕格式(300 + 种)
读写 / 互转:SRT、ASS/SSA、VTT、SUB、蓝光 SUP、VobSub、BDN、DVD 字幕,短视频 / 影视 / 电视台全格式覆盖。
2.  精准时间轴校准(王牌功能)
内置音频波形 + 频谱图,直观看到人声起止,拖拽毫秒级调字幕错位,一键批量平移整段字幕时间轴。
3.  AI 语音自动生成字幕(Whisper 本地离线)
集成 OpenAI Whisper,本地离线识别、不上传视频,几十种语言一键音转字,不用联网付费,生成带时间轴字幕;可单独下载中英文模型提速。
4.  OCR 图片字幕提取
DVD / 蓝光内嵌图片字幕(SUP/VobSub)→OCR 识别转可编辑文字字幕,解决内嵌字幕无法修改问题。
5.  自动翻译 + 批量处理
对接 DeepL / 谷歌 / 微软翻译,整份字幕一键互译;批量格式转换、批量时间修正、批量字幕内嵌压制视频。
6.  ASS 高级字幕样式
自定义字体、颜色、描边、位置、滚动特效,制作动漫 / 影视剧精美特效字幕。
7.  其他实用
自动纠错字幕(时长太短、重叠、空格错误)、拼写检查、字幕烧录进视频、字幕拆分 / 合并、帧率适配(23.976/25/30fps)。
8.  必备依赖
首次打开会自动下载:FFmpeg(音视频解析)、MPV(内置播放器),缺失则无法预览视频。
三、新手最简使用步骤:
1.  打开软件→视频→打开视频文件载入素材
2.  生成字幕:视频→自动从音频生成字幕 (Whisper),选语种下载模型自动识别
3.  波形页面拖动字幕首尾,修正字幕不同步
4.  文件→另存为,选 SRT(通用)/ASS(特效)/VTT(网页)保存
5.  简体中文设置:(菜单栏)Options---->Choose  UI language---->Language下拉菜单选择ChineseSimplified(简体中文)。
四、常用场景:
1.  自媒体:课程 / 短视频一键生成中文字幕(替代剪映付费字幕)
2.  影视:外挂字幕校对、内嵌字幕提取、双语字幕制作
3.  后期:批量字幕格式转换、多语种字幕本地化
五、更新日志:
版本 5.2.0 变更内容//2026年09月10日
新功能:
辅助分割与辅助移动——提供带完整预览的一键排序建议
章节编辑器,支持Matroska/MP4/OGM等章节格式(视频 > 更多 > 章节)
编辑原稿——可就地编辑原始参考行,以只读方式打开不匹配的原文作为参考,并在波形图上显示原文字幕
强制叙事行——新增“强制”列及“将强制行保存为…”选项
错误列表与摘要卡片(工具 > 列出错误…,批量转换)——支持导出至剪贴板、文本、Excel或网页
统计仪表盘,包含模块化卡片、计量表、检查项以及CPS直方图
字幕网格:通过“列…”对话框重新排序或隐藏列,“隐藏标签”格式模式,以及所有下拉框中的按类型搜索功能
文本框:支持拖放文本(如从原文到工作文本),可配置的“通过……搜索”快捷键、“Google查询”、macOS的“查找”、首字母大写等功能,以及更多“用……包围”选项
波形图:自动猜测波形起止位置,可捕捉镜头切换,支持编辑视频位置框、逐轨音频选择器,并可在视频/波形位置进行复制粘贴操作
使用视频实际帧时间美化时间码,并支持批量转换
视频偏移记忆最近偏移设置:在视频菜单中新增“打开最近视频…”选项
多重替换:导入/导出规则分类,全选/取消全选/反选,移动快捷键及正则表达式匹配超时处理
基于图像的字幕编辑器:支持打开DVD sup、XSUB、MP4 VobSub等多种格式,可调整“视频分辨率…”缩放比例,并支持刻录至蓝光字幕
更新检查设置,新增稳定版/测试版通道及启动通知功能
默认保存路径、编辑器中“不要在以下内容后换行”的自动断行列表,以及使用“剪切视频”功能直接裁剪字幕
SE 4 兼容性:
集成了nOCR训练、最小间隔帧率计算器,以及“移除/替换Unicode字符”功能(SE 4插件移植)
WebVTT样式管理器、语音与浏览器预览,以及可配置的WebVTT提示设置
支持导入SE 4的Settings.xml文件,并在快捷键导入时新增22个SE 4快捷键
快捷键:跳转到下一行空白、跳转到首行/末行、书签、下划线、切换自定义标签、重新计算时长、跳转到下一/上一字幕(播放翻译)、将首词移至前一字幕、在光标处第一个空格处分割
布局10(波形下方的编辑框)、“在字幕网格中居中文字”、四项网格双击操作,以及与SE 4类似的工具栏帧率设置
“仿SE 4设置”还调整了波形工具栏:“打开第二个字幕文件…”已回归SE 4视频菜单的位置
打开字幕时去除空行、支持全帧图像导出、在查找/替换中增加正则表达式片段右键菜单,以及在替换时新增Alt+F/Alt+R快捷键
Tesseract OCR:保留SE 4的10像素边距并支持多次重试调整大小
复制到剪贴板的网格菜单项及纯文本列粘贴功能均已恢复
自动翻译与人工智能:
新增“llama.cpp高级”引擎,支持批量上下文、系统提示及模式强制输出——同样适用于批量转换与seconv(--translate-prompt参数)
MiLMMT-46翻译模型:DeepL提供所有API语言;Google翻译在免费服务被屏蔽时可通过备用端点重试
对已翻译但导致行高断裂的文本重新断行,在引擎更换时保持所选语言不变,且翻译后原文不再丢失
AI审核:在网格右键菜单中,可分轮次应用建议、播放当前内容、启停llama.cpp服务器、调整请求间隔,并支持新模型(Gemma 4 E2B、EuroLLM、Granite 4.1)
语音转文字:
新增引擎与模型:WhisperX(独立运行,无需Python)、Google Cloud Speech-to-Text v2、Voxtral(清晰ASR)以及面向日语的anime-whisper
提供非语音与重复行去除的转录质量报告
清晰ASR:所有后端均具备“自动检测”语言功能,配备VAD关闭开关及无VAD重试机制;WhisperX实时进度可见
MLX Whisper引擎已被移除
文本转语音:
新增引擎:IndexTTS 2.5、Higgs Audio v3、Fish Audio S2 Pro、FireRedTTS3(audio.cpp)、dots.tts、Confucius4-TTS以及Pocket TTS(清晰ASR),此外还有VibeVoice再次回归、CosyVoice3 RL模型,以及多语言Chatterbox V3(涵盖23种语言)
视频中的声音克隆:“在视频中寻找声音并全部克隆”,Qwen3、audio.cpp、VibeVoice、MOSS-TTS、CosyVoice3及VoxCPM2等平台支持逐行克隆——首次克隆前需用户同意
支持说话人姓名识别,“让声音/音乐部分保持静默”,配备Zonos语言选择器及定制Piper语音模型
光学字符识别(OCR):
新增引擎与模型:Apple Vision OCR(macOS)、Paddle OCR 3.7(PP-OCRv6)、CrispEmbed PP-OCRv6、DeepSeek-OCR-2,以及llama.cpp HunyuanOCR 1.5、LFM2.5-VL 3B和定制视觉模型
视频OCR(内嵌字幕):可识别的字幕数量大幅增加,文本与起始时间更准确,采用CrispEmbed引擎、OCR修复引擎及拼写检查着色功能
OCR修复引擎:新增西班牙语、葡萄牙语、意大利语及西里尔字母规则,修复约115条替换列表条目,并对撇号进行校正
自动检测OCR语言,OCR完成后自动打开匹配视频,“将所有图片连同HTML索引一起保存”,并提升nOCR匹配速度
字幕格式:
新增:EBU-TT(Tech 3350)、Manzanita DVB 文本广播(.dvbttx)、Csv Excel、CANVASs SSTG1(.sdb)、Wistia json、DVD Junior SPC、Sonic DVD Producer、YouTube srv3(.ytt)、DaVinci Resolve 标记 EDL 以及 Adobe Premiere 标记
新增导出格式:Final Cut Pro Xml 字幕、EDN/xml 8 位及 Audacity/Tenacity 标签
支持从碎片化 MP4(DASH/CMAP)中读取字幕,从传输流中读取 ARIB STD-B24 字幕,以及 SMPTE-TT 位图字幕
对未知格式的导入大幅优化(通用 XML 导入器),在未知格式提示中新增“导入纯文本”选项,并支持通过“文件 > 打开”直接导入电子表格
EBU STL/文本广播:新增颜色选择器、对齐对话框、TT 列、带方框/对齐/双倍行高的视频预览,以及基于帧的时间码功能
SCC:支持将颜色作为 CEA-608 中间行代码显示,提供行长警告,并实现逐帧精确的导入时间同步
ASSA:支持嵌入与裁剪字体,在分辨率不匹配时提供重采样选项,新增高级特效,并在批量转换中新增“更改 ASSA 样式属性”功能
Lambda Cap 和 Netflix IMSC 1.1 日语版本中支持 Ruby 与强调效果;EBU-TT-D 和 IMSC Rosetta 中支持字体颜色设置
视频与图像导出:
基于图像的导出:支持高级文本特效(渐变、霓虹光效、3D 拉伸)、每行 ASSA 颜色与描边、内联字体样式与大小,以及蓝光字幕的淡入淡出与叠加效果
内置刻录:macOS 上使用 VideoToolbox 硬件编码器导出 .webm/.ts 文件,支持字距调整与 libass 样式预览
同步对话框:视频上叠加字幕、可调整大小的波形显示,以及选定音频轨道
使用 mpv 实现更平滑的波形与视频光标,提升长 GOP 视频的拖动速度,并修复暂停或快进时出现的音频断续问题
批量转换与 seconv:
批量转换:美化时间码、将颜色转换为对话内容、将时间码对齐至帧、新增“添加文件夹…”功能、显示翻译进度、保留源文件的日期时间,以及按 PID 保存每个文本广播页面
seconv:支持 --json 输出与 --help-json、--ocr-prompt、--translate-prompt、--override-position、--output-filename-append 选项,可导出全帧图像,支持 .avi/XSUB 读取,并提供批量 Paddle OCR 功能
翻译与引擎:
新增 UI 语言:库尔德语(中部)与阿塞拜疆语——所有语言文件均已与英文版同步
更新的引擎:Crisp ASR v0.8.32、llama.cpp b10840、whisper.cpp v1.9.3、CrispEmbed v0.17.9、Paddle OCR 3.7、Tesseract 5.5.3、ffmpeg 9.0.1(Windows)、libmpv 20260814(Windows)以及 yt-dlp 2026.08.19


游客,如果您要查看本帖隐藏内容请回复



081525vzid3dfmgufdyddg.png


0

主题

504

回帖

755

积分

高级会员

积分
755
发表于 6 天前 | 显示全部楼层
大神666

0

主题

910

回帖

1364

积分

金牌会员

积分
1364
发表于 4 天前 | 显示全部楼层
6666666666

0

主题

936

回帖

1403

积分

金牌会员

积分
1403
发表于 前天 18:36 | 显示全部楼层
这个好,谢谢分享
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

快速回复 返回顶部 返回列表