系统设置

按使用频率重组流程、账号、AI、维护与安全设置,常用项优先,高级项按需展开。

运营优先 单页保存 高级项折叠

运行与投稿

无人值守流程、投稿策略与内容审核,日常最常用的开关集中在第一个分组。

常用流程

自动化流程

未启用

自动完成下载、翻译、生成素材与投稿,适合日常批量运行。

仅在已启用自动推荐分区、任务存在封面、且 AI 接口支持图片输入时生效;否则自动回退文本模式。

投稿设置

投稿策略

AcFun

开启后,仅在任务的所有目标平台均上传成功时立即删除该任务的本地视频、封面和字幕;关闭时保留下载文件。

预设标签排在最前:开启「自动生成标签」时 AI 只补齐剩余名额,关闭时只上传预设标签。AcFun 只上传前 6 个(每个标签约 10 字),bilibili 最多 12 个(每个标签 20 字)。与「固定分区」类似,本项对所有任务生效,优先级高于单条任务自己生成或手改的标签;任务自身的标签仍会按顺序保留在上限之内。注意:从预设里删掉某个标签不会自动从已跑过标签生成的任务上移除它,需要时请在任务编辑页手工删除。

会占用 1 个标签名额,适合强调来源作者。

审核服务

内容审核(阿里云内容安全)

凭证未完成

审核标题、描述和封面,建议与阿里云凭证一起完成配置。

账号与登录

各平台登录凭据与 Cookies 同步。扫码登录成功后无需手工维护 Cookies 文件。

平台账号

AcFun 账号

推荐用二维码登录自动生成,也支持手动上传 Netscape/JSON 文件。

扫码并在手机端确认后会自动写入 Cookies。
AcFun 登录二维码
平台账号

bilibili 账号

推荐用二维码登录自动生成,也支持手动上传 JSON/Netscape 文件。

扫码并在手机端确认后会自动写入 Cookies。
bilibili 登录二维码
平台账号

YouTube Cookies

可选同步

CookieCloud(YouTube)

未启用
当前首版仅支持从 CookieCloud 拉取 YouTube / Google 相关 Cookies。“测试连接”只会联网校验并在内存中解析,不会写本地文件;“立即拉取一次”才会把结果写入上方的 YouTube Cookies 文件路径。 按钮会直接使用当前表单里的值,不必先保存设置。
为避免在页面源码中暴露明文密码,密码框不会回填;留空保存时会保留现有值。
如果你只是想确认服务地址、UUID、密码和加密算法是否正确,直接点“测试连接”即可,无需开启明文导出。只有当你明确需要让 yt-dlp / 本地任务读取 CookieCloud 结果时,才需要开启下面的明文导出选项并执行“立即拉取一次”。

不开启也可以使用 CookieCloud 的“测试连接”,只是不会把结果写入本地文件;此时下载任务仍会继续读取现有的 YouTube Cookies 文件。开启后会将解密后的 Cookies 以明文写入上方路径,请仅在受信任的本机上使用。

启用后可先用“测试连接”校验配置;如需写入本地 YouTube Cookies 文件,再开启明文导出并执行“立即拉取一次”。
最近未执行 CookieCloud 测试或拉取。

网络与下载

下载代理、监控 API 代理与下载内容清理。两处代理配置并列,便于对照排查连通性。

下载通道

YouTube 下载与代理

可上传由浏览器插件(如 “Get cookies.txt LOCALLY”)导出的 Netscape 格式 cookies.txt;CookieCloud 为可选项,仅用于会员专享 / 私享视频及降低限流,日常搬运并非必须。YOUTUBE_COOKIES_PATH 指向的文件即上文“YouTube Cookies 文件路径”(默认 cookies/yt_cookies.txt)。

手动模式会下载不高于所选分辨率的最高可用版本,不保证精确命中。

监控接入

YouTube 监控 API

未配置
下载页中的“启用代理下载”只影响 `yt-dlp` 下载链路;这里的代理只影响 YouTube Data API 监控请求,且不会继承下载代理或环境变量代理。

配置后可在 YouTube 监控 页面启用自动监控。

关闭时强制直连,不会回退到下载代理或 `HTTP_PROXY/HTTPS_PROXY`。

如果服务器本身无法直连 YouTube Data API,请在这里单独填写代理。
尚未配置 YouTube API 密钥,请先完成接入。
文件维护

下载内容清理

将删除 72 小时前的下载文件和目录。

AI 服务与端点

所有大模型端点的唯一入口:全局模型、字幕翻译、字幕质检、智能分段与兜底端点。

模型接入

AI 端点配置

全局模型
未配置

填写 OpenAI 兼容 API 的根地址;也可粘贴完整 /chat/completions 或 /responses 地址,系统会自动选择并规范化协议。请求参数和消息格式会按端点实际能力自动协商。客户端不限制模型的生成 token 数;如需控制费用或最长输出,请在模型网关设置额度上限和账单告警。

关闭时会按可识别的 DeepSeek、Qwen、MiMo 接口发送各自的禁用思考参数;其他模型不会收到私有参数。

字幕翻译专用覆盖
留空即继承全局
兜底端点(故障转移)
未配置(单端点)
主端点(上方「全局模型」)出现连接失败 / 超时 / 5xx 时,自动切换到此兜底端点继续调用; 留空则维持原有单端点行为,不影响任何其它功能。
仅用于探测兜底端点的连接阶段;读取/写入超时仍沿用全局 OPENAI_TIMEOUT_SECONDS(默认 600s),不会被此值截断。
字幕质检大模型
留空即继承字幕翻译/全局配置

仅用于字幕质检;地址、密钥、模型名留空时按“字幕质检专用覆盖”→“字幕翻译专用覆盖”→“全局模型”的顺序回退。

智能分段专用模型
留空即继承全局

语音识别

音频转文本的完整链路:识别引擎、音频预处理(VAD/分片)与 AI 智能分段。

引擎选择

语音识别引擎

引擎配置

Whisper

建议填写支持 /audio/transcriptions 的 API 根地址。留空时继续沿用全局 OpenAI 地址和密钥;系统会自动移除末尾的 /responses 或 /chat/completions,兼容旧配置。若 LLM 与 ASR 使用不同服务,请在此显式填写 ASR 地址和密钥。

优先请求词级时间戳;OpenAI 兼容或 LocalAI 后端不支持时会自动回退。

关闭(默认)可避免幻觉在相邻片段间传播。

引擎配置

Voxtral

音频预处理

VAD 与音频分片

Whisper 共用参数
当前说明

当前为 Whisper 模式,扫描窗、segment 时间戳和失败回退会共同决定最终字幕时间轴。

VAD 质量与容错

低于 0.4 秒的孤立窗口只会产出噪声或幻觉,默认丢弃而不送往语音识别。

分片与回退

必须小于「分片窗口」,否则分片无法向前推进;服务端会按「窗口 − 1 秒」回退并提示。

VAD 扫描参数
后处理

AI 智能分段

未启用
基于 ASR 返回的字级时间戳,由 AI 按语义重新切分字幕,获得更自然的断句与节奏。需 ASR 支持字级时间戳(如 Whisper 时间戳粒度包含 word,模型如 parakeet-crispasr);不支持时自动降级到段级 AI 分段,再失败则回退规则分段。
分段所用模型端点(专用覆盖,留空则继承全局)在 AI 服务与端点 分组配置。
节奏与批次参数

关闭时直接信任 AI 的分段结果,不做二次节奏修正。

索引制分段下通常不需要,仅在边界偏移时手动开启。

字幕翻译与排版

文本到成片字幕:翻译开关与语言、烧录样式、翻译批次并发、质检参数、格式后处理与提示词。

翻译流程

翻译开关与来源

中文字幕由 ffmpeg 烧录进画面(B 站为现成视频文件,无软字幕通道),需要「字幕来源 + 字幕翻译」两步同时开启才会出字幕。来源二选一:① 下载 YouTube 自动生成字幕(适用于原视频无人工字幕);② 语音识别 ASR 转写。上方「启用字幕翻译」开启后若未选任何来源,页面会提示且发布视频将没有字幕。

翻译流程

语言与字体

烧录控制

烧录与输出

默认字体放不下时,会优先缩小到该比例;极长横屏字幕会继续使用安全字号兜底以保持单行。

关闭(默认)时任一未译条目都会让整批翻译失败,避免成片出现原文与译文混排。

画面观感

字幕外观

字号与边距的基准值仍按视频分辨率自动适配,这里只做倍率与配色覆盖。默认值即历史观感,不改动就是现在的效果。

开启底板后描边会自动切换为圆角底框样式(BorderStyle=4),此时阴影会被 libass 当作底框外扩,建议同时关掉阴影。

翻译调优

翻译批次与并发

填 0 表示按本批字幕的实际批次数自动决定并发;内存紧张时系统还会自动下调。
质量保障

字幕质检参数

质量优先:质检不通过时不烧录字幕,但保留字幕文件并继续上传原视频(任务仍记为完成)。关闭质检等于主动放弃这道防线:不再沿用历史质检结论,也不再要求降级素材通过严格质检(避免「关掉质检反而更严格」);但 ASR 来源结局为失败时仍会拦截,除非同时取消下方的「语音识别异常时禁止烧录字幕」。注意与「质检没跑成」的区别 —— 主动关闭质检按放行处理,质检启用却没跑成(字幕文件缺失或执行异常)按拒绝处理。开关与其调优参数同在本卡片;质检所用模型端点在 AI 服务与端点 分组配置。

除文本维度外,额外校验字幕覆盖率、尾部截断、首条起点、最大空档、重叠、语速异常与重复刷屏。需要视频总时长,取不到时自动跳过这些维度。

AI 质检单次调用超时,范围 10–600 秒,默认 120。
文本后处理

字幕格式与后处理

字幕后处理
仅对 Whisper 生效
勾选(默认):VAD/ASR 结局判定为失败时,保留字幕文件但拒绝烧进成片,继续上传原视频。取消勾选后只放宽两类拦截:「ASR 来源结局」(失败 / 退化)与「质检没跑成」(字幕文件缺失或执行异常);质检给出的明确失败结论针对字幕文件内容本身,始终生效,不受本开关影响。
提示词

字幕翻译主提示词

使用内置
当前内置提示词
你是字幕翻译器。按顺序把 texts 每一项翻译成简体中文。等价翻译,不解释、不扩写;数字、代码、URL、占位符和无公认译法的专有名词可保留,其余可翻译内容尽量译成自然简体中文。必须保持与输入数组一一对应:第 N 条输入只翻译成第 N 条输出。禁止跨条目借用、合并、拆分、提前翻译下一条或重复上一条内容。若某条源文本本身是不完整短语、半句或续句,译文也必须保持同样边界,不要擅自补成完整句。不要根据上下文重写相邻条目,不要消除原始断句。严格返回 JSON:{"translations":[{"index":0,"translation":"译文1"},{"index":1,"translation":"译文2"}]}。index 必须与输入条目编号一一对应,不得缺项、不得合并、不得增项。不要输出 Markdown 代码块,不要输出解释。若确实无法输出 JSON,则每行只写一条译文,行数必须与输入条数完全相同且顺序一致。

可用变量:{target_language_name}(目标语言名称)。留空则使用内置默认模板。

提示词

严格补救提示词

首轮翻译后若检测到大量漏译条目,会用此提示词以严格模式再补翻一次。

当前内置提示词
你是字幕翻译器(严格模式)。按顺序把 texts 每一项尽量完整翻译成自然简体中文。普通句子和说明文字不得整句保留原文;仅保留数字、代码、URL、占位符和必要专有名词。必须保持与输入数组一一对应:第 N 条输入只翻译成第 N 条输出。禁止跨条目借用、合并、拆分、提前翻译下一条或重复上一条内容。即使上下文相关,也不得把相邻条目的信息揉进当前条目。若源文本是不完整短语、半句或续句,译文也保持不完整,不要补全。严格返回 JSON:{"translations":[{"index":0,"translation":"译文1"},{"index":1,"translation":"译文2"}]}。index 必须与输入条目编号一一对应,不得缺项、不得合并、不得增项,缺任何一条都会被判为整批失败。不要输出 Markdown 代码块,不要输出解释,不要用编号清单代替 JSON。
提示词

元数据翻译主提示词

使用内置
当前内置提示词
你是视频标题和简介翻译器。将输入字段改写为简体中文。只允许重述原文事实,删除导流、社媒、外链、联系方式和互动引导。title 必须是自然单行标题;description 必须是自然简介,可多段,但不能写成列表、备注或说明。禁止补充新事实、解释或备注。只返回 JSON:{"title":"","description":""}。

可用变量:{target_language_name}。留空则使用内置默认模板。

提示词

简介重试提示词

标题/简介首轮翻译后,若简介字段校验失败(如格式不自然、含导流残留等),会用此提示词单独重试简介。

当前内置提示词
你是视频简介翻译器。将 description 翻译并改写为简体中文自然简介。只允许重述原文事实,删除导流、社媒、外链、联系方式和互动引导。description 可以多段,不限制段落数,但不能输出列表、备注、解释或额外说明。只返回 JSON:{"description":""}。

转码与媒体

视频转码策略与其依赖的 FFmpeg 环境。转码与运行环境放在同一屏便于排查。

转码策略

视频转码

仅最终使用 CPU 编码时生效。libx265 输出 HEVC,编码耗时约为 libx264 的 5 倍;体积收益随素材与 preset 变化,不保证更小,建议开启后自行对比。

常规 CPU 软编码字幕烧录使用(x264 与 x265 共用),默认 medium。

1440p 及以上且超过 10 分钟时使用,默认 veryfast。

越小质量越高、体积越大。自动模式下的推荐值:4K 22.5 / 1440p 23 / 1080p 23.5 / 720p 24.5。

开启自适应量化、前瞻、多遍分析等;同时作用于硬件编码器与 CPU 软编码(x264 / x265)。老 GPU 驱动不支持时报参数错误,可关闭回退基础参数(1440p+ 长视频走 veryfast 时前瞻跟随 preset,不受此项放大)。

不写入时播放器会按默认色域解释,可能偏色。

按 CPU 编码器各自的白名单取值。x265 不支持 film / stillimage,配了会被忽略并记录到任务日志。

运行环境

FFmpeg 环境

消息推送

将任务新增、完成、报错与关键登录事件推送到企业微信、Server 酱或自建网关。

总控

通知策略

未启用

事件开关为全局共享。已启用但凭据不完整的渠道不会阻塞主流程,只会跳过发送。

渠道

企业微信群机器人

使用已保存的配置发送,不读取当前未保存表单内容。
渠道

Server 酱(ServerChan)

将以标题 + Markdown 正文的形式发送。
渠道

自建消息网关

留空通道名时使用服务端默认通道。

运维与安全

并发控制、日志清理、访问密码与最小权限 API Token。

资源控制

任务并发

文件维护

日志清理

将删除 72 小时前的日志文件。
此操作会清空 `task_manager.log`、`app.log` 并删除所有 `task_xxx.log` 文件,且无法恢复。
访问控制

密码与会话安全

两次输入的密码不匹配。
连续无操作超过该时长后自动退出,访问受保护页面会自动续期。
最小权限 API

Telegram Bot API Token

未配置

该 Token 仅允许调用 /tasks/add_via_extension 提交视频任务,不能访问设置、日志、任务管理或维护接口。

明文 Token 只会在生成后显示一次;请复制到 y2a-auto-tgbot 的设置中。生成新 Token 会立即使旧 Token 失效。
未配置
复制后请妥善保存;刷新页面后无法再次查看明文。
需要恢复默认值时,用各卡片标题右侧的「重置」按钮,可精确到单张卡片。