🎵 AI 音乐工作流

工作流

① 视频解析 模块:抖音下载

粘贴抖音分享链接(整段口令也行),自动下载无水印视频;失败时可直接上传本地视频

② 文案提取 模块:语音转文字

对已下载的视频做语音识别,得到口播逐字稿;也可以直接手动粘贴文案

③ 文案拆解 Agent:文案拆解

拆出钩子、结构、情绪曲线、卖点和可复用公式

④ 文案重写 Agent:文案重写

保留爆款结构,换成你的主题重写

⑤ 歌词创作 Agent:歌词创作 + 音乐风格

把重写后的文案改编成带 [Verse]/[Chorus] 结构的歌词,并生成音乐风格提示词

⑥ 音乐生成 模块:音频生成(对标海绵音乐)

方式A:一键复制歌词/风格,去海绵音乐粘贴生成;方式B:配置了兼容 suno-api 的接口后可全自动生成
🚀 一键填入海绵:自动打开独立浏览器窗口(首次需扫码登录一次,之后免登录)→ 你点到「创作→AI写歌→自定义写词」页 → 脚本自动填入歌词/风格/歌名并点击生成。API 模式需在【系统设置】配置音乐接口。

通用账户验证接口

后续项目在服务端使用 Client ID 和密钥调用;身份与角色由 Sub2API 验证。
请求头:X-Client-ID、X-Client-Secret。项目密钥只在创建或轮换时显示一次。

已接入项目

项目Client ID密钥调用次数最后调用操作

用户管理 0

用户首次使用 Sub2API 账户成功登录后自动同步;本站没有注册入口,也不保存 Sub2API 密码。
用户名账户角色使用次数登录次数Token最后活动操作

Agent 提示词配置

每个步骤独立 Agent:可分别改系统提示词、用户模板({占位符} 会自动填充)、模型与温度。改完点保存立即生效。

LLM 大模型(Agent 用)

OpenAI 兼容接口:DeepSeek / 通义 / Kimi / GLM / 硅基流动均可

文案提取(语音识别)

api = 云端接口(默认硅基流动 SenseVoice);local = 本地 faster-whisper

抖音解析

默认用内置解析;失效时可自建 Evil0ctal/Douyin_TikTok_Download_API 并填地址

安全公网访问

服务仅监听本机回环地址,由 Tailscale Funnel 提供固定 HTTPS 入口
本站没有注册入口,不保存 Sub2API 密码;普通用户的项目文件互相隔离。

音乐生成 API

manual = 手动去海绵音乐;suno_api = 对接 gcui-art/suno-api 兼容接口自动生成