技能教程 · TUTORIAL
AI 出视频 · 详细教程
通过开放 API 做文生视频、图生视频、首帧/尾帧锁定、参考生。需要你自己的 API Key,提交任务后轮询取回视频。
这是什么
video-gen 是一个调用开放 API 做视频生成的 skill:文生视频、图生视频、首帧/尾帧锁定、参考生、视频续写,都走它。本 skill 只覆盖视频;要生图用 image-gen,要配音用 audio-gen。
需要你自己的 API Key:它不内置额度,跑之前要配置好 Key,按平台计费。出视频比出图贵,提交前建议先查余额。
适合谁 / 不适合谁
- ✅ 给文字或图片生成短视频片段;指定首帧/尾帧锁定画面,便于接在已有素材前后。
- ✅ 图生视频、参考生、视频续写/延长、视频换人/超分。
- ❌ 不处理图片、不处理音频/配音。
怎么部署
- 下载解压:点页面顶部的「下载 …」拿到 zip,解压得到一个
video-gen/文件夹(里面是SKILL.md和scripts/)。 - 装进 AI 助手:把整个
video-gen/文件夹放进你所用助手的 skills 目录,助手就能自动发现它 ——
- WorkBuddy / CodeBuddy(用户级):
~/.workbuddy/skills/video-gen/,Windows 上是C://Users//<你的用户名>//.workbuddy//skills//video-gen//; - 只想在某个项目里用:
<项目目录>/.workbuddy/skills/video-gen/。
- 配好 Key:这个 skill 要调用平台 API,需要你自己的
sk-Key —— 见下一节「准备:配置 API Key」。 - 用起来:直接跟助手说要做什么(例:「把这张图做成 5 秒视频」),它会调用。
准备:配置 API Key
程序按这个顺序找 Key:
- 本 skill 目录下的
api_key.txt; - 环境变量
VIDEOGEN_API_KEY(也认IMAGEGEN_API_KEY,同平台同一个 Key 就能用); - 文件
~/.video-gen/api_key.txt; - 都没有 → 到平台官网「开放API」页面创建
sk-开头的 Key(平台 API 域名https://api.lk888.ai),拿到后写入api_key.txt保存。
它已内置接口地址与鉴权方式,你不用关心底层 URL。
用法
🔴 视频不要死等:出视频比出图慢得多(常见几分钟,高峰期十几分钟)。把「提交 + 轮询」拆成两步,不要一条命令干等:
# 0) 看有哪些视频模型 / 某个模型的参数
python scripts/generate.py --list-models
python scripts/generate.py --show-model "hailuo-h3"
# 1) 提交(推荐:只提交,秒回 task_id)
python scripts/generate.py --model "hailuo-h3" --prompt-file prompt.txt \
--params '{"duration":"8","aspect_ratio":"16:9","resolution":"768P"}' --submit-only
# 2) 隔 30–60 秒查一次(完成自动下载到 ./output)
python scripts/generate.py --task-id 58392 --out ./output
# 图生视频:海螺 H3 首尾帧(1 张=首帧,2 张=首尾帧)
python scripts/generate.py --model "hailuo-h3-shouweizhen" --prompt-file prompt.txt \
--upload images="C:/pic/first.png" --upload images="https://cdn.x.com/last.jpg" --submit-only
中文 prompt 不要直接放命令行参数(Windows GBK 会乱码),先写进 UTF-8 文件用 --prompt-file 传。以返回的 is_final 为唯一终点,不要重复提交(会重复计费)。
选型要点
- 先读
references/models.md(平台视频模型速查,含「按意图选型」表)。 - 有的模型不支持纯文字(素材必传):
--show-model返回的input_hint里出现「必传 / 必须 / 仅限带图」就是必传。用户只说「生成一段视频」时,先问清是文生还是图生。 - 计费口径不一样:多数按秒;提交前先查余额,试稿优先选便宜档(480P 单价最低;文生可先 768P 试稿、满意后用升分辨率功能仅补差价)。
- 写视频 prompt 必须写运动和镜头:谁在动、怎么动、镜头怎么走、多快、什么节奏、光怎么变化。只写静态画面,出来容易是「一张图轻微动一下」。
参考素材的传法
素材填进模型 type=upload 的参数里(参数名先用 --show-model 查)。用 --upload 参数名=值 指定,可重复:
# 海螺 H3 首尾帧:images 是复数名参数,1 张=首帧,2 张=首尾帧
--upload images="C:/pic/first.png" --upload images="https://cdn.x.com/last.jpg"
# 海螺 H3 全能参考:三个独立参数
--upload image_url="C:/pic/a.png" --upload video_url="https://cdn.x.com/ref.mp4"
- 复数名参数一律传数组(即使只有一个文件也要传
["..."])。 - base64 内联边界:图片/音频类文件支持
data:<mime>;base64,<数据>(单文件解码后 ≤10MB、单次合计 ≤30MB);视频文件必须传公网 URL,不能 base64。 - 平台不托管文件:URL 方式请自行上传到对象存储后传直链。
已知边界(如实说,不吹)
- 失败任务余额自动退回;按
error.type分类处置(参数错误就改参数、Key 无效就检查 Key、余额不足就充值、频率限制就退避),不要对错误文案做文本匹配。 - 接口行为以平台实时返回为准,模型上下架、参数变化以
--show-model查到的为准。
想要加功能
包里目前是 SKILL.md + scripts/generate.py + references/models.md。想加专属工作流、批量出片、或接进你们自己的系统 → 用页面底部的联系方式找我,说清场景,我帮你做。