ai-avatar-video
通过 inference.sh CLI 生成 AI 数字人口播和 Talking Head 视频,组织头像、音频、文本与唇形同步流程。
推荐使用Codex
Skills.sh 精选Skills.sh 设计本周热门 2026-07-16
inference-sh
Skill 作者
适合职业
- 视频创作者
- 课程制作人
- 内容运营
兼容工具
- Codex
- Claude Code
- OpenAI Agents
使用场景
- 数字人口播
- Talking Head 视频
- 音频与唇形同步
安装指令(将命令发送给 Codex 可直接安装)
完整说明
Skill 简介
ai-avatar-video 用于通过 inference.sh CLI 创建 AI 数字人和 Talking Head 视频,帮助 Codex 组织头像、音频、口播文本和模型参数。
核心能力
- 根据输入条件选择数字人或口播视频模型
- 组合头像、文本、音频和输出规格
- 执行生成并保存结果
- 检查人物一致性、唇形同步和声音节奏
使用前准备
- 准备有使用权限的清晰人物头像
- 准备口播文本或音频文件
- 安装并登录 inference.sh 使用的 belt CLI
- 确认模型权限、费用和内容使用边界
推荐流程
- 说明视频用途、语言、时长和画面比例。
- 提供头像及文本或音频。
- 让 Codex 检查输入并推荐模型。
- 先生成短样片验证人物和唇形。
- 确认后生成正式视频并检查输出。
安装说明
复制安装命令并在目标项目中执行。安装后先阅读 skills.sh 与 GitHub 来源说明,确认依赖、账号、费用和运行环境,再让 Codex 按该 Skill 的流程工作。
使用说明
先准备清晰头像、口播文本或音频,并按上游说明安装登录 belt CLI。让 Codex 检查输入格式、选择可用模型并确认费用,再生成短样片验证人物一致性和唇形同步。
