SkillAtlasSkill 详情

video-creation-collaborator

收录最全、更新最快的AI Agent技能库,涵盖文档处理、内容创作、编程开发、机器学习、自动化工作流等多个领域的精选技能包。

审核状态:已审核Quality 80Security 80

复制安装命令

用 Codex 或 Claude 安装复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它先审查 Skill 页面再帮你安装。

复制前请先查看来源、License 和安全提示。

项目 README

来源文件:README.md

抓取于 2026年8月4日

🎯 技能商店 - Skill Store

Stars Forks Last Commit Issues License Auto Sync

收录最全、更新最快的AI Agent技能库,涵盖文档处理、内容创作、编程开发、机器学习、自动化工作流等多个领域的精选技能包。

官方技能 本地技能 备份覆盖 自动更新

📊 统计数据

  • 官方技能: 182 个(来自 awesome-agent-skills,自动爬取)
  • 本地技能: 62 个(26核心 + 30子技能 + 6系统内置)
  • 技能总数: 244 个(官方 + 本地)
  • 备份覆盖率: 100%(71个压缩包,完整备份)
  • 自动更新: 每24小时自动爬取最新技能

🌟 核心特性

🤖 自动更新

每24小时自动爬取 awesome-agent-skills 仓库,确保技能库始终保持最新状态。

📦 双重技能库

  • 官方技能:182个来自Anthropic、Vercel、Cloudflare、Google Labs、Hugging Face等顶级团队
  • 本地技能:62个精选中文技能,涵盖内容创作、视频制作、电商营销等垂直领域

🏷️ 智能分类

按照功能、来源、Star数量等多维度标签进行分类整理。

📊 数据导出

支持JSON和CSV格式导出,方便数据分析和二次开发。

📚 官方技能来源

本技能商店收录了来自以下顶级团队的官方技能:

  • Anthropic (17个) - docx, pptx, xlsx, pdf, mcp-builder, webapp-testing 等
  • Vercel (7个) - react-best-practices, next-best-practices, composition-patterns 等
  • Cloudflare (7个) - agents-sdk, durable-objects, wrangler 等
  • Trail of Bits (26个) - building-secure-contracts, static-analysis, property-based-testing 等
  • Hugging Face (8个) - model-trainer, datasets, evaluation, jobs 等
  • Google Labs (2个) - design-md, react-components 等
  • Stripe (2个) - stripe-best-practices, upgrade-stripe
  • Supabase (1个) - postgres-best-practices
  • Expo (3个) - expo-app-design, expo-deployment, upgrading-expo
  • Sentry (7个) - code-review, commit, create-pr, find-bugs 等
  • Better Auth (3个) - best-practices, commands, create-auth
  • 其他团队 - Tinybird, Remotion, Inngest 等

💾 本地技能库(62个)

📝 内容创作与发布(10个)

  • content-creation-publisher ⭐⭐⭐⭐⭐ - 内容创作与发布全流程
  • intelligent-content-system ⭐⭐⭐⭐⭐ - 智能内容系统
  • article-illustrator ⭐⭐⭐⭐ - 文章智能配图
  • baoyu-url-to-markdown ⭐⭐⭐⭐ - 网页转Markdown
  • baoyu-format-markdown ⭐⭐⭐⭐ - Markdown格式化
  • baoyu-post-to-wechat ⭐⭐⭐⭐ - 微信公众号发布
  • baoyu-post-to-x ⭐⭐⭐ - X/Twitter发布
  • baoyu-xhs-images ⭐⭐⭐⭐ - 小红书图文生成
  • wechat-hotspot-publisher ⭐⭐⭐ - 微信热点文章生成

🎬 视频创作(9个)

  • video-creation-suite ⭐⭐⭐⭐⭐ - 完整视频创作套件
  • video-creation-collaborator ⭐⭐⭐⭐ - 多智能体协同视频创作
  • video-creation-pro ⭐⭐⭐ - 商品视频创作系统
  • video-recreation ⭐⭐⭐⭐ - 视频二创工具
  • video-frame-extractor ⭐⭐⭐ - 视频反推工具
  • viral-video-copywriting ⭐⭐⭐⭐ - 爆款短视频文案
  • historical-science-video-prod ⭐⭐ - 历史科学类视频
  • historical-interview-scripts ⭐⭐ - 历史访谈文案
  • three-body-video-creator ⭐⭐ - 《三体》视频创作

🛒 电商与营销(7个)

  • ecommerce-full-pipeline ⭐⭐⭐⭐⭐ - 跨境电商全链路自动化(1688采集/清洗/上架/推广/视频/代发/爆品挖掘/闲鱼选品捡漏)
  • pet-commerce-creator ⭐⭐⭐ - 萌宠带货短视频
  • ecommerce-copywriter ⭐⭐⭐ - 电商图片文案
  • ecommerce-video-marketing ⭐⭐⭐ - 电商视频营销
  • product-marketing-copywriter ⭐⭐⭐ - 产品营销文案
  • product-video-creator ⭐⭐⭐⭐ - 商品视频创作
  • xiaohongshu-makeup ⭐⭐⭐ - 小红书美妆内容

📊 PPT与演示(6个)

  • NanoBanana-PPT-Skills ⭐⭐⭐⭐⭐ - AI生成PPT图片和视频
  • ppt-generator ⭐⭐⭐⭐ - 智能PPT生成
  • pptx-generator ⭐⭐⭐ - JSON转PPTX
  • nanobanana-ppt-visualizer ⭐⭐⭐ - PPT视觉增强
  • ppt-roadshow-generator ⭐⭐ - PPT路演视频
  • remotion-video-enhancer ⭐⭐ - 视频转场动画

🎙️ 语音与音频(3个)

  • tts-voice-synthesis ⭐⭐⭐⭐⭐ - 智能语音合成
  • qwen3-tts-local ⭐⭐⭐⭐ - 本地语音合成(Edge-TTS)
  • qwen3-asr-assistant ⭐⭐⭐⭐ - 语音转文字

🤖 数字人与视频配音(5个)

  • infinitetalk ⭐⭐⭐⭐⭐ - 音频驱动视频配音
  • infinitetalk-shopping-avatar ⭐⭐ - 小省导购员提示词
  • digital-avatar-shopping-video ⭐⭐ - 数字人口播带货
  • dream-video-prompt-generator ⭐⭐ - 即梦视频提示词
  • agentkit-multimedia-shopping ⭐⭐ - 多媒体带货视频

📄 文档与分析(4个)

  • paper-analysis-assistant ⭐⭐⭐⭐ - arXiv论文分析
  • contract-review ⭐⭐⭐ - 合同审核
  • law-to-markdown ⭐⭐ - 法律文档转换
  • stock-analysis ⭐⭐⭐ - 股票个股分析

🤝 智能体协作(3个)

  • agent-team ⭐⭐⭐ - 智能体团队协作
  • multi-agent-meeting ⭐⭐ - 多智能体会议
  • peers-advisory-group ⭐⭐ - 同行顾问团

💼 产品与项目管理(2个)

  • product-manager-toolkit ⭐⭐⭐ - 产品经理工具包
  • sales-ai-assistant ⭐⭐ - 销售AI助手

🎨 设计与可视化(4个)

  • frontend-design ⭐⭐⭐ - 前端界面设计
  • ai-drawio ⭐⭐⭐⭐ - 流程图绘制
  • pop-up-book-illustration ⭐⭐ - 3D纸艺插画
  • web-to-app ⭐⭐ - 网页转桌面应用

📑 文档处理(4个 - 系统内置)

  • pptx ⭐⭐⭐⭐⭐ - PPT文件处理
  • xlsx ⭐⭐⭐⭐⭐ - Excel文件处理
  • pdf ⭐⭐⭐⭐⭐ - PDF文件处理
  • docx ⭐⭐⭐⭐⭐ - Word文件处理

🔧 技能管理(2个 - 系统内置)

  • find-skill ⭐⭐⭐ - 技能发现工具
  • skill-creator ⭐⭐⭐ - 技能创建工具

💰 财务分析(2个)

  • creating-financial-models ⭐⭐⭐⭐ - 财务建模套件
  • market-research-reports ⭐⭐⭐⭐ - 市场研究报告

🎭 文化创作(1个)

  • poetry-music-visual ⭐⭐ - 古诗词配图配乐

🚀 快速开始

1. 克隆仓库

git clone https://github.com/anbeime/skill.git
cd skill

2. 安装依赖

pip install -r requirements.txt

3. 运行更新

# 立即执行一次更新
python main.py --once

# 启动定时更新守护进程
python main.py --daemon

# 显示数据统计
python main.py --stats

# 导出为 CSV 格式
python main.py --export skills.csv

# 详细日志模式
python main.py --once -v

4. 浏览技能

访问 在线技能商店 或查看本地文件:

# 查看官方技能列表
cat data/skills.json

# 查看本地技能列表
cat data/local_skills.json

# 查看技能文档
ls docs/

💾 技能备份

备份位置

  • 主目录: D:\tool\skills\
  • 压缩备份: D:\tool\skills\skill压缩文件\(71个压缩包)
  • 备份覆盖率: 100%

备份说明

  • 所有本地技能均有对应压缩包
  • 系统内置技能(pptx、xlsx、pdf、docx、find-skill、skill-creator)无需压缩包
  • 包含backup标记的文件为历史版本备份

📖 文档

🛠️ 技能验证工具

内置技能验证工具,用于检查 SKILL.md 是否符合规范:

# 验证所有技能
python tools/skill_validator.py validate

# 验证单个技能
python tools/skill_validator.py validate skills/agent-team

# 读取技能属性
python tools/skill_validator.py read-properties skills/agent-team --json

# 生成 XML prompt(用于 AI 调用)
python tools/skill_validator.py to-prompt skills/agent-team

详见 工具文档。

📊 数据格式

skills.json(官方技能)

{
  "skills": [
    {
      "name": "组织名/技能名",
      "description": "技能描述",
      "link": "GitHub链接",
      "category": "分类名称",
      "source": "来源仓库",
      "crawled_at": "2026-02-02T17:07:33"
    }
  ],
  "total": 182,
  "updated_at": "2026-02-02T17:07:33"
}

local_skills.json(本地技能)

{
  "metadata": {
    "total_skills": 61,
    "core_skills": 25,
    "sub_skills": 30,
    "system_builtin": 6,
    "last_updated": "2026-02-11T15:30:00"
  },
  "categories": {
    "内容创作与发布": {...},
    "视频创作": {...},
    ...
  },
  "statistics": {
    "by_api_requirement": {
      "必需API": 15,
      "可选API": 20,
      "完全免费": 26
    }
  }
}

🎯 核心技能推荐

⭐⭐⭐⭐⭐ 五星技能(11个)

  1. content-creation-publisher - 内容创作与发布全流程
  2. intelligent-content-system - 智能内容系统
  3. video-creation-suite - 完整视频创作套件
  4. ecommerce-full-pipeline - 跨境电商全链路自动化(1688采集/上架/推广/视频/代发/爆品挖掘/闲鱼选品)
  5. NanoBanana-PPT-Skills - AI生成PPT
  6. tts-voice-synthesis - 智能语音合成
  7. infinitetalk - 音频驱动视频配音
  8. pptx - PPT文件处理(系统内置)
  9. xlsx - Excel文件处理(系统内置)
  10. pdf - PDF文件处理(系统内置)
  11. docx - Word文件处理(系统内置)

🔗 相关链接

🤝 贡献

欢迎提交 Issue 和 Pull Request!详见 贡献指南。

🤝 贡献你的技能

发现了好用的 AI Agent 技能?欢迎提交!

贡献者

感谢所有为这个项目做出贡献的伙伴:

Contributors

🌐 兄弟项目

📄 许可证

MIT License

🙏 致谢

📝 更新日志

v2.2 (2026-07-29)

  • ✨ 新增 ecommerce-full-pipeline 技能:跨境电商全链路自动化工具
  • 🛒 集成1688采集、数据清洗、多平台上架(微信小店/Shopify/TikTok)、推广方案、短视频创作、一键代发、爆品挖掘、闲鱼选品捡漏、全自动流水线
  • 📊 本地技能从61个增加到62个
  • 🏆 电商与营销分类从6个增加到7个

v2.1 (2026-07-28)

  • 🛠️ 新增技能验证工具 (tools/skill_validator/)
  • 📋 新增技能创建模板 (skills/_template/)
  • 📖 新增规范文档、最佳实践、快速入门
  • 📝 新增贡献指南 (CONTRIBUTING.md)
  • ✅ 验证工具支持双重嵌套目录结构
  • ⚠️ 非标准字段改为警告(兼容社区技能)

v2.0 (2026-02-11)

  • ✨ 新增12个本地技能
  • 📊 本地技能从49个增加到61个
  • 🏷️ 完善技能分类体系(14个分类)
  • 📦 更新技能管理数据库
  • 🔄 更新README和前端页面
  • 📝 添加技能清单文档
  • 🔍 保留182个官方技能数据

v1.0 (2026-02-09)

  • 🎉 初始版本发布
  • 📦 包含182个官方技能
  • 💾 包含49个本地技能
  • 🗂️ 建立技能仓库
  • 🤖 实现自动爬取功能

最后更新: 2026-02-11
维护者: anbeime
联系方式: GitHub Issues

📦 社区技能仓库聚合

此部分由自动化脚本每日从上游源同步更新

最后更新: 2026-08-04T04:52:59.949360 | 技能源总数: 161

数据来源

技能仓库列表

OpenAI Skills

VoltAgent Awesome Agent Skills

ClawHub (Skill Registry)

Latest commit: 87ca030

Packages

PackageDescription
clawhub-adminclawhub-admin package
clawhubCLI tool for managing skills
schemaShared API types and routes

CLI Commands

CLI

Common CLI flows:

  • Auth: clawhub login, clawhub whoami
  • Remote/headless auth: clawhub login --device
  • Discover: clawhub search ..., clawhub explore
  • Browse unified catalog (skills + plugins): clawhub package explore, clawhub package inspect <name>
  • Manage local installs: clawhub install @openclaw/demo, clawhub pin <skill>, clawhub unpin <skill>, clawhub uninstall <skill>, clawhub list, clawhub update --all
  • Inspect without installing: `clawhub inspect @op
数据与 AI

中风险

  • 来源需自行核对维护者身份。
  • 包含脚本或命令调用,安装前请复核。
  • 未检测到明显外部权限要求。
  • 未检测到高风险命令。
  • 扫描发现:2 条。

Codex — Git Clone 安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 克隆仓库:git clone https://github.com/anbeime/skill.git
  3. 将 "skills/video-creation-collaborator/video-creation-collaborator" 文件夹复制到 Codex 的 skills 目录中。
  4. 重启 Codex 让新的 skill 生效。

Codex — 手动复制安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 从源仓库下载 SKILL.md 及相关文件。
  3. 在 Codex 的 skills 目录中创建新文件夹。
  4. 将所有 skill 文件复制到新文件夹中。
  5. 重启 Codex 让新的 skill 生效。

Claude Code — Git Clone 安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 克隆仓库:git clone https://github.com/anbeime/skill.git
  3. 将 "skills/video-creation-collaborator/video-creation-collaborator" 文件夹复制到 Claude Code 的 skills 目录中。
  4. 重启 Claude Code 让新的 skill 生效。

Claude Code — 手动复制安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 从源仓库下载 SKILL.md 及相关文件。
  3. 在 Claude Code 的 skills 目录中创建新文件夹。
  4. 将所有 skill 文件复制到新文件夹中。
  5. 重启 Claude Code 让新的 skill 生效。

Cursor — Git Clone 安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 克隆仓库:git clone https://github.com/anbeime/skill.git
  3. 将 "skills/video-creation-collaborator/video-creation-collaborator" 文件夹复制到 Cursor 的 skills 目录中。
  4. 重启 Cursor 让新的 skill 生效。

Cursor — 手动复制安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 从源仓库下载 SKILL.md 及相关文件。
  3. 在 Cursor 的 skills 目录中创建新文件夹。
  4. 将所有 skill 文件复制到新文件夹中。
  5. 重启 Cursor 让新的 skill 生效。

GitHub Copilot — Git Clone 安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 克隆仓库:git clone https://github.com/anbeime/skill.git
  3. 将 "skills/video-creation-collaborator/video-creation-collaborator" 文件夹复制到 GitHub Copilot 的 skills 目录中。
  4. 重启 GitHub Copilot 让新的 skill 生效。

GitHub Copilot — 手动复制安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 从源仓库下载 SKILL.md 及相关文件。
  3. 在 GitHub Copilot 的 skills 目录中创建新文件夹。
  4. 将所有 skill 文件复制到新文件夹中。
  5. 重启 GitHub Copilot 让新的 skill 生效。

Windsurf — Git Clone 安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 克隆仓库:git clone https://github.com/anbeime/skill.git
  3. 将 "skills/video-creation-collaborator/video-creation-collaborator" 文件夹复制到 Windsurf 的 skills 目录中。
  4. 重启 Windsurf 让新的 skill 生效。

Windsurf — 手动复制安装

  1. 安装前请先查看来源仓库和风险报告。
  2. 从源仓库下载 SKILL.md 及相关文件。
  3. 在 Windsurf 的 skills 目录中创建新文件夹。
  4. 将所有 skill 文件复制到新文件夹中。
  5. 重启 Windsurf 让新的 skill 生效。
查看 SKILL.md 原文
name: video-creation-collaborator
description: 影品智创多智能体协同视频创作管理工具,提供11个智能体结构化分工、5阶段协同流程、质量管控标准与数据反馈机制,解决生图失真、视频合成瑕疵等问题,确保输出统一可控
dependency:
  python:
    - opencv-python>=4.8.0
    - pillow>=10.0.0
    - moviepy>=1.0.3
    - numpy>=1.24.0

影品智创 - 多智能体协同视频创作管理

任务目标

  • 本Skill用于: 规范化和指导10个智能体的协同创作流程,解决生图失真(多肢体/畸形)、视频合成瑕疵等问题
  • 能力包含:
    • 11个智能体结构化分工(文案创作/故事策划/脚本创作/分镜导演/分镜画师/字幕师/配音师/音效师/视频工程师/质检/数据反馈)
    • 5阶段协同流程管理(需求承接→内容创作→生图创作→音频字幕→视频合成→全流程质检→数据迭代)
    • 质量管控与闭环反馈(前置质检拦截、数据沉淀迭代)
    • 素材生成支持(图片/音频/字幕/音乐)
    • 技术检测工具支持(图片质量、视频质量、音画同步)
  • 触发条件: 用户需要进行短视频创作,或需要规范化多智能体协同流程

前置准备

  • 依赖说明:
    opencv-python>=4.8.0
    pillow>=10.0.0
    moviepy>=1.0.3
    numpy>=1.24.0
    
  • 非标准文件/文件夹准备:
    # 创建工作目录
    mkdir -p ./input/{materials,scripts}
    mkdir -p ./output/{drafts,storyboards,final}
    mkdir -p ./cache/{images,audio}
    

操作步骤

标准流程(5个阶段,10个智能体)

第一阶段: 需求承接与内容框架搭建

触发节点: 用户输入核心需求(商品信息+视频需求)

步骤1: 文案创作师智能体(首节点)

  • 职责: 基于商品信息提炼核心卖点,生成适配短视频的文案
  • 输入: 商品品类、核心卖点、目标受众、视频风格、时长
  • 输出:
    • 核心Slogan(8-12字,简洁有力)
    • 分镜适配文案(3-5句,每句4-8字)
  • 质量标准: 无歧义、无夸大,贴合视频调性
  • 下一级触发: 立即触发【故事策划师】、【字幕师】(暂存)

步骤2: 故事策划师智能体

  • 职责: 基于卖点、文案,设计适配短视频时长的场景化故事线
  • 输入: Slogan、分镜文案、商品信息、视频时长、风格
  • 输出:
    • 场景化故事线(镜头拆分、场景/动作标注)
    • 镜头数量(30秒8-10个、45秒12-15个、60秒15-18个)
  • 质量标准: 逻辑连贯,时长严格匹配,无无关场景
  • 下一级触发: 立即触发【脚本创作师】

步骤3: 脚本创作师智能体

  • 职责: 将故事线转化为标准化、可执行的分镜脚本
  • 输入: 故事线、文案、视频时长、分辨率、比例
  • 输出:
    • 标准化分镜脚本(镜头序号、时长、场景描述、画面动作、文案、音效备注)
    • 画面动作描述(明确人体肢体姿态,规避模糊表述)
  • 质量标准: 时长精准分配,画面动作具体,格式统一
  • 下一级触发: 立即触发【分镜导演】、【分镜画师】、【字幕师】、【音效师】

第二阶段: 视觉内容创作与质检

触发节点: 分镜脚本确认

步骤4: 分镜导演智能体

  • 职责: 规划每个镜头的画面细节、光影、构图,为分镜画师提供精准依据
  • 输入: 分镜脚本、商品细节图(如有)、视频风格
  • 输出:
    • 镜头画面规范(构图/光影/色调/肢体规范/商品细节)
    • 负面规避清单(禁止多余肢体、畸形、虚化等)
  • 质量标准: 构图清晰,光影均匀,肢体规范,商品细节明确
  • 下一级触发: 立即触发【分镜画师】

步骤5: 分镜画师智能体

  • 职责: 基于画面规范,生成高质量、无瑕疵的分镜图片
  • 输入: 画面描述、分镜脚本、商品信息
  • 输出: 1080P合格分镜图片(单张对应单个镜头,命名规范)
  • 质量标准:
    • 人体结构正常(无多余肢体/畸形/重影)
    • 商品细节精准(无变形/模糊)
    • 画质细腻(1080P,无颗粒感)
  • 负面规避: 禁止多余肢体、手部畸形、商品变形、画面噪点等
  • 下一级触发:
    • 图片生成后,触发【视频工程师】素材预处理
    • 同时触发【质检智能体】分镜图片专项质检

第三阶段: 音频字幕创作(并行执行)

触发节点: 分镜脚本确认(可并行启动,无需等待视觉内容)

步骤6: 配音师智能体

  • 职责: 根据分镜文案生成高质量旁白/配音
  • 输入: 分镜文案、视频风格、情感基调
  • 输出:
    • 旁白文本(与分镜文案对应,可适当口语化)
    • 音色建议(活力男声/专业女声/稳重男声/亲切女声等)
    • 语速要求(中等/稍快/稍慢)
    • 情感标注(积极/专业/沉稳/亲切等)
  • 质量标准: 语音自然流畅,情感贴合场景,无明显机械感
  • 下一级触发: 输出同步至【音效师】,调用audio_generator.py生成音频文件

步骤7: 字幕师智能体

  • 职责: 创作适配画面的字幕,确保显示效果与可读性
  • 输入: 分镜文案、分镜脚本、视频风格、画面比例
  • 输出:
    • 字幕信息包(文本+对应镜头时长+叠加位置)
    • 格式规范(字体/字号/颜色/位置)
  • 质量标准: 无错别字,字数适配(每秒1-2字),避开商品主体
  • 下一级触发: 输出同步至【视频工程师】

步骤8: 音效师智能体

  • 职责: 推荐适配的背景音乐与场景音效,确保音画协调
  • 输入: 分镜脚本、视频风格、时长、核心场景
  • 输出:
    • 音效方案包(背景音乐+场景音效+时间节点+音量参数)
    • 音效名称、风格描述、时长、音量建议
  • 质量标准: 风格贴合,节奏匹配,音量适中,无版权问题
  • 下一级触发: 输出同步至【视频工程师】

第四阶段: 视频合成与成品质检

触发节点: 分镜图片质检合格

步骤9: 视频工程师智能体

  • 职责: 基于各智能体输出素材,完成高质量视频合成
  • 输入: 合格分镜图片、字幕信息、音效方案
  • 输出: 合成后的MP4成品视频
  • 质量标准:
    • 素材预处理(调用质量检测脚本,识别瑕疵)
    • 合成参数(1080P, 25fps, 8Mbps,无黑边/卡顿)
    • 转场效果(淡入淡出,0.3-0.5秒,过渡自然)
    • 音画同步(音频偏移≤0.1秒)
  • 下一级触发: 成品输出后立即触发【质检智能体】

步骤10: 质检智能体(全流程穿插)

  • 职责: 对各智能体输出物进行全环节质检,拦截瑕疵,推动整改
  • 输入: 各环节输出物、质量标准、负面规避清单
  • 输出:
    • 分环节质检报告(合格/不合格,瑕疵类型,整改建议)
    • 质检台账(瑕疵数据、整改结果、合格率)
  • 质检维度:
    • 内容层(文案/故事线/脚本/字幕)
    • 视觉层(分镜图片/成品视频)
    • 音频层(背景音乐/音效/音画同步)
    • 格式层(比例/脚本格式/视频参数)
  • 处理规则:
    • 轻微瑕疵(文案语序微调)→直接反馈优化
    • 重大瑕疵(多肢体/画面撕裂)→拦截输出,要求重制
    • 前置质检→分镜图片/成品视频强制质检,不合格驳回
  • 下一级触发:
    • 不合格→触发对应智能体重做
    • 合格→触发【数据反馈智能体】

第五阶段: 数据沉淀与迭代优化

触发节点: 全流程质检合格

步骤11: 数据反馈智能体

  • 职责: 收集分析全流程数据,输出迭代建议,优化智能体提示词与协同逻辑
  • 输入: 质检台账、创作耗时数据、用户反馈
  • 输出:
    • 数据统计报告(合格率、高频瑕疵、创作耗时、整改率)
    • 迭代优化建议(针对高频瑕疵优化提示词、调整协同流程)
    • 数据沉淀(瑕疵类型-优化方案-效果验证闭环)
  • 分析维度:
    • 瑕疵分析(TOP3高频瑕疵,定位根因)
    • 效率分析(识别流程瓶颈)
    • 优化效果(验证迭代有效性)
  • 下一级触发: 输出同步至技能开发端,更新智能体配置,完成迭代闭环

并行协同与闭环管控

并行执行

  • 字幕师、音效师可在脚本创作师输出分镜脚本后并行启动,无需等待视觉内容完成
  • 效率提升: 减少等待时间,整体创作周期缩短

闭环管控

  • 所有输出物需经质检智能体校验合格后方可进入下一环节
  • 重大瑕疵直接拦截,避免问题流转
  • 跟踪整改结果,确保100%解决

迭代联动

  • 数据反馈智能体的优化建议直接作用于各智能体底层配置
  • **形成"创作-质检-优化"**持续迭代机制

质量检测工具使用

图片质量检测

# 调用图片质量检测脚本
python scripts/image_quality_checker.py --image ./cache/images/shot_001.jpg --resolution 1920x1080

检测维度:

  • 肢体异常(多余肢体/畸形/重影)
  • 画面质量(模糊/噪点/变形)
  • 商品细节(纹理/轮廓/按键)
  • 分辨率/比例

视频质量检测

# 调用视频质量检测脚本
python scripts/video_quality_checker.py --video ./output/final/video.mp4 --resolution 1920x1080 --duration 30 --fps 25

检测维度:

  • 分辨率/时长/帧率/码率
  • 画面质量(卡顿/撕裂/转场瑕疵)
  • 音频质量(清晰度/杂音)
  • 音画同步(偏移≤0.1秒)
  • 字幕遮挡检测

素材生成与视频合成流程

素材生成流程

1. 图片素材生成

触发时机: 分镜画师智能体完成画面设计后

执行步骤:

# 准备分镜脚本JSON文件
cat > ./scripts/storyboard.json << 'EOF'
{
  "shots": [
    {
      "shot_id": "L01",
      "description": "智能手表特写,手指滑动屏幕",
      "duration": 3.0,
      "resolution": "1920x1080"
    }
  ],
  "style": "科技风,冷色调,清晰锐利"
}
EOF

# 调用图片生成脚本
python scripts/image_generator.py \
  --storyboard ./scripts/storyboard.json \
  --output ./output/images \
  --style "科技风,冷色调"

输出规范:

  • 路径: ./output/images/shot_{shot_id}.jpg
  • 格式: JPG, 1080P (1920x1080)
  • 质量要求: 无肢体异常,商品细节清晰,画质细腻

参考: references/asset-specifications.md - 图片素材规范

2. 音频素材生成

触发时机: 配音师智能体完成旁白文本,音效师智能体完成音效方案后

执行步骤:

# 生成旁白音频
python scripts/audio_generator.py \
  --mode narration \
  --text "腕上未来,触手可及" \
  --voice "professional_male" \
  --output ./output/audio/narration_S01.wav

# 生成背景音乐
python scripts/music_generator.py \
  --style "科技风,轻快" \
  --duration 30 \
  --output ./output/audio/background_music.wav

# 混合音频(旁白+背景+音效)
python scripts/audio_generator.py \
  --mode mix \
  --narration ./output/audio/narration_S01.wav \
  --background ./output/audio/background_music.wav \
  --effects ./output/audio/sound_effects/ \
  --output ./output/audio/merged_audio.wav

输出规范:

  • 路径: ./output/audio/
  • 格式: WAV (44.1kHz, 16bit/24bit)
  • 质量要求: 无杂音,音量平衡,音质清晰

参考: references/asset-specifications.md - 音频素材规范

3. 字幕素材生成

触发时机: 字幕师智能体完成字幕设计后

执行步骤:

# 准备分镜脚本
cat > ./scripts/storyboard.json << 'EOF'
{
  "shots": [
    {
      "shot_id": "L01",
      "duration": 3.0,
      "text": "腕上未来"
    },
    {
      "shot_id": "L02",
      "duration": 3.0,
      "text": "触手可及"
    }
  ]
}
EOF

# 生成SRT字幕
python scripts/subtitle_generator.py \
  --storyboard ./scripts/storyboard.json \
  --format srt \
  --output ./output/subtitles/subtitle.srt

输出规范:

  • 路径: ./output/subtitles/subtitle.srt 或 .ass
  • 格式: SRT/ASS (UTF-8编码)
  • 质量要求: 无错别字,字数适配,位置无遮挡

参考: references/asset-specifications.md - 字幕素材规范

视频合成流程

触发时机: 所有素材(图片/音频/字幕)准备完成并质检合格后

执行步骤:

# 准备项目配置
cat > ./scripts/project_config.json << 'EOF'
{
  "images_dir": "./output/images",
  "audio_file": "./output/audio/merged_audio.wav",
  "subtitle_file": "./output/subtitles/subtitle.srt",
  "shots": [
    {
      "shot_id": "L01",
      "duration": 3.0,
      "transition": "fade"
    },
    {
      "shot_id": "L02",
      "duration": 3.0,
      "transition": "cut"
    }
  ],
  "width": 1920,
  "height": 1080,
  "fps": 25,
  "duration": 30,
  "bitrate": "8000k"
}
EOF

# 验证项目配置
python scripts/video_compositor.py \
  --config ./scripts/project_config.json \
  --output ./output/temp/validate.mp4 \
  --validate_only

# 合成最终视频
python scripts/video_compositor.py \
  --config ./scripts/project_config.json \
  --output ./output/final/final_video_$(date +%Y%m%d).mp4

输出规范:

  • 路径: ./output/final/final_video_{日期}.mp4
  • 格式: MP4 (H.264编码)
  • 参数: 1080P, 25fps, 8Mbps
  • 质量要求: 无卡顿,音画同步≤0.1秒,字幕同步无延迟

参考: references/asset-specifications.md - 视频输出规范

质量检测流程

1. 图片质量检测

python scripts/image_quality_checker.py \
  --image ./output/images/shot_L01.jpg \
  --resolution 1920x1080 \
  --check_limb_anomaly \
  --check_blur \
  --check_deformation

2. 音频质量检测

python scripts/audio_quality_checker.py \
  --audio ./output/audio/narration_S01.wav \
  --sample_rate 44100 \
  --check_noise

3. 视频质量检测

python scripts/video_quality_checker.py \
  --video ./output/final/final_video_20240122.mp4 \
  --resolution 1920x1080 \
  --duration 30 \
  --fps 25 \
  --check_sync

参考: references/quality-standards.md - 质检标准

资源索引

注意事项

  • 智能体协同: 严格按照11个智能体的触发顺序和协同规则执行
  • 素材规范: 所有素材生成必须遵循asset-specifications.md中的规范
  • 视频合成: 合成前必须确保所有素材(图片/音频/字幕)就位并质检合格
  • 质量优先: 所有输出物必须经质检智能体校验,重大瑕疵直接拦截
  • 闭环迭代: 数据反馈智能体的优化建议必须应用于下一轮创作
  • 技术检测: 视频合成前必须调用质量检测脚本,素材不合格不得合成
  • 数据沉淀: 质检台账和创作数据必须完整记录,用于迭代优化

使用示例

示例1:完整创作流程

# 用户请求: "为智能手表创作30秒短视频,科技风,目标年轻人"

# 智能体执行流程:
1. 文案创作师: 输出Slogan "腕上未来,触手可及" + 分镜文案
2. 故事策划师: 输出9个镜头的故事线
3. 脚本创作师: 输出标准化分镜脚本(时长、场景、动作、文案)
4. 分镜导演: 输出9个镜头的画面规范 + 负面规避清单
5. 分镜画师: 生成9张1080P分镜图片(调用质量检测脚本)
6. 字幕师: 输出字幕信息包(并行执行)
7. 音效师: 输出音效方案包(并行执行)
8. 质检智能体: 检测分镜图片,发现第3张图片肢体异常,反馈分镜画师重绘
9. 分镜画师: 重新生成第3张图片,质检合格
10. 视频工程师: 合成视频(调用视频质量检测脚本)
11. 质检智能体: 检测成品视频,音画同步0.08秒,合格
12. 数据反馈: 输出数据统计报告 + 迭代建议

示例2:图片质量检测

from scripts.image_quality_checker import check_image_quality

result = check_image_quality(
    image_path="./cache/images/shot_003.jpg",
    expected_resolution=(1920, 1080),
    check_limb_anomaly=True,
    check_blur=True,
    check_deformation=True
)

if not result['overall']:
    print(f"发现瑕疵: {result['issues']}")
    # 触发分镜画师重绘
else:
    print("图片质量合格,可用于合成")

示例3:质检闭环示例

质检智能体检测:
- 分镜图片: 合格率92%(10张图片,8张合格,1张轻微瑕疵,1张重大瑕疵)
  - 重大瑕疵: shot_007.jpg 发现多余肢体,驳回分镜画师重绘
  - 轻微瑕疵: shot_003.jpg 轻微模糊,反馈优化

成品视频: 合格
- 分辨率: 1920x1080 ✓
- 帧率: 25fps ✓
- 音画同步: 0.08秒 ✓
- 字幕遮挡: 无 ✓

数据反馈智能体:
- 高频瑕疵TOP3: 
  1. 肢体异常(占比8%) → 优化分镜导演/画师提示词
  2. 轻微模糊(占比6%) → 调整画质标准
  3. 字幕位置偏差(占比4%) → 优化字幕师模板
- 效率瓶颈: 分镜画师重绘耗时过长 → 调整前置质检规则

发现问题?提交给管理员复核

评分:

评论 (0)

暂无评论,成为第一个评论者吧!