1连接
登录一次即可连接,适用于任何 MCP 客户端。各客户端的具体步骤见「连接」页面。
2Claude 技能包
连接为 Claude 提供工具,技能包提供工具之间的判断力。
技能包不增加任何能力 — 工具相同、模型相同。它改变的是达成结果需要多少次尝试:生成前该问什么、如何规划多步制作、何时该修正而不是直接交付。更少重复生成,更少浪费积分。
下载技能包ZIP · 12KB · 免费
Claude Code解压到技能目录 — 个人目录(所有项目)或某个项目内。之后重启 Claude。
claude.ai / Desktop设置 → Capabilities → Skills → Upload skill,直接选择下载的 ZIP — 无需解压。
Codex 及其他客户端没有技能机制 — 将 SKILL.md 的内容粘贴到项目指令文件中(AGENTS.md 或同类文件)。
验证是否生效:让它「为我的品牌做一个 Instagram 帖子和一个 Story」。生效 — Claude 会先询问品牌、确切文案和平台,然后产出一个母版并适配到第二个尺寸。未生效 — 它会立刻生成两张独立的图。
这是本地副本,不会自动更新。技能包会指示 Claude 调用 list_video_models 等工具获取实时列表,因此不会悄悄过时 — 但有新能力发布时建议重新下载。
3固定工作流
从简报到交付,正确的工作方式。
角色 — 一次创建,永久锁定
精确的角色设计通过 create_character 作为参考上传,像素级保存。每张图片和视频都保持一致身份。
品牌资产
需要还不存在的 logo?Claude 会向你索取,用 create_asset 保存,并在未来每次创作中精确使用。
先 Master 再适配
一个确认的 master → adapt_image_size 在每个比例精确复制设计。绝不按尺寸重新生成。
视频 — 生成前先咨询
Claude 提供 2–3 个模型 + 技术方案及权衡 — 由你选择。逐模型稳定层自动应用。
完整声音
配音(支持角色声音!)、音乐、带歌词的歌曲和音效 — 然后 add_audio_to_video 为任何片段配乐。
质量关
文字精确?身份保持?无瑕疵?修到通过为止。绝不交付"差不多"。
4视频模型
随时通过 list_video_models 获取 — 含实时价格。
| 模型 | 最擅长 | 时长 | 能力 | 积分 / 5秒 |
|---|---|---|---|---|
| Veo 3.1 | 电影级画质,同步对白与音效 | 4/6/8s | 音频 尾帧 | 34 |
| Seedance 2.0 | 最佳角色一致性,多镜头,吉祥物 | 4–15s | 尾帧 | 200 |
| Kling v3 | 角色动作表现力强,最多6个镜头 | 4–15s | 音频 尾帧 | 57 |
| Hailuo 2 Pro | 物理效果,[Push in] 镜头控制 | 6s | 尾帧 | 64 |
| Runway Gen-4.5 | 单场景稳定可靠 | 5/10s | 80 | |
| PixVerse 4.5 | 风格化/动漫,20+种运镜 | 5/8s | 27 | |
| Wan I2V | 忠实图像动画,经济实惠 | ~5s | 54 | |
| Luma Modify | 重塑现有视频风格 (V2V) | — | 74 |
5声音模型
通过 list_audio_models 获取。已选择角色?配音将以其声音说话。
| 模型 | 类别 | 最擅长 |
|---|---|---|
| Gemini Voice | 配音 | 快速、多语言、角色配音 |
| ElevenLabs v3 | 配音 | 最自然 — 广告与预告片 |
| MiniMax Speech | 配音 | 300+音色,30+语言 |
| Lyria 2 | 音乐 | Google,48kHz,负向提示 |
| Stable Audio 2.5 | 音乐 | 单次生成最长约3分钟 |
| ACE-Step | 音乐 | 草稿与循环 — 最便宜 |
| MiniMax Music | 歌曲 | 带人声歌曲 — [Verse]/[Chorus] |
| ElevenLabs SFX | 音效 | 文本生成音效 |
6高级技术
关键帧插值首帧 + 尾帧 → endImageUrl — 模型在两帧之间精确动画。
Subject Lock将设计锁定到首帧 — 不长出新肢体、不变形。
Reference-to-Video最多 9 张参考图,以 @Image1..@Image9 引用 — 完全一致。
长内容链式 extend_video(4/6/8秒)突破任何单模型时长限制。
配乐add_audio_to_video — loop 铺音乐、fit 配旁白、trim 配音效。
会说话的角色generate_voiceover 用角色声音 → lipsync_video 同步口型。