09共 9 章 — 点击跳转
VlogMe 可以制作什么 AI 视频
VlogMe 规划并制作多场景完整视频,而不是只生成一个孤立的 AI 短片。
从一个创意、商品、素材视频或一组图片开始。AI 导演会补充询问关键信息,提出脚本方案,并把确认后的方案拆分成多个场景。
一个项目可以组合 AI 生成镜头、上传素材、口播数字人、旁白、音乐、音效和字幕。生成前先确认方案,不满意时只需重做对应场景。
- 适合 Reels、TikTok、Shorts 的竖屏短视频。
- 商品广告、解说视频、电影感故事和社交媒体营销内容。
- 口播人物与动物、数字人主持、唱歌、跳舞和动作迁移。
- 在同一流程中制作竖屏、横屏和方形视频。
套餐、积分与生成费用
费用取决于模型、时长和操作类型,VlogMe 会在生成前显示预计积分。
Top 模型会公开展示以便比较,实际使用权限取决于套餐。成本较低的 Fast 和兼容性用途的 Additional 仍保留在 Studio 中,并默认折叠。
提交前请查看 Generate 按钮旁的费用预估。若服务商接单后任务失败,界面会显示原因,并按退款规则返还符合条件的积分。
- 切换模型会影响质量、速度和积分消耗。
- 从模型介绍页选择的模型会在 Studio 中保持选中。
- 服务故障时,不会悄悄替换用户明确选择的模型品牌。
- 最新套餐与积分规则以价格页面为准。
向 AI 导演说明视频需求
有效的需求应说明结果、受众、格式与限制,不必逐个规定镜头运动。
打开 Create,说明成片需要达到什么目的。写清发布平台、预计时长、目标人群、语气、行动号召,以及不可改动的事实。
如果商品图、品牌参考、素材视频或人物照片很重要,请直接上传。聊天会用它们准备创意方案,开始时无需先决定技术模型。
- 模糊需求:“做一个很酷的商品视频。”
- 清晰需求:“制作 20 秒竖屏护肤广告,面向 25–40 岁女性,安静高级,三个包装特写,结尾引导试用。”
- 价格、名称、合规表述与画面文字应准确提供。
- 明确不可改变的元素:Logo、包装、人物、语言或配色。
确认脚本与分镜方案
先确保故事、旁白和画面节奏相互配合,再开始消耗积分生成素材。
检查开头吸引点、场景顺序、台词、画面文字和结尾。任何多余内容都可以在生成前让 AI 导演缩短、调整或重写。
完整视频不仅取决于单个提示词,还取决于场景之间的衔接。好的方案会变化景别与节奏,同时保持人物、商品和核心信息一致。
- 生成配音前确认读音、语言与人名。
- 画面文字要足够短,确保手机上清晰可读。
- 每个场景都应有明确作用。
- 不要指望偶然的好画面补救薄弱脚本。
准备图片、视频和人物参考
清晰素材能提升商品还原、数字人质量和跨场景一致性。
使用主体清楚、光线均匀的高清图片。商品应提供多个角度和无遮挡 Logo;人物或数字人适合使用正面照片,避免重度滤镜和多人同框。
上传素材可保存在 Library 中重复使用。如需适配多个画面比例,请保留原始文件。
- 避免主体过小、运动模糊和压缩严重的截图。
- 需要保持人物身份时,使用风格一致的参考图。
- 只有精确局部重绘或替换区域时才需要蒙版。
- 确认素材授权,并获得可识别人物与声音所需的同意。
为每个任务选择合适的 AI 视频生成模型
Top 模型各有优势,可分别覆盖写实、广告质感、动作控制、视频编辑、AI 图片和数字人。
在 Create 中可以由 VlogMe 分配场景模型;Video Studio 和 Image Studio 支持直接选择。OpenAI 与 Gemini 的能力优先通过官方 API 直连,其他模型则按需使用 Replicate 或 fal。
Top 分组始终展开,Fast 与 Additional 默认折叠以保持界面清晰;旧项目和明确选择的兼容模型仍能正确打开。
- 在模型页面比较优势、输入要求、限制和积分预估。
- 服务故障时保持当前选择,或主动改用建议的 Top 替代模型。
- 只修改局部时使用 AI 图片编辑,不要整张重新生成。
- 大型项目开始前,先用短场景测试人物、文字和动作。
只修改有问题的场景
可以单独重新生成镜头、替换素材、调整节奏或改写一句台词,无需重做整个项目。
在时间线上观看完整序列。单独看很惊艳的片段也可能破坏叙事,因此要检查节奏、连续性,以及旁白与画面的配合。
保留成功场景,只重做不符合需求的部分。如果现有视频可直接修改,则使用合适的 AI 视频编辑流程。
- 前两秒是否立即说明视频主题。
- 交替使用全景、中景与特写,避免单调。
- 为字幕和平台裁切保留安全区域。
- 最终渲染前完整预览时间线。
添加配音、音乐、音效和字幕
高质量 AI 视频不仅需要好画面,也需要有设计的声音和易读字幕。
根据人物、市场和节奏选择声音。VlogMe 的主要配音与音效流程使用 ElevenLabs。旁白下方加入获得授权的音乐,并用音效强调重要动作。
口播稳定后再生成字幕。手动检查人名、品牌、数字和标点,并在手机尺寸预览中检查对比度与行长。
- 音乐不要盖过人声,也不要在场景边界突然中断。
- 只有画面中出现说话者时才需要口型同步或口播数字人。
- 面向不同市场时,应本地化表达方式,而不只是翻译字幕。
- 未经必要授权和同意,不要克隆他人声音。
检查、导出并发布完整视频
打开声音从头到尾观看,并检查最终真正要上传的文件。
检查文字、事实、人物面部与手部、Logo、商品细节、口型、字幕时间和音量。开头与结尾画面也要按静态封面单独检查。
按发布平台需要的比例导出。保存项目和源素材,即可继续制作不同语言或不同平台版本,无需从头开始。
- 9:16 — 适合大多数 Reels、TikTok 与 Shorts。
- 16:9 — 适合 YouTube、演示文稿与横屏广告。
- 1:1 — 适合方形信息流广告位。
- 生成失败时先读取状态,再决定重试原模型或明确选择替代模型。
