vlogme.ai

VlogMe / AI 视频制作指南

AI 视频制作教程 — 从创意、脚本到完整视频导出。

用 AI 制作视频的完整流程:向 AI 导演说明需求,确认脚本与分镜,选择生成模型,加入数字人、配音、音乐和字幕,最后导出一条可发布的视频。 需要开发集成?查看 API 与 MCP 文档 →

AI 视频制作流程

需求

目标、受众与视频格式

01

方案

确认脚本和分镜

02

生成

画面、数字人与声音

03

编辑

节奏、音乐与字幕

04

导出

下载完整视频

05
先确认完整方案
9 个实用章节
无需专业剪辑经验
09共 9 章 — 点击跳转
  1. 01VlogMe 可以制作什么 AI 视频
  2. 02套餐、积分与生成费用
  3. 03向 AI 导演说明视频需求
  4. 04确认脚本与分镜方案
  5. 05准备图片、视频和人物参考
  6. 06为每个任务选择合适的 AI 视频生成模型
  7. 07只修改有问题的场景
  8. 08添加配音、音乐、音效和字幕
  9. 09检查、导出并发布完整视频
01
产品能力

VlogMe 可以制作什么 AI 视频

VlogMe 规划并制作多场景完整视频,而不是只生成一个孤立的 AI 短片。

从一个创意、商品、素材视频或一组图片开始。AI 导演会补充询问关键信息,提出脚本方案,并把确认后的方案拆分成多个场景。

一个项目可以组合 AI 生成镜头、上传素材、口播数字人、旁白、音乐、音效和字幕。生成前先确认方案,不满意时只需重做对应场景。

  • 适合 Reels、TikTok、Shorts 的竖屏短视频。
  • 商品广告、解说视频、电影感故事和社交媒体营销内容。
  • 口播人物与动物、数字人主持、唱歌、跳舞和动作迁移。
  • 在同一流程中制作竖屏、横屏和方形视频。
02
账户

套餐、积分与生成费用

费用取决于模型、时长和操作类型,VlogMe 会在生成前显示预计积分。

Top 模型会公开展示以便比较,实际使用权限取决于套餐。成本较低的 Fast 和兼容性用途的 Additional 仍保留在 Studio 中,并默认折叠。

提交前请查看 Generate 按钮旁的费用预估。若服务商接单后任务失败,界面会显示原因,并按退款规则返还符合条件的积分。

  • 切换模型会影响质量、速度和积分消耗。
  • 从模型介绍页选择的模型会在 Studio 中保持选中。
  • 服务故障时,不会悄悄替换用户明确选择的模型品牌。
  • 最新套餐与积分规则以价格页面为准。
03
快速开始

向 AI 导演说明视频需求

有效的需求应说明结果、受众、格式与限制,不必逐个规定镜头运动。

打开 Create,说明成片需要达到什么目的。写清发布平台、预计时长、目标人群、语气、行动号召,以及不可改动的事实。

如果商品图、品牌参考、素材视频或人物照片很重要,请直接上传。聊天会用它们准备创意方案,开始时无需先决定技术模型。

  • 模糊需求:“做一个很酷的商品视频。”
  • 清晰需求:“制作 20 秒竖屏护肤广告,面向 25–40 岁女性,安静高级,三个包装特写,结尾引导试用。”
  • 价格、名称、合规表述与画面文字应准确提供。
  • 明确不可改变的元素:Logo、包装、人物、语言或配色。
04
导演方案

确认脚本与分镜方案

先确保故事、旁白和画面节奏相互配合,再开始消耗积分生成素材。

检查开头吸引点、场景顺序、台词、画面文字和结尾。任何多余内容都可以在生成前让 AI 导演缩短、调整或重写。

完整视频不仅取决于单个提示词,还取决于场景之间的衔接。好的方案会变化景别与节奏,同时保持人物、商品和核心信息一致。

  • 生成配音前确认读音、语言与人名。
  • 画面文字要足够短,确保手机上清晰可读。
  • 每个场景都应有明确作用。
  • 不要指望偶然的好画面补救薄弱脚本。
05
参考素材

准备图片、视频和人物参考

清晰素材能提升商品还原、数字人质量和跨场景一致性。

使用主体清楚、光线均匀的高清图片。商品应提供多个角度和无遮挡 Logo;人物或数字人适合使用正面照片,避免重度滤镜和多人同框。

上传素材可保存在 Library 中重复使用。如需适配多个画面比例,请保留原始文件。

  • 避免主体过小、运动模糊和压缩严重的截图。
  • 需要保持人物身份时,使用风格一致的参考图。
  • 只有精确局部重绘或替换区域时才需要蒙版。
  • 确认素材授权,并获得可识别人物与声音所需的同意。
06
生成模型

为每个任务选择合适的 AI 视频生成模型

Top 模型各有优势,可分别覆盖写实、广告质感、动作控制、视频编辑、AI 图片和数字人。

在 Create 中可以由 VlogMe 分配场景模型;Video Studio 和 Image Studio 支持直接选择。OpenAI 与 Gemini 的能力优先通过官方 API 直连,其他模型则按需使用 Replicate 或 fal。

Top 分组始终展开,Fast 与 Additional 默认折叠以保持界面清晰;旧项目和明确选择的兼容模型仍能正确打开。

  • 在模型页面比较优势、输入要求、限制和积分预估。
  • 服务故障时保持当前选择,或主动改用建议的 Top 替代模型。
  • 只修改局部时使用 AI 图片编辑,不要整张重新生成。
  • 大型项目开始前,先用短场景测试人物、文字和动作。
07
剪辑

只修改有问题的场景

可以单独重新生成镜头、替换素材、调整节奏或改写一句台词,无需重做整个项目。

在时间线上观看完整序列。单独看很惊艳的片段也可能破坏叙事,因此要检查节奏、连续性,以及旁白与画面的配合。

保留成功场景,只重做不符合需求的部分。如果现有视频可直接修改,则使用合适的 AI 视频编辑流程。

  • 前两秒是否立即说明视频主题。
  • 交替使用全景、中景与特写,避免单调。
  • 为字幕和平台裁切保留安全区域。
  • 最终渲染前完整预览时间线。
08
声音

添加配音、音乐、音效和字幕

高质量 AI 视频不仅需要好画面,也需要有设计的声音和易读字幕。

根据人物、市场和节奏选择声音。VlogMe 的主要配音与音效流程使用 ElevenLabs。旁白下方加入获得授权的音乐,并用音效强调重要动作。

口播稳定后再生成字幕。手动检查人名、品牌、数字和标点,并在手机尺寸预览中检查对比度与行长。

  • 音乐不要盖过人声,也不要在场景边界突然中断。
  • 只有画面中出现说话者时才需要口型同步或口播数字人。
  • 面向不同市场时,应本地化表达方式,而不只是翻译字幕。
  • 未经必要授权和同意,不要克隆他人声音。
09
发布

检查、导出并发布完整视频

打开声音从头到尾观看,并检查最终真正要上传的文件。

检查文字、事实、人物面部与手部、Logo、商品细节、口型、字幕时间和音量。开头与结尾画面也要按静态封面单独检查。

按发布平台需要的比例导出。保存项目和源素材,即可继续制作不同语言或不同平台版本,无需从头开始。

  • 9:16 — 适合大多数 Reels、TikTok 与 Shorts。
  • 16:9 — 适合 YouTube、演示文稿与横屏广告。
  • 1:1 — 适合方形信息流广告位。
  • 生成失败时先读取状态,再决定重试原模型或明确选择替代模型。