描述
VlogMe.AI 是一个完整的 AI 视频创作平台,旨在制作完整的视频而非孤立的片段。其核心创建工作流程使用 AI 导演:用户通过文本、语音、图像、肖像或现有音轨向其简要说明,导演准备可审核的脚本和可编辑的场景计划以供批准,只有在此之后,才会生成并组装镜头、头像、声音、音乐、字幕和效果,形成一部完整的视频。
该平台分为多个工作室。视频工作室提供八种工作流程,包括图像转视频、文本转视频、起始和结束画面、会说话的头像、视频风格重塑、放大器、口型同步和复制运动,支持一系列顶级模型,如 Gemini Omni、Seedance、Kling、Veo 和 Grok Imagine。图像工作室结合生成和完整的照片编辑器,而音频工作室提供多语言文本转语音、基于权限的声音克隆、声音变换、ElevenLabs 音效、授权音乐上传、转录和字幕准备,支持 30 多种语言。一个私人实验室存储并允许用户重用和重新创建所有生成的资产,而趋势功能可以将新闻故事转化为自动发布的视频。
VlogMe 使用信用系统,大约一个信用等于一秒的头像视频,并在每次生成之前显示成本估算。计划从带水印的 720p 免费层到基本、Plus、Pro 和商业层,后者增加更高的分辨率、优先队列、自定义声音克隆和更多的每月信用。REST API 和 MCP 端点允许开发者和 AI 代理以编程方式驱动视频和会说话的头像工作流程,企业 AI 直播设置可作为定制服务提供。
VlogMe的核心功能
AI 导演生成经过批准的脚本和可编辑的场景计划
多场景视频组装,包含头像、B-roll、音乐和字幕
视频工作室提供八种工作流程和顶级生成模型
图像工作室结合生成和完整的照片编辑器
音频工作室提供 TTS、声音克隆和 ElevenLabs 音效
私人实验室用于存储、搜索和重新创建资产
趋势功能将新闻转化为视频并可选择自动发布
为开发者和 AI 代理提供的 REST API 和 MCP 端点
如何使用 VlogMe?
简要说明导演:描述结果并添加文本、肖像、音频或片段等参考。
审核计划:批准提议的脚本、场景顺序、视觉方向、声音和格式。
生成场景:根据批准的计划制作镜头、头像、声音、音乐和字幕。
编辑时间线:精炼、重新排序或替换场景,在渲染之前检查实时信用估算。
导出和发布:以 9:16 或 16:9 渲染完整视频并分享或自动发布。
VlogMe的使用案例
- 完整的多场景视频
- 会说话的头像内容
- 社交短片和广告
- 新闻驱动的频道
- 通过 API 进行程序化视频




