怎么用 MetaDig 做 AI 短视频,附教程实测案例
各位宝子们,现在做短视频的人越来越多,谁还没个「想拍但懒得拍」的念头呢!品牌片、口播、短剧小样,要是能一条龙在同一个地方做完,再发到网上,那肯定能少走很多冤枉路。
以前做条片子,得在出图软件、视频模型、配音工具、剪映之间来回横跳,素材导进导出,灵感早磨没了。现在 AI 把整条链路缝进一块画布,普通人也能端到端地把想法做出来。
今天的教程:教你怎么用 MetaDig 把一句想法做成可发布的短视频。从出图、生视频到画布底部直接出片,让你少下一个软件、少导一次素材。
MetaDig 是一站式 AI 视频专业创作平台。用户可在无限画布上完成文生视频、图生视频、数字人、AI 配音配乐与剪辑合成,节点连线就能当参考。平台接入 Wan 3.0、Seedance 2.5、GPT Image 2 等模型,还带 3D 导演台和双轨时间线。公开模板支持一键克隆,团队可以同一块画布实时协作。
官网入口:https://waytometa.cn/
一起来看看如何操作吧~
01. 单镜头角色短片
访问 MetaDig 官网:https://waytometa.cn/

注册登录,新建项目,打开画布。
新建图片节点,选择 GPT Image 2,生成一张包含长相和服装的图:
出图提示词:
写实,傍晚巷口,暖黄路灯,积水反光。二十多岁女生,黑短发,深色冲锋衣,斜挎包,半身侧脸看手机。镜头略低,能看到鞋面。不要字幕,不要海报感。
「图1」
图没问题了,新建一个视频节点,选 Wan 3.0,把这张图丢进参考槽,在提示词中引用「图1」。注意:这张图只负责锁定人物的脸和衣服,不要让模型重新生成面部。
视频提示词:
「图1」是角色正脸和服装,不要改五官,不要换衣服。傍晚街巷,「图1」从右侧入画,走向暖灯,低头看一眼手机。镜头跟拍到半身,最后两秒停在鞋面反光。只要巷口环境声,不要旁白,不要字幕,无人脸变形。时长 5 秒。
点击生成。如果发现脸部变形或衣服被改了,直接在提示词里用自然语言描述问题,局部调整即可,不用整条重新抽卡。
看看效果:人物被图片固定住了,这条 5 秒视频可以当封面,也能作为下一段的开头。
02. 视频+BGM,画布直出成片
第二条只换机位和动作,模型选 Wan 3.0 或 Seedance 2.5:
第二条视频提示词:
图1是角色正脸和服装,视频1只提供走路节奏,音频1提供巷口环境声。不要改五官,不要换衣服。
傍晚街巷,图1从画面右侧入画,按视频1的步频走向巷口暖灯。镜头跟拍到半身,最后两秒停在鞋面反光。不要旁白,不要大字幕,无人脸变形。

两段都出来后,丢进画布底部的时间线:
选中第一段,点「加入时间线」;第二段再点一次
空格预览,片头片尾空就把手往里收;接得跳,交界处加 0.5 秒黑场
播放头拖到开头,把 BGM 加进下面那条音频轨
点「导出成片」,1080P,画幅选自动或 9:16
合成不消耗积分,成片会自动回到画布。支持最多 40 个片段、总长 5 分钟,做短视频完全够用。
来看效果:同一个人,从巷口走到便利店,BGM 全程铺底。不用再去剪映里手动对齐。
03. 一些分享
在尝试用 MetaDig 做短视频之后,我真是大开眼界,收获满满!
过去制作 AI 视频如同抽卡:提示词冗长,生成一条 5 秒视频后若不满意只能整条重抽,之后还需导入剪映进行对齐。作为新手一晚上能烧掉好多积分,片子还是散的。将流程整合进画布后,这想法彻底变了。
就拿出图来说,以前一张参考图既要管脸,又要管动作,又要管滤镜,模型只能平均。
现在槽位分开:图1管长相,导演台管站位,视频节点管这一段正在发生的事。同样积分,成功率会高一截。不是模型突然变聪明,是你少让它猜。