最近后台每天都有人问我同一个问题AI视频到底怎么赚钱说实话我自己从第一次打开即梦AI到做出第一条能过审的AI短片前后折腾了大半个月。但现在回头看如果按对的方法走2小时真的够用——关键在于别把AI视频想得太玄乎也别一上来就研究那些酷炫但用不上的“高阶技巧”。这个“即梦豆包剪映”的组合是我现在带新人时最常推荐的起步方案。它不是最专业的但一定是最适合普通人的没有复杂的部署、没有高昂的成本用一套从写脚本、生成画面到剪辑成片都能闭环的工具链帮你从0到1做出一条能发出去的AI短片。这篇文章就把这套打法的全流程拆给你看包括即梦的参数怎么调、豆包的提示词怎么写、剪映怎么把AI素材剪得像真人拍的以及那些我踩过的坑和接单时的实用经验。1. 先把这套打法的底层逻辑讲清楚1.1 AI短片不是“AI全自动”而是“AI出料人组装”很多人一提AI视频第一反应是“我输入一句话AI帮我生成一部电影”。真做过的都知道现阶段离这个目标还很远。更现实的工作流是AI负责出素材人负责做决定。具体来说一支AI短片的制作链路通常是这样确定主题和脚本也就是你想讲一个什么故事、传达什么信息。把脚本拆成分镜一个一个描述清楚每个画面里有什么、镜头在动还是静、画面比例是多少。用即梦这种AI生成工具把分镜描述变成一张张图片或一段段视频素材。把素材导进剪映按顺序排好加上配音、字幕、背景音乐和简单转场。输出成片发布或交付。你会发现AI只是帮你省掉了“找素材”“拍摄”“做特效”的时间真正决定片子好不好看的是你的脚本、分镜设计和剪辑节奏。这也是为什么我会在课程里反复强调工具只是手创意才是脑。小白最容易犯的错就是花大量时间研究怎么把AI生成的画面变精致却忽略了一个可能不太妙的故事脚本——最后做出来确实“大片感十足”但根本没人愿意看完。1.2 为什么偏偏是即梦、豆包、剪映这三件套现在市面上AI视频工具有一堆可灵、海螺、Runway、Pika各有各的长处。但如果你是一个完全没接触过AI视频的小白我强烈建议先从“即梦豆包剪映”这套组合上手原因有三个第一注册门槛低。这三款工具都有网页版和国内可以直接使用的客户端用手机号就能注册不需要准备特殊环境也不考验电脑配置。第二免费额度够用。新手从学习到做出第一条作品基本用免费额度就能完成等你确定要做这个方向再考虑开通付费会员或者用API批量调用压力小很多。第三工具间配合顺手。即梦和剪映本身都在同一个大的创作生态里生成好的素材可以直接保存到本地再导入剪映中间几乎没有格式兼容问题豆包则负责文本端的“脑力活”写脚本、分镜头、提炼提示词、整理复盘一个对话框全搞定。当然不是说可灵、海螺不行。我的建议是先用这套组合跑通一次完整流程你对AI视频的“手感”建立起来之后再去尝试其他工具那时候你会很清楚地意识到不同工具在构图、动态、风格上的差异而不会因为工具太多而无所适从。1.3 2小时学完30集关键在掌握“最小可用流程”很多人看到“30集”第一反应是这个课一定很长。其实恰恰相反我们设计这30集时给自己的要求是总时长控制在2小时以内一集4分钟左右每集只解决一个具体问题。为什么这么短因为AI视频这个赛道技术迭代太快与其做又长又全的“百科全书”不如教大家先跑通一条“最小可用流程”。所谓最小可用流程就是从0到1做出一支60秒以内、能见人的短片需要的全部环节。一旦跑通一次后面不管做什么题材都是在往这套流程里加东西。所以你看课程大纲它其实是按“做一条片子”的顺序来排的先是认识工具和账号准备再是脚本怎么写、提示词怎么提然后是即梦生成素材的技巧接着是剪映剪辑最后是成片发布和接单注意事项。跟着做一遍你手里就有了一部完整的作品这时候再去学更复杂的运镜、角色一致性、多镜头叙事才有意义。2. 开工前先把三个工具准备好2.1 即梦图片生成和视频生成怎么选即梦AI是目前国内普通用户最容易上手的AI视觉生成工具之一它同时支持图片生成和视频生成两条线。新人第一次打开即梦面对一堆输入框和模型选项容易懵。我的建议是先分清两个入口图片生成适合做封面、分镜图、静态场景。你可以输入提示词也可以上传一张参考图让AI按参考风格生成。视频生成适合做动态镜头。有“文生视频”和“图生视频”两种方式文生视频是你写一段描述AI直接生成动态画面图生视频是先生成一张满意的图再让画面动起来。实际做AI短片时我更喜欢“先出图、再让图动”的路子。原因很简单文生视频的随机性大你写“一个女孩在森林里跑”它可能给你一个完全不符合预期的角度或背景。但如果你先生成一张构图、光线都满意的图然后让即梦基于这张图去生成视频可控性会大大提高。在即梦生成视频时几个关键参数要留意画面比例抖音/B站横版选16:9抖音/快手竖版选9:16封面常用4:3或1:1。最好在生成前就定好后期裁剪会损失画质。视频时长即梦单次生成的视频时长一般比专业软件短所以一个3秒到5秒的镜头就够了需要更长画面就多生成几段剪映里拼接。运动幅度这个决定了镜头里主体动得厉害还是轻微。对话场景选小幅度避免人物脸崩空镜或转场可以选大幅度画面更有冲击力。种子值部分模型支持随机种子如果你生成了一张特别满意的图可以记录种子值用它去微调提示词能保持角色风格统一。这些细节在你实际动手前可能没什么感觉但一旦开始生成就会明白它们有多重要。2.2 豆包脚本、提示词与文本处理豆包是字节跳动推出的AI助手能对话、写作、总结、翻译、分析文档最关键的是它对国内用户的表达习惯理解得比较到位。它在这套工作流里的角色是“文本中枢”。具体用途有三个写脚本。你把想法告诉豆包比如“我账号想做美食探店帮我写一个60秒口播脚本”它会按口播结构给你一版你再结合自己的需求改一改。拆解分镜。脚本写好后让豆包把它拆成一个个镜头描述包含画面内容、景别、运镜方式、时长建议。这一步能省掉大量脑力。优化提示词。即梦这类生成工具对提示词的理解越来越强但如果你写得太口语化效果就会飘。把一句大白话丢给豆包让它帮你扩写成结构化的提示词再复制到即梦生成效果好很多。我做课程时经常打一个比方豆包不是帮你“代替思考”的而是帮你把脑子里那个模糊的想法变成AI能理解、也愿意执行的指令。所以用豆包的关键是“会提问”把问题说得越具体它给你的答案就越能用。另外热点里经常有人搜“豆包清理电脑的指令”这也是豆包的使用场景延伸。它确实可以根据你的系统情况给出一套电脑清理建议比如怎么清理临时文件、怎么关闭无用的开机启动项。但我要提醒一句AI给的建议只能当参考尤其是涉及删除文件、修改系统设置的时候你一定要先看懂它要做什么再动手执行别一句“帮我清理C盘”就让它给你删东西出了问题得不偿失。2.3 剪映基础设置与导出参数剪映是这套组合里负责“后期组装”的工具。它有两个主要版本手机版和专业版。如果你要正经做短片我建议直接用专业版也就是电脑版画面更大、轨道更清楚、关键帧和字幕功能也更完整。剪映上手不复杂但有几个地方新人容易踩坑全局设置里先把草稿位置改到空间较大的盘避免C盘被素材塞满。建立项目时就设置好分辨率横屏选1920×1080竖屏选1080×1920帧率选30fps或60fps。别等做到一半再改很多素材比例会乱。学会用“自由层级”或“复合片段”这类功能多轨道素材整理起来会清晰很多。导出设置里分辨率选与项目一致码率选更高或推荐格式用MP4就好。如果你要发布到视频平台H.264编码是通用性最好的选择。剪映的免费版对新手来说完全够用字幕识别、音乐库、音效、调色、转场这些功能都有。不需要一开始就追求那些高级插件先把“剪得顺”这件事做好。3. 从0到1完整做一支AI短片3.1 选题和脚本先让豆包给你写出能拍的剧本我做AI短片第一步永远是确定主题。很多小白一上来就说“我想做个科幻大片”这个方向太大了AI根本接不住。我给学员的建议是第一次动手选一个你熟悉的小场景比如“一只橘猫在窗台发呆”“一碗面从下锅到出锅的过程”“30秒讲清一个生活小技巧”。越具体越可控。主题定好之后用豆包写脚本。我给你一个可以直接抄的提问模板“你是一名短视频编导。请帮我写一个时长60秒的口播短视频脚本主题是XX面向XX人群风格XX。要求有开头钩子、内容主体、结尾行动引导。口头表达尽量自然口语化不要一堆书面语。请输出完整脚本并标注每段大概的时长。”比如我做美食短片时会这样问“写一个60秒美食短视频脚本主题是家常版番茄炒蛋面向想学做饭的年轻人风格轻松幽默。开头用一句钩子中间教做法结尾引导大家关注。”豆包生成脚本后不要直接拿来用而是要过一遍脑子开头那一句够不够抓人中间信息有没有多余结尾是不是自然你改完脚本才算变成你自己的。3.2 分镜表把文字变成即梦能听懂的画面有了脚本接下来要做分镜表。分镜表就是把每句话对应的画面列出来方便后续生成素材。一个简单的分镜表长这样镜头序号内容描述景别运镜/运动建议时长是否生成素材1番茄和鸡蛋放在案板上阳光斜照近景静止3秒是2鸡蛋敲开入碗筷子搅拌特写轻微运动4秒是3番茄切块汁水流出特写轻微运动4秒是4油锅烧热蛋液倒入微微蓬起中景轻微运动5秒是5番茄下锅翻炒裹上酱汁中景轻微运动5秒是你没必要用Excel做得很花哨在文档里列个表格就行。但这一步不能省。没有分镜表你到即梦里就是一句接一句地乱生成最后素材一大堆能用的没几个剪的时候特别痛苦。分镜表做好后可以让豆包帮你把每个镜头写出一条适合生成的提示词。比如“切番茄”那个镜头提示词可以是“电影感实拍风格特写镜头新鲜番茄在木质案板上切成片红色汁水微微渗出自然侧光桌面有面粉洒落浅景深画面干净无文字无水印”。3.3 即梦生成素材常用参数和生成技巧现在到了核心环节用即梦把分镜变成画面。打开即梦建议按“先生成图片、再生成视频”的顺序来做。先生成满意的静态图再用图生视频生成动态素材。这样生成一轮下来的废片率会低很多。生成图片时提示词里写清楚四个要素主体、场景、风格、画质。比如“一只橘猫趴在窗台上午后阳光摄影写实风高清细节”。不要只写“猫在窗台”那画面就完全不可控。风格参考可以多试几种摄影写实、国风水墨、3D卡通、赛博朋克、厚涂插画。同一段内容换风格就是另一种气质。对新手来说我建议优先选摄影写实或3D卡通这两种风格最容易出片观众接受度也高。生成视频时参数设置我一般这样来比例和分镜表保持一致。时长优先选3-5秒。运动幅度看镜头内容人物说话时选“微小”走路奔跑选“中等”空镜景物转场选“较大”。如果一次生成的画面不满意不要急着反复点击生成而是先检查提示词是不是不够具体。很多时候不是你运气差是AI没听懂你要求。生成后一定要做筛选。标准很简单画面有没有明显畸变、主体是否清晰、运动是否自然、有没有文字乱入。画质差一点的镜头后面可以用剪映的调色补救但主体糊了、结构崩了的直接扔掉重来。3.4 剪映粗剪拼镜头、卡节奏、加字幕配音素材都生成好后打开剪映开始组装。我的习惯是先把所有可用的镜头按分镜表顺序拖到时间线不急着加任何效果先把“故事顺序”理顺。第一遍粗剪只需要做三件事每个镜头截取最合适的部分。AI生成视频往往头尾会有点乱中间最稳。用分割工具把不用的头尾裁掉只保留好的几秒。控制镜头节奏。短片的节奏主要靠镜头时长控制叙事镜头3-5秒快节奏内容可以压到1-2秒舒缓空镜可以放到5秒以上。不要让所有镜头都一样长那样会显得很平。找到配乐和卡点。剪映的音频库可以直接搜索背景音乐。AI短片加音乐后质感会立刻提升卡点则能让画面切换更有张力。你可以在音乐波形上看到明显的重拍把画面切换点对齐到重拍上节奏感就出来了。接下来是配音和字幕。如果片子有旁白可以用剪映的录音功能自己录也可以用AI配音。字幕方面剪映有智能识别字幕一键识别生成后手动修正错别字和断句就行。字幕样式建议统一不要花哨黑白灰加一点透明度或者用平台流行的描边字重点是“干净、能看清”。3.5 成片检查和导出导出前至少完整看三遍片子。第一遍看逻辑故事说得通不通第二遍看画面有没有穿帮、变脸、忽明忽暗的镜头第三遍听声音旁白和音乐音量是不是平衡有没有爆音。有一个特别容易忽略的问题AI视频素材的颜色和光影差异可能很大镜头一暖一冷拼在一起会很难受。我的习惯是在剪映里加一个统一的调节层稍微压一点高光、提一点对比度、统一色温整体观感会协调很多。导出设置按前面说的分辨率1920×1080或1080×1920帧率30fps码率选更高格式MP4。检查一下有没有水印很多免费工具会带默认水印发布前要处理干净。4. 制作过程中最容易踩的坑4.1 画面崩坏和角色不统一AI视频最常见的翻车现场就是“角色换脸”。上一秒还是个穿红裙子的女孩下一秒镜头切回来变成穿蓝衣服了或者五官都不一样了。这在多镜头叙事里简直是灾难。避免方法一是尽量用图生视频不要每段都重新文生视频。先确定主角的一张基准图后续镜头都用这张图来做延伸。二是提示词里反复固定角色特征比如“红色短发、蓝眼睛、白色T恤、街头背景”每个镜头都带上这些关键词。三是生成完成后做筛选把角色不统一的镜头直接删掉别心疼。素材不够就重新生成也不要放一个穿帮镜头进成片。4.2 视频素材不够、镜头跳切太硬新手刚上手时一个常见问题是“我以为生成5个镜头就够了结果剪完一看只有30秒句子还没说完就没了”。解决办法很简单前期多生成。一个镜头可以换提示词生成两三版哪怕只选一版用其他留着备选。拍摄成本是0多生几条不吃亏。镜头跳切太硬通常是场景或角度差距太大导致的。两个镜头如果是从左边拍到右边、然后突然切到正面特写观感会很突兀。简单处理手法是加叠化转场或使用剪映的运镜转场更专业的做法是在分镜表里提前规划好景别递进全景交代环境、中景展示动作、特写强调细节切换起来就会顺很多。4.3 电脑卡顿、剪映闪退怎么办做AI视频素材多、分辨率高剪映对电脑配置有一定要求。很多人拿老笔记本硬扛结果预览卡成PPT导出还闪退。我的经验是剪辑前先把素材整理到项目文件夹别放在桌面或C盘。预览时降低播放分辨率等全部剪完再调回高清预览。关闭其他占内存的软件浏览器、聊天工具能关就关。如果还是很卡开剪映的代理模式或轻量化预览先剪结构最后导出前再切回原画质。如果你想在不花钱换电脑的前提下给系统腾点空间可以问问豆包“如何清理电脑C盘空间”它会告诉你清理临时文件、禁用无用的开机启动项、清理缓存这些常规操作。但一定注意AI给的指令你看得懂、确认安全再执行别复制一条“删除某个文件夹”的命令就无脑跑把重要文件删了后悔都来不及。4.4 版权、平台规则和商用风险AI视频的分发和政策风险是很多人忽视却最重要的问题。这几年AI生成图片、视频越来越普遍但平台对AI内容的审核和标识要求也在变化。你需要记住几个底线第一不要用AI生成涉及真人肖像的内容尤其不能用真实明星、公众人物的形象去做二创第二不要用AI生成虚假新闻、误导性信息这在很多平台是严重违规第三接商单时提前看甲方是否接受AI制作如果接受要在合同里注明制作方式免得交付后有纠纷第四关注即梦、剪映等工具的最新条款尤其是免费生成内容的商用授权范围。不同平台在不同时期政策会有调整以官方说明为准。我自己接单时一定会问清楚甲方对AI内容的看法。有的客户对AI成片完全接受有的则明确要求“不能用AI”。这不是技术问题是商业问题提前沟通清楚能避开很多麻烦。4.5 常见问题速查表问题可能原因解决建议生成画面模糊提示词缺少“高清”“细节”关键词或原图分辨率低提示词加高清细节先生成大图再生成视频角色前后不一致每段提示词没有固定特征用统一参考图提示词重复关键特征素材时长不够单次生成太短或生成的片段可用部分太少多生成备选素材按需拼接合理空镜补充剪映预览卡顿素材分辨率过高电脑性能不足降低预览分辨率、关闭多余软件、开轻量化模式字幕识别不准有口音、语速过快或背景音太杂手动修正断句配音时保持清晰低语速画面色彩不统一各素材光影、色温不一致用调节层统一色温、对比度加统一滤镜微调5. 学完怎么接到第一单5.1 新手接单的常见需求类型很多人学AI视频就是冲着“接单赚钱”来的这没问题但要清楚什么样的单子适合新手。我统计过身边学员接到的第一单集中在四类一是电商商品展示视频比如手机壳、首饰、小家电的AI演示动画二是口播号剪辑帮博主把一段口播剪成有画面感的视频穿插AI空镜三是小说推文类视频用AI生成故事封面和场景画面加上配音做成一两分钟的故事短片四是文旅或门店宣传用AI生成一些氛围感画面搭配字幕和音乐帮商家做本地推广视频。这四类单子有一个共同特点不要求复杂的剧情和连贯的人物表演更看重画面质感和后期包装。恰好是AI视频工具最容易出效果的方向。5.2 怎么定价、怎么谈需求新手最尴尬的问题就是“我该收多少钱”。我见过有人一条收50块也有人一条收5000块。价格差距不在技术而在你能给对方创造的价值。给新手的参考逻辑是先按“作品时长使用范围”定价。一条30秒到60秒的AI短视频如果只是发朋友圈或抖音收两三百很正常如果是商用广告、要投信息流价格要翻倍甚至更多。不要只算你制作的两个小时还要算素材成本、修改成本以及对方的使用范围。谈需求时一定要问清楚交付格式横屏还是竖屏、时长要求、风格参考、是否有指定素材、修改次数上限、署不署名。很多纠纷都出在“我以为”上所以开工前一定要文字确认一遍需求截图留底。5.3 交付物和长期迭代接单交付不只是给一个MP4文件那么简单。整理素材源文件、草稿工程文件、版本记录这些是一个专业接单者的基本素养。如果客户后面想改你还能高效修改如果他续单你手里有完整的模板后续效率也会高很多。交付后记得问一句反馈最好能要到对方的使用效果数据比如播放量、转化率。这些数据是你以后提价的底气。如果对方满意可以主动提一句“后续还有类似需求可以继续合作”大部分客户是愿意为靠谱和稳定持续买单的。长期来看接单赚钱的本质不是“我会用AI”而是“我能用AI稳定地帮别人解决问题”。技术工具会越来越简单但判断需求、沟通项目、控制品质这些能力才是你在AI视频赛道越来越值钱的核心资产。写到这儿我特别想多说一句我见过太多人把精力花在“研究更酷的生成技巧”上作品发出来却没人看然后怪平台限流。实际上AI视频真正难的不是技术而是审美和讲故事的能力。先老老实实做出一条60秒、逻辑通顺、画面不崩的片子把它挂出去哪怕是给自己的朋友圈看你都会比90%只囤课不下场的人强。工具更新换代很快但“从0到1做出作品”的手感永远是下一步所有可能性的起点。