首页路线 6 · 进阶能力 › 任务卡 6.5 多模态生成:图片、视频、3D 模型

任务卡 6.5 多模态生成:图片、视频、3D 模型

挑战 前置:任务卡 6.4 MCP 连接器:连接外部工具和服务 适用版本:WorkBuddy Desktop 1.0+ 更新:2026-08-31 交付:多模态生成:图片、视频、3D 模型

① 看结果:做完你手里会多出这个

这张卡做完,你会得到一份「多模态生成:图片、视频、3D 模型」的可交付产物。先看成品长什么样,再倒推做法:

产物预览 · 多模态生成:图片、视频、3D 模型

多模态生成:图片、视频、3D 模型(完成后你手里的样子)

你需要一张产品配图发公众号、一段 5 秒宣传视频发抖音、一个 3D 模型做产品展示。传统工具做这些要花几小时甚至几天,还要学 PS、PR、Blender。打开 WorkBuddy,用自然语言描述需求,图片几分钟出图、视频 1-3 分钟生成、

要点 1:1. 文生图(消耗约 5-10 积分)——做完这一步,你会得到「1. 文生图(消耗约 5-10 积分)」对应的可查看产物或结果。

要点 2:2. 图生视频(消耗约 50-100 积分)——做完这一步,你会得到「2. 图生视频(消耗约 50-100 积分)」对应的可查看产物或结果。

要点 3:3. 文生 3D 模型——做完这一步,你会得到「3. 文生 3D 模型」对应的可查看产物或结果。

这就是「跟着任务链走完」能拿到的成品。接下来倒推它怎么做出来的。

② 拆思路:这条任务链为什么这么下

做出上面的结果,靠的是一条 4 步任务链。看懂每一步的意图,你就能自己「出题」了:

#Prompt / 操作原文意图(为什么这么写)
1 帮我生成一张产品配图:一个极简风格的无线耳机,放在大理石桌面上,自然光,浅色调,适合发公众号头图 这一步在补充关键上下文或提出明确交付要求,让 AI 基于前面的内容继续,而不是重新开始
2 用刚才生成的耳机图片,生成一段 5 秒的宣传视频:镜头缓慢推近,光影流动,最后定格在产品特写 这一步在补充关键上下文或提出明确交付要求,让 AI 基于前面的内容继续,而不是重新开始
3 帮我生成一个 3D 模型:一个低多边形风格的咖啡杯,带把手,适合做产品展示用 这一步在补充关键上下文或提出明确交付要求,让 AI 基于前面的内容继续,而不是重新开始
4 帮我做一套产品宣传物料:1. 生成一张产品主视觉图 2. 用这张图生成 5 秒视频 3. 生成产品的 3D 模型用于展示页 这一步在补充关键上下文或提出明确交付要求,让 AI 基于前面的内容继续,而不是重新开始

③ 跟练回放:照着走一遍

下面是这段任务在 WorkBuddy 里的完整回放。点「下一步」逐步展开,把每条 Prompt 复制到你的 WorkBuddy 里跟练。

💡 小贴士:图片消耗 5-10 积分:文生图性价比高,多试几个描述对比效果,不满意就重新生成。
💡 小贴士:视频消耗 50-100 积分:视频成本较高,先用图片确认画面满意了,再做图生视频。
💡 小贴士:3D 模型要描述清晰:写清形状、风格(低多边形/写实/卡通)、用途,生成效果更好。
💡 小贴士:组合使用最高效:先生图再转视频、先生 3D 再截图配图,一套物料一条对话搞定。

④ 变式挑战:换个场景,你会不会

任务:把上面的任务链换到你的场景

把模板里 带下划线的词换成你自己的话题,在 WorkBuddy 里跑通:

帮我生成一张产品配图:一个极简风格的无线耳机,你的对象放在大理石桌面上,自然光,浅色调,适合发公众号头图

检查点:① 只改内容、结构照抄;② 每一条都等 AI 回复后再发下一条;③ 至少追问一次「把 X 改成 Y」,确认 AI 是基于上文修改而非重新开始。

⑤ 交付自检:证明你真的会了

对照你手里的产物,勾选完成项

🎉 本卡完成!进度 +1(学习徽章联动已在路上)