ZAODIAN AI CREATIVE STUDIO // 造点AI 阿里旗下夸克推出的 AI 创意生成工具 · 用想象"造点"不同
访问官网
AI IMAGE × VIDEO CREATION

造点AI:从一句话到一段音画同步的视频

把 AI 生图与 AI 生视频塞进同一个极简界面,接入 Midjourney V7 与通义万相 Wan2.5,让普通用户也能做"电影感"创作。

2核心能力:AI 生图 + AI 生视频
4+视频模型:万相 2.1/2.2/2.2 专业/2.5
1080P视频清晰度 · 24 帧/秒
10s单段视频时长上限
造点AI是阿里旗下夸克推出的 AI 创意生成工具,slogan 为"用想象'造点'不同",集成 AI 生图与 AI 生视频两大核心能力,被称为"阿里版即梦"来源①。它引入全球领先的图像生成模型 Midjourney V7 与通义万相 Wan2.5,尤其擅长亚洲人像、中文与国风元素的生成;视频生成是国内较早接入万相 Wan2.5、支持音画同步创作的应用之一,能同时生成人声、音效与背景音乐,适配 10 秒时长、24 帧/秒、1080P 高清输出。本文以"编号 walkthrough + 功能卡 + 技巧清单"的结构展开,最后更新于 2026-08-25。

编号 Walkthrough:从注册到发布的完整链路 5 STEPS

按这条编号引导走一遍,零基础用户也能在数小时内完成一条可发布的 AI 短视频。

进入创作界面 / ENTRY

打开造点AI,进入首页"创作"界面,界面分灵感、创作、我的三个标签。在"创作"页可切换"AI 生图"与"AI 视频"两种模式,移动端极简、网页端可切换大模型。

提示:网页端功能更全,需要切换模型时优先用网页端。

选择模式与模型 / MODEL

AI 生图可选夸克图片 1.0 或 Midjourney V7;AI 生视频可选万相 2.1 专业版、万相 2.2、万相 2.2 专业版、万相 2.5。亚洲人像、中文与国风元素优先试 Midjourney V7,影视感动态画面优先试 Wan2.5。

提示:同一句话用不同模型多跑几次,差异往往很大。

输入提示词与参数 / INPUT

既可直接导入图片再描述如何调整,也可纯文字生图/生视频。生图提供风格、尺寸、智能润色、特征词四项设置;生视频提供尺寸、智能音效、智能润色三项设置,特征词覆盖人像、镜头视角、光线、风景、结构、动态氛围与质感细节。

提示:用"主体 + 镜头 + 光线 + 风格 + 细节"的五段式写法更稳。

生成与多版本对比 / GENERATE

点击生成后,平台按所选模型输出图像或视频。视频会同步生成人声、音效与背景音乐,实现音画同步。对不满意的部分可修改关键词、调整风格方向、优化画面结构,做二次创作升级,直到选出最优版本。

提示:AI 生视频消耗积分,先在生图阶段定稿再转视频更省。

预览、保存与分享 / PUBLISH

在"我的"标签可查看已生成内容,支持保存到本地、分享到社交平台或发布到灵感社区。发布后可参与官方创作赛事、与其他创作者交流创意,形成"创作—展示—互动"的闭环。

提示:发布到灵感社区能获得曝光与积分反馈。

功能卡:四大核心能力

造点AI 把创作能力收敛为四张功能卡,每张对应一个高频场景。

CARD 01 · IMAGE

AI 生图

接入 Midjourney V7 与夸克图片 1.0,擅长亚洲人像、中文与国风元素,提供风格、尺寸、智能润色与特征词四项控制,含 3D、儿童绘本、春日人像等预设风格。

CARD 02 · VIDEO

AI 生视频

接入通义万相 Wan2.5,支持音画同步视频生成,能同时生成人声、音效与背景音乐,支持 10 秒时长、24 帧/秒、1080P 高清输出,满足电影级场景创作。

CARD 03 · EFFECT

创意特效

提供角色穿越、风格变换、魔法转场等创意特效玩法,一键变换人物或场景风格,让普通素材快速变成有戏剧张力的短视频内容。

CARD 04 · COMMUNITY

灵感社区

内置灵感社区,可浏览、学习其他创作者的作品,覆盖二次元、AI 短剧、人像、壁纸头像、宠物等分类,形成"看—学—做—发"的创作循环。

造点AI 的关键差异化在 音画同步——多数 AI 视频工具只生成无声画面,造点AI 借助通义万相 Wan2.5 能一次性产出"画面 + 人声 + 音效 + BGM"的完整视频,省去后期配音对轨的环节来源②

技巧清单:把造点AI 用顺的 7 条经验

从真实使用中沉淀出的高频技巧,按 checklist 逐条对照执行。

实操 Checklist

  • 先定主体再补细节:提示词先写清楚"画什么",再补镜头、光线、风格、质感,避免模型理解跑偏。
  • 人像国风用 Midjourney V7:亚洲人像、中文元素、国风场景下 V7 表现明显更稳,写实人像优先试它。
  • 影视动态用 Wan2.5:需要运镜、人物动作与音画同步时选 Wan2.5,它是目前音画同步能力最完整的模型。
  • 生图定稿再转视频:AI 生视频消耗积分,先用生图把构图与角色定稿,再以图为参考生成视频,性价比更高。
  • 善用特征词控制画面:人像、镜头视角、光线、风景、结构、动态氛围、质感细节七类特征词能显著提升可控性。
  • 移动端做创意、网页端做精修:移动端操作短适合发散创意,网页端可切换模型适合做精细调优与多版本对比。
  • 发布到灵感社区拿反馈:发布作品能获得点赞与积分反馈,是验证创意方向与持续迭代的有效路径。

模型与计费速查表

能力可选模型关键参数计费方式
AI 生图夸克图片 1.0 / Midjourney V7风格/尺寸/智能润色/特征词消耗积分
AI 生视频万相 2.1专业 / 2.2 / 2.2专业 / 2.5尺寸/智能音效/智能润色消耗积分(高于生图)
视频输出1080P · 24fps · ≤10s音画同步含人声/音效/BGM含在生成成本内
积分获取做任务 / 充值10 元 ≈ 100 积分按量付费

常见问题

造点AI 是免费的吗?

基础生成功能免费提供,但 AI 生图与 AI 生视频会消耗积分,积分可通过做任务或充值获取,目前约 10 元可购买 100 积分,生视频消耗高于生图。

造点AI 和即梦、可灵有什么区别?

造点AI 聚焦 AI 生图与 AI 生视频两项核心能力,接入 Midjourney V7 与万相 Wan2.5;即梦额外有数字人与动作模仿;可灵功能更全含风格转绘、对口型等。造点AI 强在音画同步与国风人像。

造点AI 支持哪些大模型?

AI 生图支持夸克图片 1.0 与 Midjourney V7;AI 生视频支持通义万相 Wan2.1 专业版、Wan2.2、Wan2.2 专业版、Wan2.5。模型切换在网页端完成,移动端不提供切换入口。

造点AI 生成的视频有声音吗?

有。造点AI 接入通义万相 Wan2.5,是国内较早支持音画同步视频生成的应用,能一次性生成人声、音效与背景音乐,无需后期单独配音对轨。

造点AI 生成的内容可以商用吗?

生成内容在遵守平台用户协议与模型授权条款的前提下可用于发布与分享,涉及商业用途、品牌宣传等场景建议先查阅官网最新的知识产权与授权说明,避免侵权风险。

造点AI 适合什么人用?

面向普通用户与内容创作者,适合广告设计师、平面设计师、影视制作人快速生成创意素材,也适合博主、自媒体、短视频创作者产出图文与视频内容,学生也可用于学习与作业。

参考资料

  1. 来源:维基百科《通义万相》相关词条(通义万相 Wan2.5 视频生成与音画同步能力)
  2. 来源:维基百科《Midjourney》词条(Midjourney V7 图像生成模型背景与能力)
  3. 来源:36 氪关于阿里上线造点AI 的报道(造点AI 与即梦、可灵的对比分析)
  4. 来源:界面新闻关于 AI 创作工具的观察(国内 AI 生图与生视频工具竞争格局)
  5. 来源:爱范儿关于 AI 视频生成工具的评测(音画同步与电影级场景创作能力解析)
  6. 来源:虎嗅关于 AIGC 创意平台的报道(AI 创意表达平台与多模态生成趋势分析)
青衣网络 AI 观察团队 · 最后更新 2026-08-25 · 本文仅作工具观察,不构成任何投资或采购建议。