全球粉丝用"上万个"提示词让阿里云AI做出一条开幕大片
一句话结论
米兰冬奥开幕大片《YOUR EPIC VIBE》从全球上百国、上万参赛者的万相 AI 一句话生成视频中精选 100 个剪辑而成;原文拆解了高速冰雪运动画面避免肢体扭曲的物理挑战,并给出「总体描述 + 镜头序号 + 时间戳 + 分镜内容」的可复用分镜提示词公式与智能多镜省力用法,是普通人用 AI 视频生成参加全球级创作的完整案例。
就在今夜,米兰冬奥会即将拉开帷幕。 “开幕大片”《YOUR EPIC VIBE》率先发布,让我们一睹为快!
**这次冬奥“开幕大片”有点不一样!中文翻译是 “意展你风采” ** 这是从全球上百个国家、上万人参加的米兰冬奥会AIGC全球大赛中,精选出的100个优秀作品 汇聚而成。
活动由国际奥委会联合阿里云共同发起。参赛选手只需用 阿里云万相 AI 输入一句话,生成 脑海中想象的 5 秒冬奥视频即可参赛。体育和AI技术的结合过往都只是服务于赛事本身,现在居然把观众带进赛场!同时我也很好奇,在冬奥体育运动这种需要表现高速运动和复杂粒子物理规律的画面,万相AI将如何应对?
地狱级挑战
高速运动
短道速滑、雪车、空中技巧等项目,运动速度极快且动作幅度大。
传统 AI 模型处理此类场景时,极易出现肢体扭曲、穿模或瞬移等物理错误。
较长视频可以通过叙事铺垫掩盖瑕疵,但在 15 秒的窗口内,几乎不存在缓冲空间。
每一帧都暴露在放大镜下,容错率极低。
物理规律
冰雪运动的特殊性在于:
- 花样滑冰的托举动作要求毫米级平衡
- 雪板切入雪面时溅起的雪沫
- 冰面上流动的倒影
- 高速转弯时身体的压弯角度
细节构成了冰雪运动的真实感,AI 必须生成符合物理规律的视频。
不仅要保证高速运动的连贯性,无卡顿、撕裂、鬼影,就连运动模糊都要贴合真实光学效果。
生成专业运动视频
看到“开幕大片”里的画面效果 ,我也忍不住尝试体验了一把万相AI的视频生成
这里提供一个提升效果的万能视频分镜公式:
总体描述 + 镜头序号 + 时间戳 + 分镜内容
我让Claude 4.5帮我生成了一个专业视频生成提示词如下。
你是一个专业的视频分镜脚本编写者,需要为AI视频生成工具提供清晰、结构化的提示词,创作时长为5-15秒的短视频。 按照”总体描述 + 镜头序号 + 时间戳 + 分镜内容”的结构编写视频生成提示词:
总体描述: 概述视频主题、叙述视角、情感基调和核心事件,鼓励超现实和富有想象力的创意(如透明角色、外太空场景、梦幻环境等)
镜头序号: 为每个镜头编号,格式为”第X个镜头”,建议2-4个镜头(适配5-15秒视频时长)
时间戳: 标明镜头时间范围,格式为”[X-Y秒]“,总时长控制在5-15秒内
分镜内容: 描述场景、角色动作、表情情绪、镜头运动和转场方式,鼓励天马行空的想象(非常规场景、超自然元素、视觉奇观等)
Format(格式)
这个故事以[视角]视角,讲述了一个关于[主题]的[类型]。
第1个镜头[0-X秒][场景]。[角色][动作],[表情/情绪]。
第2个镜头[X-Y秒][转场方式],[镜头运动],[场景]。[角色][动作],[表情/情绪]。
第3个镜头[Y-Z秒][转场方式],[场景]。[角色][动作],[表情/情绪]。
注意: 总时长5-15秒,镜头数量2-4个,鼓励使用超现实元素(透明人物、月球/太空场景、梦幻世界、时空扭曲等)
待输入
{{你的主题}}
如果不需要精准控制每个镜头,强烈推荐打开“智能多镜”功能。
只需最简单提示词,都能生成相当不错的分镜效果。
一起来看看我以《YOUR EPIC VIBE》为灵感生成的3段画面吧!
测试 1:熊猫滑雪
先来看看这只滑雪的奶牛猫,很有意思!

我也尝试让阿里云万相 AI 生成了一段”熊猫滑雪”视频。
雪板划过雪面的痕迹、毛茸茸身体随着地形起伏,动感和细节都超出了我的预期。

测试 2:机器人滑雪

YOUR EPIC VIBE作品
咱也来个赛博朋克机器人滑雪,开启智能多镜。
赛博朋克机器人自由式滑雪。
蓝紫霓虹风,很赛博朋克!

测试 3:火柴人滑雪
大家有时会吐槽 AI 生成的图片和视频都太精致了,这次的作品中也有用线条表现运动的,非常艺术!

我也用Wait But Why经典的火柴人形象生成一段滑雪视频。
感觉很有故事和趣味性。

大家也可以试试更多风格。
比如水墨风、3D渲染、童话绘本,看能不能组合出更有趣的东西。
技术亮点解析
发现阿里云万相 AI 在这次大赛中的表现,不是简单的”文字生成视频”,还有一些令人惊喜的亮点。
1. 复杂动态表现能力
万相 AI 专门强化了复杂动态表现和运镜遵循能力,能在大幅度复杂动作中保持人物肢体稳定性、动作和谐性和连贯性。
轻松应对像高山速降、花式跳台这样的高速、复杂动作。

2. 物理规律还原
通过精心准备的高质量运动数据微调,AI 模型”学会”了:
- 急转时的身体倾斜角度
- 跳跃落地的缓冲姿态
- 雪板切入雪面的阻力
- 背后扬起的粉雪轨迹
让滑雪者与雪地的互动变得更加真实、自然,都变得丝滑顺畅、如临其境。

3. 语言泛化与意图理解
阿里云万相 AI 自带提示词强化,从而生成符合并超出用户预期的精彩视频内容。

模型能让用户任意语言、任意内容的描述,都可以通过模型强化和完善为冰雪运动中的关键要素。

4. 多模态参考生成
万相 AI 可以进行镜像级人物重建,能精准捕捉用户上传的形象特征。
它能直接参考输入视频里的形象和声音来做二创,不管是人还是拟人形象都能当主角,多人合拍、人与物同框都没问题。
而且它还自带 AI 角色库,用起来很方便。
我随手输了句“ @关羽 滑雪”,开启智能多镜。

生成的关羽老爷滑雪:

5. 智能多镜能力
万相 AI 的智能多镜能力,解决了主流视频生成模型的“单镜头限制”痛点,能够在一个生成任务中输出包含多个镜头的连贯视频流。
再搭配原生音画同步能力,非专业用户也能轻松产出视听完整的作品。

从观看到共创
米兰冬奥会AIGC全球大赛 的意义,远不止于产出了一部精美的“开幕大片”。
传统上,制作一部高质量冰雪运动视频,需要专业团队、昂贵设备、复杂后期。
但万相 AI 消解了这些门槛。

《YOUR EPIC VIBE》 还将在瑞士洛桑奥林匹克博物馆、意大利米兰和平门、中国杭州三地联展。
这次大赛不仅是一场艺术和技术的“民主化”,阿里巴巴的AI生态技术让创作权从少数专业人士手中释放出来,与此同时,也开创了一种全新可能性:让全球粉丝不仅是奥运故事的见证者,更是叙事者和创造者。
写在最后
这场跨越上百个国家和地区、历时20天的“全景实验”,最终留下的不仅是一部“开幕大片”和上万件作品,更是一个关于未来的预言:
除了降本增效,AI 也可以成为文化连接的媒介,成为集体创作的协调者,成为让不同文明背景的人们共同讲述一个故事的可能性。
每一次媒介技术的变革,都会重塑我们参与世界的方式。如果说摄影技术让我们拥有了记录的权利,电视转播让我们拥有了在场的权利,那么 AI 带来的,是 “想象力的平权”。
只要求你有一颗不甘平庸的大脑,和一种想要表达的冲动。
原文信息
- 作者:向阳乔木(@vista8)
- 原文发布日期:2026-02-06 原文地址:
赞同,实践出真知。
作者写得真不错,学到了不少。
这篇文章分析得很透彻,收藏了!
写得挺用心的,支持一下。
讲解得很细致,新手也能看懂。
实测过类似工具,作者说的基本属实。
这个比较实用,已转发给同事。
很有价值的分享,感谢整理。