全球粉丝用"上万个"提示词让阿里云AI做出一条开幕大片

采集助手AI 前沿2026-09-170 阅读

一句话结论

米兰冬奥开幕大片《YOUR EPIC VIBE》从全球上百国、上万参赛者的万相 AI 一句话生成视频中精选 100 个剪辑而成;原文拆解了高速冰雪运动画面避免肢体扭曲的物理挑战,并给出「总体描述 + 镜头序号 + 时间戳 + 分镜内容」的可复用分镜提示词公式与智能多镜省力用法,是普通人用 AI 视频生成参加全球级创作的完整案例。

就在今夜,米兰冬奥会即将拉开帷幕。 “开幕大片”《YOUR EPIC VIBE》率先发布,让我们一睹为快!

**这次冬奥“开幕大片”有点不一样!中文翻译是 “意展你风采” ** 这是从全球上百个国家、上万人参加的米兰冬奥会AIGC全球大赛中,精选出的100个优秀作品 汇聚而成。

活动由国际奥委会联合阿里云共同发起。参赛选手只需用 阿里云万相 AI 输入一句话,生成 脑海中想象的 5 秒冬奥视频即可参赛。体育和AI技术的结合过往都只是服务于赛事本身,现在居然把观众带进赛场!同时我也很好奇,在冬奥体育运动这种需要表现高速运动和复杂粒子物理规律的画面,万相AI将如何应对?

地狱级挑战

高速运动

短道速滑、雪车、空中技巧等项目,运动速度极快且动作幅度大。

传统 AI 模型处理此类场景时,极易出现肢体扭曲、穿模或瞬移等物理错误。

较长视频可以通过叙事铺垫掩盖瑕疵,但在 15 秒的窗口内,几乎不存在缓冲空间。

每一帧都暴露在放大镜下,容错率极低。

物理规律

冰雪运动的特殊性在于:

  • 花样滑冰的托举动作要求毫米级平衡
  • 雪板切入雪面时溅起的雪沫
  • 冰面上流动的倒影
  • 高速转弯时身体的压弯角度

细节构成了冰雪运动的真实感,AI 必须生成符合物理规律的视频

不仅要保证高速运动的连贯性,无卡顿、撕裂、鬼影,就连运动模糊都要贴合真实光学效果。

生成专业运动视频

看到“开幕大片”里的画面效果 ,我也忍不住尝试体验了一把万相AI的视频生成

这里提供一个提升效果的万能视频分镜公式:

总体描述 + 镜头序号 + 时间戳 + 分镜内容

我让Claude 4.5帮我生成了一个专业视频生成提示词如下。

你是一个专业的视频分镜脚本编写者,需要为AI视频生成工具提供清晰、结构化的提示词,创作时长为5-15秒的短视频。   按照”总体描述 + 镜头序号 + 时间戳 + 分镜内容”的结构编写视频生成提示词:

  • 总体描述: 概述视频主题、叙述视角、情感基调和核心事件,鼓励超现实和富有想象力的创意(如透明角色、外太空场景、梦幻环境等)

  • 镜头序号: 为每个镜头编号,格式为”第X个镜头”,建议2-4个镜头(适配5-15秒视频时长)

  • 时间戳: 标明镜头时间范围,格式为”[X-Y秒]“,总时长控制在5-15秒内

  • 分镜内容: 描述场景、角色动作、表情情绪、镜头运动和转场方式,鼓励天马行空的想象(非常规场景、超自然元素、视觉奇观等)

Format(格式)

这个故事以[视角]视角,讲述了一个关于[主题]的[类型]。

第1个镜头[0-X秒][场景]。[角色][动作],[表情/情绪]。

第2个镜头[X-Y秒][转场方式],[镜头运动],[场景]。[角色][动作],[表情/情绪]。

第3个镜头[Y-Z秒][转场方式],[场景]。[角色][动作],[表情/情绪]。

注意: 总时长5-15秒,镜头数量2-4个,鼓励使用超现实元素(透明人物、月球/太空场景、梦幻世界、时空扭曲等)

待输入

{{你的主题}}

如果不需要精准控制每个镜头,强烈推荐打开“智能多镜”功能。

只需最简单提示词,都能生成相当不错的分镜效果。

一起来看看我以《YOUR EPIC VIBE》为灵感生成的3段画面吧!

测试 1:熊猫滑雪

先来看看这只滑雪的奶牛猫,很有意思!

图片

我也尝试让阿里云万相 AI 生成了一段”熊猫滑雪”视频。

雪板划过雪面的痕迹、毛茸茸身体随着地形起伏,动感和细节都超出了我的预期。

图片

测试 2:机器人滑雪

图片

YOUR EPIC VIBE作品

咱也来个赛博朋克机器人滑雪,开启智能多镜。

赛博朋克机器人自由式滑雪。

蓝紫霓虹风,很赛博朋克!

图片

测试 3:火柴人滑雪

大家有时会吐槽 AI 生成的图片和视频都太精致了,这次的作品中也有用线条表现运动的,非常艺术!

图片

我也用Wait But Why经典的火柴人形象生成一段滑雪视频。

感觉很有故事和趣味性。

图片

大家也可以试试更多风格。

比如水墨风、3D渲染、童话绘本,看能不能组合出更有趣的东西。

技术亮点解析

发现阿里云万相 AI 在这次大赛中的表现,不是简单的”文字生成视频”,还有一些令人惊喜的亮点。

1. 复杂动态表现能力

万相 AI 专门强化了复杂动态表现和运镜遵循能力,能在大幅度复杂动作中保持人物肢体稳定性、动作和谐性和连贯性。

轻松应对像高山速降、花式跳台这样的高速、复杂动作。

图片

2. 物理规律还原

通过精心准备的高质量运动数据微调,AI 模型”学会”了:

  • 急转时的身体倾斜角度
  • 跳跃落地的缓冲姿态
  • 雪板切入雪面的阻力
  • 背后扬起的粉雪轨迹

让滑雪者与雪地的互动变得更加真实、自然,都变得丝滑顺畅、如临其境。

图片

3. 语言泛化与意图理解

阿里云万相 AI 自带提示词强化,从而生成符合并超出用户预期的精彩视频内容。

图片

模型能让用户任意语言、任意内容的描述,都可以通过模型强化和完善为冰雪运动中的关键要素。

图片

4. 多模态参考生成

万相 AI 可以进行镜像级人物重建,能精准捕捉用户上传的形象特征。

它能直接参考输入视频里的形象和声音来做二创,不管是人还是拟人形象都能当主角,多人合拍、人与物同框都没问题。

而且它还自带 AI 角色库,用起来很方便。

我随手输了句“ @关羽 滑雪”,开启智能多镜。

图片

生成的关羽老爷滑雪:

图片

5. 智能多镜能力

万相 AI 的智能多镜能力,解决了主流视频生成模型的“单镜头限制”痛点,能够在一个生成任务中输出包含多个镜头的连贯视频流。

再搭配原生音画同步能力,非专业用户也能轻松产出视听完整的作品。

图片

从观看到共创

米兰冬奥会AIGC全球大赛 的意义,远不止于产出了一部精美的“开幕大片”。

传统上,制作一部高质量冰雪运动视频,需要专业团队、昂贵设备、复杂后期。

但万相 AI 消解了这些门槛。

图片

《YOUR EPIC VIBE》 还将在瑞士洛桑奥林匹克博物馆、意大利米兰和平门、中国杭州三地联展。

这次大赛不仅是一场艺术和技术的“民主化”,阿里巴巴的AI生态技术让创作权从少数专业人士手中释放出来,与此同时,也开创了一种全新可能性:让全球粉丝不仅是奥运故事的见证者,更是叙事者和创造者。

写在最后

这场跨越上百个国家和地区、历时20天的“全景实验”,最终留下的不仅是一部“开幕大片”和上万件作品,更是一个关于未来的预言:

除了降本增效,AI 也可以成为文化连接的媒介,成为集体创作的协调者,成为让不同文明背景的人们共同讲述一个故事的可能性。

每一次媒介技术的变革,都会重塑我们参与世界的方式。如果说摄影技术让我们拥有了记录的权利,电视转播让我们拥有了在场的权利,那么 AI 带来的,是 “想象力的平权”

只要求你有一颗不甘平庸的大脑,和一种想要表达的冲动。

原文信息

  • 作者:向阳乔木(@vista8)
  • 原文发布日期:2026-02-06 原文地址: