← 回總覽

阿里视频大模型 Wan3.0 开启公测:文档、ppt 也能变视频

📅 2026-08-07 11:23 量子位的朋友们 人工智能 1 分鐘 1147 字 評分: 72
AI 视频生成 多模态 AI 模型发布 AI 商业化 阿里云
📌 一句话摘要 阿里发布 Wan3.0 视频生成大模型,支持最长 30 秒生成、文档/PPT/Excel 输入与多种参考模态,从内容生成工具向生产力工具升级。 📝 详细摘要 文章报道阿里视频生成大模型 Wan3.0 于 8 月 6 日开启公测,梳理其核心升级点。在生成能力上,单次可生成 30 秒连续视频,支持智能时长推荐,使复杂镜头语言与完整叙事成为可能;在输入模态上,除文本、图片、音频、视频外,新增 doc、xls、ppt、pdf、md 等文档格式,可结合提示词生成教学课件、产品演示与业务汇报;在画面真实性上,人物表现强调千人千面与微表情联动,数字化图表信息也有质感提升;视频编辑支持修改

📌 一句话摘要

阿里发布 Wan3.0 视频生成大模型,支持最长 30 秒生成、文档/PPT/Excel 输入与多种参考模态,从内容生成工具向生产力工具升级。

📝 详细摘要

文章报道阿里视频生成大模型 Wan3.0 于 8 月 6 日开启公测,梳理其核心升级点。在生成能力上,单次可生成 30 秒连续视频,支持智能时长推荐,使复杂镜头语言与完整叙事成为可能;在输入模态上,除文本、图片、音频、视频外,新增 doc、xls、ppt、pdf、md 等文档格式,可结合提示词生成教学课件、产品演示与业务汇报;在画面真实性上,人物表现强调千人千面与微表情联动,数字化图表信息也有质感提升;视频编辑支持修改画面、剧情与台词。文章还列出了百炼、万镜一刻等公测入口与 API 价格,并注明为阿里云提供、量子位获授权转载。

💡 主要观点

- Wan3.0 单次可生成 30 秒连续视频,并支持智能时长推荐。 更长的生成时长使一镜到底、连续运镜等复杂叙事成为可能,AI 视频从生成单个镜头扩展到完整故事表达。

新增文档输入模态,支持 doc、xls、ppt、pdf、md 等格式。 模型可从结构化文档中读取信息,结合提示词生成产品演示、教学课件、业务汇报等生产力场景内容。
画面真实感提升,强调人物千人千面与细粒度参考保持。 五官皮肤细节更敏锐,情绪与微表情联动;角色、道具、风格等维度在生成中可稳定保持。
视频编辑能力增强,支持修改画面、剧情与台词。 文章同时指出声音质感与文字准确度仍有进步空间,说明当前版本存在明确边界。

💬 文章金句

- AI 视频从"生成一个镜头"走向"讲述一段完整的故事"。

  • 视频生成模型正从内容生成升级为生产力工具,用户对画面的要求不止于清晰,更要真实。

📊 文章信息

AI 初评:72

来源:量子位

作者:量子位的朋友们

分类:人工智能

语言:中文

阅读时间:4 分钟

字数:899

标签: AI 视频生成, 多模态 AI, 模型发布, AI 商业化, 阿里云

阅读完整文章

查看原文 → 發佈: 2026-08-07 11:23:54 收錄: 2026-08-07 18:00:47

🤖 問 AI

針對這篇文章提問,AI 會根據文章內容回答。按 Ctrl+Enter 送出。