2026年8月11日 星期二
返回归档
今日头条
模型动态

阿里Wan3.0公测引爆全网:30秒电影级视频生成,文档秒变大片

阿里巴巴正式公测全新一代视频生成模型Wan3.0,单次生成上限达30秒1080P高清视频,首创多格式办公文档直转能力,支持doc/xls/ppt/pdf/md等格式直接生成视频。480P分辨率仅0.3元/秒,性价比远超Seedance 2.5。

模型动态2026-08-11 08:00

Sora 2正式关闭服务,AI视频生成进入"中国时间"

2026年4月26日,OpenAI正式关闭Sora 2的Web和App体验,API将于9月24日终止服务。这一消息标志着AI视频生成领域的一个关键转折点。 Sora关停的深层原因:视频生成的计算成本远超文本/图像生成。据估算,生成一段高质量1分钟4K视频所需算力,约为生成等量文本内容的1000倍以上。在OpenAI将战略重心转向GPT-5系列的背景下,Sora的运营难以为继。 后Sora时代格局: - ByteDance Seedance 2:API稳定性得分92,多镜头生成能力强 - Google Veo 3.1:真实感最强,支持原生音频,但API尚未公开 - Kuaishou Klin...

技术前沿2026-08-11 10:15

中科院等发布WorldExam:全球首个视频世界模型能力评测基准

这项由中国科学院自动化研究所(CASIA)联合香港中文大学(CUHK)、上海人工智能实验室(SLAI)、高德地图(AMAP)及清华大学(THU)共同完成的研究,于2026年8月以预印本形式公开发布,论文编号arXiv:2608.02603。 核心问题:当前的AI视频生成模型评测体系长期停留在"画面好不好看"和"角色有没有按指令动"的层面,没有追问更关键的问题——AI生成的"世界"真的会对周遭环境做出合理反应吗? WorldExam把视频世界模型的能力层层拆解: 1. 表面画质层:画面清晰度、色彩还原 2. 运动合理性层:角色动作是否符合物理规律 3. 世界反应性层:当AI角色靠近障碍物时障...

投融资动态2026-08-11 07:00

可灵AI创全球视频大模型最大融资纪录:30亿美元落地,估值180亿美元

7月2日,快手旗下AI视频生成业务"可灵AI"完成近30亿美元(约203.8亿人民币)融资,投后估值达180亿美元(约1223亿人民币),创下全球视频大模型公司最大额融资纪录。 融资阵容: - 领投方:CPE源峰、国方创投、BlueFive、腾讯、中关村科学城基金(联合国科投资)、中信证券 - 产业资本:阿里云、百度等顶级产业资本 - 文娱产业方:华策影视、芒果产业投资人(厚为资本) 运营数据亮点: - 2026年Q1营收超6.5亿元,同比增长超300% - 2026年3月ARR(年化收入)近5亿美元,一年内增长4倍 - B端企业客户API调用收入和P端付费会员订阅收入双轮驱动 - B端和...

投融资动态2026-08-11 11:00

AI短剧赛道融资潮:四家公司三个月合计近300亿元

AI视频大模型赛道资本热度持续攀升,头部企业接连完成大额融资。 四笔重磅融资: 1. 可灵AI(快手):近30亿美元,投后估值180亿美元,CPE源峰/腾讯/中信证券领投 2. 生数科技:5亿美元,阿里云领投,通用世界模型企业 3. 爱诗科技:C轮累计29.8亿元人民币,C+轮阿里巴巴领投,旗下PixVerse覆盖175个国家 4. 演语科技:近3亿美元B+轮,投后估值超20亿美元,旗下LibTV AI视频创作平台 互联网巨头既是"投资人"也是"参赛者": - 腾讯、阿里云、百度罕见同台入股可灵 - 阿里领投生数科技B轮与爱诗科技C+轮 - 各家自研模型加速迭代:字节Seedance 2....

模型动态2026-08-11 14:00

字节Seedance 2.5发布:30秒超长视频+50个参考素材,AI短剧神器

字节跳动正式发布新一代视频生成模型Seedance 2.5,较年初发布的Seedance 2.0在四大核心能力上均实现突破。 核心升级: 1. 超长视频:单次生成从15秒突破到30秒,可"套娃式"多次续写极限累加到60秒 2. 50个参考素材:单次最多30张图+10段视频+10段音频,角色设定/场景/道具/参考片段/配音全部可当参考 3. 多人参考与音色参考:多角色同框不"撞脸",一段录音锁定角色声音 4. 时间戳文本控制:第几秒谁出场、第几秒开打、第几秒反转,精确到秒下指令 商业化落地加速: - AI短剧制作成本从传统实拍的30-50万压缩至3-5万元 - 质量已达到可商用标准 - 爆款...

技术前沿2026-08-11 15:30

CVPR 2026:六个基准从六个维度重新定义"好视频"

CVPR 2026收录六篇视频生成评估相关工作,从六个维度重新定义视频生成质量评估标准。 六维评估框架: 1. 人体姿态(Google WyD):1,544个精选视频,覆盖9大类别56个子类别,细粒度人体动作标注,通过姿态检测器提取关键点轨迹用匈牙利匹配算法评估 2. 美学评估:关注视频的视觉美感和构图质量 3. 虚假信息:检测AI生成视频中的虚假内容和不合理信息 4. 物理真实感:验证视频中的物理规律是否正确(重力、碰撞、流体) 5. 社会推理:评估视频中的社会行为逻辑是否合理 6. 参考对比:与参考视频的质量对比评估 核心趋势:否定FVD"一个数字定胜负"的评估范式。FVD衡量的是像素...

创作者生态2026-08-11 16:00

央视网启动AI短剧云创平台生态合作计划,构建产业"新基建"

4月16日,2026年中国网络视听大会上,央视网启动"AI短剧云创平台生态合作计划"及"跟着短剧去运动"生活体育AI短剧/漫剧创投扶持计划。 四大核心模块: 1. 内容聚合与创意中心:联合全球优质音视频AI大模型和工具集,提供AI编剧、智能分镜、视频生成、智能配音等全流程创作工具 2. 智能审核与合规平台:依托"清晏审核"自研智能技术,提供前置合规审核与"央视网云创平台合规认证" 3. 全渠道发行网络:一键接入全网主流分发网络,一键触发海外传播,建立透明自动化分账系统 4. 人才培养与合作平台:赋能OPC创作新模式,为个人创作者提供线上工作室、专业培训、采风中心与社区互动 生态落地采用"央...

创作者生态2026-08-11 16:30

咪咕发布"繁星沐光"五大战略:2万+IP免费开放+2亿专项扶持资金

2026年中国网络视听大会微短剧高质量发展论坛上,中国移动咪咕数媒发布"繁星沐光"五大战略计划。 五大战略: 1. 开放IP:2万+全版权精品网文与剧本IP免费开放,覆盖200+细分题材,IP改编成功率达43%,漫剧改编全网播放量突破15亿 2. 工具打造:基于"仝舟"平台的AI短剧制作工具,整合移动九天算力与行业头部模型,提供AI剧本创作/AI剧视频生产/智能剪辑与自动化投流三大核心工作流,提效降本超60% 3. 平台激励:2亿元AI剧专项扶持资金,计划扶持1000+部AI剧,助力100家合作方收入破百万 4. 会员升级:咪咕悦看开设AI剧专区,千万级用户专属流量池 5. 多元发行:依托中...

创作者生态2026-08-11 17:00

AniShort完成近亿元融资,AI短剧工具赛道年度最大单笔

2026年6月,八点八数字旗下AI短剧协作平台AniShort完成近亿元融资,由北京泰中合领投,多家机构跟投,老股东全线加码。 平台核心能力: - 全流程闭环:打通剧本创作、分镜生成、图片生成、视频生成、智能剪辑、团队协作管理、成片审阅 - 顶级模型集成:满血集成Seedance 2.0、Gemini、DeepSeek、Banana、Image2等全球顶级AI模型 - 多画布节点式光标级协同技术,被业内称为"AI短剧界的飞书" - 10万字小说一键拆解,主体分镜一键生成 - 智能体批量自动化执行任务,成片效率百倍提升 行业首创3D创作体系: - 3D世界:文字/参考图/视频片段三种输入,一...

工具测评2026-08-11 18:00

2026 AI视频模型横评:Wan3.0/Veo3.1/Kling3.0/Hailuo02/Seedance同场景实测

专业测评团队用控制变量方式实测当下第一梯队的开源与闭源视频生成模型。场景统一为都市情感短剧人物特写,同一张参考图,I2V与T2V各一条,共10条并排对比。 I2V实测数据(同一张参考图): | 模型 | 分辨率 | 时长 | 音频 | 出片耗时 | 单价 | |------|--------|------|------|----------|------| | Wan 2.2 14B(开源) | 480x832 | 5.06s | 无 | ~744s | ~$0.07 | | Hailuo 02 | 768x1364 | 5.88s | 无 | ~280s | $0.27 | | Seeda...

行业应用2026-08-11 12:00

AI视频全球市场预计2030年达180亿美元,中国厂商加速登顶

2026年上半年,AI视频生成赛道经历一轮激烈的格局重塑。Sora退场后,中国厂商正加速登顶。 市场数据: - 2026年全球AI视频生成工具市场约35亿美元 - 预计2030年将达180亿美元,2026-2030年CAGR约50% - 付费用户规模从千万级向4000-6500万扩张 - 单客年贡献从约300美元向300-400美元提升 技术演进路径: - GANs主导的Demo探索阶段 → 扩散模型质量突破 → DiT为核心骨干架构 - 2025年Veo 3、Sora 2、Wan2.5相继发布,原生音画同步成为标配 - 可灵3.0于2026年2月发布,技术命题从"能否生成视频"转向"能否...

技术前沿2026-08-11 13:00

Xmax X2.0:清华团队发布全球首个虚实融合实时交互视频模型

清华史佳欣团队(KEG出身,和智谱同实验室)Xmax AI发布X2.0实时交互视频模型。2026年2月发X1(全球首个虚实融合实时交互视频模型),7月15日发X2.0。 X1到X2.0演进: - 分辨率:480p → 960p@24fps - 延迟:毫秒级 - 端侧:iPhone可跑384p@16fps - 六大模式:CharX(角色变身)/ClothX(换装)/VibeX(氛围)/MoX(动态)/DimX(维度)/Free(自由) 技术底座: - 流式DiT + 多阶段蒸馏 + FP8 + 统一交互架构 - 破解"速度/成本/质量"不可能三角 定价爆点: - 海外:$6/h - 国内:...