当前位置:首页 > 科技资讯 > 正文

OpenAI推出Sora 2,视频生成市场激战正酣

近日,OpenAI(美国人工智能公司“开放人工智能研究中心”)隆重推出了其视频生成模型的重大更新——Sora 2,并同步上线了一款社交应用(Sora App)。相较于前一代,Sora 2在物理表现上更为精准、逼真且可控,还实现了音频与对话的同步生成功能。

10月10日,相关概念股逆市上扬。其中,初灵信息(300250.SZ)涨幅达12.94%,开普云(688228.SH)涨幅为4.52%,视觉中国(000681.SZ)上涨3.11%。

OpenAI推出Sora 2,视频生成市场激战正酣 Sora 2 视频生成 AI 市场竞争 第1张

Sora 2引领视频生成新风尚

Sora 2是一个原生的视频和音频生成模型,是去年Sora模型的升级版。OpenAI将其比作视频生成领域的GPT-3.5时刻。

与前述AI视频生成模型相比,Sora 2在物理运动、人物塑造等方面取得了显著进步。首先,Sora 2能够精确还原与物理规律相关的复杂运动;其次,它具备跨镜头一致性控制能力,支持多镜头切换下的场景连贯呈现;此外,Sora 2还拥有多模态协同能力,可同步生成与画面匹配的环境音、对话音效,并能实现人物口型与发音的精准对齐,甚至能根据简单的提示词补充自然剧情。

据OpenAI相关负责人透露,Sora 2在9月底上线后短短五天内,下载量已突破100万次,其增长速度甚至超过了此前大受欢迎的ChatGPT。

在同类产品中,xAI也在其社交媒体平台推出了Grok Imagine v0.9,该模型支持从静态图像直接转化为动态视频,并能无缝集成背景音乐、对话甚至唱歌元素。相较于前一版本,该模型在视觉质量、运动流畅度和音频生成方面也实现了升级。

此外,据外媒报道,谷歌的新一代文生视频模型Veo 3.1的首批真实生成样本能够生成时长8秒、分辨率为720p且包含音轨的视频片段。与前代版本相比,Veo 3.1在多个细节方面也进行了优化。

目前,文生视频技术已较为成熟,Veo3、Sora等视频模型都能较好地完成文字到视频的转换。各家公司正积极推动相关产品的迭代升级,一场围绕全能型AI视频生成器的竞争已经拉开帷幕。

市场持续扩张,国内企业积极布局

分析人士指出,文生视频应用行业的发展逐渐形成了“模型能力-用户场景-商业变现”的完整链路,既避免了因单一工具属性导致的增长乏力,更以“数据飞轮+社交网络”的双重“护城河”,巩固了其在AI生成式内容领域的领先地位。

从市场空间来看,根据Fortune business insights的预测,2024年AI视频生成的全球市场规模将达到6.15亿美元,预计2025年将增长至7.17亿美元,同比增长率为17%。而到2032年,AI视频生成市场的规模有望达到25.63亿美元。从2025年至2032年的复合增长率为20%。

面对如此巨大的市场空间,国内企业正积极抢占发展先机。汉王科技(002362.SZ)在文本、图像、视频、生物特征、语音等多模态识别、文本理解和利用等技术上深耕多年,已形成智能终端产品和行业解决方案。

视觉中国(000681.SZ)作为全球正版视觉内容平台,积极与智谱清影、通义千问展开合作,将光厂创意平台接入文生视频 API,进一步拓展了自身在创意内容生成领域的边界。2025年上半年,视觉中国的视觉内容与服务实现营收3.99亿元,同比增长0.05%。

风语筑(603466.SH)在互动平台表示,公司正在数字人驱动、文生文、文生图等场景积极引入AIGC技术,并在文生视频、图生视频等生成式3D内容场景进行积极探索。

机构建议关注三大方向

从产业趋势来看,AI视频生成技术正由辅助创作向自主生成阶段迈进。华泰证券表示,随着算法能力与算力成本的优化,影视、广告、游戏等行业将实现降本增效。同时,创新的AI应用商业形态及产品有望不断涌现。

光大证券认为,Sora 2展示了文生视频模型的性能提升远未达到上限。AI视频有望逐渐从业余娱乐创作向商业化创作拓展。此外,文生视频的快速发展也将带动算力和存储需求,有望提振相关领域的投资情绪。

对于相关领域的市场机会,中国银河证券分析师列出了三大主线:一是受益于AI视频规模化落地,未来算力需求将进一步呈现爆发与架构多元化趋势;二是人工智能物联网推动智能终端从“数据采集器”向“自主决策体”跃迁;三是AI+视频成为拉动流量并快速变现的最佳赛道。