自OpenAI发布文生视频模型Sora以来,中美两国的AIGC企业发展路径大相径庭:一边是成本高昂、难以扩展的Sora2和几乎零留存率的Sora App;另一边,是中国企业植根于广泛的应用土壤,逐渐走向成熟,并迎来商业化的全面爆发。
据《智能涌现》最新报道,专注于视觉多模态生成式AI的智象未来,在2025年的全年营收已突破1亿元。其C端产品vivago.ai也迎来了下载高峰,其中1月新增近千万用户,在全球100+国家和地区进入Google Play“视频播放与编辑”类别榜前十,展现出巨大的商业潜力。
自成立以来,智象未来相继发布了HiDream-I1图像生成大模型和HiDream-E1交互编辑模型,并在2025年4月全面开源。开源24小时内即在国际权威AI测评榜单Artificial Analysis中登顶。
这家源自合肥的企业,通过自研的超百亿参数大模型和全球首创的扩散自回归架构,在生成质量与效率之间找到了完美平衡。目前,其产品已在文创、影视、广告等多个领域得到广泛应用。
《智能涌现》独家获悉,智象未来的融资进程正在加速:B轮融资已进入交割阶段,下一轮TS已提前确定。接近公司的核心知情人士透露,两轮融资均为数亿元量级。在AI视觉生成赛道竞争日益激烈的背景下,智象未来凭借其硬核技术实力和清晰的商业化路径,持续获得头部资本的重仓布局。
在多模态落地应用加速的当下,智象未来还蕴藏着怎样的商业潜力?
从创立之初,智象未来就找到了一种务实的浪漫。创始人梅涛是加拿大工程院外籍院士,曾在微软任职长达12年。他在多媒体分析和计算机视觉领域发表了300多篇论文,并15次荣获最佳国际论文奖。
但梅涛的经历远不止于此。2018年,他加入京东,担任京东探索研究院副院长。这段经历让他看到了技术到商业化落地的可能性。
在决定创办智象未来时,梅涛有着清晰的构想。一方面,多模态是实现通用AGI的最可能路径;另一方面,在商业化前景上,多模态比纯语言模型有着更广阔的空间。梅涛曾在2025年对36氪表示:“当前全球AIGC收入的50%-60%来自图片和视频相关应用,高于纯文本模型。”
这正是梅涛的主战场——在计算机视觉(CV)和多模态领域有着深厚的积累。
然而,对于当时的中国创新企业来说,Sora是一座难以逾越的大山。考虑到其对物理世界的还原程度和实现的惊艳效果,业内普遍期待中国创企能否拿出可以与之匹敌的生成结果。
一场竞赛就此展开。在Sora发布后仅半年内,智象未来就发布了自主研发的多模态大模型。2025年4月更是开源了图像生成大模型HiDream-I1与交互编辑模型HiDream-E1打通了从对话到图像创作的闭环。HiDream-I1在Artificial Analysis中24小时内登顶成为首个进入全球第一梯队的中国自研生成式AI模型并在图像质量、语义理解、艺术表现三大维度刷新了行业纪录。
然而多位创业者复盘后认为Sora在架构创新上有些落后。梅涛当时也感觉Sora的功能与预期相近。此后半年随着智象未来等初创企业的入局OpenAI在视频生成领域已不具太大优势。特别是从产品落地角度看无论是海外还是国内的其他产品都已相差无几。
与此同时在探索多模态架构范式上智象未来甚至走在了前列。公司最早研发了生成和理解双模型而后规划理解生成一体化这被看作是通往物理世界的最佳路径。
智象未来也一直在突破行业难题的路上。2025年随着最新模型的开源以及vivago2.0等产品的发布梅涛告诉36氪DiT(Diffusion Transformer)架构利用Transformer的强大能力处理视频数据让AI模型能高效建模时空关系并灵活生成不同分辨率的视频这是一个重要的进步。然而对整个生成式AI领域而言复杂物理现象的逼真还原仍是悬而未决的难题——飞溅的水珠轨迹、物体碰撞的力学反馈等人类直觉可感的动态细节仍处于“形似而神不似”的探索阶段在相关场景中仍常出现视觉违和感。
智象未来通过Sparse DiT架构让模型在生成效果和运行速度之间找到了优异的平衡点。再通过对抗蒸馏技术在增加推理效率的同时极大地增强了画面的细节和美感。这最终促成了智象未来旗下HiDream-I1模型的多个创造性成绩。
与大厂卷基模、搞参数的逻辑不同小厂更讲究创新与落地。在梅涛看来这也是智象未来的价值所在——解决好AI最后一公里的落地问题。
“从我们创业第一天起我们就非常有危机感意识就想着怎么样去找PMF。我们在商业化方面走得比较早也比较快。”梅涛曾对36氪表示。
成立早期智象未来就形成了“1+3+N”布局即一个核心多模态大模型驱动创作工具平台、互动营销内容工具和一站式视频创作Agent三大产品。截至目前其服务已覆盖全球超2000万个人用户和超4万企业用户。
“做好定位之后核心是怎么做好交付服务好客户让AI真正产生价值。”梅涛告诉36氪智象未来有国内最全的多模态版权语料、数十万小时版权视频素材以及上万个授权IP。不仅涵盖了国内70%影视数据且已形成上亿条AIGC二创素材目前在影视、文旅、营销等场景得到广泛应用。
“在微软研究院我们就经常说从一个技术到一个产品可能需要一百个工程师;要把产品卖好可能还需要一百个解决方案专家或BD可见中间的Gap有多大。当时我就想我一定要找个地方去把链条打通。”
也正是这份从技术到落地的全链条能力让智象未来自诞生至今一直颇受资本看好。
2024年智象未来完成数亿元A轮融资由合肥产投集团领投安徽省人工智能母基金等机构参与。2025年底京东集团作为战略投资方对智象未来进行加码其背后的物流、零售、健康、工业等庞大业务场景恰恰是多模态AI技术绝佳的落地试验田和应用沃土。
随后便有知情人士透露智象未来紧锣密鼓地启动了B轮融资的筹备工作并计划于2026年初完成交割。
36氪近期了解到智象未来已顺利拿到下一轮TS其中老股东持续加持新股东有产业资本、业务能深度合作的上市公司和知名投资机构目前B轮融资金额已达到数亿元人民币。
2025年是中国多模态生成式AI的爆发元年。随着AIGC技术的日趋成熟生产力与创造力显著提升驱动应用市场呈爆发式增长态势。根据IDC数据全球生成式AI市场规模未来五年复合增长率预计高达63.8%到2028年将达2842亿美元占AI总投资的35%。而智象未来凭借极强的技术实力与产业化落地思维成为其中的获益者。公司商业化进程迅速36氪获悉智象未来2025年的全年营收已过亿。
能在竞争激烈的多模态生成领域快速实现这样的成绩得益于智象未来独特的商业模式思考与强势的底层创新能力可以说智象未来是行业里为数不多的商业化与技术创新两手抓的企业。
在创立的三年时间里智象未来经历了不同的商业模式。2023年的模式是MaaS卖模型和API类似于云计算的PaaS模式;2024年的模式是SaaS主要卖工具让用户在智象未来的平台上使用工具生产内容;现如今其已升级模式正式转变为RaaS即交付结果、以用户价值为导向的商业模式包括工具、内容素材、限额视频制作/投放只收少量的基础费用主要是赚取客户的GMV提升后的分佣。据梅涛表述其认为这样的客户价值相对清晰可以基本上实现零风险投入增量收益共享。
“随着创业渐入佳境我们已经找到了商业回报和能力提升的平衡点。”梅涛表示一方面要不断加大水位做好垂类基础模型的研究;另一方面依旧要解决最后一公里问题深入到用户的实际场景需求里打通更多垂类数据如教育、电商和文旅等行业做精调真正解决行业问题。
本文由主机测评网于2026-06-13发表在主机测评网_免费VPS_免费云服务器_免费独立服务器,如有疑问,请联系我们。
本文链接:https://www.vpshk.cn/20260647264.html