
近期,美国AI初创公司LMArena宣布完成A轮融资,融资金额高达1.5亿美元,投后估值达到17亿美元(约合120亿人民币)。本轮融资由Felicis Ventures和加州大学伯克利分校旗下的投资基金UC Investments领投,A16Z、光速创投等多家知名VC跟投。
此轮融资之所以引人关注,主要有三点原因:
首先,LMArena的估值增长迅猛。其上一次融资是在2025年5月的种子轮,当时估值仅为6亿美元。这意味着在短短七个月内,其估值翻了三倍,迅速晋升独角兽行列。
其次,LMArena团队规模极小。根据PitchBook等数据显示,截至2026年初,公司员工总数仅有29人,相当于人均估值四个亿。
最后,LMArena的产品看似技术含量不高,许多人认为“我也能行”。实际上,LMArena并非一家传统意义上的AI公司,而是一个为大型模型打分、排名的网站,可以视为大模型版的安兔兔。
在大模型竞争激烈的背景下,却是一个大模型“跑分”工具率先赚得盆满钵满。
LMArena的崛起其实是无心插柳的结果。
LMArena起源于一个开源学术组织LMSYS Org,该组织由来自加州大学伯克利分校等名校的学生、教授发起,致力于通过开发开源模型、系统和数据集,使大模型的使用和评估更加平民化。
值得一提的是,LMSYS Org的华人成员众多,包括伯利克的博士Lianmin Zheng、UCSD的助理教授Hao Zhang等。
2023年3月,LMSYS Org发布了一款名为Vicuna的开源模型,性能可媲美ChatGPT。然而,他们发现当时市场上缺乏可靠的测试方法来判断模型的好坏。于是,研究团队在同年4月推出了名为Chatbot Arena的开放测试平台。该平台在AI圈内迅速走红。2024年9月,Chatbot Arena更名为LMArena,现已成为全球最权威的大模型评测平台之一。
LMArena的核心理念是“匿名对战”。用户输入提示词后,系统随机挑选两个AI模型生成输出。用户在不知道模型身份的情况下,对比输出质量并做出选择。经过大量这样的对战后,每个模型的最终得分得以确定。
这一简单的打分机制直接解决了大模型评测的核心痛点。
2025年初,LMArena正式注册为公司,开始从学术项目转向商业化发展。
提到“跑分”,人们很容易联想到国内曾经的安卓跑分工具。这类工具拥有用户、知名度和流量,但难以找到有效的商业化变现方式。最后往往被大厂“包养”,逐渐失去公信力,最终被用户抛弃。那么,LMArena是否也会面临同样的问题呢?
答案是肯定的。虽然LM Arena尚未直接接受AI大厂的投资,但包括A16Z在内的VC机构投资了许多AI公司,间接的利益关系不容忽视。
LM Arena在公信力上遭受的最大质疑是2024年初在AI圈内引起轩然大波的Meta“作弊”事件。
多家AI公司、高校的研究人员联合发表文章指责LM Arena帮助部分AI公司操纵排名。文章指出Meta在发布Llama 4前私下在LM Arena平台上测试了多个模型变体但最终只公开了表现最好的一个模型的得分以在排行榜上名列前茅。此外文章还认为LM Arena存在偏向性增加了大厂模型的“对战”次数使这些公司的模型排名获得不公平优势。
对于这些指责LM Arena回应称“一些说法与事实不符”并表示公布预发布模型的分数本身没有意义。
那么如果不以牺牲公正性为代价LM Arena还有哪些更好的商业化手段呢?
2025年9月LMArena正式推出首个商业化产品AI Evaluations。该产品主要面向开发AI大模型的企业或研究机构为他们提供模型评估服务。AI Evaluations在2025年12月的ARR已达到了3000万美元。
考虑到AI Evaluations上线不到四个月这样的成绩还算不错但它显然还不足以支撑17亿美元的估值。投资AI Evaluations的硅谷VC还看到了哪些潜力?
在领投LMArena的种子轮融资后A16Z曾解释自己的投资逻辑其核心观点有三条:
首先A16Z认为LMArena的评分已在事实上成为评价AI大模型性能的标准是AI产业发展的关键基础设施。
第二LMArena打造了一个简单而成功的飞轮机制:用更多模型吸引更多用户从而产生更多偏好数据进而吸引更多模型加入。这个飞轮一旦形成就是难以复制的壁垒。
第三A16Z认为中立、持续的评测未来将是AI大模型监管的刚需。
本文由主机测评网于2026-06-13发表在主机测评网_免费VPS_免费云服务器_免费独立服务器,如有疑问,请联系我们。
本文链接:https://www.vpshk.cn/20260647171.html