专门评估AI模型性能的初创公司LMArena近日在A轮融资中筹集1.5亿美元(约2160亿韩元),将其估值推高至17亿美元(约2.448万亿韩元)。本轮融资由Felicis和UC Investments领投,安德森·霍洛维茨、凯鹏华盈、光速创投等硅谷知名风险投资公司大规模参与。LMArena由两名加州大学伯克利分校的研究人员于2023年共同创立,成立不到一年便迅速提升了身价。
LMArena旨在解决的核心难题是现有AI性能评估方式存在的"数据污染"问题。这一缺陷源于当AI模型预先学习的外部数据中已存在正确答案时,模型的回应可能扭曲其真实性能。为克服此问题,公司采用了不依赖固定评估题目,而是利用真实用户生成的动态提示的结构。
LMArena运营着一个基于云的平台,其用户界面以聊天机器人形式构建。输入该界面的问题会由两个不同的AI模型处理,用户比较结果后选择更优的回复。这种实时反馈会转化为AI基准评估标准并存储。公司通过汇总这些数据,定期发布性能优异的AI模型排行榜。
目前该排行榜首位是谷歌去年底公布的"Gemini 3 Pro"。随后是"Gemini 3 Flash"和埃隆·马斯克的xAI开发的"Grok 4.1"模型,它们均位列前茅。OpenAI也曾在外界发布GPT-5模型前,以"summit"为代号在LMArena平台上进行过先行测试。
LMArena计划通过此轮融资,加速其AI评估平台的运营效率提升、研发扩展以及人才招聘。特别是其去年作为商业服务推出的"AI Evaluations",据悉已突破3000万美元(约432亿韩元)的年度消费金额门槛,预计未来收入基础也将得到巩固。
公司联合创始人兼首席执行官阿纳斯塔西奥斯·安耶洛普洛斯强调:"若不验证AI能为人类提供何种价值,便无法正确运用该技术。真正的价值评估必须基于真实的用户体验。"


