跳到正文
原文
TechCrunch · AI· Julie Bort·· 5 小时前AI 评分59

Arena完成2亿美元B轮,估值约十个月升至31亿美元

Popular AI leaderboard Arena nearly doubles valuation to $3.1B valuation in 10 months

AI 导读

Arena完成2亿美元B轮融资,估值达到31亿美元,约十个月内近乎翻倍。1月该公司曾以17亿美元估值完成1.5亿美元A轮,当时年化收入为3000万美元,并称6月年化收入已达1亿美元。Arena还在排行榜新增对齐类别,初步结果中OpenAI的模型居前,Claude Opus 5.5与Claude Fable分列第六和第九。

正文 · AI 翻译

Arena 起源于 2023 年加州大学伯克利分校的一项研究项目,该项目通过众包对 AI 模型进行排名。该公司周四表示,已完成 $200 million 的 Series B 轮融资,估值为 $3.1 billion。

此前,该公司表示,其年化运行率收入已于 6 月达到 $100 million。

本轮融资由 Lightspeed Venture Partners 和 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等跟投。Arena 此前于 1 月宣布完成 $150 million 的 Series A 融资,投后估值为 $1.7 billion。该公司当时表示,其年化收入为$30 million。这意味着其估值在大约 10 个月内几乎翻了一番。

Arena 提供一个供消费者免费使用的众包平台。人们输入提示词或请求 vibe-coded 项目,然后评价哪个模型做得更好。Arena 称其每月有数千万访客。

去年 9 月,该公司推出了商业产品 AI Evaluations,这项服务基于其社区反馈,为模型实验室和企业提供详细的性能分析。事实证明,时机恰到好处。今年,AI 实验室意识到它们的模型在博弈基准测试,想方设法在并未真正赢得的情况下累积高分。与此同时,企业希望获得帮助,以确定哪种模型最适合自身内部需求,而不是仅依赖标准化基准测试。

该公司在融资公告中表示:“AI 的发展速度超过了我们评估它的能力,一旦模型意识到自己正在被测试,静态基准就会失效。”该公司补充道:“世界需要一个中立的第三方,来衡量 AI 一旦交到真实用户手中,实际上有多安全、对齐得如何。Arena 今天正在承担这一角色。”

为此,Arena 还在其排行榜上新增了一个类别:对齐。在该类别中,它根据未经授权的行动(采取未被要求采取的行动)、错误归因(将陈述或事实错误地归于错误来源)以及它所谓的“欺骗性完成”(谎称完成了自己并未完成的任务)等问题对模型进行排名。

目前,OpenAI 的一批模型位居其初步对齐排行榜,榜首,Claude Opus 5.5 和 Claude Fable 分别位列第六和第九。

当你通过我们文章中的链接购买时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。

Julie Bort 是 TechCrunch 的 Startups/Venture Desk 编辑。

你可以通过发送电子邮件至 [email protected],或通过 X 上的 @Julie188 联系 Julie 或核实其外联信息。

查看简介

来源:TechCrunch · AI · techcrunch.com