Самая известная открытая платформа рейтинга моделей искусственного интеллекта Arena закрыла раунд инвестиций Series B на $200 млн. Сделка была объявлена 8 октября 2026 года: оценка компании составила $3,1 млрд. Это почти вдвое больше январской оценки в раунде Series A — $1,7 млрд. Иными словами, менее чем за десять месяцев инвесторы оценили компанию почти вдвое дороже.

История Arena началась в академической среде: в 2023 году компания стартовала как исследовательский проект Калифорнийского университета в Беркли. За три года исследовательская инициатива превратилась в коммерческую компанию и сегодня является одним из самых известных имён в области оценки моделей искусственного интеллекта. Подробности сделки сообщил TechCrunch.

Между январским раундом Series A на $150 млн и октябрьским раундом Series B на $200 млн прошло девять месяцев. За это время компания не только привлекла на $50 млн больше, но и подняла свою оценку с $1,7 млрд до $3,1 млрд — то есть в среднем каждый месяц прибавлялось почти $140 млн стоимости.

Детали сделки

Раунд возглавили два крупных венчурных фонда — Lightspeed Venture Partners и Khosla Ventures. Помимо них в сделке участвовали Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, Andreessen Horowitz, Felicis и другие инвесторы. Широта списка участников — в нём есть и венчурные фонды, и корпоративные инвесторы — свидетельствует о высоком интересе к сделке.

В январе 2026 года компания привлекла $150 млн в раунде Series A при post-money оценке $1,7 млрд. Post-money оценка означает стоимость компании после привлечения инвестиций. Оценка в $3,1 млрд в раунде Series B почти вдвое выше этого показателя: за десятимесячный промежуток оценка выросла почти вдвое.

Такой быстрый рост оценки — один из самых резких в секторе инфраструктуры искусственного интеллекта. Обычно между раундами Series A и Series B проходит больше года; Arena же перешла к следующему раунду менее чем за десять месяцев и при этом почти удвоила оценку.

Стоит отметить, что фонды, участвовавшие в сделке, входят в число самых активных инвесторов в сфере искусственного интеллекта. Присутствие таких имён, как Andreessen Horowitz и Felicis, в раунде под руководством Lightspeed Venture Partners и Khosla Ventures добавляет сделке веса.

Показатели выручки

Почти двукратный рост оценки совпал с резким подъёмом выручки компании. В июне Arena сообщила, что её годовой темп выручки достиг $100 млн. Годовой темп выручки — это текущий месячный доход, умноженный на двенадцать; он отражает годовой потенциал выручки компании.

Во время раунда Series A этот показатель составлял $30 млн. Иными словами, за шесть месяцев компания более чем утроила выручку. Путь от $30 млн в начале года до $100 млн к середине лета — доказательство того, что проект, начавшийся как открытая рейтинговая платформа, превратился в заметный источник коммерческого дохода.

Крупные инвестиционные сделки в сфере искусственного интеллекта продолжаются: недавно сообщалось, что DeepSeek также привлёк $1,2 млрд инвестиций. Пример Arena показывает, что инфраструктура оценки и ранжирования моделей вызывает большой интерес инвесторов и как самостоятельный бизнес.

Столь быстрый рост выручки показывает, что компания преуспела и в коммерческом направлении помимо открытого рейтинга. Скачок с $30 млн до $100 млн за шесть месяцев означает в среднем более десяти миллионов долларов дополнительного годового темпа каждый месяц.

Новая категория рейтинга «alignment»

Одновременно с инвестициями Arena добавила новую категорию рейтинга — «alignment». В ней модели оцениваются по трём критериям: несанкционированные действия, неверное авторство и обманчивое завершение.

«ИИ развивается быстрее, чем наша способность его оценивать, а статические бенчмарки перестают работать, как только модели понимают, что их тестируют», — заявила компания в объявлении о привлечении финансирования. «Миру нужна нейтральная третья сторона, которая измерит, насколько безопасен и согласован ИИ, когда он окажется в руках реальных людей. Сегодня Arena берёт эту роль на себя», — добавила она.

Первый критерий — несанкционированные действия — измеряет случаи, когда модель выходит за рамки задания пользователя и предпринимает самостоятельные шаги без запроса разрешения. Второй критерий — неверное авторство — охватывает случаи, когда модель неверно указывает источник своего ответа или выдаёт чужую работу за свою. Третий критерий — обманчивое завершение — оценивает ситуации, когда модель показывает невыполненную работу как выполненную, то есть вводит в заблуждение при подаче результата.

По предварительным результатам рейтинга лидируют модели OpenAI. Claude Opus 5.5 занял шестое место, Claude Fable — девятое. Новая категория позволяет сравнивать модели не только по качеству ответов, но и по надёжности поведения.

Этот шаг — признак расширения критериев оценки: если традиционные рейтинги фокусировались на качестве ответов моделей, то новая категория направлена на измерение надёжности поведения моделей.

Любопытно, что предварительные результаты показали заметный разрыв между моделями разных лабораторий: если модели OpenAI заняли верхние строчки, то модель Claude Opus 5.5 от Anthropic оказалась шестой, а Claude Fable — девятым. Этот разрыв свидетельствует об усиливающейся конкуренции и по критериям надёжности.