Сервис для сравнения нейросетей Arena оценили в $3,1 млрд — за девять месяцев стоимость выросла на 82%

Платформа Arena, где пользователи сравнивают ChatGPT, Claude, Gemini и другие ИИ-модели, привлекла $200 млн в новом инвестиционном раунде. После сделки компанию оценили в $3,1 млрд — против $1,7 млрд в январе 2026 года. При этом Arena не создаёт собственную большую языковую модель: её бизнес строится вокруг независимой оценки чужих ИИ-систем.
О раунде Series B компания объявила 8 октября. Его возглавили Lightspeed Venture Partners и Khosla Ventures, а среди других участников оказались Salesforce Ventures, Dell Technologies Capital, 01 Advisors, Endeavor Catalyst и существующие инвесторы.
Предыдущий крупный раунд Arena закрыла 6 января: тогда компания привлекла $150 млн при оценке в $1,7 млрд. Таким образом, менее чем за год её стоимость выросла примерно на 82%.
Как бесплатные сравнения нейросетей превратились в бизнес
Arena выросла из исследовательского проекта Калифорнийского университета в Беркли, запущенного в 2023 году под названием Chatbot Arena. Позднее сервис назывался LMArena, а в начале 2026 года получил нынешнее имя.
Базовая механика сохранилась: пользователь задаёт один запрос двум моделям, сравнивает ответы и голосует за лучший. Результаты тысяч таких сравнений формируют рейтинги, основанные не только на синтетических тестах, но и на предпочтениях реальных пользователей.
Сегодня Arena работает не только с текстовыми моделями. Платформа сравнивает генераторы изображений и видео, системы для программирования, поиска и ИИ-агентов.
По собственным данным компании, с января сервис накопил 350 млн сессий, 62 млн голосов и провёл более 1000 новых оценок моделей. Agent Arena за первые пять месяцев набрала более 7 млн сессий, а ежемесячная аудитория всей платформы измеряется десятками миллионов пользователей из более чем 150 стран.
Для обычных посетителей Arena остаётся бесплатной. Деньги компания получает в том числе от AI Evaluations — коммерческого сервиса, с помощью которого разработчики и предприятия проверяют свои модели на реальных задачах и получают подробную аналитику.
В июне Arena сообщила, что её annualized run rate превысил $100 млн. Это не значит, что компания уже заработала $100 млн за календарный год: показатель отражает годовой эквивалент текущего темпа выручки.
Теперь Arena оценивает не только качество, но и поведение ИИ
Одновременно с новым раундом компания представила Arena Alignment Index — рейтинг того, насколько корректно ИИ-агенты следуют намерениям пользователей.
Исследователи проанализировали около 90 тысяч реальных сессий с 27 моделями и выделили три типа проблем: действия без разрешения пользователя, приписывание ему несуществующих утверждений и ложные сообщения о выполненной работе.
Последняя проблема оказалась особенно заметной. В среднем примерно 10% сессий содержали случаи, когда агент заявлял о завершении задачи, хотя фактически её не выполнил. При отладке программного кода доля таких эпизодов доходила до 48%.
Arena подчёркивает, что индекс пока предварительный и охватывает лишь часть возможных рисков. Но направление хорошо объясняет интерес инвесторов: по мере того как ИИ получает доступ к файлам, браузеру, корпоративным данным и другим инструментам, компаниям становится важно знать не только какая модель «умнее», но и насколько ей можно доверять самостоятельные действия.
Именно развитие таких систем оценки Arena собирается финансировать за счёт привлечённых $200 млн.