Платформу для порівняння нейромереж Arena оцінили в $3,1 млрд — за дев’ять місяців її вартість зросла на 82%

Платформа Arena, де користувачі порівнюють ChatGPT, Claude, Gemini та інші ШІ-моделі, залучила $200 млн у новому інвестиційному раунді. Після угоди компанію оцінили в $3,1 млрд — проти $1,7 млрд у січні 2026 року. Водночас Arena не розробляє власну велику мовну модель: її бізнес будується навколо незалежного оцінювання чужих ШІ-систем.
Про раунд Series B компанія оголосила 8 жовтня. Його очолили Lightspeed Venture Partners і Khosla Ventures, а серед інших учасників були Salesforce Ventures, Dell Technologies Capital, 01 Advisors, Endeavor Catalyst та наявні інвестори.
Попередній великий раунд Arena закрила 6 січня: тоді компанія залучила $150 млн за оцінки в $1,7 млрд. Отже, менш ніж за рік її вартість зросла приблизно на 82%.
Як безкоштовні порівняння нейромереж перетворилися на бізнес
Arena виросла з дослідницького проєкту Каліфорнійського університету в Берклі, запущеного у 2023 році під назвою Chatbot Arena. Згодом сервіс мав назву LMArena, а на початку 2026 року отримав нинішнє ім’я.
Базова механіка залишилася незмінною: користувач надсилає один запит двом моделям, порівнює відповіді та голосує за кращу. Результати тисяч таких порівнянь формують рейтинги, які ґрунтуються не лише на синтетичних тестах, а й на вподобаннях реальних користувачів.
Сьогодні Arena працює не лише з текстовими моделями. Платформа порівнює генератори зображень і відео, інструменти для програмування, пошуку та ШІ-агентів.
За даними самої компанії, із січня сервіс накопичив 350 млн сесій, 62 млн голосів і провів понад 1000 нових оцінювань моделей. Agent Arena за перші п’ять місяців зібрала понад 7 млн сесій, а щомісячна аудиторія всієї платформи налічує десятки мільйонів користувачів із більш ніж 150 країн.
Для звичайних відвідувачів Arena залишається безкоштовною. Дохід компанія отримує зокрема від AI Evaluations — комерційного сервісу, за допомогою якого розробники та корпоративні клієнти тестують свої моделі на реальних завданнях і мають доступ до докладної аналітики.
У червні Arena повідомила, що її annualized run rate перевищив $100 млн. Це не означає, що компанія вже заробила $100 млн за календарний рік: показник відображає річний еквівалент поточного темпу виторгу.
Тепер Arena оцінює не лише якість, а й поведінку ШІ
Разом із новим раундом компанія представила Arena Alignment Index — рейтинг того, наскільки точно ШІ-агенти дотримуються намірів користувачів.
Дослідники проаналізували близько 90 тисяч реальних сесій із 27 моделями та виокремили три типи проблем: дії без дозволу користувача, приписування йому неіснуючих тверджень і неправдиві звіти про виконання завдання.
Остання проблема виявилася особливо відчутною. У середньому приблизно 10% сесій містили випадки, коли агент заявляв про завершення завдання, хоча насправді його не виконав. Під час налагодження програмного коду частка таких випадків доходила до 48%.
Arena підкреслює, що індекс поки попередній і охоплює лише частину ймовірних ризиків. Проте обраний напрям добре пояснює зацікавленість інвесторів: у міру того як ШІ дістає доступ до файлів, браузера, корпоративних даних та інших інструментів, компаніям стає важливо знати не тільки яка модель «розумніша», а й наскільки безпечно довіряти їй автономні дії.
Саме розвиток таких систем оцінювання Arena планує фінансувати коштом залучених $200 млн.