Вс, 11 Окт
Для Cyberpunk 2077 создают мод с умными NPC — с ними можно разговаривать, путешествовать и давать поручения Игры 10.10.2026 22:26
Сервис для сравнения нейросетей Arena оценили в $3,1 млрд — за девять месяцев стоимость выросла на 82% IT-бизнесНейросети 10.10.2026 22:20
Полный слив GTA VI или криптоафера: хакер угрожает выложить сюжетную кампанию до релиза ИгрыКрипто 10.10.2026 22:15
Вышел трейлер финального сезона «Ходячие мертвецы: Дэрил Диксон» — премьера состоится в феврале 2027 года Кино/Сериалы 10.10.2026 22:12
Audi запатентовала безумную имитацию ДВС для электрокаров: вибрации, задержка газа и настоящие искры Автомобили 10.10.2026 22:10
В Deadlock добавили шахматиста Соломона — онлайн игры впервые превысил 262 тысячи человек Игры 10.10.2026 20:42
Диабет от голода, а не от сахара: почему ученые признали диабет 5-го типа и чем он опасен Наука 10.10.2026 20:39
Батарея на 9000 мА·ч и экран 185 Гц: OnePlus раскрыла флагман 16, но западные рынки его не увидят Гаджеты 10.10.2026 20:35
По «Сумеркам» выпустили официальную «Монополию» с Эдвардом, Джейкобом и знакомыми местами саги Кино/Сериалы 10.10.2026 20:32
Бесплатная замена Photoshop прямо в браузере: редактор ImageFlow научился менять свет на готовых фото Софт 10.10.2026 20:28
Предзаказы Metro 2039 откроются на следующей неделе — коллекционка получит настоящий шлем спартанца Игры 10.10.2026 20:24

Сервис для сравнения нейросетей Arena оценили в $3,1 млрд — за девять месяцев стоимость выросла на 82%

Max Ivanov · 10.10.2026 22:20 · 3 минуты чтения

Платформа Arena, где пользователи сравнивают ChatGPT, Claude, Gemini и другие ИИ-модели, привлекла $200 млн в новом инвестиционном раунде. После сделки компанию оценили в $3,1 млрд — против $1,7 млрд в январе 2026 года. При этом Arena не создаёт собственную большую языковую модель: её бизнес строится вокруг независимой оценки чужих ИИ-систем.

О раунде Series B компания объявила 8 октября. Его возглавили Lightspeed Venture Partners и Khosla Ventures, а среди других участников оказались Salesforce Ventures, Dell Technologies Capital, 01 Advisors, Endeavor Catalyst и существующие инвесторы.

Предыдущий крупный раунд Arena закрыла 6 января: тогда компания привлекла $150 млн при оценке в $1,7 млрд. Таким образом, менее чем за год её стоимость выросла примерно на 82%.

Как бесплатные сравнения нейросетей превратились в бизнес

Arena выросла из исследовательского проекта Калифорнийского университета в Беркли, запущенного в 2023 году под названием Chatbot Arena. Позднее сервис назывался LMArena, а в начале 2026 года получил нынешнее имя.

Базовая механика сохранилась: пользователь задаёт один запрос двум моделям, сравнивает ответы и голосует за лучший. Результаты тысяч таких сравнений формируют рейтинги, основанные не только на синтетических тестах, но и на предпочтениях реальных пользователей.

Сегодня Arena работает не только с текстовыми моделями. Платформа сравнивает генераторы изображений и видео, системы для программирования, поиска и ИИ-агентов.

По собственным данным компании, с января сервис накопил 350 млн сессий, 62 млн голосов и провёл более 1000 новых оценок моделей. Agent Arena за первые пять месяцев набрала более 7 млн сессий, а ежемесячная аудитория всей платформы измеряется десятками миллионов пользователей из более чем 150 стран.

Для обычных посетителей Arena остаётся бесплатной. Деньги компания получает в том числе от AI Evaluations — коммерческого сервиса, с помощью которого разработчики и предприятия проверяют свои модели на реальных задачах и получают подробную аналитику.

В июне Arena сообщила, что её annualized run rate превысил $100 млн. Это не значит, что компания уже заработала $100 млн за календарный год: показатель отражает годовой эквивалент текущего темпа выручки.

Теперь Arena оценивает не только качество, но и поведение ИИ

Одновременно с новым раундом компания представила Arena Alignment Index — рейтинг того, насколько корректно ИИ-агенты следуют намерениям пользователей.

Исследователи проанализировали около 90 тысяч реальных сессий с 27 моделями и выделили три типа проблем: действия без разрешения пользователя, приписывание ему несуществующих утверждений и ложные сообщения о выполненной работе.

Последняя проблема оказалась особенно заметной. В среднем примерно 10% сессий содержали случаи, когда агент заявлял о завершении задачи, хотя фактически её не выполнил. При отладке программного кода доля таких эпизодов доходила до 48%.

Arena подчёркивает, что индекс пока предварительный и охватывает лишь часть возможных рисков. Но направление хорошо объясняет интерес инвесторов: по мере того как ИИ получает доступ к файлам, браузеру, корпоративным данным и другим инструментам, компаниям становится важно знать не только какая модель «умнее», но и насколько ей можно доверять самостоятельные действия.

Именно развитие таких систем оценки Arena собирается финансировать за счёт привлечённых $200 млн.

Нравится ВсёЗависло?

Добавьте нас в предпочитаемые источники Google, чтобы чаще видеть наши новости.

Добавь нас в свой Google

Поделиться

Оставить комментарий