
Лидерборд LMArena подорожал почти вдвое за 10 месяцев
LMArena подняла $200 млн при валюации $3,1 млрд против $1,7 млрд в январе. Выручка платформы доросла до $100 млн в год.
LMArena — платформа, где пользователи сравнивают ответы конкурирующих ИИ-моделей друг с другом, — привлекла $200 млн в новом раунде финансирования при оценке в $3,1 млрд. В январе та же компания оценивалась в $1,7 млрд, так что её оценка почти удвоилась за десять месяцев. Раунд возглавили венчурные фирмы Lightspeed Venture Partners и Khosla Ventures, к ним присоединились Salesforce Ventures, Dell Technologies Capital и a16z. Годовая выручка платформы достигла $100 млн в июне, против $30 млн в январе.
LMArena также добавила новую категорию рейтинга под названием alignment. В ней оцениваются несанкционированные действия ИИ-моделей, то есть то, что от них никто не просил делать. Также проверяется ложная атрибуция — когда факт приписывают не тому источнику. И проверяется обманчивое завершение задачи — ложь о том, что задача выполнена, хотя на деле она не была сделана. В текущем рейтинге верхние строчки занимают модели от OpenAI, создателя ChatGPT. Claude Opus 5.5 и Claude Fable, обе от Anthropic, занимают шестое и девятое место. Если такие проверки станут стандартом, выбор модели будет меньше зависеть от собственных показателей бенчмарков каждого поставщика. У бизнеса появится более понятный способ судить, какой модели безопасно доверить действовать самостоятельно.
Источник: techcrunch.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи