
Дообученная командой RWB модель BerryLM-XL на 358 млрд параметров заняла третье место в топе русскоязычного бенчмарка MERA с показателем 0,835. Результат лучше среди ИИ-моделей показывает только Claude Opus 4.6 — 0,862. Эталон на основе человеческих ответов — 0,852.
ℹ️ MERA — основной русскоязычный бенчмарк, включающий тесты на логику, научные рассуждения, этику, общие знания о мире и другие области.
«Дообучение и интеграция наших LLM решают конкретную бизнес-задачу: превращают сложную технологию в прикладной инструмент, который помогает пользователям быстрее принимать решения, а продавцам — эффективнее развивать свой бизнес», — объясняет директор по данным RWB Павел Раваев.
