Reasoning-модели нужно измерять по-новому. Представляем публичный лидерборд MERA Reason +9 24.07.2026 07:11 alenusch 3 Искусственный интеллект Открытые данные Open source
Как оценивать LLM на практике, если времени на «идеальный бенчмарк» нет +18 30.06.2026 06:32 alenusch 1 Блог компании Сбер Машинное обучение Искусственный интеллект
MERA Code: всесторонняя оценка генерации кода в прикладных сценариях +7 18.07.2025 12:18 alenusch 0 Блог компании Сбер Блог компании Open Data Science Машинное обучение
MERA v.1.2.0 Новая версия независимого бенчмарка, что поменялось? +29 25.09.2024 09:00 alenusch 3 Блог компании SberDevices Машинное обучение Natural Language Processing
Трекеры и верификаторы интернет-рекламы: оценка Mera (by Okkam) 23.07.2024 09:08 dentsuRU 0 Управление e-commerce Медийная реклама
Музей DataArt. Осмотр видеотерминала Mera CM 7209 +25 22.10.2019 17:55 DataArt 12 Блог компании DataArt История IT Старое железо