Квантизация больших языковых моделей: FP32, BF16, INT8, NF4 и QLoRA 15.05.2026 12:57 Qwertcoser 0 Машинное обучение Алгоритмы Высоконагруженные системы Облачные вычисления Big Data
ASR на CPU. Как выбрать бэкенд, настроить Triton и не потерять в точности +11 21.04.2026 13:47 vs_nikulin 0 Блог компании MWS AI Блог компании МТС Блог компании Конференции Олега Бунина (Онтико) Машинное обучение Natural Language Processing
ASR на CPU. Как выбрать бэкенд, настроить Triton и не потерять в точности +14 21.04.2026 13:47 vs_nikulin 0 Блог компании MWS AI Блог компании МТС Блог компании Конференции Олега Бунина (Онтико) Машинное обучение Natural Language Processing
Triton FP8: реализация и автотюнинг GEMM/Attention под RTX 40xx/Blackwell +14 06.10.2025 07:08 badcasedaily1 0 Блог компании OTUS Программирование Python Машинное обучение
Когда YOLO не спасает: как один параметр может испортить всё +7 03.09.2025 10:47 alexsphera 1 Машинное обучение Искусственный интеллект
Как сделать билд минимального размера в Unity? +18 05.01.2023 10:00 DyadichenkoGA 13 Разработка игр Unity Разработка под AR и VR