Как оптимизировать LLM-инференс в 2026 году +18 22.06.2026 15:40 sir-off 2 GPGPU Блог компании Cloud.ru Машинное обучение Параллельное программирование DevOps Искусственный интеллект
Скрытая цена LLM: как KV-cache увеличивает стоимость инференса и как эту проблему решает Google TurboQuant +21 04.05.2026 07:00 konstantin_kozhin 0 Блог компании МТС Искусственный интеллект Машинное обучение Natural Language Processing Сжатие данных
Алгоритмы спекулятивного инференса LLM +3 05.01.2025 09:25 svtDanny 4 Машинное обучение Искусственный интеллект Алгоритмы Высокая производительность Open source