Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM 10.09.2026 15:27 SestrichkinK 0 Искусственный интеллект Linux Системное администрирование Серверная оптимизация Высоконагруженные системы
Контекст растёт, KV-кэш — нет: Qwen3.8-27B на ограниченной VRAM с CMF формате +3 09.09.2026 09:34 infosave 1 Rust Искусственный интеллект Серверная оптимизация
Я прогнал топ VRAM-калькуляторов для LLM — все ошибаются в одном и том же +5 08.09.2026 09:26 Isk4R1oT 0 Python Rust Искусственный интеллект Машинное обучение Высоконагруженные системы
Как устроена токеномика — экономика мира ИИ +16 27.08.2026 07:10 Roman_Parabat 0 Блог компании МТС Искусственный интеллект Управление проектами Бизнес-модели Управление продуктом
Свой инференс для 25 разработчиков: 452:1, KV‑пул и почему это не экономит денег +3 22.08.2026 12:05 Tialian 2 IT-инфраструктура Искусственный интеллект Финансы в IT DevOps Анализ и проектирование систем
Топ вопросов с NLP собеседований: архитектуры LLM, инференс и оптимизация -1 10.08.2026 19:15 abletobetable 0 Машинное обучение Natural Language Processing Искусственный интеллект
Инференс LLM: от KV-кэша до продакшен-деплоя +10 27.07.2026 05:30 a_ryzhov 4 Блог компании hh.ru Блог компании Конференции Олега Бунина (Онтико) Машинное обучение Высоконагруженные системы Искусственный интеллект
Интендант Императора, или Как обеспечить ваше GPU данными при помощи СХД +4 13.07.2026 09:31 xitren 0 Блог компании АЭРОДИСК Хранение данных Серверное администрирование Сетевые технологии Искусственный интеллект
Походка за двадцать минут и миллион рублей: что RL сделал с двуногими роботами и во что упёрся их «мозг» +7 10.07.2026 09:26 0xReality 7 Робототехника Машинное обучение Искусственный интеллект Научно-популярное
Почему дорогая LLM дороже: экономика инференса, которую видно в твоём 5-часовом лимите +5 02.07.2026 22:37 Raicon 2 Искусственный интеллект Natural Language Processing Машинное обучение Программирование Исследования и прогнозы в IT
Полез в исходники vLLM, чтобы понять, почему один символ убивает prompt caching -1 02.07.2026 07:00 xonika9 0 Искусственный интеллект Машинное обучение Open source Программирование Высоконагруженные системы
Контекстное окно: почему нейросеть забывает части разговора +22 15.06.2026 06:11 DashaPasha 9 Блог компании BotHub Искусственный интеллект Научно-популярное
Скрытая цена LLM: как KV-cache увеличивает стоимость инференса и как эту проблему решает Google TurboQuant +21 04.05.2026 07:00 konstantin_kozhin 0 Блог компании МТС Искусственный интеллект Машинное обучение Natural Language Processing Сжатие данных
KV-кэш, экспертное сообщество и критическое мышление 22.04.2026 09:38 urassl 4 Машинное обучение Natural Language Processing Искусственный интеллект
KV-Cache в LLM: разбираем инференс через 9 ключевых вопросов +4 10.04.2026 11:21 YUNGC0DE 0 Машинное обучение Искусственный интеллект