Битва поколений: сравниваем Qwen3.5 и Qwen3.6 в локальном инференсе. Новое не всегда лучше +11 30.09.2026 11:06 ooptimum 9 Искусственный интеллект
Почему инференс LLM становится дорогим и как снизить расходы на GPU без покупки новых карт +10 28.09.2026 11:05 sproshchaev 0 Блог компании OTUS Машинное обучение Искусственный интеллект DevOps Kubernetes
Выбор агентской модели для кластеров из 2× DGX Spark (сентябрь 2026) +4 24.09.2026 15:06 nikkoris 1 Искусственный интеллект Машинное обучение Компьютерное железо
Давай по новой, Миша: speculative decoding от черновика до проверки +5 22.09.2026 09:09 GG1KENOBI 0 Машинное обучение Искусственный интеллект Python Natural Language Processing Программирование
Запустить LLM локально: что считать до покупки видеокарты? +4 18.09.2026 14:16 sproshchaev 3 Блог компании OTUS Машинное обучение Искусственный интеллект Компьютерное железо Natural Language Processing
Что значит развернуть LLM локально: два дня с vLLM, DGX Spark и настоящими ограничениями +7 11.09.2026 14:58 damir9311 7 Искусственный интеллект Машинное обучение Операционные системы Серверное администрирование
Я прогнал топ VRAM-калькуляторов для LLM — все ошибаются в одном и том же +5 08.09.2026 09:26 Isk4R1oT 0 Python Rust Искусственный интеллект Машинное обучение Высоконагруженные системы
LLM зацикливается: как найти причину, не трогая параметры? +7 03.09.2026 16:40 sproshchaev 0 Блог компании OTUS Машинное обучение Natural Language Processing Искусственный интеллект DevOps
Свой инференс для 25 разработчиков: 452:1, KV‑пул и почему это не экономит денег +3 22.08.2026 12:05 Tialian 2 IT-инфраструктура Искусственный интеллект Финансы в IT DevOps Анализ и проектирование систем
Приватная LLM в облаке: развертываем RAG-систему в Managed Kubernetes +34 20.08.2026 08:01 outworld66 0 Блог компании Selectel Монетизация IT-систем Kubernetes DevOps Искусственный интеллект
3 бита вместо 16: разбираем TurboQuant и когда его реально стоит включать +21 15.08.2026 08:01 ab429 3 Блог компании Selectel Искусственный интеллект IT-инфраструктура Open source
«Тосок бессмысл»: как я не смог заставить Gemma 4 писать хорошие стихи +13 12.08.2026 07:03 dsheremet 6 Natural Language Processing Машинное обучение Контент и копирайтинг Искусственный интеллект
Hermes c локальными LLM vs GigaCode: сравниваем агентов на реальных PHP/Symfony-задачах +5 11.08.2026 10:28 PHP-Programmist 12 PHP Искусственный интеллект
Ускорение инференса энкодерной guard‑модели: TensorRT, Triton, vLLM, Ray Serve +9 05.08.2026 11:26 AnnaResh 2 Машинное обучение Natural Language Processing Высоконагруженные системы DevOps
Хватит сливать данные в Claude и GPT: как поднять свой on‑prem LLM +18 04.08.2026 13:01 net0pyr 2 Блог компании RUVDS.com Информационная безопасность Искусственный интеллект Системное администрирование Облачные сервисы