Как мы собрали локальный AI-сервер на 4× RTX 4090 с водянкой — кейс для крупного клиента +15 08.05.2026 06:00 Dmitrii-Chashchin 16 DevOps Управление проектами Управление продажами Искусственный интеллект Машинное обучение
Почему self-hosted LLM падает в проде +16 04.05.2026 08:00 pandy 2 Блог компании Битрикс24 DevOps Искусственный интеллект
Как я собрал на DGX Spark приватный AI-сервер, и теперь рассказываю, что туда вошло +17 03.05.2026 09:15 AGmind 28 Машинное обучение Серверное администрирование Open source DevOps
Как в СНГ выбирают людей для AI-внедрения — и почему это страшно. Кейс из жизни +6 24.04.2026 09:05 yakvenalex 25 IT-компании Программирование Карьера в IT-индустрии Искусственный интеллект Python
vLLM, LoRA и GPU-кластеры: техническая анатомия обогащения поисковой выдачи Авито мультимодальными моделями +4 23.04.2026 09:12 Kirill0720 0 Блог компании AvitoTech Машинное обучение Искусственный интеллект
Практическое руководство по Qwen: установка, настройка vLLM и работа через API +48 22.04.2026 12:00 natlysky 16 Блог компании Selectel Искусственный интеллект Машинное обучение Python Open source
Как мы научили ИИ подбирать мебель по архитектурным чертежам +4 21.04.2026 04:14 Tehnologika 2 Обработка изображений Машинное обучение Искусственный интеллект Natural Language Processing
ИИ Анализ новостного сентимента как торговый сигнал +6 19.04.2026 11:59 tripolskypetr 11 Финансы в IT Искусственный интеллект Анализ и проектирование систем TypeScript
KV-Cache в LLM: разбираем инференс через 9 ключевых вопросов +4 10.04.2026 11:21 YUNGC0DE 0 Машинное обучение Искусственный интеллект
Один timestamp, один round-robin, один плавающий список tools: 7 анти-паттернов, которые убивают префикс кэша LLM +17 30.03.2026 08:00 Ser_no 3 Искусственный интеллект Блог компании Битрикс24
Как я приручил 30-миллиардник на RTX 3090: Тестируем Nemotron-Cascade-2 в домашнем сетапе +13 28.03.2026 14:06 Antra 14 Искусственный интеллект
vLLM Production Stack. Часть 1: Базовые возможности vLLM +2 27.03.2026 16:09 Bambarambambum 0 DevOps Системное администрирование Видеокарты Kubernetes
Собственная облачная LLM на 16 ГБ VRAM — часть 1: базовая сборка, tools и MCP +50 06.03.2026 08:00 yakvenalex 16 Блог компании Selectel Python Программирование Искусственный интеллект IT-инфраструктура
Снижаем стоимость инференса. Часть 1. Популярные подходы и что помогло нам повысить утилизацию GPU на 70% +8 24.09.2025 11:38 ddgudynin 2 Блог компании Cloud.ru Облачные сервисы IT-инфраструктура Искусственный интеллект DevOps
Как запустить свою LLM для инференса. Руководство по запуску: Ollama, vLLM, Triton, LM Studio, llama.cpp, SGLang +24 20.09.2025 19:31 maksimov_m 0 Machine Learning Машинное обучение Python DevOps