Qwen3.6 27B MTP весит на +0.3 Гб больше, а даёт ускорение в ~2 раза. С 60 t/s до 130 t/s без потерь. Что такое MTP 18.05.2026 02:28 Shannon 106 Искусственный интеллект
Калькулятор VRAM для локальных LLM: Какие модели ИИ запустятся у вас на компьютере? 16.05.2026 09:04 nlaik 15 Машинное обучение Open source Видеокарты
Локальные LLM в реальной работе: Gemma 4, Qwen 3.6 и Qwen Coder +66 11.05.2026 14:18 vyacheslavteplyakov 222 Искусственный интеллект
Гефестыч: наш опыт автоматизации Code Review через LLM. «Грабли», решения, код +6 04.05.2026 11:08 DanilChechkov 10 Блог компании Леста Игры Open source Искусственный интеллект качество кода Машинное обучение
Open WebUI (с веб-поиском) + llama.cpp +11 24.04.2026 16:57 bars_arseniy 8 Искусственный интеллект Машинное обучение Open source
Как в СНГ выбирают людей для AI-внедрения — и почему это страшно. Кейс из жизни +6 24.04.2026 09:05 yakvenalex 25 IT-компании Программирование Карьера в IT-индустрии Искусственный интеллект Python
Выжать больше из локальных LLM. Ollama медленнее llama.cpp в 3 раза. UD_Q4_K_XL лучше чем Q4_K_M, а вес тот же и т.д +162 23.04.2026 22:13 Shannon 83 Искусственный интеллект
Запускаем Qwen3.6 35B-A3B + opencode локально на RTX 4070 12GB — AI-ассистент для разработки без облака +18 22.04.2026 09:30 rAnto 30 Искусственный интеллект Машинное обучение Open source
Локальный запуск GLM-5.1 +5 11.04.2026 10:33 Qwertcoser 10 Машинное обучение Искусственный интеллект Open source Natural Language Processing Системное администрирование
Свой ИИ без облаков: практический гайд по llama.cpp + Qwen +19 03.04.2026 09:30 FirstJohn 26 Блог компании FirstVDS Искусственный интеллект Машинное обучение Серверное администрирование
Квантизация с нуля: как запустить 160ГБ LLM на ноутбуке и не потерять в качестве +23 26.03.2026 14:57 python_leader 13 Искусственный интеллект Машинное обучение Natural Language Processing
Запускаем LLM на AMD RX580: разбор проблем ROCm, Ollama и реальный GPU inference +23 15.03.2026 06:15 alexkekiy 29 GPGPU Старое железо Программирование Отладка Искусственный интеллект
GGUF: квантизация с калибровкой (imatrix) +9 06.10.2025 07:58 efreelancer 6 Машинное обучение Искусственный интеллект Python
Как запустить свою LLM для инференса. Руководство по запуску: Ollama, vLLM, Triton, LM Studio, llama.cpp, SGLang +24 20.09.2025 19:31 maksimov_m 0 Machine Learning Машинное обучение Python DevOps