Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27 25.09.2026 12:59 webthefirst 33 Искусственный интеллект Машинное обучение Видеокарты Компьютерное железо GPGPU
Мощный ИИ агент в 16гб VRAM +74 09.09.2026 13:38 Mashinow 114 Программирование Серверная оптимизация Тестирование IT-систем Машинное обучение GPGPU
Контекст растёт, KV-кэш — нет: Qwen3.8-27B на ограниченной VRAM с CMF формате +3 09.09.2026 09:34 infosave 1 Rust Искусственный интеллект Серверная оптимизация
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16 29.08.2026 09:15 kotafey 37 Искусственный интеллект Настройка Linux Компьютерное железо
Qwen3.8-27B на своей карте против 304B по API +8 16.08.2026 10:36 daniel_ivanov 16 Open source Искусственный интеллект