Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27 25.09.2026 12:59 webthefirst 33 Искусственный интеллект Машинное обучение Видеокарты Компьютерное железо GPGPU
Давай по новой, Миша: speculative decoding от черновика до проверки +5 22.09.2026 09:09 GG1KENOBI 0 Машинное обучение Искусственный интеллект Python Natural Language Processing Программирование
Дело о 38 токенах в секунду: почему M3 Ultra начинал с двенадцати +5 28.08.2026 09:05 Homosum 2 Искусственный интеллект Компьютерное железо
DeepSeek 0731 на DGX Spark: разгоняю до 68 tok/s и разбираюсь, почему у автора карточки 57 +7 03.08.2026 14:32 AGmind 13 Машинное обучение Искусственный интеллект Natural Language Processing Open source
Как мы запустили Ornith‑35B на ноутбуке с 8 ГБ VRAM и разогнали её до 99 ток/с на AMD Strix Halo +4 19.07.2026 23:10 PetrUfa 11 Машинное обучение Open source Видеокарты Linux Windows
DSpark на двух DGX Spark: порт, баг на одну строку и бенчмарки, которые пришлось мерить заново +4 05.07.2026 16:22 AGmind 2 Open source Искусственный интеллект Машинное обучение