35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4 29.09.2026 20:26 aigen31 0 Машинное обучение Программирование GPGPU Open source Python
Выбор агентской модели для кластеров из 2× DGX Spark (сентябрь 2026) +4 24.09.2026 15:06 nikkoris 1 Искусственный интеллект Машинное обучение Компьютерное железо
Как 17B активных бьют 70B плотных: анатомия Mixture-of-Experts (MoE) 12.09.2026 07:09 mr8bit 1 Блог компании Cloud.ru Машинное обучение Научно-популярное Искусственный интеллект
MoVA: новая архитектура внимания +4 09.09.2026 23:31 ToxaBes 0 Машинное обучение Искусственный интеллект
CMF: новый формат для создания специализированных LLM моделей +8 04.09.2026 15:07 infosave 1 Искусственный интеллект Rust
Qwen4: Архитектура будущего +18 30.08.2026 14:59 Master_AI 21 Блог компании GPTunneL Искусственный интеллект Машинное обучение Open source IT-компании
Почему MoE-модель тормозит? Чек-лист из трех шагов +3 26.08.2026 13:55 MaDeLa 1 Искусственный интеллект Linux Open source
753B на одной видеокарте: разбор FreeToken +9 23.08.2026 17:59 danyathewriter 20 Машинное обучение Искусственный интеллект Высоконагруженные системы Компьютерное железо
Как запустить LLM на 2,8 трлн параметров на ноутбуке +13 18.08.2026 12:20 sproshchaev 10 Блог компании OTUS Машинное обучение Искусственный интеллект Компьютерное железо Хранение данных
MoE на 5090 недобирает полтора раза, и дело не в маршрутизации +4 12.08.2026 08:45 Artem_Burei 4 Искусственный интеллект Компьютерное железо Исследования и прогнозы в IT Анализ и проектирование систем
Всё, что вы хотели знать о локальном ИИ, но стеснялись спросить +68 11.08.2026 17:16 danyathewriter 77 Машинное обучение Искусственный интеллект
DeepSeek 0731 на DGX Spark: разгоняю до 68 tok/s и разбираюсь, почему у автора карточки 57 +7 03.08.2026 14:32 AGmind 13 Машинное обучение Искусственный интеллект Natural Language Processing Open source
Kimi K3 — что реально даёт открытие весов самой большой модели +11 28.07.2026 03:46 stas-clear 1 Искусственный интеллект Машинное обучение Open source
Как мы запустили Ornith‑35B на ноутбуке с 8 ГБ VRAM и разогнали её до 99 ток/с на AMD Strix Halo +4 19.07.2026 23:10 PetrUfa 11 Машинное обучение Open source Видеокарты Linux Windows
GigaChat 3.5 — меньше, быстрее, сильнее +109 06.07.2026 08:48 chameleon-lizard 74 Блог компании Сбер Natural Language Processing Open source Машинное обучение Искусственный интеллект