Как Splash ускоряет локальные LLM на Mac +7 01.10.2026 08:39 evgentys00 2 Искусственный интеллект Машинное обучение macOS Open source
35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4 29.09.2026 20:26 aigen31 0 Машинное обучение Программирование GPGPU Open source Python
Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19 27.09.2026 20:43 WufCorp 19 Искусственный интеллект Машинное обучение Rust Open source Windows
Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27 25.09.2026 12:59 webthefirst 33 Искусственный интеллект Машинное обучение Видеокарты Компьютерное железо GPGPU
«Друзья не дают друзьям пользоваться Ollama» +48 22.09.2026 08:44 achekalin 38 Искусственный интеллект Серверное администрирование Управление разработкой
Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM 10.09.2026 15:27 SestrichkinK 0 Искусственный интеллект Linux Системное администрирование Серверная оптимизация Высоконагруженные системы
Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6 30.08.2026 09:25 Weron2 2 Искусственный интеллект
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16 29.08.2026 09:15 kotafey 37 Искусственный интеллект Настройка Linux Компьютерное железо
Возвращение короля: разбираемся, что такое Qwen3.8 27B +17 17.08.2026 12:06 Master_AI 21 Блог компании GPTunneL Искусственный интеллект Open source Исследования и прогнозы в IT Видеокарты
Всё, что вы хотели знать о локальном ИИ, но стеснялись спросить +68 11.08.2026 17:16 danyathewriter 77 Машинное обучение Искусственный интеллект
Как я ужал русский эмбеддер до 24 млн параметров — и чуть не испортил его одной цифрой +7 28.07.2026 16:50 AGmind 9 Машинное обучение Искусственный интеллект Open source
Как мы запустили Ornith‑35B на ноутбуке с 8 ГБ VRAM и разогнали её до 99 ток/с на AMD Strix Halo +4 19.07.2026 23:10 PetrUfa 11 Машинное обучение Open source Видеокарты Linux Windows
Маленькая модель на 0.6B держит квантование лучше, чем «крупная» на 1B: измерил деградацию function-calling на 4 ГБ VRAM +7 07.07.2026 14:38 Happynood 2 Машинное обучение Python Open source Высоконагруженные системы DevOps
Как я обучил русский RAG‑сплиттер, который режет документы по индексам, а не по тексту +14 04.07.2026 18:53 AGmind 5 Машинное обучение Natural Language Processing Open source Искусственный интеллект
Локальный запуск openai/gpt-oss-20b MXFP4 GGUF на ноутбуке без дискретной видеокарты: практический тест на 32 GB RAM +13 09.06.2026 06:34 AndrejGV 8 Искусственный интеллект Машинное обучение Ноутбуки Open source Компьютерное железо