Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp +52 30.09.2026 08:00 automagician 18 Блог компании Selectel Искусственный интеллект Машинное обучение Open source IT-инфраструктура
35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4 29.09.2026 20:26 aigen31 0 Машинное обучение Программирование GPGPU Open source Python
Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19 27.09.2026 20:43 WufCorp 19 Искусственный интеллект Машинное обучение Rust Open source Windows
GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B +7 26.09.2026 17:26 SkalolazOther 13 Искусственный интеллект Видеокарты Компьютерное железо
Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27 25.09.2026 12:59 webthefirst 33 Искусственный интеллект Машинное обучение Видеокарты Компьютерное железо GPGPU
Я захотел, чтобы Obsidian заполнялся сам +9 24.09.2026 09:07 ijne 19 Open source Windows Машинное обучение Программирование Искусственный интеллект
Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti +18 23.09.2026 08:49 SkalolazOther 13 Искусственный интеллект Видеокарты Компьютерное железо
«Друзья не дают друзьям пользоваться Ollama» +48 22.09.2026 08:44 achekalin 38 Искусственный интеллект Серверное администрирование Управление разработкой
Запустить LLM локально: что считать до покупки видеокарты? +4 18.09.2026 14:16 sproshchaev 3 Блог компании OTUS Машинное обучение Искусственный интеллект Компьютерное железо Natural Language Processing
Как я выбирал локальную модель для кодинга на 16 ГБ VRAM — и трижды менял победителя +7 17.09.2026 14:12 lebedkin_lab 33 Искусственный интеллект Программирование Компьютерное железо WordPress
Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM 10.09.2026 15:27 SestrichkinK 0 Искусственный интеллект Linux Системное администрирование Серверная оптимизация Высоконагруженные системы
Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6 30.08.2026 09:25 Weron2 2 Искусственный интеллект
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16 29.08.2026 09:15 kotafey 37 Искусственный интеллект Настройка Linux Компьютерное железо
753B на одной видеокарте: разбор FreeToken +9 23.08.2026 17:59 danyathewriter 20 Машинное обучение Искусственный интеллект Высоконагруженные системы Компьютерное железо
Чем Go полезен при разработке AI‑агентов +26 19.08.2026 13:20 nezorflame 2 Блог компании AvitoTech Go Читальный зал Отладка Искусственный интеллект