12 ГБ VRAM и WAN 2.2 I2V‑A14B: как заставить RX6700XT генерировать видео неограниченной длины +8 21.09.2026 10:09 fullnavigator 3 Видеокарты Работа с видео Компьютерное железо
Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM 10.09.2026 15:27 SestrichkinK 0 Искусственный интеллект Linux Системное администрирование Серверная оптимизация Высоконагруженные системы
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16 29.08.2026 09:15 kotafey 37 Искусственный интеллект Настройка Linux Компьютерное железо
Селф-хост на RTX PRO 6000, продолжение: 2-битный DeepSeek V4 Flash x Ornith1.5-35B, как оно? +3 26.08.2026 14:02 daniel_ivanov 0 Искусственный интеллект
RGB‑значения нужно нормализовать делением на 255 или на 256? +27 11.08.2026 12:08 PatientZero 37 Обработка изображений Алгоритмы Программирование
Квантование ломает вызов инструментов не так, как показывает BFCL: проверил на MCP-серверах +5 08.07.2026 15:05 Happynood 0 Машинное обучение Python Open source Высоконагруженные системы DevOps
Маленькая модель на 0.6B держит квантование лучше, чем «крупная» на 1B: измерил деградацию function-calling на 4 ГБ VRAM +7 07.07.2026 14:38 Happynood 2 Машинное обучение Python Open source Высоконагруженные системы DevOps
Всё, что вы хотели знать про локальные LLM, но боялись заинференсить +11 06.07.2026 16:24 gpugo_team 38 Блог компании GPUGO
4.6-битные сети: от теории к практике. Причём здесь HardTanh? +5 26.06.2026 10:07 SmartEngines 1 Блог компании Smart Engines Машинное обучение Искусственный интеллект Математика Программирование
Как оптимизировать LLM-инференс в 2026 году +18 22.06.2026 15:40 sir-off 2 GPGPU Блог компании Cloud.ru Машинное обучение Параллельное программирование DevOps Искусственный интеллект
Четыре грабли, один вихрь и 60% на CIFAR-10 с M0+ +2 21.06.2026 02:58 Fakeonomics 0 Программирование микроконтроллеров Искусственный интеллект
Тернарный KAN: не баг, а фича — почему дискретные веса работают лучше +16 19.06.2026 22:56 Fakeonomics 10 Искусственный интеллект
Культ квантования: почему 3 битные LLM это диагноз, а не оптимизация 19.05.2026 11:15 YH7H22 20 Машинное обучение
Калькулятор VRAM для локальных LLM: Какие модели ИИ запустятся у вас на компьютере? 16.05.2026 09:04 nlaik 15 Машинное обучение Open source Видеокарты
Как возникает реальность? Новая математическая модель. Сравнение с другими теориями -5 26.04.2026 15:57 AleksandrTallinn 43 Физика Квантовые технологии Математика Научно-популярное Читальный зал