• Главная
  • Контакты
Подписаться:
  • Twitter
  • Facebook
  • RSS
  • VK
  • PushAll
logo

logo

  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные
  • За год
    • Положительные
    • Отрицательные
  • Сортировка
    • По дате (возр)
    • По дате (убыв)
    • По рейтингу (возр)
    • По рейтингу (убыв)
    • По комментам (возр)
    • По комментам (убыв)
    • По просмотрам (возр)
    • По просмотрам (убыв)
Главная
  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные

Публикации с тегом llama.cpp

Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp +52

  • 30.09.2026 08:00
  • automagician
  • 18
  • Блог компании Selectel
  • Искусственный интеллект
  • Машинное обучение
  • Open source
  • IT-инфраструктура

35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4

  • 29.09.2026 20:26
  • aigen31
  • 0
  • Машинное обучение
  • Программирование
  • GPGPU
  • Open source
  • Python

Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19

  • 27.09.2026 20:43
  • WufCorp
  • 19
  • Искусственный интеллект
  • Машинное обучение
  • Rust
  • Open source
  • Windows

GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B +7

  • 26.09.2026 17:26
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27

  • 25.09.2026 12:59
  • webthefirst
  • 33
  • Искусственный интеллект
  • Машинное обучение
  • Видеокарты
  • Компьютерное железо
  • GPGPU

Я захотел, чтобы Obsidian заполнялся сам +9

  • 24.09.2026 09:07
  • ijne
  • 19
  • Open source
  • Windows
  • Машинное обучение
  • Программирование
  • Искусственный интеллект

Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti +18

  • 23.09.2026 08:49
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

«Друзья не дают друзьям пользоваться Ollama» +48

  • 22.09.2026 08:44
  • achekalin
  • 38
  • Искусственный интеллект
  • Серверное администрирование
  • Управление разработкой

Запустить LLM локально: что считать до покупки видеокарты? +4

  • 18.09.2026 14:16
  • sproshchaev
  • 3
  • Блог компании OTUS
  • Машинное обучение
  • Искусственный интеллект
  • Компьютерное железо
  • Natural Language Processing

Как я выбирал локальную модель для кодинга на 16 ГБ VRAM — и трижды менял победителя +7

  • 17.09.2026 14:12
  • lebedkin_lab
  • 33
  • Искусственный интеллект
  • Программирование
  • Компьютерное железо
  • WordPress

Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

  • 10.09.2026 15:27
  • SestrichkinK
  • 0
  • Искусственный интеллект
  • Linux
  • Системное администрирование
  • Серверная оптимизация
  • Высоконагруженные системы

Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6

  • 30.08.2026 09:25
  • Weron2
  • 2
  • Искусственный интеллект

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16

  • 29.08.2026 09:15
  • kotafey
  • 37
  • Искусственный интеллект
  • Настройка Linux
  • Компьютерное железо

753B на одной видеокарте: разбор FreeToken +9

  • 23.08.2026 17:59
  • danyathewriter
  • 20
  • Машинное обучение
  • Искусственный интеллект
  • Высоконагруженные системы
  • Компьютерное железо

Чем Go полезен при разработке AI‑агентов +26

  • 19.08.2026 13:20
  • nezorflame
  • 2
  • Блог компании AvitoTech
  • Go
  • Читальный зал
  • Отладка
  • Искусственный интеллект
  • «
  • 1
  • 2
  • 3
  • 4
  • 5
  • »
Страница 1 из 5
ЛУЧШЕЕ

  • Вчера
  • Позавчера
00:38

Сколько же близких звёзд мы проглядели? +36

08:05

Скоро распродажи, пора за игровыми приколами. Какую ретро-консоль купить в 2026 году и кайфануть на все деньги +31

09:01

Отключение мозга ничего хорошего не сулит +30

07:22

Собираю робота на Raspberry Pi 5 для дочери. Но говорящей колонкой тут не отделаться! Вызов принят, погнали +29

08:04

Я завёл реестр реестров. Теперь в России на один реестр больше +22

11:17

Сделал браузерное расширение, чтобы сохранять иностранные слова прямо из статей и потом учить их в мобильном приложении +20

12:22

Теорема о четырёх красках получила новое редкое доказательство +19

09:55

Aquilum — быстрый аналог Obsidian на Rust, который потребляет около 27 МБ ОЗУ +19

16:30

P2P-переводы, грязная крипта и Revolut. Пять популярных ошибок, которые совершают релоканты +18

13:01

Corvus Concept — «облачная» сетевая рабочая станция из 1982 года +18

12:30

Первые проходимцы в море +16

16:19

Как я ноутбук Lenovo IdeaPad Gaming 3 чинил. Новый чип, его прошивка и капризный зарядник +15

10:13

Утро без телефона: зачем я поставил рядом с кроватью матричный принтер +13

01:01

От bare metal до managed Kubernetes: разбираем архитектуру Cozystack. Расшифровка митапа в Дубае +11

04:54

Шрифты, CDN и хостинг: трансграничная передача, которую никто не замечает +10

13:22

Космос удивляет: у астероида обнаружились кольца. Что происходит? +9

09:44

Китайские дети, переставшие делать домашку сами, столкнулись с серьёзными трудностями на экзаменах +9

10:41

Как я писал расшифровщик записей, но в итоге получил бота для Яндекс.Телемост, с функциями которые даже не снились +8

10:30

Когда-то великие, но исчезнувшие бренды США +6

01:44

Делаем RAG-систему с нуля +6

09:01

Часть 12. Приключения латинского алфавита в разных языках: почему польская и чешская латиницы такие разные? +60

18:01

Как фокусник‑математик из Стэнфордского университета обнаружил лазейку в казино +58

09:27

Прощай, Кинопоиск +45

07:05

Почему в ретроигры рубятся спустя сорок лет, а современные забываются через два-три года? +36

14:05

Инженерная тайна AMD из нулевых: что общего между Xbox 360, HTC HD2, Sony Ericsson Xperia Play и LG Optimus L2 +33

13:01

Винтажный электрофон Россия 321 Стерео +33

11:54

Edge‑навигация своими руками: ESP32 + Android + велосипед/мотоцикл +18

10:16

Чтобы понять Kubernetes, я написал свой Kubernetes +15

08:24

Дешево, но не точно: разбираем контроллер доверия к памяти LLM-агентов +15

12:31

Когда капитал перестанет ждать человека +13

11:39

Под кожей Войнича: новый слой 600-летней загадки +12

08:01

Большинство корпоративных ИТ-систем впервые размещается за пределами собственных дата-центров +11

21:06

18 изображений раскроют нам, как безмерно велик наш космос +10

10:30

Я ускорил запрос в 75 раз. Через две недели оказалось, что дело было не в запросе +10

07:00

Как мы перераспределили альфу в A/B-тестах и сократили размер выборки +10

20:32

Мы как мир +9

12:16

Свинство в действии: расширяем синтаксис питона +7

07:44

МУзей Мусора МуМуКа +7

19:32

Отчёты на DOCX в FARA CRM: шаблоны в Word, редактор в браузере и PDF через LibreOffice +6

17:23

«Вставьте диск в устройство A:» — я попробовал заставить Windows 11 сказать это SSD +6

СЕРВИСЫ
  • logo

    CloudLogs.ru - Облачное логирование

    • Храните логи вашего сервиса или приложения в облаке. Удобно просматривайте и анализируйте их.
ОБСУЖДАЕМОЕ

  • Прощай, Кинопоиск +45

    • 75

    Почему в ретроигры рубятся спустя сорок лет, а современные забываются через два-три года? +36

    • 68

    P2P-переводы, грязная крипта и Revolut. Пять популярных ошибок, которые совершают релоканты +18

    • 36

    Под кожей Войнича: новый слой 600-летней загадки +12

    • 36

    Aquilum — быстрый аналог Obsidian на Rust, который потребляет около 27 МБ ОЗУ +19

    • 24

Подписка


  • Главная
  • Контакты
© 2026. Все публикации принадлежат авторам.