• Главная
  • Контакты
Подписаться:
  • Twitter
  • Facebook
  • RSS
  • VK
  • PushAll
logo

logo

  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные
  • За год
    • Положительные
    • Отрицательные
  • Сортировка
    • По дате (возр)
    • По дате (убыв)
    • По рейтингу (возр)
    • По рейтингу (убыв)
    • По комментам (возр)
    • По комментам (убыв)
    • По просмотрам (возр)
    • По просмотрам (убыв)
Главная
  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные

Публикации с тегом llama.cpp

Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp +52

  • 30.09.2026 08:00
  • automagician
  • 18
  • Блог компании Selectel
  • Искусственный интеллект
  • Машинное обучение
  • Open source
  • IT-инфраструктура

35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4

  • 29.09.2026 20:26
  • aigen31
  • 0
  • Машинное обучение
  • Программирование
  • GPGPU
  • Open source
  • Python

Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19

  • 27.09.2026 20:43
  • WufCorp
  • 19
  • Искусственный интеллект
  • Машинное обучение
  • Rust
  • Open source
  • Windows

GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B +7

  • 26.09.2026 17:26
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27

  • 25.09.2026 12:59
  • webthefirst
  • 33
  • Искусственный интеллект
  • Машинное обучение
  • Видеокарты
  • Компьютерное железо
  • GPGPU

Я захотел, чтобы Obsidian заполнялся сам +9

  • 24.09.2026 09:07
  • ijne
  • 19
  • Open source
  • Windows
  • Машинное обучение
  • Программирование
  • Искусственный интеллект

Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti +18

  • 23.09.2026 08:49
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

«Друзья не дают друзьям пользоваться Ollama» +48

  • 22.09.2026 08:44
  • achekalin
  • 38
  • Искусственный интеллект
  • Серверное администрирование
  • Управление разработкой

Запустить LLM локально: что считать до покупки видеокарты? +4

  • 18.09.2026 14:16
  • sproshchaev
  • 3
  • Блог компании OTUS
  • Машинное обучение
  • Искусственный интеллект
  • Компьютерное железо
  • Natural Language Processing

Как я выбирал локальную модель для кодинга на 16 ГБ VRAM — и трижды менял победителя +7

  • 17.09.2026 14:12
  • lebedkin_lab
  • 33
  • Искусственный интеллект
  • Программирование
  • Компьютерное железо
  • WordPress

Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

  • 10.09.2026 15:27
  • SestrichkinK
  • 0
  • Искусственный интеллект
  • Linux
  • Системное администрирование
  • Серверная оптимизация
  • Высоконагруженные системы

Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6

  • 30.08.2026 09:25
  • Weron2
  • 2
  • Искусственный интеллект

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16

  • 29.08.2026 09:15
  • kotafey
  • 37
  • Искусственный интеллект
  • Настройка Linux
  • Компьютерное железо

753B на одной видеокарте: разбор FreeToken +9

  • 23.08.2026 17:59
  • danyathewriter
  • 20
  • Машинное обучение
  • Искусственный интеллект
  • Высоконагруженные системы
  • Компьютерное железо

Чем Go полезен при разработке AI‑агентов +26

  • 19.08.2026 13:20
  • nezorflame
  • 2
  • Блог компании AvitoTech
  • Go
  • Читальный зал
  • Отладка
  • Искусственный интеллект
  • «
  • 1
  • 2
  • 3
  • 4
  • 5
  • »
Страница 1 из 5
ЛУЧШЕЕ

  • Вчера
  • Позавчера
09:01

LLM научилась генерировать ДНК +38

14:58

Не ИИ заменит людей, а люди заменят ИИ. И это уже происходит +26

04:47

Трамп перемирил AI-техбро, а также новый бюджет РФ на 2027: главное за неделю +24

08:01

FreeBSD 14.5 — новые возможности без смены курса +23

08:30

Удобно или безопасно? Как мы перестали выбирать в защите от роботов +22

16:18

OpenRTL: Говорили, что RAD на классическом C++ невозможен. Я повторил RTL и VCL-архитектуру RAD Studio за 1500 строк +21

13:01

Решаем проблему качества в Factorio при помощи матриц +20

16:18

Все, что вы не знали о киберпанке — как появился, что с ним стало и наконец — что он такое на самом деле. Финал +18

12:01

Спросить SIEM словами: подключаем LLM‑ассистента к Wazuh +18

03:44

Узбекистан решил строить образовательную инфраструктуру для собственной микроэлектроники +17

08:00

Исходящие вебхуки Битрикс24: как принять POST на своём сервере и что делать дальше +15

13:05

ИИ-слоп: не всё так плохо? +13

11:30

ESP32-P4 вместо планшета на стене: неделю живу с панелью Home Assistant и разбираюсь, зачем она нужна +13

07:50

Коррекция дисторсии без «шахматной доски» +13

10:21

MWS Cloud Platform глазами новичка: что здесь есть и как все устроено +12

07:36

Защитит ли ИИ от дрона? Разрабатываем умный прицел +12

07:05

Zynq 7000. Камера MIPI‑CSI-2 и вывод видеопотока через HDMI и Ethernet UDP. Часть 2 +12

07:31

Недельный геймдев: #295 — 4 октября, 2026 +11

15:05

Я посчитал, во сколько обходится свой сервер вместо облака в 2026 году +10

10:23

Парсинг на Python: HTTP, Scrapy или браузер — практическое сравнение +10

09:55

Aquilum — быстрый аналог Obsidian на Rust, который потребляет около 27 МБ ОЗУ +76

08:04

Я завёл реестр реестров. Теперь в России на один реестр больше +75

09:01

Отключение мозга ничего хорошего не сулит +69

16:30

P2P-переводы, грязная крипта и Revolut. Пять популярных ошибок, которые совершают релоканты +57

13:01

Corvus Concept — «облачная» сетевая рабочая станция из 1982 года +54

00:38

Сколько же близких звёзд мы проглядели? +53

08:05

Скоро распродажи, пора за игровыми приколами. Какую ретро‑консоль купить в 2026 году и кайфануть на все деньги +46

16:19

Как я ноутбук Lenovo IdeaPad Gaming 3 чинил. Новый чип, его прошивка и капризный зарядник +40

07:22

Собираю робота на Raspberry Pi 5 для дочери. Но говорящей колонкой тут не отделаться! Вызов принят, погнали. (Часть 1) +38

12:22

Теорема о четырёх красках получила новое редкое доказательство +32

12:30

Первые проходимцы в море +31

20:21

OpsDeck: собрал рабочее место DevOps‑инженера в одном окне и выложил в open source +30

11:17

Сделал браузерное расширение, чтобы сохранять иностранные слова прямо из статей и потом учить их в мобильном приложении +26

10:13

Утро без телефона: зачем я поставил рядом с кроватью матричный принтер +24

10:41

Как я писал расшифровщик записей, но в итоге получил бота для Яндекс.Телемост, с функциями, которые даже не снились +22

13:22

Космос удивляет: у астероида обнаружились кольца. Что происходит? +19

09:44

Китайские дети, переставшие делать домашку сами, столкнулись с серьёзными трудностями на экзаменах +18

18:21

Как я читаю книги и смотрю сериалы в оригинале, не «выучив язык» целиком +17

18:19

Роджер Пенроуз о пространстве‑времени, сознании и Вселенной (интервью) +14

17:55

Жил‑был «Кенгурёнок» +12

СЕРВИСЫ
  • logo

    CloudLogs.ru - Облачное логирование

    • Храните логи вашего сервиса или приложения в облаке. Удобно просматривайте и анализируйте их.
ОБСУЖДАЕМОЕ

  • P2P-переводы, грязная крипта и Revolut. Пять популярных ошибок, которые совершают релоканты +57

    • 164

    Я завёл реестр реестров. Теперь в России на один реестр больше +75

    • 106

    Aquilum — быстрый аналог Obsidian на Rust, который потребляет около 27 МБ ОЗУ +76

    • 86

    Я посчитал, во сколько обходится свой сервер вместо облака в 2026 году +10

    • 58

    Отключение мозга ничего хорошего не сулит +69

    • 34

    Собираю робота на Raspberry Pi 5 для дочери. Но говорящей колонкой тут не отделаться! Вызов принят, погнали. (Часть 1) +38

    • 30

    Скоро распродажи, пора за игровыми приколами. Какую ретро‑консоль купить в 2026 году и кайфануть на все деньги +46

    • 29

    OpsDeck: собрал рабочее место DevOps‑инженера в одном окне и выложил в open source +30

    • 24

    Хотел сделать контроллер теплового насоса, а получился симулятор ESP32, Arduino и цепей 12/230 В +7

    • 22

    Первые проходимцы в море +31

    • 21

    Утро без телефона: зачем я поставил рядом с кроватью матричный принтер +24

    • 20

Подписка


  • Главная
  • Контакты
© 2026. Все публикации принадлежат авторам.