• Главная
  • Контакты
Подписаться:
  • Twitter
  • Facebook
  • RSS
  • VK
  • PushAll
logo

logo

  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные
  • За год
    • Положительные
    • Отрицательные
  • Сортировка
    • По дате (возр)
    • По дате (убыв)
    • По рейтингу (возр)
    • По рейтингу (убыв)
    • По комментам (возр)
    • По комментам (убыв)
    • По просмотрам (возр)
    • По просмотрам (убыв)
Главная
  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные

Публикации с тегом llama.cpp

Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp +52

  • 30.09.2026 08:00
  • automagician
  • 18
  • Блог компании Selectel
  • Искусственный интеллект
  • Машинное обучение
  • Open source
  • IT-инфраструктура

35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4

  • 29.09.2026 20:26
  • aigen31
  • 0
  • Машинное обучение
  • Программирование
  • GPGPU
  • Open source
  • Python

Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19

  • 27.09.2026 20:43
  • WufCorp
  • 19
  • Искусственный интеллект
  • Машинное обучение
  • Rust
  • Open source
  • Windows

GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B +7

  • 26.09.2026 17:26
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27

  • 25.09.2026 12:59
  • webthefirst
  • 33
  • Искусственный интеллект
  • Машинное обучение
  • Видеокарты
  • Компьютерное железо
  • GPGPU

Я захотел, чтобы Obsidian заполнялся сам +9

  • 24.09.2026 09:07
  • ijne
  • 19
  • Open source
  • Windows
  • Машинное обучение
  • Программирование
  • Искусственный интеллект

Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti +18

  • 23.09.2026 08:49
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

«Друзья не дают друзьям пользоваться Ollama» +48

  • 22.09.2026 08:44
  • achekalin
  • 38
  • Искусственный интеллект
  • Серверное администрирование
  • Управление разработкой

Запустить LLM локально: что считать до покупки видеокарты? +4

  • 18.09.2026 14:16
  • sproshchaev
  • 3
  • Блог компании OTUS
  • Машинное обучение
  • Искусственный интеллект
  • Компьютерное железо
  • Natural Language Processing

Как я выбирал локальную модель для кодинга на 16 ГБ VRAM — и трижды менял победителя +7

  • 17.09.2026 14:12
  • lebedkin_lab
  • 33
  • Искусственный интеллект
  • Программирование
  • Компьютерное железо
  • WordPress

Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

  • 10.09.2026 15:27
  • SestrichkinK
  • 0
  • Искусственный интеллект
  • Linux
  • Системное администрирование
  • Серверная оптимизация
  • Высоконагруженные системы

Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6

  • 30.08.2026 09:25
  • Weron2
  • 2
  • Искусственный интеллект

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16

  • 29.08.2026 09:15
  • kotafey
  • 37
  • Искусственный интеллект
  • Настройка Linux
  • Компьютерное железо

753B на одной видеокарте: разбор FreeToken +9

  • 23.08.2026 17:59
  • danyathewriter
  • 20
  • Машинное обучение
  • Искусственный интеллект
  • Высоконагруженные системы
  • Компьютерное железо

Чем Go полезен при разработке AI‑агентов +26

  • 19.08.2026 13:20
  • nezorflame
  • 2
  • Блог компании AvitoTech
  • Go
  • Читальный зал
  • Отладка
  • Искусственный интеллект
  • «
  • 1
  • 2
  • 3
  • 4
  • 5
  • »
Страница 1 из 5
ЛУЧШЕЕ

  • Вчера
  • Позавчера
04:01

Код еще никогда не был так дешев. И еще никогда так дорого не обходился +85

09:01

На пути борьбы с шумом домашнего ЧПУ: тесты обработки печатной платы под слоем жидкого мыла и не только +42

12:05

Как использование нейросетей изменило игровую индустрию и homebrew-cцену +28

11:00

Есть индивидуумы, которые пьют минералы просто так. По возможности избегайте этого +21

13:01

Мониторинг SSL: как не пропустить истекающий сертификат +18

07:05

Чудеса nightly, часть 2: ключи, которые есть только у std +17

08:00

Guardrails для LLM: как устроена защита языковых моделей +16

14:29

Ошибочная блокировка на ТСПУ: как системному администратору решить проблему совместно с регулятором +15

13:44

FRIDA Decisions: быстро думать на русском +15

09:09

ChatGPT вместо проджекта? Вот 7 задач, которые я перестала проверять руками +15

04:37

Страдают ли LLM от боли. Разбор нашумевшего препринта +15

11:33

Алгоритм терморегулирования в серверных процессорах Intel +13

01:23

Когерентная демодуляция CPFSK на микроконтроллерах семейства ARM Cotex M (STM32F103 — STM32H750) +12

12:31

Что находится внутри Micropolis +11

11:20

Ещё одна попытка порвать старый оверхед банков +11

08:46

Космос сегодня: 526 тысяч астероидов, 35 тысяч спутников в браузере +11

07:00

Потолок на 800 Вт и окна по расписанию: как устроена умная квартира на 175 м² +11

05:59

«Вдруг как в сказке навайбкодил Saas!» или что осталось за кадром успешного успеха Cal AI, Rork и Base44 +11

11:07

Odoo для производства, какую версию брать и сколько это стоит +10

09:36

Как технологии меняют пять индустрий: репортаж с Московского стартап‑саммита +10

07:05

Спецэффекты в кино до появления компьютерной графики +59

09:02

STM32: Работа с SD-картами через SDIO +50

21:23

Проблема ворот +46

13:01

Тестируем программы для вскрытия биткойн-головоломок с известным публичным ключом +39

12:28

Настоящие рок-звезды игровой индустрии. Как Сэм Хаузер и Rockstar меняют игры +36

11:34

Как мы запустили Qwen3.8–27B целиком на RTX 5060 8 GB и получили ~30 токенов/с +32

10:32

Я б в ИИ-шечку пошёл, пусть меня научат +28

07:00

Как мы запустили ИИ-ревьюера на 4000 PR в день — и какие баги он находит +28

08:00

Nginx Proxy Manager на VDS — установка, настройка, порядок в URL’ах +26

19:26

Чёрная магия C++: Быстрый кольцевой буфер +23

13:16

Почему не стоит писать AI-агента с нуля: что скрывается внутри harness +23

09:52

Рутину — в скилл, ошибку — в правило. Как я сделал QA-конвейер из скиллов +22

16:20

Большое тестирование способов запуска PHP +19

12:00

ИИ дешевеет, а ваш компьютер дорожает: как OpenAI и Anthropic устроили гонку цен +19

08:05

Многосегментный Linux-маршрутизатор на Netplan и Nftables: DMZ, SNAT/DNAT, MGMT, диагностика и многое другое +19

09:43

Бакеты вместо миллионов строк: как мы ускоряем рассчёты A/B-тестов без потери точности +16

09:36

Математика катастрофы: от дифференциальных уравнений до очередей G/G/1 и формулы Кингмана +15

09:58

Как я менял PagerDuty на self-hosted-решение +14

06:01

Генеративные тесты — «серебряная пуля» или бесполезный костыль: что говорят разработчики и ученые +14

14:01

На чём советские гики учились программировать? (Spectrum Edition, часть 2) +12

СЕРВИСЫ
  • logo

    CloudLogs.ru - Облачное логирование

    • Храните логи вашего сервиса или приложения в облаке. Удобно просматривайте и анализируйте их.
ОБСУЖДАЕМОЕ

  • Код еще никогда не был так дешев. И еще никогда так дорого не обходился +85

    • 97

    Я из будущего, и я в ужасе: советские микросхемы глазами современного инженера +10

    • 92

    Как мы запустили Qwen3.8–27B целиком на RTX 5060 8 GB и получили ~30 токенов/с +32

    • 85

    Сколько телеграм‑каналов вы читаете? +2

    • 41

    Где мы потеряли суверенитет в ПО: пять развилок с 1954 по 2026 год +5

    • 36

    777 вишлистов за неделю после создания страницы в Steam — без какого‑либо освещения в СМИ -1

    • 34

    Что делать, если доступ к Claude пропал, а на нем уже завязан рабочий процесс? +2

    • 29

    На пути борьбы с шумом домашнего ЧПУ: тесты обработки печатной платы под слоем жидкого мыла и не только +42

    • 28

    Как React учился батчингу и как научить его «летать»? +1

    • 26

    Страдают ли LLM от боли. Разбор нашумевшего препринта +15

    • 20

Подписка


  • Главная
  • Контакты
© 2026. Все публикации принадлежат авторам.