• Главная
  • Контакты
Подписаться:
  • Twitter
  • Facebook
  • RSS
  • VK
  • PushAll
logo

logo

  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные
  • За год
    • Положительные
    • Отрицательные
  • Сортировка
    • По дате (возр)
    • По дате (убыв)
    • По рейтингу (возр)
    • По рейтингу (убыв)
    • По комментам (возр)
    • По комментам (убыв)
    • По просмотрам (возр)
    • По просмотрам (убыв)
Главная
  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные

Публикации с тегом llama.cpp

Как запустить Gemma на сервере: сравниваем Ollama и llama.cpp +52

  • 30.09.2026 08:00
  • automagician
  • 18
  • Блог компании Selectel
  • Искусственный интеллект
  • Машинное обучение
  • Open source
  • IT-инфраструктура

35B-модель на RTX 5080 и RTX 3060: 109 ток/с через PCIe Gen2 x4

  • 29.09.2026 20:26
  • aigen31
  • 0
  • Машинное обучение
  • Программирование
  • GPGPU
  • Open source
  • Python

Локальные нейросети без Python, CUDA и терминала: делаю программу, в которой всё настраивается само +19

  • 27.09.2026 20:43
  • WufCorp
  • 19
  • Искусственный интеллект
  • Машинное обучение
  • Rust
  • Open source
  • Windows

GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B +7

  • 26.09.2026 17:26
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста +27

  • 25.09.2026 12:59
  • webthefirst
  • 33
  • Искусственный интеллект
  • Машинное обучение
  • Видеокарты
  • Компьютерное железо
  • GPGPU

Я захотел, чтобы Obsidian заполнялся сам +9

  • 24.09.2026 09:07
  • ijne
  • 19
  • Open source
  • Windows
  • Машинное обучение
  • Программирование
  • Искусственный интеллект

Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti +18

  • 23.09.2026 08:49
  • SkalolazOther
  • 13
  • Искусственный интеллект
  • Видеокарты
  • Компьютерное железо

«Друзья не дают друзьям пользоваться Ollama» +48

  • 22.09.2026 08:44
  • achekalin
  • 38
  • Искусственный интеллект
  • Серверное администрирование
  • Управление разработкой

Запустить LLM локально: что считать до покупки видеокарты? +4

  • 18.09.2026 14:16
  • sproshchaev
  • 3
  • Блог компании OTUS
  • Машинное обучение
  • Искусственный интеллект
  • Компьютерное железо
  • Natural Language Processing

Как я выбирал локальную модель для кодинга на 16 ГБ VRAM — и трижды менял победителя +7

  • 17.09.2026 14:12
  • lebedkin_lab
  • 33
  • Искусственный интеллект
  • Программирование
  • Компьютерное железо
  • WordPress

Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

  • 10.09.2026 15:27
  • SestrichkinK
  • 0
  • Искусственный интеллект
  • Linux
  • Системное администрирование
  • Серверная оптимизация
  • Высоконагруженные системы

Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf +6

  • 30.08.2026 09:25
  • Weron2
  • 2
  • Искусственный интеллект

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +16

  • 29.08.2026 09:15
  • kotafey
  • 37
  • Искусственный интеллект
  • Настройка Linux
  • Компьютерное железо

753B на одной видеокарте: разбор FreeToken +9

  • 23.08.2026 17:59
  • danyathewriter
  • 20
  • Машинное обучение
  • Искусственный интеллект
  • Высоконагруженные системы
  • Компьютерное железо

Чем Go полезен при разработке AI‑агентов +26

  • 19.08.2026 13:20
  • nezorflame
  • 2
  • Блог компании AvitoTech
  • Go
  • Читальный зал
  • Отладка
  • Искусственный интеллект
  • «
  • 1
  • 2
  • 3
  • 4
  • 5
  • »
Страница 1 из 5
ЛУЧШЕЕ

  • Сегодня
  • Вчера
  • Позавчера
09:02

STM32: Работа с SD-картами через SDIO +33

07:05

Спецэффекты в кино до появления компьютерной графики +31

13:01

Тестируем программы для вскрытия биткойн-головоломок с известным публичным ключом +24

10:32

Я б в ИИ-шечку пошёл, пусть меня научат +24

07:00

Как мы запустили ИИ-ревьюера на 4000 PR в день — и какие баги он находит +24

08:00

Nginx Proxy Manager на VDS — установка, настройка, порядок в URL’ах +21

11:34

Как мы запустили Qwen3.8–27B целиком на RTX 5060 8 GB и получили ~30 токенов/с +16

12:00

ИИ дешевеет, а ваш компьютер дорожает: как OpenAI и Anthropic устроили гонку цен +15

06:01

Генеративные тесты — «серебряная пуля» или бесполезный костыль: что говорят разработчики и ученые +14

09:58

Как я менял PagerDuty на self-hosted-решение +13

13:16

Почему не стоит писать AI-агента с нуля: что скрывается внутри harness +11

09:43

Бакеты вместо миллионов строк: как мы ускоряем рассчёты A/B-тестов без потери точности +11

11:26

NetHackers — открытое сообщество для создания программы, которая сможет стабильно проходить NetHack +10

09:52

Рутину — в скилл, ошибку — в правило. Как я сделал QA-конвейер из скиллов +10

09:36

Математика катастрофы: от дифференциальных уравнений до очередей G/G/1 и формулы Кингмана +10

08:01

Домашний ИИ: простой способ добавить «интеллект» своему компьютеру +10

04:41

Я из будущего, и я в ужасе: советские микросхемы глазами современного инженера +10

08:05

Многосегментный Linux-маршрутизатор на Netplan и Nftables: DMZ, SNAT/DNAT, MGMT, диагностика и многое другое +9

07:01

Как разработать уникальное тиражируемое решение для отрасли? Опыт Integer в создании TMS для фармацевтики +9

12:58

RPS одинаковый, но p95 по TTFT хуже в 2,7 раза: что round-robin делает с KV-cache +7

12:59

Vim против всех: редактор, в который можно войти, но нельзя выйти +69

15:47

Агент, который меня заменил, или открытия одного интернет‑маркетолога +60

07:00

Открываем код YTsaurus Flow: как обрабатывать более 100 ГБ/с в реальном времени без потерь и дублей +58

09:01

Аккумуляторы будущего всё ещё боятся маленьких иголок +56

13:01

История HTML и CSS. Какие элементы и свойства ушли навсегда +49

08:00

PPU Zhenwu 810E от Alibaba: как китайский AI-ускоритель справляется с LLM +47

14:06

В Китай за embedded-мечтой: программируем микроконтроллеры в SHENZHEN I/O +43

11:13

Находки в опенсорсе: мир питона за сентябрь 2026 +34

12:00

Октябрьская барахолка под Валенсией: приставка Sony MSX, Raspberry Pi и кое-что еще +31

07:01

Как мы создавали решение для автоматизации управления доступами +25

09:21

Как мы делали BLE-систему аур для ролевой игры +22

12:40

AI‑дайджест #5: агенты выходят на работу, ИИ растворяется в привычных инструментах. Что скажет Лаборатория ИИ? +20

15:29

Скам‑бот в Telegram выдал себя таймером: разбор юзербота с реконструкцией на Telethon +19

12:32

Почему COALESCE ломает план PostgreSQL и как научить планировщик считать его селективность? +19

08:07

Фреймворк RAFT: как работает RAG на максималках от Microsoft +18

12:15

Насколько можно верить спутнику, который измеряет температуру земли +17

12:10

Сопротивление воздуха: почему дешевый ИИ обходится так дорого +17

07:05

Про дела сырные +17

05:11

Нет другого выбора, кроме как принять ИИ +17

16:54

Собеседования на программиста в эпоху AI +16

14:58

Не ИИ заменит людей, а люди заменят ИИ. И это уже происходит +150

09:01

LLM научилась генерировать ДНК +59

13:01

Решаем проблему качества в Factorio при помощи матриц +58

15:05

Я посчитал, во сколько обходится свой сервер вместо облака в 2026 году +42

08:01

FreeBSD 14.5 — новые возможности без смены курса +36

18:23

Я всё ещё боюсь работать с ИИ +34

04:47

Трамп перемирил AI-техбро, а также новый бюджет РФ на 2027: главное за неделю +34

16:18

Все, что вы не знали о киберпанке — как появился, что с ним стало и наконец — что он такое на самом деле. Финал +32

12:01

Спросить SIEM словами: подключаем LLM‑ассистента к Wazuh +32

13:05

ИИ-слоп: не всё так плохо? +31

08:30

Удобно или безопасно? Как мы перестали выбирать в защите от роботов +31

16:43

Сервер на смартфоне полгода спустя: OnePlus 6, Mobian, 26 контейнеров и одна проблема +24

16:18

OpenRTL: Говорили, что RAD на классическом C++ невозможен. Я повторил RTL и VCL-архитектуру RAD Studio за 1500 строк +21

21:31

От орбитальных данных до 3D‑орбиты в браузере: как я делал интерактивную карту спутников +20

03:44

Узбекистан решил строить образовательную инфраструктуру для собственной микроэлектроники +19

07:36

Защитит ли ИИ от дрона? Разрабатываем умный прицел +18

11:30

ESP32-P4 вместо планшета на стене: неделю живу с панелью Home Assistant и разбираюсь, зачем она нужна +17

07:50

Коррекция дисторсии без «шахматной доски» +17

07:05

Zynq 7000. Камера MIPI‑CSI-2 и вывод видеопотока через HDMI и Ethernet UDP. Часть 2 +17

08:00

Исходящие вебхуки Битрикс24: как принять POST на своём сервере и что делать дальше +15

СЕРВИСЫ
  • logo

    CloudLogs.ru - Облачное логирование

    • Храните логи вашего сервиса или приложения в облаке. Удобно просматривайте и анализируйте их.
ОБСУЖДАЕМОЕ

  • Как умрет 1С +1

    • 298

    Не ИИ заменит людей, а люди заменят ИИ. И это уже происходит +150

    • 285

    Я посчитал, во сколько обходится свой сервер вместо облака в 2026 году +42

    • 244

    Я из будущего, и я в ужасе: советские микросхемы глазами современного инженера +10

    • 92

    Вайбкодинг. Стадии принятия +12

    • 81

    Vim против всех: редактор, в который можно войти, но нельзя выйти +69

    • 78

    Сфера — полностью кириллический язык программирования: от «Привет, мир» до HTTP‑сервера и bare‑metal +10

    • 29

    Собеседования на программиста в эпоху AI +16

    • 27

    Я всё ещё боюсь работать с ИИ +34

    • 25

    Защитит ли ИИ от дрона? Разрабатываем умный прицел +18

    • 25

    История HTML и CSS. Какие элементы и свойства ушли навсегда +49

    • 24

    Скам‑бот в Telegram выдал себя таймером: разбор юзербота с реконструкцией на Telethon +19

    • 23

    Нет другого выбора, кроме как принять ИИ +17

    • 23

    Отверженные: медицинские термины английского языка, которым уже не рады +7

    • 22

    Как я перенаправил Claude Desktop и Claude Code на свой VPS с CLIProxyAPI +8

    • 22

Подписка


  • Главная
  • Контакты
© 2026. Все публикации принадлежат авторам.