• Главная
  • Контакты
Подписаться:
  • Twitter
  • Facebook
  • RSS
  • VK
  • PushAll
logo

logo

  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные
  • За год
    • Положительные
    • Отрицательные
  • Сортировка
    • По дате (возр)
    • По дате (убыв)
    • По рейтингу (возр)
    • По рейтингу (убыв)
    • По комментам (возр)
    • По комментам (убыв)
    • По просмотрам (возр)
    • По просмотрам (убыв)
Главная
  • Все
    • Положительные
    • Отрицательные
  • За сегодня
    • Положительные
    • Отрицательные
  • За вчера
    • Положительные
    • Отрицательные
  • За 3 дня
    • Положительные
    • Отрицательные
  • За неделю
    • Положительные
    • Отрицательные
  • За месяц
    • Положительные
    • Отрицательные

Публикации с тегом kv-cache

Сайзинг RAM и vCPU для локальной языковой модели: считаем стартовый размер VM

  • 10.09.2026 15:27
  • SestrichkinK
  • 0
  • Искусственный интеллект
  • Linux
  • Системное администрирование
  • Серверная оптимизация
  • Высоконагруженные системы

Контекст растёт, KV-кэш — нет: Qwen3.8-27B на ограниченной VRAM с CMF формате +3

  • 09.09.2026 09:34
  • infosave
  • 1
  • Rust
  • Искусственный интеллект
  • Серверная оптимизация

Я прогнал топ VRAM-калькуляторов для LLM — все ошибаются в одном и том же +5

  • 08.09.2026 09:26
  • Isk4R1oT
  • 0
  • Python
  • Rust
  • Искусственный интеллект
  • Машинное обучение
  • Высоконагруженные системы

Как устроена токеномика — экономика мира ИИ +16

  • 27.08.2026 07:10
  • Roman_Parabat
  • 0
  • Блог компании МТС
  • Искусственный интеллект
  • Управление проектами
  • Бизнес-модели
  • Управление продуктом

Свой инференс для 25 разработчиков: 452:1, KV‑пул и почему это не экономит денег +3

  • 22.08.2026 12:05
  • Tialian
  • 2
  • IT-инфраструктура
  • Искусственный интеллект
  • Финансы в IT
  • DevOps
  • Анализ и проектирование систем

Топ вопросов с NLP собеседований: архитектуры LLM, инференс и оптимизация -1

  • 10.08.2026 19:15
  • abletobetable
  • 0
  • Машинное обучение
  • Natural Language Processing
  • Искусственный интеллект

Инференс LLM: от KV-кэша до продакшен-деплоя +10

  • 27.07.2026 05:30
  • a_ryzhov
  • 4
  • Блог компании hh.ru
  • Блог компании Конференции Олега Бунина (Онтико)
  • Машинное обучение
  • Высоконагруженные системы
  • Искусственный интеллект

Интендант Императора, или Как обеспечить ваше GPU данными при помощи СХД +4

  • 13.07.2026 09:31
  • xitren
  • 0
  • Блог компании АЭРОДИСК
  • Хранение данных
  • Серверное администрирование
  • Сетевые технологии
  • Искусственный интеллект

Походка за двадцать минут и миллион рублей: что RL сделал с двуногими роботами и во что упёрся их «мозг» +7

  • 10.07.2026 09:26
  • 0xReality
  • 7
  • Робототехника
  • Машинное обучение
  • Искусственный интеллект
  • Научно-популярное

Почему дорогая LLM дороже: экономика инференса, которую видно в твоём 5-часовом лимите +5

  • 02.07.2026 22:37
  • Raicon
  • 2
  • Искусственный интеллект
  • Natural Language Processing
  • Машинное обучение
  • Программирование
  • Исследования и прогнозы в IT

Полез в исходники vLLM, чтобы понять, почему один символ убивает prompt caching -1

  • 02.07.2026 07:00
  • xonika9
  • 0
  • Искусственный интеллект
  • Машинное обучение
  • Open source
  • Программирование
  • Высоконагруженные системы

Контекстное окно: почему нейросеть забывает части разговора +22

  • 15.06.2026 06:11
  • DashaPasha
  • 9
  • Блог компании BotHub
  • Искусственный интеллект
  • Научно-популярное

Скрытая цена LLM: как KV-cache увеличивает стоимость инференса и как эту проблему решает Google TurboQuant +21

  • 04.05.2026 07:00
  • konstantin_kozhin
  • 0
  • Блог компании МТС
  • Искусственный интеллект
  • Машинное обучение
  • Natural Language Processing
  • Сжатие данных

KV-кэш, экспертное сообщество и критическое мышление

  • 22.04.2026 09:38
  • urassl
  • 4
  • Машинное обучение
  • Natural Language Processing
  • Искусственный интеллект

KV-Cache в LLM: разбираем инференс через 9 ключевых вопросов +4

  • 10.04.2026 11:21
  • YUNGC0DE
  • 0
  • Машинное обучение
  • Искусственный интеллект
Страница 1 из 1
ЛУЧШЕЕ

  • Сегодня
  • Вчера
  • Позавчера
00:38

Сколько же близких звёзд мы проглядели? +12

07:22

Собираю робота на Raspberry Pi 5 для дочери. Но говорящей колонкой тут не отделаться! Вызов принят, погнали +4

09:01

Часть 12. Приключения латинского алфавита в разных языках: почему польская и чешская латиницы такие разные? +45

07:05

Почему в ретроигры рубятся спустя сорок лет, а современные забываются через два-три года? +29

09:27

Прощай, Кинопоиск +27

14:05

Инженерная тайна AMD из нулевых: что общего между Xbox 360, HTC HD2, Sony Ericsson Xperia Play и LG Optimus L2 +25

18:01

Как фокусник‑математик из Стэнфордского университета обнаружил лазейку в казино +22

13:01

Винтажный электрофон Россия 321 Стерео +14

11:54

Edge‑навигация своими руками: ESP32 + Android + велосипед/мотоцикл +14

11:39

Под кожей Войнича: новый слой 600-летней загадки +7

10:16

Чтобы понять Kubernetes, я написал свой Kubernetes +7

08:01

Большинство корпоративных ИТ-систем впервые размещается за пределами собственных дата-центров +7

07:00

Как мы перераспределили альфу в A/B-тестах и сократили размер выборки +7

17:23

«Вставьте диск в устройство A:» — я попробовал заставить Windows 11 сказать это SSD +6

08:24

Дешево, но не точно: разбираем контроллер доверия к памяти LLM-агентов +6

12:31

Когда капитал перестанет ждать человека +5

10:30

Я ускорил запрос в 75 раз. Через две недели оказалось, что дело было не в запросе +4

07:44

МУзей Мусора МуМуКа +4

20:32

Мы как мир +3

13:59

Миллионы за комментарий. Почему IT‑гиганты скупают книги и корпоративную почту? +3

12:16

Свинство в действии: расширяем синтаксис питона +3

09:20

Скорость визуального восприятия: правда и мифы +3

07:30

Запустили полнотекстовый и гибридный поиск в YDB: рассказываем, что под капотом +69

07:30

Запустили полнотекстовый и гибридный поиск в YDB: рассказываем, что под капотом +69

08:05

Первые отечественные электронные лифты. УЛЖМ МЯУ +55

11:50

Часы Unix тикали от розетки: откуда взялся 1970 год и что сломается в 2038-м +46

07:05

Технология будущего в 2003 году. Взлёт и падение IrDA +43

10:50

Что реально дает Wi-Fi 7 дома +37

11:45

Найм уровня undefined +33

13:01

Сложно о простом. Ничего не понимаю в ИБ. Часть 1. Зачем защищать корпоративную сеть, если она и так работает? +32

16:00

Как я создал СуперЗавуч — программу для генерации расписаний занятий +31

09:01

Зелёный пайплайн ничего не доказывает. Семь способов, которыми quality gate пропускает брак в прод +31

08:00

Разбор Jev — модели, которая не умеет писать +30

06:28

Скоростная разработка электроники 2 +30

09:49

Я хотел одного гуля, а ИИ‑агенты собрали конвейер 3D‑персонажей для Unreal Engine 5 +22

10:01

Я обучил нейросеть играть в «Точки» — теперь она меня обыгрывает +20

13:08

Когда одного CNI мало — deepdive в CNI Chaining +19

11:08

Прорыв GPT-6 Astra, Claude взрослеет до версии 5.5, скандал вокруг задачи Навье-Стокса: главные события в ИИ за сентябрь +19

06:43

C++: Айсберг времени жизни объектов +19

13:00

На чем гики из третьих стран учились программировать? +18

12:35

Blackview Gamibook 16 — самый честный обзор на ноутбук за 160к с RTX5060 +17

12:36

Безопасники против хакеров: симметрия инструментов и асимметрия скоростей +16

СЕРВИСЫ
  • logo

    CloudLogs.ru - Облачное логирование

    • Храните логи вашего сервиса или приложения в облаке. Удобно просматривайте и анализируйте их.
ОБСУЖДАЕМОЕ

  • Прощай, Кинопоиск +29

    • 54

    Почему в ретроигры рубятся спустя сорок лет, а современные забываются через два-три года? +29

    • 54

    Я хотел одного гуля, а ИИ‑агенты собрали конвейер 3D‑персонажей для Unreal Engine 5 +22

    • 34

    Что реально дает Wi-Fi 7 дома +37

    • 33

    Скоростная разработка электроники 2 +30

    • 26

    Под кожей Войнича: новый слой 600-летней загадки +7

    • 24

    Как я создал СуперЗавуч — программу для генерации расписаний занятий +31

    • 21

    Я обучил нейросеть играть в «Точки» — теперь она меня обыгрывает +20

    • 21

    Технология будущего в 2003 году. Взлёт и падение IrDA +43

    • 20

Подписка


  • Главная
  • Контакты
© 2026. Все публикации принадлежат авторам.