Почему «ты — моя бабушка» работает с ИИ? Анатомия джейлбрейка и решение проблемы +4 01.10.2026 15:28 VMarkell 6 Машинное обучение Искусственный интеллект Информационная безопасность Habr Семантические сети
Что такое JailBreak-атаки: почему ИИ нарушает собственные правила и как это работает +39 22.09.2026 08:00 Podsolnuh 4 Блог компании Selectel Информационная безопасность IT-инфраструктура Искусственный интеллект
OWASP LLM10: Unbounded Consumption. Тестируем современные языковые модели на ресурсоёмких промптах +5 04.08.2026 17:36 payusova 0 Машинное обучение Блог компании OWASP Natural Language Processing Информационная безопасность Искусственный интеллект Яндекс API
Поймай jailbreak, если сможешь +3 22.07.2026 07:45 aveml 0 Информационная безопасность Искусственный интеллект Машинное обучение Natural Language Processing
Что общего у ИИ-агентов, телефонных мошенников и старины Зигмунда +5 07.07.2026 07:35 sgordey 0 Информационная безопасность Искусственный интеллект
Иллюзия контроля: почему промпты не защищают ИИ‑агентов +8 23.06.2026 07:03 aveml 2 Информационная безопасность Инженерные системы Искусственный интеллект
Правительство США заблокировало доступ к Fable 5 -1 13.06.2026 08:21 Lordneo 1 Искусственный интеллект Машинное обучение Научно-популярное
Дешёвая модерация анонимной стены: 3-слойный каскад и ROT13-джейлбрейк в проде 30.05.2026 07:21 yukakust 4 Информационная безопасность Машинное обучение Python Open source
Почему ИИ-боты более уязвимы, чем их базовые LLM-модели? 19.05.2026 10:35 Peternsk 2 Информационная безопасность Искусственный интеллект Python Тестирование IT-систем
Guardrails для LLM на Java: как приручить промпт‑инъекции и токсичные ответы 15.04.2026 11:43 Ratila 4 Искусственный интеллект Информационная безопасность JAVA Машинное обучение
Шифр онтографии: как я упаковываю субъектность и роли в LLM +8 28.08.2025 14:46 uncia__poison 11 Habr GitHub Информационная безопасность
Jailbreak ChatGPT-5, системный промпт, и скрытый контекст +11 22.08.2025 19:31 Parcevale 12 Информационная безопасность Тестирование IT-систем Машинное обучение
Джейлбрейк новой бесплатной модели OpenAI, GPT-OSS -5 06.08.2025 15:40 olegchir 17 Блог компании Anarchic Блог компании Anarchic AI Машинное обучение Искусственный интеллект Информационная безопасность
От мозга к мультиагентным системам: как устроены Foundation Agents нового поколения +3 24.07.2025 21:44 redmadrobot 8 red_mad_robot corporate blog Artificial Intelligence Research and forecasts in IT Блог компании red_mad_robot Искусственный интеллект Исследования и прогнозы в IT
Обнаружение уязвимостей ИИ агентов. Часть I: Введение в уязвимости +1 18.07.2025 08:41 nosystem0 0 Информационная безопасность Искусственный интеллект