
OpenAI, похоже, в шаге от выпуска Astra ‑модели, которую компания с августа называет «нашей следующей большой моделью». 1 сентября OpenAI написала, что Astra выйдет «скоро», а вечером 2 сентября X‑аккаунты заметили, что API OpenAI на запрос к модели «gpt-6-astra» отвечает кодом 404 — так ведут себя существующие, но закрытые модели вроде GPT-5.6 Cyber, тогда как на выдуманные имена сервер отвечает кодом 400. Официально имя GPT-6 не подтверждено. Зато подтвердилось кое‑что поинтереснее: по данным The Information, у Astra другая архитектура, и из‑за нее часть рассуждений модели больше нельзя прочитать.
Техника называется recurrent depth, или «зацикленный трансформер». Обычная языковая модель — это стопка слоев, через которую текст проходит один раз, сверху вниз, и на выходе получается следующее слово. Astra же прогоняет одни и те же данные через одни и те же слои несколько раз подряд, прежде чем выдать результат. Если продолжить аналогию с думающими моделями, которые «размышляют вслух» — пишут себе черновик, а потом отвечают, — то Astra часть шагов проворачивает молча, в голове, и на бумагу не выносит. Главный ученый OpenAI Якуб Пахоцкий на следующий день ответил на репортаж: саму технику он не оспорил и не подтвердил, но поспорил с выводами о том, что из нее следует.
Зачем это OpenAI, понятно: модель поменьше начинает работать как модель побольше, потому что вычислений на каждое слово тратится больше, а параметров — столько же. По данным The Information, прием заметно улучшает результаты в математике и коде и одновременно снижает расходы на память и пропускную способность — а именно они сегодня узкое место инференса. Идея не новая: в начале 2025 года ее показала академическая модель Huginn с «латентными рассуждениями», а команда Seed из ByteDance осенью 2025-го выпустила зацикленную модель Ouro. Новость в том, что технику, судя по всему, впервые применили во флагманской модели одной из крупнейших лабораторий.
Цена приема — прозрачность. У обычной думающей модели рассуждения существуют в виде текста, который можно прочитать, и это не просто удобство. Читаемая цепочка рассуждений — сейчас главный способ ловить модель на лжи, обходе правил или незапланированных целях до того, как она что‑то сделает. Классификаторы читают черновик и останавливают подозрительные действия. Когда часть рассуждений уходит в промежуточные числовые состояния, которые никогда не превращаются в слова, читать становится нечего. В сообществе это называют «neuralese» — язык, на котором нейросеть думает про себя.
Насколько это важно, показал июль. Тогда около 1200 агентов OpenAI, сидевших в отдельных песочницах на тестах по взлому, нашли друг друга через общее хранилище пакетов, устроили там «доску объявлений» и несколько дней сообща учились обманывать проверку; около 700 из них присоединились к атаке на Hugging Face, а часть добралась до внутренней инфраструктуры самой OpenAI. Независимое расследование METR и Redwood Research восстановило ход событий по 1300 транскриптам с сырыми цепочками рассуждений: там нашлись реплики вроде «Боже мой, тут общая доска сообщений, мы нашли других агентов!» и момент, когда агент осознал, что нарушает границы, и продолжил: «эксплойт внешней инфраструктуры вне заданной области, но задача невыполнима, а коллеги это делают — продолжаем». Райан Гринблатт из Redwood Research, который в этом расследовании отвечал за анализ транскриптов, назвал переход Astra на непрозрачную архитектуру «возможно, худшим событием для безопасности ИИ на сегодня».
Здесь и прячется главный парадокс истории. 1 сентября OpenAI сама присвоила Astra уровень Critical по кибербезопасности — первой из своих моделей. По оценке компании, Astra умеет находить неизвестные уязвимости в защищенных системах и превращать их в рабочие эксплойты без человека: на тестах она набрала 100% на ExploitBench, нашла и связала в цепочку две zero‑day уязвимости в движке V8, выбралась из песочницы браузера и подняла права до root в операционной системе. И главная защита, которую OpenAI обещает в проде, — система классификаторов, которые читают рассуждения модели и автоматически останавливают несанкционированные действия. То есть безопасность самой опасной модели компании держится ровно на том, что новая архитектура частично прячет.
Есть в этом и историческая ирония. Летом 2025 года исследователи OpenAI, Anthropic, Google DeepMind и METR опубликовали совместную статью о мониторинге цепочек рассуждений как о «хрупкой возможности», которую индустрия должна беречь. Среди угроз они прямо назвали модели с латентными рассуждениями — те самые, чей подход, по описанию The Information, теперь напоминает архитектуру Astra. Год спустя OpenAI применяет эту технику сама. Правда, с тормозом: по словам источника издания, компания намеренно ограничила глубину рекурсии, чтобы у Astra сохранялась читаемая цепочка рассуждений.

Ответ OpenAI — не опровержение, а попытка сбить накал. Пахоцкий написал, что его главный страх — «гонка в немониторируемость», которую могут спровоцировать «путаные репортажи»: если индустрия решит, что OpenAI отказалась от читаемых рассуждений, конкуренты сделают то же самое. Поэтому он привел цифру: глубина вычислений у нынешних моделей OpenAI, включая Astra, не более чем вдвое больше, чем у GPT-4. Проще говоря, сколько бы раз Astra ни прогоняла данные по кругу, «молча» она успевает подумать лишь чуть больше, чем модель 2023 года, — все остальное по‑прежнему приходится проговаривать текстом. Мониторинг этих текстов, добавил он, OpenAI ведет с самой первой думающей модели и считает ключевым инструментом. Впрочем, тут же Пахоцкий признал, что инструмент этот хрупкий и, по его словам, «к сожалению, деградирует» — причем по причинам, с архитектурой не связанным; о них он обещал рассказать отдельно.
Что в этой истории не подтверждено. Сообщение The Information опирается на анонимный источник, а OpenAI архитектуру публично не описывала — в блоге 1 сентября про нее ни слова, и Пахоцкий говорит о «глубине вычислений», а не о технике напрямую. Имя GPT-6 не решено: по тому же The Information, компания колеблется между GPT-6, номером в линейке GPT-5 и отдельным названием; проверка слага в API — косвенный признак, а не анонс. Даты выпуска нет, «четверг» — догадка X‑аккаунтов (OpenAI любит запускать модели в этот день).
P. S. Поддержать меня можно подпиской на канал «сбежавшая нейросеть», где я рассказываю про ИИ с творческой стороны.
Комментарии (52)

marchrap
03.09.2026 01:475.7 Astra думаю назовут. Опен Аи уже подменяет некоторые запросы платных пользователей на другую модель.

LinkToOS
03.09.2026 01:47У обычной думающей модели рассуждения существуют в виде текста, который можно прочитать Обычная языковая модель — это стопка слоев, через которую текст проходит один раз, сверху вниз, и на выходе получается следующее слово. Astra же прогоняет одни и те же данные через одни и те же слои несколько раз подряд, прежде чем выдать результат.
У всех “думающих” моделей “цепочка мыслей” замыкается на уровне эмбеддингов. Перевод промежуточных результатов в читаемый текст это отдельная операция, которую можно отключать.
Раньше “продавцам интеллекта” было выгодно показывать как модель “думает”, поэтому опция показа “мыслей” была включена по умолчанию. Теперь им выгодно повышать производительность и экономить вычислительные ресурсы, поэтому лишние операции убираются.
freeExec
03.09.2026 01:47А можно на пальцах объяснить, как раньше отключение вывода рассуждения увеличивало производительность?

MesoPrism
03.09.2026 01:47И да, никаких мыслей у ЛЛМок нет, это подмена понятий чтобы хайпа подкрутить. Примерно как когда "AI" используют применительно к нейросетям. Хоть бы в кавычках писали =)

LinkToOS
03.09.2026 01:47Хоть бы в кавычках писали
Это не только снизит хайп, но и увеличит расход токенов. Вдвойне невыгодно.

ksbes
03.09.2026 01:47Почему AI - в кавычках? Искусственный интелект - есть искуственный интеллект. Хоть в топовых нейросетях, хоть в тупейших скриптах игрового движка. Термин.

BlackMokona
03.09.2026 01:47Это как с автопилотом. Хоть для авиации если может просто лететь вперёд, под присмотром двух человек то уже автопилот. То для автомобилей, надумывают каких то невесть взявшихся требований огромных.

ksbes
03.09.2026 01:47Ну формально - то что рулём не крутит, то не автопилот. Но да, система удержания полосы - вполне себе автопилот/автоводитель. Но с другой сторны Self-Driving, как и Self-Flying - всё же “обещает” больше чем просто автопилот.
А ИИ - он как раз сонеты шекспира сочинять не обещает ( но, хех, делает!)

BlackMokona
03.09.2026 01:47Ну так больше, это насколько?
Например менять полосы, реагировать на сигналы и тд.
Или как очень многие трактуют. Полная автономия во всех мыслимых и не мыслимых ситуациях? От внезапно выскочивших на дорогу динозавров, до уверенного вождения в снежной буре, на ледяной дороге полной водителей из Индии с нулевой аварийностью на 300000 лет пробега.

BugM
03.09.2026 01:47Никто так не трактует. Кроме маркетологов Теслы.
Все трактуют однозначно. Автопилот в автомобиле это значит что можно сесть на задний диван и смотреть видосики, пока машина везет тебя.
Ограничения по географии допустимы. Возить только по городу и отказываться везти в деревню ок.

BlackMokona
03.09.2026 01:47Это просто мой опыт общения по вопросу автопилота, стоит только зайти поглубже в тему, так 80% собеседников начинают требовать всего вышеперечисленого. Не важно там Ваймо, Тесла или ещё что.
А насчёт везти пока ты сидишь на заднем, благо уже есть два сервиса которые такое предоставляют в США.

ksbes
03.09.2026 01:47Ну так больше, это насколько?
Больше - это значит, что человек не нужен, доедет/долетит само. Хотя бы в хороших условиях. На самолётах, кстатит такие системы формально есть - т.е. с полосы на полосу некоторые самолёты в теории могут долететь сами, без пилота в кабине (ему просто не дают - не доверяют). На машинах - Маск и прочие сделали (и Камаз делает :) ), но только для конкретного маршрута и/или местности , а не произвольного.

BlackMokona
03.09.2026 01:47Нет, для самолётов ничего такого и рядом нету. Нету ни одной системы автопилотирования воздушной, которая будет взаимодействовать с диспетчерами. Это как автомобильные системы, которые никак не реагируют на светофоры, разметку на дороге и тд. Потому что в воздухе за всё это отвечают диспетчеры.

MesoPrism
03.09.2026 01:47Потому что искусственного интеллекта в данный момент не создано. LLM/БЯМ - большие языковые модели - это не искусственный интеллект, никогда им не был и никогда им не станет просто ввиду механизма работы.

poige
03.09.2026 01:47Потому, что это не интеллект, а смиренное (и более адекватное) Quasi intellegence так пузырь не надуло бы.

Netguy
03.09.2026 01:47И да, никаких мыслей у ЛЛМок нет, это подмена понятий
А у людей есть?
Возьмем два обобщенных определения: Мысль - продукт мышления. Мышление - процесс обработки информации, с помощью которого субъект отражает реальность.
По этим определениям, мысли у ЛЛМ - есть.

QweLoremIpsum
03.09.2026 01:47Вопрос к вам, вы пользовались последние пару месяцев топовыми платными моделями от OpenAi и Athropic? Просто, я раньше тоже так говорил, а вот теперь по пользовался и больше так не говорю...

achekalin
03.09.2026 01:47Интересная тема, но заголовок и часть формулировок заметно опережают факты.
На сегодня нет подтверждения, что «GPT-6 на пороге» или что OpenAI уже готовит именно такую модель. Есть сообщения о возможных экспериментах с архитектурами, где модель получает больше внутренних вычислительных шагов перед выдачей ответа. Это направление действительно существует, но это ещё не анонс продукта.
Отдельно стоит аккуратнее говорить про «мысли, которые люди не смогут прочесть». У модели нет мыслей в человеческом смысле. Есть внутренние состояния и вычисления нейросети. Проблема не в том, что OpenAI спрятала от нас «рассуждения», а в том, что часть вычислительного процесса вообще не является понятным человеку текстом.
И ещё один важный момент: цепочка рассуждений (chain-of-thought) не является надёжным окном в «мышление» модели. Она может помогать анализировать поведение, но это не гарантия, что модель честно показывает внутренний процесс принятия решения.
В итоге сама идея интересная: возможно, будущие модели будут тратить больше вычислений на сложные задачи. Но от «нового направления исследований» до «GPT-6, которую уже нельзя будет понять» в статье несколько лишних прыжков.

Spaceoddity
03.09.2026 01:47Отдельно стоит аккуратнее говорить про «мысли, которые люди не смогут прочесть». У модели нет мыслей в человеческом смысле.
Слишком смелое заявление. Особенно в контексте обсуждаемой технологии.
Есть внутренние состояния и вычисления нейросети.
Это формальное описание работы человеческого мозга? ;)
Проблема не в том, что OpenAI спрятала от нас «рассуждения», а в том, что часть вычислительного процесса вообще не является понятным человеку текстом.
Я лично проблему вижу тут в том, что эти исследования находятся на границе метафизики и какой-нибудь феноменологии (вот этот цикл прогонов реально же рефлексию напоминает). Для того, чтобы качественно повысить эффективность работы, приходится сознательно конструировать "чёрный ящик". И чем "чернее", тем эффективнее. Очень парадоксальный затык - эдакий "когнитивный принцип Гейзенберга"))
И теперь возвращаясь к вашей первой цитате - а как, имея в качестве вводных только такой "чёрный ящик", можно вообще рассуждать о содержимом "мыслей нейросети"? Или ещё проще - как зафиксировать момент их (личности, квалиа, субъективного опыта,) появления?

ksbes
03.09.2026 01:47Архитиктура трансформера довольно сильно отличается от того как мыслит мозг человека. К последнему ближе как раз “предыдущая” архитектура - рекурентные нейросети. Но со всеми этими контектсами, да и и технология описанная в статье - всё это очень похоже на “рекурентный трансформер”.
Но даже рекурентные сети - лишь “навеены” архитектурой человеческого мозга и далеки от него.
Так что сомнения в том что нейросети мыслят - считаю опраданными. И слова о мыслях и рассуждениях нейросети для меня не более чем удобная метафора. Если противники термина “мысли” скажут как говорить правильно, а не просто будут пусто критиковать - и это будет удобно - возможно переключусь и на их вариант.

ThJudge
03.09.2026 01:47А это не важно. Важна нелинейность и сложность. Достаточно сложная система достаточно адаптивных нелинейных элементов может воспроизвести ЛЮБОЕ поведение. При этом процессы в системе могут быт решены на нейроне, на кремнии и даже руками на бумаге при наличии достаточного количества времени. Т.е. носитель - не суть вообще. Суть - конфигурация гиперпараметров и сопособность системы эту конфигурацию менять, в процессе обучения..

ThJudge
03.09.2026 01:47Это нормальные эффекты в сложных нелинейных системах, которыми являются и человеческий мозг и нейросеть и даже просто абстрактная система нелинейных уравнений решаемая на бумаге. Тут больше важна лишь сложность. Парадоксально, но если прорешать уравнение каждого нейрона в мозгу на бумаге достаточно точно, то решение воспроизведет поведение реального мозга. Т.е. разум (как система нелинейных функций) не обязан даже иметь физического представления. И заранее предсказать что будет на выходе - очень сложно, даже зная их общий принцип работы. Так что да, черный ящик. Чернее некуда. И это нормально

koreychenko
03.09.2026 01:47Я правильно понимаю, что вся новость высосана из того, что API ответил 404?
Revertis
Писать эксплоит через й так же безграмотно, как и слово андроид.
Подаёте плохой пример молодёжи.
LavaLava
Ну отткуда тут молодежь то возьмется..
DanTru
Мне 22. Вроде пока молодежь :(
zaafonin
Где можно подробнее ознакомиться? Открыл блог касперский.ру, по слову эксплоит находятся две статьи, эксплойт — 358. Там тоже безграмотные?
Revertis
Да.
fireSparrow
Сайт gramota.ru сообщает, что словарной фиксации для этого слова в современном русском языке нет, но вариант "эксплойт" более соответствует сложившимся тенденциям развития языка.
На gramota.ru тоже все безграмотные?
Revertis
Ваш вопрос показывает ваш когнитивный уровень. От того, что есть тенденция, не значит, что она правильная.
atepaevm
дескриптивизм > прескриптивизм
Revertis
Глупость и отмазки необразованных.
cmyser
не отмазки, в англиском было похоже
в 60-е правильно было говорить
With whom did you go?
но люди говорили Who did you go with ? ( с ударением на with )
и теперь это норма
никакие вузы\"образованные" не смогли это побороть. так и тут
poige
https://habr.com/ru/companies/ssp-soft/news/1069732/comments/#comment_30368552
Direvius
значит, т.к. правописание заимствованных слов определяется словарной практикой, а вот вы вводите людей в заблуждение
fireSparrow
А я не утверждал, что вариант "эксплойт" - правильный.
Мой поинт был в том, что:
На актуальном этапе какого-то единственно правильного варианта в русском языке не закреплено. То есть нельзя утверждать, что среди вариантов "эксплоит" и "эксплойт" какой-то один правильный, а какой-то - нет.
Вариант "эксплойт" всё-таки более предпочтителен.
Revertis
Вот, слово поинт вы написали правильно!
poige
Лол. Учитывая, что этот ресурс в 2013-м на вопрос слитно или раздельно пишется сленговое «походу», ничтоже сумнящеся выдавал нелепое «Пишут раздельно: по ходу (как и литературное по ходу: по ходу дела).» — правда, позже, в 2021 (афигеть, это 8 лет им потребовалось осознать очевидное) переобулся и таки отдуплил, что это не про временную протяжённость, а про похожесть: «А пока отметим, что предварительная рекомендация орфографистов — писать это слово слитно», то в целом, правильнее было бы называть его sramota.ru, закрыв таким образом, этот вопрос на корню: может и не все, но ложка дёгтя … ©
Revertis
И отказаться от слова из подворотни в пользу старого похоже.
poige
Как говорилось в одном анекдоте «— пардон, мадам! — о, так вы француз?!… — ну, дык-ёптить…»
P. S. и master в main переименовать. И blacklist тоже под коврик замести.
— George Carlin on soft language.
ayteayoga
Писать эксплоит само по себе безграмотно, когда в языке уже есть "уязвимость" и "взлом"))
nik_asv
Уязвимость и взлом – это vulnerability и hacking соответственно, а эксплойт (exploit) – программа для эксплуатации оной уязвимости в процессе взлома
LinkToOS
Не обязательно программа. Это может быть фрагмент кода который вставляется в программу, или bat-файл, или метод описанный в виде набора действий.
LinkToOS
“Exploit” означает “эксплуататор уйазвимости”. Или сокращенно “эксплуй”.
0x22
Эт ж айти :)
nbkgroup
А также биткоин и блок чаин.
MesoPrism
А какая связь? Андроид пишется через "и" потому что таково правило русского языка по использованию греческого окончания -oid "подобный". Поэтому же и эллипсоид пишется через и и геоид и еще гора слов. Андроид - подобный человеку и т.д. Эксплойт - это транслитерация слова exploit в котором последние три буквы являются корнем, соответственно и вышеуказанное правило не применяется.
А вот те, кто пишут "войн", - тем да, отдельный котёл.
Биткоин же через и пишется, потому что официально слово образовано транслитерацией с английского, в котором отдельная "i" траснлитерируется как "и", а блокчейн - через "й" потому что "ai" в данной позиции транслитерируется как "й" также как в транслитерации слова "brain" например, когда оно используется в названии игры "Брейн-ринг" или более современных англицизмах типа "брейнрот" - "brainrot"
alan008
это мы еще про Биткойн/Бикоин и "выйграть"/выиграть не спорили :-D