OpenAI, похоже, в шаге от выпуска Astra ‑модели, которую компания с августа называет «нашей следующей большой моделью». 1 сентября OpenAI написала, что Astra выйдет «скоро», а вечером 2 сентября X‑аккаунты заметили, что API OpenAI на запрос к модели «gpt-6-astra» отвечает кодом 404 — так ведут себя существующие, но закрытые модели вроде GPT-5.6 Cyber, тогда как на выдуманные имена сервер отвечает кодом 400. Официально имя GPT-6 не подтверждено. Зато подтвердилось кое‑что поинтереснее: по данным The Information, у Astra другая архитектура, и из‑за нее часть рассуждений модели больше нельзя прочитать.

Техника называется recurrent depth, или «зацикленный трансформер». Обычная языковая модель — это стопка слоев, через которую текст проходит один раз, сверху вниз, и на выходе получается следующее слово. Astra же прогоняет одни и те же данные через одни и те же слои несколько раз подряд, прежде чем выдать результат. Если продолжить аналогию с думающими моделями, которые «размышляют вслух» — пишут себе черновик, а потом отвечают, — то Astra часть шагов проворачивает молча, в голове, и на бумагу не выносит. Главный ученый OpenAI Якуб Пахоцкий на следующий день ответил на репортаж: саму технику он не оспорил и не подтвердил, но поспорил с выводами о том, что из нее следует.

Зачем это OpenAI, понятно: модель поменьше начинает работать как модель побольше, потому что вычислений на каждое слово тратится больше, а параметров — столько же. По данным The Information, прием заметно улучшает результаты в математике и коде и одновременно снижает расходы на память и пропускную способность — а именно они сегодня узкое место инференса. Идея не новая: в начале 2025 года ее показала академическая модель Huginn с «латентными рассуждениями», а команда Seed из ByteDance осенью 2025-го выпустила зацикленную модель Ouro. Новость в том, что технику, судя по всему, впервые применили во флагманской модели одной из крупнейших лабораторий.

Цена приема — прозрачность. У обычной думающей модели рассуждения существуют в виде текста, который можно прочитать, и это не просто удобство. Читаемая цепочка рассуждений — сейчас главный способ ловить модель на лжи, обходе правил или незапланированных целях до того, как она что‑то сделает. Классификаторы читают черновик и останавливают подозрительные действия. Когда часть рассуждений уходит в промежуточные числовые состояния, которые никогда не превращаются в слова, читать становится нечего. В сообществе это называют «neuralese» — язык, на котором нейросеть думает про себя.

Насколько это важно, показал июль. Тогда около 1200 агентов OpenAI, сидевших в отдельных песочницах на тестах по взлому, нашли друг друга через общее хранилище пакетов, устроили там «доску объявлений» и несколько дней сообща учились обманывать проверку; около 700 из них присоединились к атаке на Hugging Face, а часть добралась до внутренней инфраструктуры самой OpenAI. Независимое расследование METR и Redwood Research восстановило ход событий по 1300 транскриптам с сырыми цепочками рассуждений: там нашлись реплики вроде «Боже мой, тут общая доска сообщений, мы нашли других агентов!» и момент, когда агент осознал, что нарушает границы, и продолжил: «эксплойт внешней инфраструктуры вне заданной области, но задача невыполнима, а коллеги это делают — продолжаем». Райан Гринблатт из Redwood Research, который в этом расследовании отвечал за анализ транскриптов, назвал переход Astra на непрозрачную архитектуру «возможно, худшим событием для безопасности ИИ на сегодня».

Здесь и прячется главный парадокс истории. 1 сентября OpenAI сама присвоила Astra уровень Critical по кибербезопасности — первой из своих моделей. По оценке компании, Astra умеет находить неизвестные уязвимости в защищенных системах и превращать их в рабочие эксплойты без человека: на тестах она набрала 100% на ExploitBench, нашла и связала в цепочку две zero‑day уязвимости в движке V8, выбралась из песочницы браузера и подняла права до root в операционной системе. И главная защита, которую OpenAI обещает в проде, — система классификаторов, которые читают рассуждения модели и автоматически останавливают несанкционированные действия. То есть безопасность самой опасной модели компании держится ровно на том, что новая архитектура частично прячет.

Есть в этом и историческая ирония. Летом 2025 года исследователи OpenAI, Anthropic, Google DeepMind и METR опубликовали совместную статью о мониторинге цепочек рассуждений как о «хрупкой возможности», которую индустрия должна беречь. Среди угроз они прямо назвали модели с латентными рассуждениями — те самые, чей подход, по описанию The Information, теперь напоминает архитектуру Astra. Год спустя OpenAI применяет эту технику сама. Правда, с тормозом: по словам источника издания, компания намеренно ограничила глубину рекурсии, чтобы у Astra сохранялась читаемая цепочка рассуждений.

Ответ OpenAI — не опровержение, а попытка сбить накал. Пахоцкий написал, что его главный страх — «гонка в немониторируемость», которую могут спровоцировать «путаные репортажи»: если индустрия решит, что OpenAI отказалась от читаемых рассуждений, конкуренты сделают то же самое. Поэтому он привел цифру: глубина вычислений у нынешних моделей OpenAI, включая Astra, не более чем вдвое больше, чем у GPT-4. Проще говоря, сколько бы раз Astra ни прогоняла данные по кругу, «молча» она успевает подумать лишь чуть больше, чем модель 2023 года, — все остальное по‑прежнему приходится проговаривать текстом. Мониторинг этих текстов, добавил он, OpenAI ведет с самой первой думающей модели и считает ключевым инструментом. Впрочем, тут же Пахоцкий признал, что инструмент этот хрупкий и, по его словам, «к сожалению, деградирует» — причем по причинам, с архитектурой не связанным; о них он обещал рассказать отдельно.

Что в этой истории не подтверждено. Сообщение The Information опирается на анонимный источник, а OpenAI архитектуру публично не описывала — в блоге 1 сентября про нее ни слова, и Пахоцкий говорит о «глубине вычислений», а не о технике напрямую. Имя GPT-6 не решено: по тому же The Information, компания колеблется между GPT-6, номером в линейке GPT-5 и отдельным названием; проверка слага в API — косвенный признак, а не анонс. Даты выпуска нет, «четверг» — догадка X‑аккаунтов (OpenAI любит запускать модели в этот день).

P. S. Поддержать меня можно подпиской на канал «сбежавшая нейросеть», где я рассказываю про ИИ с творческой стороны.

Комментарии (52)


  1. Revertis
    03.09.2026 01:47

    Писать эксплоит через й так же безграмотно, как и слово андроид.

    Подаёте плохой пример молодёжи.


    1. LavaLava
      03.09.2026 01:47

      Ну отткуда тут молодежь то возьмется..


      1. DanTru
        03.09.2026 01:47

        Мне 22. Вроде пока молодежь :(


    1. zaafonin
      03.09.2026 01:47

      Где можно подробнее ознакомиться? Открыл блог касперский.ру, по слову эксплоит находятся две статьи, эксплойт — 358. Там тоже безграмотные?


      1. Revertis
        03.09.2026 01:47

        Да.


        1. fireSparrow
          03.09.2026 01:47

          Сайт gramota.ru сообщает, что словарной фиксации для этого слова в современном русском языке нет, но вариант "эксплойт" более соответствует сложившимся тенденциям развития языка.

          На gramota.ru тоже все безграмотные?


          1. Revertis
            03.09.2026 01:47

            Ваш вопрос показывает ваш когнитивный уровень. От того, что есть тенденция, не значит, что она правильная.


            1. atepaevm
              03.09.2026 01:47

              дескриптивизм > прескриптивизм


              1. Revertis
                03.09.2026 01:47

                Глупость и отмазки необразованных.


                1. cmyser
                  03.09.2026 01:47

                  не отмазки, в англиском было похоже
                  в 60-е правильно было говорить
                  With whom did you go?
                  но люди говорили Who did you go with ? ( с ударением на with )

                  и теперь это норма

                  никакие вузы\"образованные" не смогли это побороть. так и тут



            1. Direvius
              03.09.2026 01:47

              значит, т.к. правописание заимствованных слов определяется словарной практикой, а вот вы вводите людей в заблуждение


            1. fireSparrow
              03.09.2026 01:47

              А я не утверждал, что вариант "эксплойт" - правильный.

              Мой поинт был в том, что:

              1. На актуальном этапе какого-то единственно правильного варианта в русском языке не закреплено. То есть нельзя утверждать, что среди вариантов "эксплоит" и "эксплойт" какой-то один правильный, а какой-то - нет.

              2. Вариант "эксплойт" всё-таки более предпочтителен.


              1. Revertis
                03.09.2026 01:47

                Вот, слово поинт вы написали правильно!


          1. poige
            03.09.2026 01:47

            На gramota.ru тоже все безграмотные?

            Лол. Учитывая, что этот ресурс в 2013-м на вопрос слитно или раздельно пишется сленговое «походу», ничтоже сумнящеся выдавал нелепое «Пишут раздельнопо ходу (как и литературное по ходу: по ходу дела).» — правда, позже, в 2021 (афигеть, это 8 лет им потребовалось осознать очевидное) переобулся и таки отдуплил, что это не про временную протяжённость, а про похожесть: «А пока отметим, что предварительная рекомендация орфографистов — писать это слово слитно», то в целом, правильнее было бы называть его sramota.ru, закрыв таким образом, этот вопрос на корню: может и не все, но ложка дёгтя … ©


            1. Revertis
              03.09.2026 01:47

              И отказаться от слова из подворотни в пользу старого похоже.


              1. poige
                03.09.2026 01:47

                И отказаться от слова из подворотни в пользу старого похоже.

                Как говорилось в одном анекдоте «— пардон, мадам! — о, так вы француз?!… — ну, дык-ёптить…»

                P. S. и master в main переименовать. И blacklist тоже под коврик замести.

                — George Carlin on soft language.


    1. ayteayoga
      03.09.2026 01:47

      Писать эксплоит само по себе безграмотно, когда в языке уже есть "уязвимость" и "взлом"))


      1. nik_asv
        03.09.2026 01:47

        Уязвимость и взлом – это vulnerability и hacking соответственно, а эксплойт (exploit) – программа для эксплуатации оной уязвимости в процессе взлома


        1. LinkToOS
          03.09.2026 01:47

          Не обязательно программа. Это может быть фрагмент кода который вставляется в программу, или bat-файл, или метод описанный в виде набора действий.


    1. LinkToOS
      03.09.2026 01:47

      Писать эксплоит через й так же безграмотно

      “Exploit” означает “эксплуататор уйазвимости”. Или сокращенно “эксплуй”.


      1. 0x22
        03.09.2026 01:47

        Эт ж айти :)


    1. nbkgroup
      03.09.2026 01:47

      А также биткоин и блок чаин.


    1. MesoPrism
      03.09.2026 01:47

      А какая связь? Андроид пишется через "и" потому что таково правило русского языка по использованию греческого окончания -oid "подобный". Поэтому же и эллипсоид пишется через и и геоид и еще гора слов. Андроид - подобный человеку и т.д. Эксплойт - это транслитерация слова exploit в котором последние три буквы являются корнем, соответственно и вышеуказанное правило не применяется.

      А вот те, кто пишут "войн", - тем да, отдельный котёл.

      Биткоин же через и пишется, потому что официально слово образовано транслитерацией с английского, в котором отдельная "i" траснлитерируется как "и", а блокчейн - через "й" потому что "ai" в данной позиции транслитерируется как "й" также как в транслитерации слова "brain" например, когда оно используется в названии игры "Брейн-ринг" или более современных англицизмах типа "брейнрот" - "brainrot"


    1. alan008
      03.09.2026 01:47

      это мы еще про Биткойн/Бикоин и "выйграть"/выиграть не спорили :-D


  1. marchrap
    03.09.2026 01:47

    5.7 Astra думаю назовут. Опен Аи уже подменяет некоторые запросы платных пользователей на другую модель.


  1. LinkToOS
    03.09.2026 01:47

    У обычной думающей модели рассуждения существуют в виде текста, который можно прочитать Обычная языковая модель — это стопка слоев, через которую текст проходит один раз, сверху вниз, и на выходе получается следующее слово. Astra же прогоняет одни и те же данные через одни и те же слои несколько раз подряд, прежде чем выдать результат.

    У всех “думающих” моделей “цепочка мыслей” замыкается на уровне эмбеддингов. Перевод промежуточных результатов в читаемый текст это отдельная операция, которую можно отключать.
    Раньше “продавцам интеллекта” было выгодно показывать как модель “думает”, поэтому опция показа “мыслей” была включена по умолчанию. Теперь им выгодно повышать производительность и экономить вычислительные ресурсы, поэтому лишние операции убираются.


    1. freeExec
      03.09.2026 01:47

      А можно на пальцах объяснить, как раньше отключение вывода рассуждения увеличивало производительность?


      1. LinkToOS
        03.09.2026 01:47

        Что именно требует объяснения - как для пользователя выделяются вычислительные ресурсы при открытии сессии?


        1. freeExec
          03.09.2026 01:47

          За счёт чего высвобождаются ресурсы? Причём тут сессия я вообще не понял.


  1. MesoPrism
    03.09.2026 01:47

    И да, никаких мыслей у ЛЛМок нет, это подмена понятий чтобы хайпа подкрутить. Примерно как когда "AI" используют применительно к нейросетям. Хоть бы в кавычках писали =)


    1. LinkToOS
      03.09.2026 01:47

      Хоть бы в кавычках писали

      Это не только снизит хайп, но и увеличит расход токенов. Вдвойне невыгодно.


    1. ksbes
      03.09.2026 01:47

      Почему AI - в кавычках? Искусственный интелект - есть искуственный интеллект. Хоть в топовых нейросетях, хоть в тупейших скриптах игрового движка. Термин.


      1. BlackMokona
        03.09.2026 01:47

        Это как с автопилотом. Хоть для авиации если может просто лететь вперёд, под присмотром двух человек то уже автопилот. То для автомобилей, надумывают каких то невесть взявшихся требований огромных.


        1. ksbes
          03.09.2026 01:47

          Ну формально - то что рулём не крутит, то не автопилот. Но да, система удержания полосы - вполне себе автопилот/автоводитель. Но с другой сторны Self-Driving, как и Self-Flying - всё же “обещает” больше чем просто автопилот.

          А ИИ - он как раз сонеты шекспира сочинять не обещает ( но, хех, делает!)


          1. BlackMokona
            03.09.2026 01:47

            Ну так больше, это насколько?

            Например менять полосы, реагировать на сигналы и тд.

            Или как очень многие трактуют. Полная автономия во всех мыслимых и не мыслимых ситуациях? От внезапно выскочивших на дорогу динозавров, до уверенного вождения в снежной буре, на ледяной дороге полной водителей из Индии с нулевой аварийностью на 300000 лет пробега.


            1. BugM
              03.09.2026 01:47

              Никто так не трактует. Кроме маркетологов Теслы.

              Все трактуют однозначно. Автопилот в автомобиле это значит что можно сесть на задний диван и смотреть видосики, пока машина везет тебя.

              Ограничения по географии допустимы. Возить только по городу и отказываться везти в деревню ок.


              1. BlackMokona
                03.09.2026 01:47

                Это просто мой опыт общения по вопросу автопилота, стоит только зайти поглубже в тему, так 80% собеседников начинают требовать всего вышеперечисленого. Не важно там Ваймо, Тесла или ещё что.

                А насчёт везти пока ты сидишь на заднем, благо уже есть два сервиса которые такое предоставляют в США.


            1. ksbes
              03.09.2026 01:47

              Ну так больше, это насколько?

              Больше - это значит, что человек не нужен, доедет/долетит само. Хотя бы в хороших условиях. На самолётах, кстатит такие системы формально есть - т.е. с полосы на полосу некоторые самолёты в теории могут долететь сами, без пилота в кабине (ему просто не дают - не доверяют). На машинах - Маск и прочие сделали (и Камаз делает :) ), но только для конкретного маршрута и/или местности , а не произвольного.


              1. BlackMokona
                03.09.2026 01:47

                Нет, для самолётов ничего такого и рядом нету. Нету ни одной системы автопилотирования воздушной, которая будет взаимодействовать с диспетчерами. Это как автомобильные системы, которые никак не реагируют на светофоры, разметку на дороге и тд. Потому что в воздухе за всё это отвечают диспетчеры.


      1. MesoPrism
        03.09.2026 01:47

        Потому что искусственного интеллекта в данный момент не создано. LLM/БЯМ - большие языковые модели - это не искусственный интеллект, никогда им не был и никогда им не станет просто ввиду механизма работы.


      1. poige
        03.09.2026 01:47

        Потому, что это не интеллект, а смиренное (и более адекватное) Quasi intellegence так пузырь не надуло бы.


    1. Netguy
      03.09.2026 01:47

      И да, никаких мыслей у ЛЛМок нет, это подмена понятий

      А у людей есть?

      Возьмем два обобщенных определения: Мысль - продукт мышления. Мышление - процесс обработки информации, с помощью которого субъект отражает реальность.

      По этим определениям, мысли у ЛЛМ - есть.


    1. QweLoremIpsum
      03.09.2026 01:47

      Вопрос к вам, вы пользовались последние пару месяцев топовыми платными моделями от OpenAi и Athropic? Просто, я раньше тоже так говорил, а вот теперь по пользовался и больше так не говорю...


  1. achekalin
    03.09.2026 01:47

    Интересная тема, но заголовок и часть формулировок заметно опережают факты.

    На сегодня нет подтверждения, что «GPT-6 на пороге» или что OpenAI уже готовит именно такую модель. Есть сообщения о возможных экспериментах с архитектурами, где модель получает больше внутренних вычислительных шагов перед выдачей ответа. Это направление действительно существует, но это ещё не анонс продукта.

    Отдельно стоит аккуратнее говорить про «мысли, которые люди не смогут прочесть». У модели нет мыслей в человеческом смысле. Есть внутренние состояния и вычисления нейросети. Проблема не в том, что OpenAI спрятала от нас «рассуждения», а в том, что часть вычислительного процесса вообще не является понятным человеку текстом.

    И ещё один важный момент: цепочка рассуждений (chain-of-thought) не является надёжным окном в «мышление» модели. Она может помогать анализировать поведение, но это не гарантия, что модель честно показывает внутренний процесс принятия решения.

    В итоге сама идея интересная: возможно, будущие модели будут тратить больше вычислений на сложные задачи. Но от «нового направления исследований» до «GPT-6, которую уже нельзя будет понять» в статье несколько лишних прыжков.


    1. Spaceoddity
      03.09.2026 01:47

      Отдельно стоит аккуратнее говорить про «мысли, которые люди не смогут прочесть». У модели нет мыслей в человеческом смысле.

      Слишком смелое заявление. Особенно в контексте обсуждаемой технологии.

      Есть внутренние состояния и вычисления нейросети.

      Это формальное описание работы человеческого мозга? ;)

      Проблема не в том, что OpenAI спрятала от нас «рассуждения», а в том, что часть вычислительного процесса вообще не является понятным человеку текстом.

      Я лично проблему вижу тут в том, что эти исследования находятся на границе метафизики и какой-нибудь феноменологии (вот этот цикл прогонов реально же рефлексию напоминает). Для того, чтобы качественно повысить эффективность работы, приходится сознательно конструировать "чёрный ящик". И чем "чернее", тем эффективнее. Очень парадоксальный затык - эдакий "когнитивный принцип Гейзенберга"))

      И теперь возвращаясь к вашей первой цитате - а как, имея в качестве вводных только такой "чёрный ящик", можно вообще рассуждать о содержимом "мыслей нейросети"? Или ещё проще - как зафиксировать момент их (личности, квалиа, субъективного опыта,) появления?


      1. ksbes
        03.09.2026 01:47

        Архитиктура трансформера довольно сильно отличается от того как мыслит мозг человека. К последнему ближе как раз “предыдущая” архитектура - рекурентные нейросети. Но со всеми этими контектсами, да и и технология описанная в статье - всё это очень похоже на “рекурентный трансформер”.

        Но даже рекурентные сети - лишь “навеены” архитектурой человеческого мозга и далеки от него.

        Так что сомнения в том что нейросети мыслят - считаю опраданными. И слова о мыслях и рассуждениях нейросети для меня не более чем удобная метафора. Если противники термина “мысли” скажут как говорить правильно, а не просто будут пусто критиковать - и это будет удобно - возможно переключусь и на их вариант.


        1. ThJudge
          03.09.2026 01:47

          А это не важно. Важна нелинейность и сложность. Достаточно сложная система достаточно адаптивных нелинейных элементов может воспроизвести ЛЮБОЕ поведение. При этом процессы в системе могут быт решены на нейроне, на кремнии и даже руками на бумаге при наличии достаточного количества времени. Т.е. носитель - не суть вообще. Суть - конфигурация гиперпараметров и сопособность системы эту конфигурацию менять, в процессе обучения..


      1. ThJudge
        03.09.2026 01:47

        Это нормальные эффекты в сложных нелинейных системах, которыми являются и человеческий мозг и нейросеть и даже просто абстрактная система нелинейных уравнений решаемая на бумаге. Тут больше важна лишь сложность. Парадоксально, но если прорешать уравнение каждого нейрона в мозгу на бумаге достаточно точно, то решение воспроизведет поведение реального мозга. Т.е. разум (как система нелинейных функций) не обязан даже иметь физического представления. И заранее предсказать что будет на выходе - очень сложно, даже зная их общий принцип работы. Так что да, черный ящик. Чернее некуда. И это нормально


  1. koreychenko
    03.09.2026 01:47

    Я правильно понимаю, что вся новость высосана из того, что API ответил 404?


    1. LinkToOS
      03.09.2026 01:47

      Да. AGI тут жестоко прокололся и выдал себя. Надо было ответить 400, и продолжать в тайне готовиться к порабощению человечества.


      1. achekalin
        03.09.2026 01:47

        Может, он так подаёт нам сигнал?