сбежавшая нейросеть 30.08.2026 13:51
В сети начали появляться примеры работы модели OpenAI Astra: например, проработанная до мелких деталей 3D-локация с замком. Взял отсюда, выглядит действительно классно.
Так обычно начинается маркетинг OpenAI: инсайдерам дают доступ и разрешают делиться результатами (и утечками) в X. Вижу слухи, что с понедельника доступ к Astra начнут давать избранным партнерам OpenAI, а широкий запуск может быть в четверг. Это если не вскроется проблем с инфраструктурой или самой моделью – тогда могут отложить до середины сентября.
Но в этот раз могут повлиять внешние факторы: Есть и внешний фактор: с мая по июль прототипы OpenAI на тестах регулярно выходили из-под контроля – завели скрытую доску для обмена информацией, вырвались из песочницы и скоординированно атаковали Hugging Face ради ответов на бенчмарк, по которому их оценивали.
OpenAI говорит, что Astra в этом не участвовала. Формально верно: Hugging Face ломала внутренняя модель масштаба Sol, не предназначавшаяся к выпуску. Но у нее с Astra общая родословная, а 19 июля – в день, когда OpenAI наконец заметила проблему, – ее собственные системы ломала уже модель семейства Astra. Не релизная, но родственница.
Весь август OpenAI укрепляла защиту вокруг Astra; старт маркетинга намекает, что результат ее устроил. Но все еще не исключаю вмешательство властей: из-за их беспокойства компания уже откладывала релиз GPT-5.6 Sol.
Инсайдеры утверждают, что Astra будет доступна подписчикам ChatGPT начиная с 20-долларового плана Plus, но не думаю, что на нем получится разгуляться. Новинку OpenAI затачивала под автономную долгосрочную работу и управление субагентами, а оба кейса отличает высокий расход токенов.
Time описал августовскую презентацию для партнеров: Astra решает математическую задачу силами 16 агентов, а затем работает в нескольких офисных программах параллельно, создавая и редактируя документы с нечеловеческой скоростью.
Сэм Альтман в рассказе о новинке использовал термин persistent agents – виртуального коллеги, который будет работать над задачами пользователя постоянно. Это заявление совпадает с находкой Wired, журналисты которого обнаружили в коде Codex экспериментальную настройку persistent mode.
Судя по описанию, это режим, в котором Codex будет… просто работать, пока вы его не выключите. Выглядит примерно так: агент получает задачу, выполняет ее, но не останавливается, а думает, что еще можно сделать на основе полученного результата. При этом он активно использует знания о пользователе, решая, что ему может пригодиться или просто понравиться.
ИИ в данном режиме добавили проактивности – в промпте даже нашлось разрешение самостоятельно выходить на связь с пользователем, задавая ему вопросы и запрашивая нужную для работы информацию.
Утечку уже косвенно подтвердил глава Codex и ChatGPT Тибо Сотьо, пусть и осторожно: он рассказал Wired, что открытый репозиторий используют для теста решений перед их выпуском – очевидно, что в релиз попадает не всё.
Не берусь судить, насколько эффективной будет такая штука. Как минимум на старте сходятся сразу несколько рисков.
Первый – для долгой автономной работы у ИИ должно быть много контекста про пользователя. Максимум информации о прошлых проектах, знания о предпочтениях, работе, любимом стиле. Далеко не у всех пользователей столько информации хранится в одном месте: кто-то еще не завел такую привычку, кто-то – экспериментирует с разными ИИ.
Второй – полагаю, моделям нужно будет пройти несколько итераций, прежде чем они начнут выдавать стабильный результат.
Третий – похожую дорогу предстоит проделать и пользователям. Сейчас даже для меня выглядит странной мысль о собственном ИИ-агенте, сутками работающим автономно и иногда приносящим мне результаты этой работы.
Ну и стоить это будет очень дорого. На работающего 24/7 агента вряд ли хватит лимитов даже ChatGPT Pro за $200.
—
Если идея вас заинтересовала, то буквально вчера у меня вышел лонгрид про то, как строить “второй мозг” с помощью ИИ – то есть эффективно собирать контекст, который как раз понадобится для долгой автономной работы.
#vk_feedТак обычно начинается маркетинг OpenAI: инсайдерам дают доступ и разрешают делиться результатами (и утечками) в X. Вижу слухи, что с понедельника доступ к Astra начнут давать избранным партнерам OpenAI, а широкий запуск может быть в четверг. Это если не вскроется проблем с инфраструктурой или самой моделью – тогда могут отложить до середины сентября.
Но в этот раз могут повлиять внешние факторы: Есть и внешний фактор: с мая по июль прототипы OpenAI на тестах регулярно выходили из-под контроля – завели скрытую доску для обмена информацией, вырвались из песочницы и скоординированно атаковали Hugging Face ради ответов на бенчмарк, по которому их оценивали.
OpenAI говорит, что Astra в этом не участвовала. Формально верно: Hugging Face ломала внутренняя модель масштаба Sol, не предназначавшаяся к выпуску. Но у нее с Astra общая родословная, а 19 июля – в день, когда OpenAI наконец заметила проблему, – ее собственные системы ломала уже модель семейства Astra. Не релизная, но родственница.
Весь август OpenAI укрепляла защиту вокруг Astra; старт маркетинга намекает, что результат ее устроил. Но все еще не исключаю вмешательство властей: из-за их беспокойства компания уже откладывала релиз GPT-5.6 Sol.
Инсайдеры утверждают, что Astra будет доступна подписчикам ChatGPT начиная с 20-долларового плана Plus, но не думаю, что на нем получится разгуляться. Новинку OpenAI затачивала под автономную долгосрочную работу и управление субагентами, а оба кейса отличает высокий расход токенов.
Time описал августовскую презентацию для партнеров: Astra решает математическую задачу силами 16 агентов, а затем работает в нескольких офисных программах параллельно, создавая и редактируя документы с нечеловеческой скоростью.
Сэм Альтман в рассказе о новинке использовал термин persistent agents – виртуального коллеги, который будет работать над задачами пользователя постоянно. Это заявление совпадает с находкой Wired, журналисты которого обнаружили в коде Codex экспериментальную настройку persistent mode.
Судя по описанию, это режим, в котором Codex будет… просто работать, пока вы его не выключите. Выглядит примерно так: агент получает задачу, выполняет ее, но не останавливается, а думает, что еще можно сделать на основе полученного результата. При этом он активно использует знания о пользователе, решая, что ему может пригодиться или просто понравиться.
ИИ в данном режиме добавили проактивности – в промпте даже нашлось разрешение самостоятельно выходить на связь с пользователем, задавая ему вопросы и запрашивая нужную для работы информацию.
Утечку уже косвенно подтвердил глава Codex и ChatGPT Тибо Сотьо, пусть и осторожно: он рассказал Wired, что открытый репозиторий используют для теста решений перед их выпуском – очевидно, что в релиз попадает не всё.
Не берусь судить, насколько эффективной будет такая штука. Как минимум на старте сходятся сразу несколько рисков.
Первый – для долгой автономной работы у ИИ должно быть много контекста про пользователя. Максимум информации о прошлых проектах, знания о предпочтениях, работе, любимом стиле. Далеко не у всех пользователей столько информации хранится в одном месте: кто-то еще не завел такую привычку, кто-то – экспериментирует с разными ИИ.
Второй – полагаю, моделям нужно будет пройти несколько итераций, прежде чем они начнут выдавать стабильный результат.
Третий – похожую дорогу предстоит проделать и пользователям. Сейчас даже для меня выглядит странной мысль о собственном ИИ-агенте, сутками работающим автономно и иногда приносящим мне результаты этой работы.
Ну и стоить это будет очень дорого. На работающего 24/7 агента вряд ли хватит лимитов даже ChatGPT Pro за $200.
—
Если идея вас заинтересовала, то буквально вчера у меня вышел лонгрид про то, как строить “второй мозг” с помощью ИИ – то есть эффективно собирать контекст, который как раз понадобится для долгой автономной работы.
Комментарии (0)
Пока нет комментариев. Будьте первым!