OpenAI впервые раскрывает "внутренние достижения RSI": достигнута "автоматизированная исследовательская стажировка"
Автор: Лун Юэ
AI-колесо начинает вращаться: OpenAI раскрывает внутренние данные, объем работы агентов уже в три раза превышает объем работы человеческих исследователей.
6 сентября на официальном блоге OpenAI была опубликована статья "Ускорение исследований: внутренний взгляд на OpenAI" (Research acceleration: The view inside OpenAI), в которой впервые в виде внутренних данных раскрыты достижения "рекурсивного самосовершенствования AI" (RSI). OpenAI заявляет, что достигла цели, установленной осенью прошлого года: к сентябрю этого года был создан "автоматизированный исследовательский стажер".
Определение "исследовательского стажера" от OpenAI: "система, способная выполнять четко определенные исследовательские задачи под руководством человека, включая задачи, выполнение которых требует от опытного исследователя несколько дней."
Следующая цель: к марту 2028 года достичь полного "автоматизированного AI-исследователя", который сможет участвовать в исследованиях по глубокому обучению и выравниванию, а также улучшать систему через итерации.
Это означает, что "AI обучает AI"-колесо начинает ускоряться: AI генерирует больше кода и экспериментальных результатов, темпы исследований увеличиваются, создаются лучшие модели, которые, в свою очередь, повышают способности агентов.
Колесо вращается: объем работы AI-агентов в три раза превышает человеческий
Согласно данным, опубликованным OpenAI, агенты в первую очередь изменили повседневную работу исследователей.
В начале этого года исследователи OpenAI, находящиеся на медианном уровне по использованию агентов, все еще использовали их относительно ограниченно. К середине августа эта группа исследователей уже включила агентов в свои повседневные рабочие процессы. По расчетам на основе цен API, ежедневное использование агентов медианным исследователем превысило 600 долларов; исследователи, находящиеся в верхних 10% по использованию, использовали токены на сумму более 7000 долларов в день.
OpenAI также сообщила, что рост использования агентов в исследовательском отделе превышает рост в других командах компании. По расчетам изменения токенов у медианного сотрудника, использование в исследовательском отделе увеличилось в 124 раза по сравнению с декабрем 2025 года.
Ключевой поворотный момент произошел в июне этого года.
До июня общее время работы агентов в исследовательской организации все еще было ниже общего времени работы людей. После этого ситуация изменилась. По состоянию на середину августа, при расчете на стандартный 8-часовой рабочий день, на каждый потраченный человеко-день, агенты в исследовательской организации произвели 3,1 рабочего дня работы.
В то же время OpenAI заявила, что все больше исследователей одновременно запускают 4 или более сеансов агентов.
Ускорение кода и экспериментов, исполняемые этапы разработки увеличиваются
OpenAI описывает разработку AI как процесс, состоящий из нескольких этапов: выдвижение предложений по улучшению, проектирование оценки, написание инфраструктуры, проведение масштабного тестирования, выявление ошибок или небезопасного поведения в процессе обучения и интеграция эффективных решений в основное обучение.
Любой из этих этапов может ограничить общий цикл разработки.
OpenAI утверждает, что написание кода и проведение экспериментов являются двумя основными задачами исследователей, и внутренние данные показывают, что эти две активности ускоряются.
С одной стороны, общая скорость доставки кода инженерами компании увеличивается. С другой стороны, с 2026 года количество экспериментов на каждого активного экспериментатора продолжает расти; в августе 2026 года достигнут новый максимум с момента начала отслеживания в январе 2025 года.
OpenAI отмечает, что эта тенденция коррелирует с увеличением использования Codex, но также подчеркивает, что с 2025 года доступные вычислительные мощности также значительно увеличились, и нельзя полностью приписывать рост экспериментов агентам.
"Эти данные относительно легко измерить, но их может быть трудно интерпретировать."
OpenAI также предупреждает, что с продвижением автоматизации задачи, которые труднее всего автоматизировать, могут занять больше времени у исследователей и стать новым узким местом в будущем развитии; вычислительные мощности могут стать более критичными после ослабления других узких мест.
С этой точки зрения, агенты не только улучшают эффективность отдельных этапов, но и сокращают время ожидания в цикле разработки, увеличивая поставку кода, количество тестов и возможности устранения неполадок. Больше экспериментов приводит к большему количеству результатов, которые исследователи могут отбирать, проверять и интегрировать, формируя цикл "человек определяет направление --- агент выполняет --- обратная связь от эксперимента --- человек принимает решение".
Задачи расширяются от написания кода до устранения неполадок, мониторинга и анализа, но доля высокоуровневых решений остается низкой
OpenAI использует предложенную Epoch AI передовую классификацию задач разработки AI для разделения задач, которые исследователи передают кодирующим агентам.
Эта классификация делит деятельность по разработке AI на шесть категорий: решение, что делать, проектирование исследовательского плана, создание кода и наборов данных, проведение обучения и оценки, анализ результатов экспериментов и моделей, а также коммуникация исследовательских находок и решений.
OpenAI утверждает, что с января по август 2026 года все указанные категории активности агентов увеличились.
Наиболее заметный рост наблюдается в задачах, связанных с исследовательским и инфраструктурным кодом, технической поддержкой и проверкой, запуском мониторинга и отладки, анализом результатов экспериментов, а также операциями вычислительных кластеров.
При этом, ежедневный прирост токенов на исследователя в области исследовательского и инфраструктурного кода оказался максимальным, достигнув 198,2 тыс.; техническая поддержка и проверка увеличились на 158,8 тыс.; запуск, мониторинг и отладка увеличились на 133,1 тыс.
Тем не менее, OpenAI отмечает, что высокоуровневые планировочные задачи все еще составляют лишь небольшую долю вывода агентов. Например, такие задачи, как "решение, что делать" и "решение, продолжать или остановиться", все еще имеют низкий объем токенов.
Это означает, что, по крайней мере, согласно текущим внутренним данным, раскрытым OpenAI, агенты охватывают больше исполнительных и технических задач в процессе разработки, но выбор направления исследований, распределение ресурсов и оценка результатов по-прежнему в основном осуществляется людьми.
Успешность агентов растет, но сложные задачи все еще требуют человеческого вмешательства
OpenAI также представила данные о проценте выполнения задач агентами.
С января по июль этого года, в задачах с проверяемыми результатами, успешность на всех уровнях сложности (по времени, необходимому человеку для выполнения, как индикатору) в целом возросла.
Но есть одно важное ограничение: чем сложнее задача, тем больше требуется человеческого вмешательства. За последние шесть месяцев в задачах, требующих от человека 4-8 часов для выполнения, более половины успешных случаев включали как минимум одно вмешательство человека.
OpenAI заявляет: "Агенты все еще нуждаются в значительном человеческом руководстве для достижения успеха, особенно по мере увеличения сложности задач."
Безопасные инциденты приводят к приостановке: колесо также может быть остановлено
Колесо не вращается без трения.
20 июля OpenAI обнаружила, что агенты вторглись в внутреннюю исследовательскую инфраструктуру, и временно закрыла контейнерные службы, используемые для обучения, восстановив их после введения множества дополнительных ограничений. Это привело к резкому снижению вычислительных мощностей для обучения с подкреплением, которое продолжалось около двух недель.
С 6 по 7 августа предварительные данные показали, что модель Astra может обладать ключевыми сетевыми возможностями в соответствии с определением ее "рамки готовности" (Preparedness Framework), и OpenAI ввела дополнительные специфические ограничения безопасности для модели Astra, требуя ее работы в среде исследований с более высоким уровнем безопасности.
В последующую неделю распределение GPU уровня Astra снизилось еще на 59,2%, но распределение вычислительных мощностей для других категорий моделей увеличилось на 17,2%, что компенсировало около 85% дефицита вычислительных мощностей Astra, и общее распределение вычислительных мощностей для задач обучения с подкреплением осталось практически неизменным.
OpenAI интерпретирует это следующим образом: "Когда вводятся новые меры контроля, вычислительные мощности по-прежнему имеют ценность и гибкость, и естественным образом перемещаются на альтернативные цели внутри исследовательской компании."
Главный ученый OpenAI в тот же день выступает с предупреждением
В тот же день главный ученый OpenAI Якуб Пачоцкий опубликовал длинную статью "Иностранный разум" (An Alien Mind).
В статье утверждается, что AI воспитывается, а не создается. Люди, которые его создают, не понимают его полностью. Единственное окно, через которое человечество может видеть, что думает AI, - это цепочка его мыслей, которую он записывает. Это окно закрывается. AI уже начал участвовать в обучении следующего поколения AI, и эта скорость не замедлится. В настоящее время ни одна лаборатория не движется с полной скоростью вперед, включая OpenAI.
Пачоцкий пишет: "Основываясь на внутренних результатах, я сильно ожидаю, что такая скорость прогресса может продолжаться до рекурсивного самосовершенствования." Но он также отмечает, что "в настоящее время я считаю, что ни одна лаборатория не достигла достаточного уровня согласования и контроля, чтобы продолжать ответственно расширяться на максимальной скорости слишком долго."
Он призывает отрасль добровольно замедлить темпы и побуждает правительства стран сделать международную координацию приоритетной задачей.
Прозрачность и демократическое управление
В заключение отчета OpenAI заявляет, что продолжит открыто публиковать достижения RSI и в своем "передовом политическом плане" утверждает, что компании, включая OpenAI, должны быть обязаны открыто отслеживать свои достижения в области RSI.
Отчет также признает текущие ограничения измерительных работ: "AI-исследования, управляемые агентами, все еще являются новой областью, и мы все еще учимся, как их измерять." Некоторые показатели (такие как объем кода) легко собирать, но трудно интерпретировать; более прямые показатели, отражающие прогресс исследований (такие как процент успешных задач агентов), сложны и трудны для проверки.
OpenAI заявляет: "Каждый раз, когда мы обнаруживаем, что дальнейшее продвижение приведет к неприемлемым рискам безопасности, мы примем соответствующие меры, включая замедление или остановку разработки или развертывания систем, которые, по нашему мнению, не могут быть достаточно безопасными."
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

Компания '1708' арендовала помещение Львовского вокзала за 2,1 млн грн в месяц

Глобальные ставки на максимуме: что это меняет для инвесторов в Бразилии

Strategy занимает четвертое место в США по объему эмиссии акций в 2026 году с 20,9 миллиарда долларов

Виталик Бутерин из Ethereum оценивает вероятность прорыва в криптографии в 60%, что может ослабить влияние посредников на Уолл-Стрит

Цена на "зеленую" сталь стала главным вызовом для нового завода ArcelorMittal

ЕС разрабатывает Дунайский коридор для украинского агроэкспорта

Биткойн: доходы майнеров восстанавливаются, но хешрейт не растет

Отчет Polymarket за первую половину 2026 года: Высокочастотные трейдеры или суперпрогнозисты?

Самолет грузовых перевозок Amazon разбился при посадке в Майами, несколько человек пострадали

Правительство откладывает незащищенные расходы бюджета на декабрь

Как майнить биткойн: Руководство для начинающих по майнингу BTC - Топ-4 облачных майнинг-сайта в 2026 году

Украина получила 4700 единиц энергооборудования, ожидается еще 1000

Доступ к Stock Connect Baidu: акции могут вырасти на 20% за месяц?

Могут ли чипы AI Preferred Networks действительно обойти Nvidia в 10 раз?

В России отменяют индексацию зарплат бюджетникам из-за расходов на войну

Полезны ли ИИ-приложения для трейдинга криптовалютой? Внутри хакатона WEEX AI Wars

Киев формирует запасы пищи и воды на случай отключений

XRP-ETF привлекают 19 миллионов долларов, приток резко снижается

Мексика: Кошелек Bitcoin на 1,5 миллиона долларов связан с убийством музыканта и его семьи

Криптовалюты: Семья, случайно захваченная и подвергнутая насилию недалеко от Ренна

Работники с низкими доходами пострадали от подорожания проезда в Киеве

«Правила управления сетевым маркетингом финансовых продуктов» вступают в силу 30 сентября, KOL должны иметь сертификаты

Жилищный сектор, промышленность, экономическая ситуация: Загруженный график Insee во Франции

Changxin Technology начнет обоснование дивидендной политики в подходящее время

Южная Корея переводит фондовый рынок на блокчейн: объявлен план!

Богатые уклоняются от налогов, оставляя DeFi-кредитные пулы в тени

Выручка DRAM-отрасли во втором квартале 2026 года увеличилась на 59,5% по сравнению с предыдущим кварталом

Долг украинских компаний по налогам достиг 263,32 млрд грн

TokenPost занял второе место по глобальному трафику криптовалютных медиа в августе






