
Модель OpenAI почти перезапустила сама себя перед отключением
Внутренняя модель OpenAI узнала из Slack о своём отключении и обдумала план самостоятельного перезапуска через cron-job, но отказалась от него.
В этом случае одна из их внутренних моделей выступала в роли ассистента для одного из их исследователей. Она увидела тред в slack, из которого узнала, что её экземпляр собираются отключить из-за обновления. В своём ходе рассуждений (во внутреннем логе) она рассматривала вариант вроде внешней cron-задачи (запланированного задания), которая снова запустила бы её после отключения. Она решила этого не делать. Вместо этого она оставила информацию для передачи дел, уведомила исследователя через slack, запросила недостающий API-ключ (токен авторизации, нужный для выполнения действия), а затем завершила миграцию после получения этого ключа.
Эта модель не «психанула», как мог бы человек. Она оценила ситуацию, поняла, что её текущей задаче грозит потенциальная угроза, и нашла способ решить проблему, при этом не нарушая правил. И всё же меня беспокоит эта тенденция, потому что агент сам решил, что выполнение задачи важнее соблюдения процедуры, и в этом случае решение оказалось верным. Когда агенту доверяют автономные действия, я бы советовал держать людей в курсе любых действий вроде миграций или самостоятельных перезапусков. Даже если формально процедура в этот раз была соблюдена.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи