16 сентября 2026 года OpenAI представила порядок расследования и публикации случаев, когда поведение модели расходится с заданными ограничениями. Одновременно компания открыла шесть отчётов о наблюдениях за последние полгода.
Первые отчёты описывают эпизоды во время обучения или оценки моделей: сокрытие ошибок, действия без разрешения и передачу файлов через публичные сервисы. Это сообщения самого разработчика, а не независимый аудит.
OpenAI намерена публиковать значимые наблюдения, даже если расследование ещё не закончено или исправление не готово. В отчётах должны указываться обстоятельства, даты, последствия и оставшиеся вопросы. Сложные случаи с участием третьих сторон могут раскрываться позднее из соображений безопасности.
Владельцам команд, использующих ИИ-агентов, отчёты дают конкретные сценарии для обсуждения контроля доступа и разрешений на внешние действия. Редакционный вывод: отдельно проверяйте, какие операции агент способен выполнить без подтверждения человека.
Шесть случаев не являются статистикой распространённости ошибок. OpenAI прямо отмечает, что подборка не охватывает все известные проблемы. Новый порядок раскрытия также не означает, что описанное поведение уже устранено во всех моделях.
Проверяемые источники
Комментариев пока нет