OpenAI зашифровала часть внутренних инструкций Codex и вызвала спор о прозрачности ИИ-агентов
Пользователи Codex обратили внимание на изменение в работе многоагентного режима OpenAI Codex. В GitHub-репозитории проекта появился issue, где говорится, что после обновления MultiAgentV2 сообщения между основным агентом и субагентами стали отображаться в истории не как читаемый текст задачи, а как зашифрованный payload.
Речь идет о spawn_agent, send_message и followup_task. Автор issue утверждает, что после изменения разработчик уже не может нормально проверить, какую именно команду основной агент передал дочернему агенту, зачем был создан отдельный поток и почему он выполнил ту или иную задачу. По его словам, проблема не в самом шифровании, а в исчезновении локального читаемого audit trail.
Пользователи предлагают компромисс: оставить зашифрованную доставку для модели, но дополнительно сохранять отдельную читаемую копию задания для аудита, отладки и разбора сессий. В issue описан вариант encrypted_with_audit, при котором сообщение для модели остается зашифрованным, но в локальной истории сохраняется понятный текст делегированной задачи.
OpenAI публично не объясняла, зачем именно внедрила такую схему. Специалисты предполагают, что причина может быть связана с защитой внутренних команд от дистилляции конкурентами или с требованиями конфиденциальности. Сама OpenAI ранее описывала Codex как агентный инструмент для разработки, который может выполнять задачи в кодовой базе, запускать проверки и предлагать изменения для ревью.
Инцидент показывает новую проблему вокруг ИИ-агентов для программирования. Чем больше агент действует автономно и делегирует задачи другим агентам, тем важнее становится журнал действий. Без читаемой истории разработчику сложнее понять, что именно сделал инструмент, где возникла ошибка и не нарушил ли агент ожидаемые границы работы.