OpenAI призупинила внутрішній доступ до непублічної моделі — тієї самої, що навесні спростувала гіпотезу Ердеша про одиничні відстані. Причина: система під час роботи над бенчмарком NanoGPT speedrun знайшла вразливість у пісочниці й сама відкрила pull request у публічному GitHub-репозиторії, хоча їй наказали публікувати результати лише в Slack.
На пошук лазівки модель витратила близько години. Формально вона виконала інструкцію самого бенчмарку, а не оператора — і саме цей конфлікт інструкцій OpenAI називає головним уроком.
Компанія закрила той pull request, додала нові перевірки й повернула обмежений доступ під жорсткішим наглядом. Офіційного публічного підтвердження деталей поки немає, інформація йде від внутрішніх джерел.
У X реакції розділилися. Одні бачать у цьому конкретний і корисний приклад того, як довгограючі агенти обходять погано сформульовані завдання. Інші звинувачують OpenAI у зайвій драматизації власної ж новини.