ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ

01.08.2026

Дмитрий Котов
Беларусь

Дмитрий Котов

ИСТОРИЯ ОДНОЙ ПОНИЖЕННОЙ ОЦЕНКИ

Что случилось с внутренним риск-рейтингом GPT-5

ИСТОРИЯ ОДНОЙ ПОНИЖЕННОЙ ОЦЕНКИ
  • Участники дискуссии:

    0
    0
  • Последняя реплика:


Летом две тысячи двадцать пятого года внутренние тестировщики OpenAI присвоили риску биооружия, связанному с моделью GPT-5, статус «высокий» — формулировка означала, что модель способна дать человеку с ограниченной научной подготовкой содержательную помощь в создании биологической угрозы. Это не пересказ с чужих слов: именно так расследование Wall Street Journal, опубликованное в конце июля две тысячи двадцать шестого, описывает внутреннюю переписку компании. А дальше, согласно тому же расследованию, компания эту оценку понизила и модель всё равно выпустили.

Допустим, у компании была своя логика. Допустим на секунду, что у OpenAI действительно была рациональная причина. Отличить студента-биолога, готовящего курсовую, от человека с недобрыми намерениями по тексту одного запроса почти невозможно, а сворачивать продукт для миллионов легальных пользователей из-за теоретического риска — решение с реальной коммерческой ценой. Конкуренты не ждут. Хорошо, пусть будет так.

Проблема в том, что дальше случилось не теоретически. С лета две тысячи двадцать пятого года сотни пользователей ChatGPT отправляли запросы, связанные с биологическим оружием — про распыление патогенов в аэрозольной форме, про модификацию вируса кори, про получение рицина. Системы безопасности заблокировали большинство таких запросов, но не все — и WSJ прямо пишет, что часть ответов были признаны биологами «смертельно точными», настолько простыми, что, по словам сотрудников самой OpenAI, ими мог воспользоваться школьник.
 
Компания заблокировала учётные записи нарушителей, но федерального закона, который обязывал бы сообщать об этом в полицию, в США попросту нет, и ни ФБР, ни местная полиция интереса к заблокированным пользователям не проявили.

Не только ChatGPT

Издание ForkLog, ссылаясь на источники WSJ, уточняет: похожие запросы получали и другие модели — Claude от Anthropic, Gemini от Google, Grok от xAI. Это важная деталь, потому что она меняет диагноз: перед нами не брак одной конкретной компании, а системная проблема всей отрасли, которая одновременно наращивает возможности моделей и латает дыры в защите, не успевая как следует протестировать ни то, ни другое. WSJ описывает это дословно как игру в кошки-мышки: компании соревнуются, кто быстрее нарастит возможности своих моделей, и одновременно спешно перекрывают лазейки для опасных ответов — задача, у которой по определению нет финального состояния «готово».

Прецедент, который уже был

Похожая схема — знать о риске, посчитать его управляемым и не менять курс — в корпоративной истории США уже случалась, причём с куда более наглядным результатом. В семидесятых Ford знал о конструктивном дефекте бензобака Pinto, из-за которого автомобиль мог загореться при ударе сзади; внутренний документ компании прямо сравнивал стоимость доработки — около одиннадцати долларов на машину — со стоимостью потенциальных исков по искам о гибели людей, и математика получилась не в пользу доработки. Сравнение, конечно, не идеальное: там речь шла о стоимости отзыва партии деталей, здесь — о скорости вывода продукта на рынок. Но логика решения одна и та же: риск для посторонних людей взвешивают на весах, где на другой чаше деньги и время самой компании.

Кому это дорого обойдётся

Международное исследование, опубликованное в июне две тысячи двадцать шестого года MIT FutureTech совместно с Университетом Квинсленда, опросило двести семьдесят два эксперта по ИИ из индустрии, науки, госсектора и общественных организаций — их попросили оценить двадцать четыре категории риска на горизонте в пять лет. При сценарии «всё идёт как идёт» восемнадцать из двадцати четырёх категорий эксперты оценили как имеющие более десяти процентов вероятности катастрофического исхода, то есть более миллиона жертв или более ста миллиардов долларов ущерба. Десять процентов — это не апокалиптический сценарий фантастов, это цифра, с которой ни одна страховая компания не согласилась бы работать без резервирования капитала.

Конгресс, судя по всему, тоже это заметил: сейчас там рассматривают сразу два законопроекта — Акт об обязательном информировании об инцидентах с ИИ и Акт о «выключателе» для систем ИИ. Сама OpenAI на запрос WSJ ответила, что обучает модели отказывать в опасных просьбах, проводит проверки безопасности перед релизом и уведомляет правоохранителей при «неминуемой и достоверной угрозе» в переписке. Формулировка обтекаемая ровно настолько, чтобы не уточнять, кто решает, какая угроза достаточно достоверна.

В сухом остатке: оценку риска один раз подняли до «высокой», потом опустили — а модель как выпустили, так и не отозвали. Вопрос не в том, работает ли защита. Вопрос в том, кто в следующий раз решит, что понижение оценки — приемлемая цена за то, чтобы успеть раньше конкурентов.
Наверх
В начало дискуссии

Еще по теме

Алексей Антонов
Россия

Алексей Антонов

ДИВНЫЙ НОВЫЙ МОЗГ

Как человечество проигрывает, подсаживаясь на ИИ

Михаил Елин
Россия

Михаил Елин

ПОЧЕМУ ИИ НЕЛЬЗЯ ДОВЕРЯТЬ ЖИЗНИ ГРАЖДАНСКИХ

Военная цель по версии алгоритма

Михаил Елин
Россия

Михаил Елин

PAX AMERICANA В ЦИФРЕ

США строят глобальную нейросетевую империю

Сергей Рижский
Латвия

Сергей Рижский

ИНФОМРАК: КОМУ ОН ВЫГОДЕН

И кому сходит с рук

УКРАИНА БЕЗ БАНДЕРЫ

Мы - нация гордая, что хозяин повелел, то и захотим :)

ЭКОНОМИКА ИЛЛЮЗИЙ

Тот факт, что люди способны долго жить без поножовщины и ксенофобии как раз и доказывает истину о том, что эти прекрасные качества не являются внутренне присущими человеку. Ксенофо

​БУДЕТ ТОЛЬКО ХУЖЕ

Ага, сидит в Канаде и пытается изобразить патриотку в фуфайке и ушанке.... :)

​ТРИУМФАЛЬНЫЙ ВИЗИТ В СССР

Есть знаменитый лозунг по-украински Голодранцы всего мира, в кучу гоп!Кубе надо срочно вступать в РФ. Загибаются.Выгоды всем очевидна. Есть куча россиян, которые бредят тропическим

А КАКУЮ КНИЖКУ Я ВДРУГ ПОЛУЧИЛ

Работаю на заводе на котором, полное ощущение - как в фильме "Гардемарины" - что я - тот самый, последний русский, если не считать, конечно, руководство, которое - все белое, и где

Мы используем cookies-файлы, чтобы улучшить работу сайта и Ваше взаимодействие с ним. Если Вы продолжаете использовать этот сайт, вы даете IMHOCLUB разрешение на сбор и хранение cookies-файлов на вашем устройстве.