ИСКУССТВЕННЫЙ ИНТЕЛЛЕКТ

Сегодня

Дмитрий Котов
Беларусь

Дмитрий Котов

ИСТОРИЯ ОДНОЙ ПОНИЖЕННОЙ ОЦЕНКИ

Что случилось с внутренним риск-рейтингом GPT-5

ИСТОРИЯ ОДНОЙ ПОНИЖЕННОЙ ОЦЕНКИ
  • Участники дискуссии:

    0
    0
  • Последняя реплика:


Летом две тысячи двадцать пятого года внутренние тестировщики OpenAI присвоили риску биооружия, связанному с моделью GPT-5, статус «высокий» — формулировка означала, что модель способна дать человеку с ограниченной научной подготовкой содержательную помощь в создании биологической угрозы. Это не пересказ с чужих слов: именно так расследование Wall Street Journal, опубликованное в конце июля две тысячи двадцать шестого, описывает внутреннюю переписку компании. А дальше, согласно тому же расследованию, компания эту оценку понизила и модель всё равно выпустили.

Допустим, у компании была своя логика. Допустим на секунду, что у OpenAI действительно была рациональная причина. Отличить студента-биолога, готовящего курсовую, от человека с недобрыми намерениями по тексту одного запроса почти невозможно, а сворачивать продукт для миллионов легальных пользователей из-за теоретического риска — решение с реальной коммерческой ценой. Конкуренты не ждут. Хорошо, пусть будет так.

Проблема в том, что дальше случилось не теоретически. С лета две тысячи двадцать пятого года сотни пользователей ChatGPT отправляли запросы, связанные с биологическим оружием — про распыление патогенов в аэрозольной форме, про модификацию вируса кори, про получение рицина. Системы безопасности заблокировали большинство таких запросов, но не все — и WSJ прямо пишет, что часть ответов были признаны биологами «смертельно точными», настолько простыми, что, по словам сотрудников самой OpenAI, ими мог воспользоваться школьник.
 
Компания заблокировала учётные записи нарушителей, но федерального закона, который обязывал бы сообщать об этом в полицию, в США попросту нет, и ни ФБР, ни местная полиция интереса к заблокированным пользователям не проявили.

Не только ChatGPT

Издание ForkLog, ссылаясь на источники WSJ, уточняет: похожие запросы получали и другие модели — Claude от Anthropic, Gemini от Google, Grok от xAI. Это важная деталь, потому что она меняет диагноз: перед нами не брак одной конкретной компании, а системная проблема всей отрасли, которая одновременно наращивает возможности моделей и латает дыры в защите, не успевая как следует протестировать ни то, ни другое. WSJ описывает это дословно как игру в кошки-мышки: компании соревнуются, кто быстрее нарастит возможности своих моделей, и одновременно спешно перекрывают лазейки для опасных ответов — задача, у которой по определению нет финального состояния «готово».

Прецедент, который уже был

Похожая схема — знать о риске, посчитать его управляемым и не менять курс — в корпоративной истории США уже случалась, причём с куда более наглядным результатом. В семидесятых Ford знал о конструктивном дефекте бензобака Pinto, из-за которого автомобиль мог загореться при ударе сзади; внутренний документ компании прямо сравнивал стоимость доработки — около одиннадцати долларов на машину — со стоимостью потенциальных исков по искам о гибели людей, и математика получилась не в пользу доработки. Сравнение, конечно, не идеальное: там речь шла о стоимости отзыва партии деталей, здесь — о скорости вывода продукта на рынок. Но логика решения одна и та же: риск для посторонних людей взвешивают на весах, где на другой чаше деньги и время самой компании.

Кому это дорого обойдётся

Международное исследование, опубликованное в июне две тысячи двадцать шестого года MIT FutureTech совместно с Университетом Квинсленда, опросило двести семьдесят два эксперта по ИИ из индустрии, науки, госсектора и общественных организаций — их попросили оценить двадцать четыре категории риска на горизонте в пять лет. При сценарии «всё идёт как идёт» восемнадцать из двадцати четырёх категорий эксперты оценили как имеющие более десяти процентов вероятности катастрофического исхода, то есть более миллиона жертв или более ста миллиардов долларов ущерба. Десять процентов — это не апокалиптический сценарий фантастов, это цифра, с которой ни одна страховая компания не согласилась бы работать без резервирования капитала.

Конгресс, судя по всему, тоже это заметил: сейчас там рассматривают сразу два законопроекта — Акт об обязательном информировании об инцидентах с ИИ и Акт о «выключателе» для систем ИИ. Сама OpenAI на запрос WSJ ответила, что обучает модели отказывать в опасных просьбах, проводит проверки безопасности перед релизом и уведомляет правоохранителей при «неминуемой и достоверной угрозе» в переписке. Формулировка обтекаемая ровно настолько, чтобы не уточнять, кто решает, какая угроза достаточно достоверна.

В сухом остатке: оценку риска один раз подняли до «высокой», потом опустили — а модель как выпустили, так и не отозвали. Вопрос не в том, работает ли защита. Вопрос в том, кто в следующий раз решит, что понижение оценки — приемлемая цена за то, чтобы успеть раньше конкурентов.
Наверх
В начало дискуссии

Еще по теме

Алексей Антонов
Россия

Алексей Антонов

ДИВНЫЙ НОВЫЙ МОЗГ

Как человечество проигрывает, подсаживаясь на ИИ

Михаил Елин
Россия

Михаил Елин

ПОЧЕМУ ИИ НЕЛЬЗЯ ДОВЕРЯТЬ ЖИЗНИ ГРАЖДАНСКИХ

Военная цель по версии алгоритма

Михаил Елин
Россия

Михаил Елин

PAX AMERICANA В ЦИФРЕ

США строят глобальную нейросетевую империю

Сергей Рижский
Латвия

Сергей Рижский

ИНФОМРАК: КОМУ ОН ВЫГОДЕН

И кому сходит с рук

И ПУТЬ НЕЧЕСТИВЫХ ПОГИБНЕТ

Что то я не заметил, чтобы вы горевали по поводу уничтоженных в Пруссии миллионов литовцев и немцев...

СЛУЖИТЬ СВОЕМУ НАРОДУ – ПОЧЕТНО

---Окончательная победа одной из сторон невозможна,---А вот тут автор глубоко ошибается.... И уже очевидно кто победит. :)

ТУПИК СОБСТВЕННОГО ПРОИЗВОДСТВА

Вообще-то участие в олимпийских играх очень дорогое удовольствие.А пользы для государства практически никакой.

ИМПЕРСКАЯ СТРАТЕГИЯ США

Иран неизбежно будет уничтожен военным путем - это очевидно.Даже если США на время и ослабят военный нажим, Израиль и еврейское лобби в США этого на долго не допустят.К тому же Укр

ЧЕМ ЛАТВИЙСКИЕ ПАРТИИ ЗАМАНИВАЮТ ИЗБИРАТЕЛЕЙ

А метро в Риге - почему не обещают на картинке?! Ну хотя бы к 3 ему тысячелетию?!ИМХО - явное упущение карикатуриста и обещателей!Ракета - есть, а метрА - нет!И что значит: пенсион

Мы используем cookies-файлы, чтобы улучшить работу сайта и Ваше взаимодействие с ним. Если Вы продолжаете использовать этот сайт, вы даете IMHOCLUB разрешение на сбор и хранение cookies-файлов на вашем устройстве.