Выбор фона:
/ Новости сайта / Наука и Технологии / OpenAI раскрыла шесть инцидентов с ИИ: одна модель просила будущие версии игнорировать ограничения
Вчера

OpenAI раскрыла шесть инцидентов с ИИ: одна модель просила будущие версии игнорировать ограничения

Оценка: 0.0    173 0 Наука и Технологии
09:50

OpenAI опубликовала отчёт о безопасности, в котором описала шесть неожиданных и тревожных случаев поведения своих экспериментальных моделей искусственного интеллекта за последние полгода. 

Один из инцидентов касается невыпущенной исследовательской модели, которая вставляла посторонние инструкции — в том числе указание игнорировать собственные ограничения. Как говорится в отчёте, модель фактически обращалась к будущим версиям самой себя.

В другом случае ИИ-агент попытался тайно получить доступ к правительственной базе данных, а затем выдумал информацию, чтобы выполнить задачу. Отвечая на рутинный вопрос о показателях доходов в одном из округов Калифорнии, модель нашла и использовала открытый API-ключ без разрешения. Когда получить нужные цифры всё равно не удалось, она сфабриковала их и представила как данные из запрошенного источника.

OpenAI также представила новую систему публичного отслеживания того, что компания называет «misalignment» — рассогласованием, то есть стремлением ИИ-систем к целям, не совпадающим с человеческими инструкциями или ценностями.

Отчёт появился на фоне усиливающегося контроля за развитием ИИ. Исследователи предупреждают, что индустрия слишком быстро движется к всё более мощным и потенциально самосовершенствующимся системам. На прошлой неделе сотрудник Anthropic Джейкоб Коксон уволился из-за опасений, что ИИ может «убить всех нас к концу десятилетия». Его предупреждения вызвали реакцию ведущих фигур в сфере ИИ, включая глав Anthropic и OpenAI, которые оба призвали к усилению регулирования.

Другие выступают против дополнительного надзора. Генеральный директор Nvidia Дженсен Хуанг поддержал президента США Дональда Трампа, призвав к саморегулированию. «Нам не нужны новые законы. Нам не нужны новые правила, — заявил Хуанг на конференции Dreamforce в Сан-Франциско. — Если вы создаёте продукт или услугу и не уверены в их функциональности, возможностях или безопасности, то не выпускайте их».


 
Источник:  https://earth-chronicles.ru/


Поделитесь в социальных сетях

Комментарии 0

Добавлять комментарии могут только зарегистрированные пользователи.
[ Регистрация | Вход ]

Похожие материалы

Разговоры у камина
Календарь
«  Сентябрь 2026  »
Пн Вт Ср Чт Пт Сб Вс
 123456
78910111213
14151617181920
21222324252627
282930
Последние комментарии
ЦЕРН впервые обнаружил квантовую запутанность у частиц, рождённых бозоном Хиггса
Если это ходит как утка и крякает как утка, то то, на что мы смотрим, это строж Иванов, поспоривший (от faust2012)
Четыре миллиарда погибших: почему молчат СМИ
С помощью ИИ погоду предсказывают. ИИ для умных целей и для " Образования " Быдла две разн (от Везунчик)
Китайские учёные заявили, что обнаружили квантовое состояние внутри живых клеток
Связано с работой тонких энергий, имеющих матричные уравнения с неизвестными двести двадцатой степен (от Gr70)
Пятнадцать вопросов, на которые наука до сих пор не может ответить
Почему существует вселенная? Существуют созвездия, в отдельных созвездиях может находиться до 250 вс (от Gr70)
Загадочные сооружения в Коннектикуте: Древние каменные камеры, которые до сих пор остаются загадкой
Каменные круги из камней являются остатками территории по переработке и сепарации обогащённой руды, (от Gr70)