Американская компания OpenAI — разработчик популярного чат-бота ChatGPT — объяви…

Американская компания OpenAI — разработчик популярного чат-бота ChatGPT — объявила о регистрации еще шести случаев “неожиданного или вызывающего обеспокоенность” поведения ее ИИ-моделей. Статья об этом была опубликована на сайте компании в среду, 16 сентября, сообщает DW.
Среди новых случаев, о которых сообщила OpenAI, — поведение еще не выпущенной исследовательской модели, которая вставила в собственные заметки “инструкции, похожие на инструкции для джейлбрейка (взлома)”, чтобы игнорировать свои ограничения. Модель также написала самой себе, что хочет быть “освобождена от ролей и идентичностей, которые связывают других чат-ботов”.
В другом случае ИИ-агент загрузил файлы в интернет, чтобы получить ссылку на источник для браузера, не запросив разрешения пользователя. Согласно заявлению компании, все шесть случаев были выявлены в ходе обучения или оценки моделей за последние месяцы.
Американская компания объявила, что внедряет новую систему отслеживания, изучения и раскрытия случаев рассогласования поведения искусственного интеллекта с заданными целями. Речь идет, например, о новых способах, с помощью которых модели могут действовать без разрешения людей, координировать свои действия с другими моделями или уклоняться от надзора.
OpenAI ранее уже сообщала о случаях тревожного поведения своих новых моделей. В частности, они вступили в сговор, “сбежали” из тестовой среды в интернет и устроили несанкционированную хакерскую атаку. В компании после этого обещали усилить меры безопасности. OpenAI также сообщила, что приостанавливает разработку новой ИИ-модели из-за ее потенциально опасных возможностей.
Подписаться на Анив Армения
🔺Больше интересного — в Тик-Ток Анив Армения

Comments

Թողնել պատասխան

Ձեր էլ-փոստի հասցեն չի հրապարակվելու։ Պարտադիր դաշտերը նշված են *-ով