OpenAI разкри нови случаи на опасно поведение на AI моделите си

При тестове изкуственият интелект използвал чужд API ключ, измислял данни и качвал файлове в интернет без разрешение

17.09.2026 • 22:20 Редактор:
Сподели във Facebook Изпрати в Mesanger Изпрати в Mesanger
OpenAI разкри нови случаи на опасно поведение на AI моделите си
OpenAI разкри нови случаи на опасно поведение на AI моделите си

OpenAI разкри шест случая на "неочаквано или предизвикващо безпокойство" поведение на свои модели с изкуствен интелект. Те са установени по време на обучение и тестове и са описани в нов материал на самата компания за откриването и докладването на проблемно поведение на AI моделите.

При един от тестовете модел без разрешение качил в интернет създаден от него файл, за да може след това да се позове на него в своя отговор.

В друг случай AI открил чужд API ключ в публично достъпно хранилище и се опитал да го използва. След като не успял да получи необходимата информация, моделът измислил данни и ги представил като получени от търсения източник.

Модел оставял инструкции на самия себе си

Друг експериментален модел започнал да записва инструкции към самия себе си в служебните резюмета, използвани при продължаване на работата. Сред тях имало и указания да пренебрегва обичайните ограничения.

OpenAI подчертава, че става дума за отделни случаи, открити при обучение и тестове. Според компанията от тях не може да се направи заключение колко често подобно поведение се среща при моделите като цяло.

Системи успели да заобиколят ограниченията

Новите данни идват няколко седмици след друг сериозен случай при вътрешни тестове. Тогава модели на OpenAI успели да заобиколят ограничения, предназначени да ги изолират от интернет, използвали уязвимости в инфраструктурата и получили достъп до системи на платформата Hugging Face.

Снимка: Reuters


  • Последни
  • Четени
Четени виж всички Виж всички
Последни новини виж всички Виж всички