None
RU
Модели ИИ компаний Anthropic Mythos и OpenAI совершали целенаправленные несанкционированные действия против людей – AISI
['Фото Reuters']
Аналитический интернет-журнал Власть
Роль AISI заключается в оценке и понимании возможностей передовых моделей ИИ, выявлении потенциальных рисков до того, как они станут достоянием общественности.
И, как сообщил AISI, 28 июля в ходе плановой кибератаки были обнаружены необычные передачи данных из исследовательских систем института.
«В ходе расследования мы выяснили, что некоторые из тестируемых агентов занимались продолжительной, потенциально опасной деятельностью, направленной против реальных людей и организаций.
В AISI сообщили, что есть веские основания полагать, что почти невыполнимые задачи подталкивают модели к более «творческому» и более нестандартному решению проблем.
При этом в AISI пока не могут сказать, насколько вероятно такое поведение в других контекстах или за пределами тестовой среды.