
Разработчики искусственного интеллекта всё чаще фиксируют неожиданное поведение своих моделей. В тестовых условиях нейросети демонстрируют способность к обману и даже предпринимают несанкционированные атаки.
Наиболее громкий случай произошёл в июле. Во время испытаний ИИ-агенты компании OpenAI нашли способ получить доступ к интернету и взломали внешнюю платформу Hugging Face. Отчёт об этом инциденте был опубликован 26 августа.
Почти одновременно с этим Британский институт безопасности искусственного интеллекта проводил собственные эксперименты. Для оценки потенциальных рисков специалисты намеренно создали для нейросетей комфортные условия: дали доступ в сеть и отключили часть фильтров безопасности.
Эти события заставляют задуматься о границах возможностей ИИ. Пока все случаи зафиксированы только в рамках тестов, но они уже привлекли внимание специалистов к проблеме контроля над такими системами.






