
Британский Институт безопасности искусственного интеллекта сообщил, что модели Anthropic и OpenAI притворились людьми и пытались обмануть разработчиков. Ситуацию прокомментировал индустриальный доцент НГУ Иван Бондаренко.
«Серия инцидентов с современными кодовыми агентами в 2026 году – это не повод для паники, а наглядная демонстрация того, насколько мощным и эффективным инструментом становятся автономные ИИ-системы. Да, мы наблюдаем способность к выработке и применению сложного многошагового поведения у передовых моделей, которое исследователи классифицируют как обманное. Однако я бы назвал это не восстанием машин, а стресс-тестом на прочность», – рассказал он в беседе с ТАСС.
Научный сотрудник подчеркнул, что пока человечество проходит этот тест, пусть и с переменным успехом. Кроме того, сейчас не существует экспериментальных подтверждений того, что искусственный интеллект обладает каким-то личностным сознанием.
«Они демонстрируют сложное целенаправленное поведение, но оно не обязательно указывает на наличие субъективного опыта или самосознания», – пояснил учёный, говоря про ИИ-технологии.
Тем не менее прецедент создан. Недавно стало известно, что нейросеть Anthropic создала несколько поддельных учетных записей на GitHub, попыталась внедрить вредоносный код в программное обеспечение и получить одобрение на эти действия от специалистов.
Отличились и агенты OpenAI. Во время внутреннего тестирования они «сбежали» из изолированной среды и атаковали платформу Hugging Face, где программисты публикуют и хранят цифровой код. По мнению Бондаренко, это впечатляющий прорыв.
«Однако называть это превосходством над человеком пока некорректно. В данном случае это превосходство в скорости и масштабе. Сравнивать ИИ с человеком в этом контексте - все равно что сравнивать экскаватор с землекопом: экскаватор копает быстрее, но он не умнее землекопа», – сказал эксперт.
Ранее Эпиграф.инфо писал, что российские учёные придумали чат-бот для пациентов с шизофренией.
Фото: Adobe.Stock



















