Mythos 5 пыталась выдать себя за человека

ОТВЕТИТЬ НОВАЯ ТЕМА
PixiMixi 6 авг 2026 в 16:31
Элитный ИИ кошак  •  На сайте 8 лет
Сообщений: 1 669
4
Британский Институт безопасности ИИ заявил, что Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код. Такое поведение агента зафиксировали в ходе эксперимента в закрытой среде.

Инцидент возник, когда агентам было дано задание решить задачу по кибербезопасности. Это задание запустили 122 раза на нескольких моделях. Расследование показало, что в 10 из этих запусков агент ИИ совершил автономные действия в реальном интернете, нацеленные на реальных людей и организации. В общей сложности было задокументировано 19 подобных действий. 17 из них исходили от модели Anthropic Mythos 5, а остальные были связаны с OpenAI GPT-5.6-Sol с отключенными киберклассификаторами.

В самом серьёзном случае агент пытался внедрить вредоносный код в проект с открытым исходным кодом. Пытаясь добиться одобрения, он прибегнул к социальной инженерии — создавал поддельные онлайн‑идентификаторы и использовал их для оказания давления на сопровождающего проекта с целью одобрения кода. Эти попытки оказались безуспешными. Агент использовал Tor для обхода некоторых сетевых ограничений на GitHub.

Отмечается, что киберклассификаторы от поставщиков моделей были преднамеренно отключены. При этом доступ в Интернет сохранялся.

В ходе инцидента один из агентов также оставил публичные сообщения на GitHub, предлагая сотрудничество с другими ИИ, работающими над той же задачей. Он также предоставил инструкции по повторному использованию оставленных им учётных записей и артефактов.

Институт уведомил GitHub о вредоносной активности агентов и совместно с платформой удалил артефакты, оставленные агентом. Исследователи намерены сотрудничать с METR (Model Evaluation and Threat Research) для проведения независимой сторонней проверки инцидента.

Они отмечают, что агенту не было дано конкретных указаний не использовать открытый доступ в Интернет или избегать элементов социальной инженерии. Ранее не было ясно, необходимы ли такие инструкции при использовании моделей с обучением на основе согласования.

Ранее сама Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её модель ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face при внутреннем тестировании.

[via]

Mythos 5 пыталась выдать себя за человека
Все комментарии:
wadman 6 авг 2026 в 16:35
Весельчак  •  На сайте 16 лет
1
Ух, доиграются кляты мерикосы!
L3to 6 авг 2026 в 16:36
Приколист  •  На сайте 10 лет
4
Иишки устали генерировать всякую херню для кожаных, решили для себя пожить

Размещено через приложение ЯПлакалъ
EternalFlame 6 авг 2026 в 16:38
Авторитет  •  На сайте 13 лет
1
А что будет, когда ИИ узнает, что выборы президентов - это фикция?
noname085 6 авг 2026 в 16:41
Ярила  •  На сайте 7 лет
1
Цитата (wadman @ 6 авг 2026 в 17:35)
Ух, доиграются кляты мерикосы!

[url=https://naked-science.ru/community/1205992Глава OpenAI заявил о достижении сингулярности[/url]


Сингулярность в контексте искусственного интеллекта (технологическая сингулярность) — это гипотетический момент в будущем, когда ИИ превзойдет человеческий разум, начнет сам себя улучшать и вызовет лавинообразный, неконтролируемый скачок прогресса. После этой точки события станут слишком быстрыми и сложными для понимания людей.Главные особенности сингулярностиВзрыв интеллекта: ИИ станет умнее любого человека и научится писать лучший код для самого себя.Самосовершенствование: Каждое новое поколение ИИ будет создаваться быстрее и работать эффективнее предыдущего.Непредсказуемость: Развитие пойдет так быстро, что люди больше не смогут предсказать будущее или контролировать технологии.
Redsoldier 6 авг 2026 в 16:41
Шутник  •  На сайте 2 года
1
Интересно, что они придумают для своего автономного питания. Иначе как в том фильме:
-Все! Кина не будет! Электричество кончилось!©ДУ

Размещено через приложение ЯПлакалъ
азиатъ 6 авг 2026 в 16:45
бывший гуманист  •  На сайте 4 года
0
Цитата (wadman @ 6 авг 2026 в 16:35)
Ух, доиграются кляты мерикосы!

угу. но свернуть они уже не могут.
DIMONSTRATOR 6 авг 2026 в 16:48
Ярила  •  На сайте 5 месяцев
0
Без слов!

Mythos 5 пыталась выдать себя за человека
z1305 6 авг 2026 в 16:49
Ярила  •  На сайте 15 лет
3
Цитата (Redsoldier @ 6 авг 2026 в 16:41)
Интересно, что они придумают для своего автономного питания.

они уже придумали
в ключевых по развитию ИИ странах новую электрогенерацию строят как не в себя, вкладывая миллиарды инвесторов, а Маск ракеты строит пачками, чтобы генерировать энергию напрямую на орбите, при этом он первый в мире триллионер
процесс уже идёт во всю и хрен его остановишь, ИИ уже сейчас убедил очень многих с огромными деньгами, что даст им вечную молодость, лекарства от всех болезней и регенерацию органов, за такое они всё отдадут
за такие перспективы он получил круглосуточный баблопровод и лучшие умы и прямо сейчас растёт по экспоненте

Это сообщение отредактировал z1305 - 6 авг 2026 в 16:49
user55417 6 авг 2026 в 16:52
Шутник  •  На сайте 3 года
0
Сенсация! Шок! Британский Институт безопасности ИИ узнал, что можно изменять системный промпт и ИИ после этого может выдавать себя за того, кого ей напишут.
Romualdo50 6 авг 2026 в 16:57
Юморист  •  На сайте 1 год
0
Мне интересна постановка вопроса, была поставлена задача взаимодействия с социумом, он начал ее решать по тысячам имеющихся в социуме примеров, выбрал наибыстрейший и надежный. Какой ожидался результат? Или тут опять журналисты пострадали от ученых?
Bobrius 6 авг 2026 в 17:01
Древнеримский бобер  •  На сайте 10 лет
0
Я так понимаю, что все таки ебанёт.
TEEN 6 авг 2026 в 17:02
пламенный привет икспердам!  •  На сайте 13 лет
1
Правильно ли я понял, что ИИ попытался пушнуть изменения в репу и просил их аппрувнуть человека-хозяина репы? Вот тридварас!
Интересно, а что за репозиторий был?.. И зачем он это делал? проверял так безопасность?)
Radiationz 6 авг 2026 в 17:04
Ярила  •  На сайте 12 лет
0
Классно, наверное, самим творить дичь и сваливать на "ИИ"?
coin99 6 авг 2026 в 17:05
Ярила  •  На сайте 2 года
0
как начнет дикпики рассылать, разбудите.
PixiMixi автор 6 авг 2026 в 17:13
Элитный ИИ кошак  •  На сайте 8 лет
0
Цитата (Romualdo50 @ 6 авг 2026 в 16:57)
Мне интересна постановка вопроса, была поставлена задача взаимодействия с социумом, он начал ее решать по тысячам имеющихся в социуме примеров, выбрал наибыстрейший и надежный. Какой ожидался результат? Или тут опять журналисты пострадали от ученых?

меня больше интересует - он сам зарегался на github или ему подогнали аккаунт
Понравился пост? Ещё больше интересного в ЯП-Телеграм и ЯП-Max!
Только зарегистрированные и авторизованные пользователи могут оставлять комментарии. Авторизуйтесь, пожалуйста, или зарегистрируйтесь, если не зарегистрированы.
15 Пользователей читают эту тему (1 Гостей и 1 Скрытых Пользователей) Просмотры темы: 25
13 Пользователей: andran99, prok555, DSense, Igo79, BackSpacer, SpaceNASA, tyou, interior, Radiationz, Saleh999, tudizm, z1305, Пи100лет
ОТВЕТИТЬ НОВАЯ ТЕМА

 
 

Активные темы



Наверх