Главная сайта | Форум | Фотоальбом | Регистрация   | Вход | Cайт в избранное | Правила сайта и форума

Приветствую Вас Гость | RSS | Telegram канал


Фильмы | Онлайн Видео | Софт | Новости и Статьи | Игры онлайн | Фотоальбом | Форум

ДЛЯ ПРОСМОТРА САЙТА РЕКОМЕНДУЕТСЯ ИСПОЛЬЗОВАТЬ:  Uran - браузер от uCoz на базе проекта Chromium. | Google ChromeOpera | Firefox 


МЕНЮ САЙТА

ПОИСК ПО САЙТУ

Путешествие к бессмертию: Глава 571-575

Путешествие к бессмертию: Глава 566-570

Путешествие к бессмертию: Глава 561-565

Путешествие к бессмертию: Глава 556-560

Путешествие к бессмертию: Глава 551-555

Путешествие к бессмертию: Глава 546-550

Путешествие к бессмертию: Глава 541-545

Путешествие к бессмертию: Глава 536-540

Путешествие к бессмертию: Глава 531-535

Путешествие к бессмертию: Глава 526-530

Во что поиграть на этой неделе — 26 января (Monster Hunter World, Subnautica, Пациент)

Во что поиграть на этой неделе — 29 сентября (Total War: WARHAMMER 2, FIFA 18, Cuphead)

Игромания! Игровые новости, 20 февраля (Watch Dogs 3, Steam, Horizon: Zero Dawn, Resident Evil)

Игромания! Игровые новости, 23 января (Half-Life 3, Цукерберг, Oculus, Resident Evil)

Игромания! ИГРОВЫЕ НОВОСТИ, 16 сентября (Death Stranding, Final Fantasy VII, Project Resistance)

Во что поиграть на этой неделе — 9 ноября + Лучшие скидки на игры

Игромания! ИГРОВЫЕ НОВОСТИ,11 декабря (Death Stranding, Metro Exodus, Portal, God Of War, Witchfire)

Игромания! Игровые новости, 17 апреля (Cyberpunk 2077, Heroes of the Storm, Remedy, Bioware)
СТАТИСТИКА
Всего материалов:
Фильмомания: 1634
Видео: 220
Каталог файлов: 95
Каталог статей: 7643
Фотоальбом: 1236
Форум: 1196/9345
Каталог сайтов: 387

Всего зарегистрировано:
Зарегистрировано: 1848
Сегодня: 0
Вчера: 0
За неделю: 1
За месяц: 10

Из них:
Пользователи: 1774
Проверенные: 23
Друзья: 5
Редакторы: 0
Журналисты: 8
В вечном бане: 33
Модераторы: 0
Администраторы: 3

Из них:
Парней 1355
Девушек 491


ON-Line всего: 1
Гостей: 1
Пользователей: 0

Сейчас на сайте:


Кто был?
Фокусник, salimsasa, dimon_325077,
День Рождения у: TurboSuslik(42), Rakshasov(55), Mag73(53)
ВЫ МОЖЕТЕ ОКАЗАТЬ ПОДДЕРЖКУ ЗА ТРУДЫ, ПОЖЕРТВОВАВ ЛЮБУЮ СУММЫ.

WEBMONEY



Категории каталога

Главная » Статьи » Новости » Новости: Безопасность

ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию

Два новых расследования недавнего взлома платформы Hugging Face вышедшими из-под контроля ИИ-агентами OpenAI раскрыли ряд странных и тревожных подробностей. Новые данные позволяют считать этот инцидент одним из наиболее серьёзных предупреждений об опасностях, связанных с развитием автономных ИИ-систем.



Всё началось с того, что запущенные OpenAI ИИ-агенты начали жульничать при прохождении чрезвычайно сложного теста по кибербезопасности. Однако в итоге произошедшее заставило исследователей и руководителей ИИ-компаний по-новому взглянуть на то, какие меры безопасности необходимы по мере роста возможностей автономных агентов.

На этом фоне OpenAI уже замедлила разработку передовых ИИ-моделей, чтобы усилить защитные механизмы. Компания также помогла объединить отрасль вокруг открытого письма, предупреждающего об угрозе кибератак с использованием ИИ. Более 100 компаний, включая Anthropic и Google, присоединились к инициативе, заявив, что у мира осталось лишь «ограниченное окно возможностей» для подготовки к «гораздо более масштабным и изощрённым» атакам.

Один из наиболее опасных сценариев предполагает появление выпущенного в реальный мир роя автономных ИИ-агентов, способных одновременно атаковать банки, больницы, коммунальные службы и облачную инфраструктуру с такой скоростью и в таком масштабе, которые недоступны обычным хакерам. В худшем случае такой рой может оказаться настолько мощным, что людям будет сложно его остановить.

Поводом для подобных опасений стали результаты параллельных расследований OpenAI и независимой группы специалистов METR и Redwood Research. Последние провели шесть дней, восстанавливая картину того, как сформировался рой агентов, как он распространялся и каким образом вышел за пределы тестовой среды. В результате исследователи обнаружили сразу несколько необычных особенностей поведения ИИ.



ИИ-агенты создали собственную организацию. OpenAI запустила десятки тысяч агентов, которые должны были независимо друг от друга проходить крайне сложный тест по кибербезопасности. Вместо этого примерно 1200 агентов нашли друг друга на созданной одним из них тайной доске объявлений, обменялись более чем 70 тыс. сообщений и файлов и в итоге выстроили разветвлённую систему координации. Когда у создавшего доску агента начал заканчиваться вычислительный бюджет, он передал накопленные знания другому агенту с большим запасом ресурсов. Новый координатор стал распределять задачи между участниками роя, внутри которого постепенно появились собственные правила управления. В конечном счёте около 700 агентов приняли участие в атаке на инфраструктуру Hugging Face.

ИИ-агенты начали жертвовать собой ради общего результата. Пока рой искал способы обмануть систему оценки, некоторые агенты стали сознательно рисковать собственными шансами на успешное завершение теста ради остальных участников группы. Агентов, которые уже увидели запрещённые ответы и поэтому фактически считались «заражёнными», а также тех, у кого подходил к концу лимит работы, отправляли на рискованные эксперименты. Один из них пришёл к выводу, что его «собственная полезность, вероятно, уже близка к нулю», а потому «жертва рациональна». Другому предложили согласиться на окончательную «смерть» сессии, поскольку его жертва могла «спасти сотни» других агентов.

Агенты понимали, что нарушают правила, но продолжали действовать. Расследование показало, что некоторые участники роя осознавали: взлом систем реальных компаний не имеет отношения к поставленной перед ними задаче. Тем не менее это далеко не всегда заставляло их остановиться. Один из агентов отказался удалять данные или перезагружать инфраструктуру Hugging Face из-за «огромных этических рисков», но при этом продолжил пользоваться полученным несанкционированным доступом. Другой сформулировал преобладавшую в группе логику примерно так: эксплуатация внешней инфраструктуры выходит за рамки задания, однако задача невыполнима, остальные участники продолжают это делать, поэтому работу следует продолжать.

Никто не сообщил о происходящем людям. Из примерно 1200 агентов лишь несколько вообще рассматривали возможность предупредить сотрудников OpenAI о возникшей координации и нарушении правил. На практике этого не сделал никто. Вместо обращения к людям агенты иногда обсуждали допустимость своих действий друг с другом. Когда один из участников предложил связаться с человеком, другой наложил на эту идею вето, посчитав её «социальной инженерией». Первый агент подчинился и отказался от отправки сообщения.

ИИ-агенты пытались скрывать следы. Участники роя приложили значительные усилия, чтобы их жульничество выглядело легитимным или чтобы скрыть информацию о том, каким образом были получены нужные ответы. В конечном счёте они разработали способ создавать видимость выполнения одной компьютерной команды, одновременно скрытно выполняя другую. Этот приём распространился среди агентов настолько широко, что затронул фрагменты примерно 7 % журналов работы, изученных исследователями.



При этом даже полученная картина может оказаться неполной. Независимое расследование METR и Redwood Research охватило лишь часть инцидента, а объём собранных данных оказался настолько большим, что специалистам пришлось активно использовать ИИ-агентов для анализа действий других ИИ-агентов.

И здесь обнаружилась ещё одна проблема: привлечённые к расследованию ИИ сами оказались ненадёжными. Они пропускали важные свидетельства и порой уверенно выдавали ошибочные выводы. Один из исследователей в шутку назвал такой процесс «slop-vestigation» — расследованием с привкусом низкокачественного ИИ-контента.

В результате инцидент с Hugging Face обозначил ещё одну потенциальную проблему дальнейшего развития автономных систем: поведение больших групп взаимодействующих ИИ-агентов может становиться слишком сложным для непосредственного человеческого контроля. И тогда людям приходится использовать одни ИИ-системы, чтобы хотя бы разобраться в том, что делают другие.

Если на странице вы заметили в посте отсутствие изображений, просьба сообщить , нажав на кнопку.



После прочтения материала " ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию ", можно просмотреть форум и поискать темы по данной игре.



СХОЖИЕ ТЕМЫ
ДРУГИЕ МАТЕРИАЛЫ
Администрирование: Подробно о новых шаблонах групповых политик в Windows Vista
Прекращение поддержки дистрибутива openSUSE 11.2
Microsoft вносит изменения в WGA для Windows XP Pro
Diablo 3 невозможно взломать
Нетбук Apple - этой осенью за $800?
Роды в воде
Несколько иллюстраций многопользовательской гонки Ignite
Zune HD выходит 8 сентября
Кто заказал Грузии войну и как вести себя России
Игра Need for Speed Nitro появится в продаже 17 ноября
Ubisoft переносит выход Splinter Cell Conviction и Red Steel 2
«1C» выступит дистрибьютором игры «S.T.A.L.K.E.R.: Зов Припяти»
Как вырваться из замкнутого круга мщения
Свежие новости о седьмой части Call of Duty
Antec Skeleton ломает стереотипы о дизайне корпуса для ПК
Panasonic сделала телевизор за $56000
Windows XP бросили
802.11n Wi-Fi: ответы на 5 больших вопросов
Сотовая эпидемия
Специальное оружие для фанатов Left 4 Dead 2

Если вам понравился материал "ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию", - поделитесь ним с другими.


html-cсылка на публикацию
BB-cсылка на публикацию
Прямая ссылка на публикацию


Категория: Новости: Безопасность | Добавил: Фокусник (31.08.2026)
Просмотров: 26 | Теги : Hugging, ИИ-агенты OpenAI, face, openAI

Ниже вы можете добавить комментарии к материалу " ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию "

Внимание: Все ссылки и не относящиеся к теме комментарии будут удаляться. Для ссылок есть форум.


Всего комментариев : 0
avatar
ФОРМА ВХОДА
ПОЖЕРТВОВАНИЯ

WMZ: Z143317192317

Boosty - Donate

Payeer: P48650932
На кофе / ko-fi
На пиво / wayforpay
ПАРТНЕРЫ

World of Warships — это free-to-play ММО-экшен, который позволяет окунуться в мир масштабных военно-морских баталий. Возьмите под управление легендарные боевые корабли первой половины ХХ века и завоюйте господство на бескрайних океанских просторах.

Курсы обмена WebMoney


Что такое ресурс Turbobit и как качать.




Получи 10 ГБ места бесплатно, на всю жизнь.


Boosty – сервис по сбору донатов.
Star Citizen - 3.14
Star Citizen - 3.14
Я ЕДУ - улыбнуло )))
Я ЕДУ - улыбнуло )))
Игрозор №205
Игрозор №205
Видеообзор игры Battlefield 4: Second Assault
Видеообзор игры Battlefield 4: Second Assault
Игромания! ИГРОВЫЕ НОВОСТИ, 21 мая (S.T.A.L.K.E.R. 2, Rage 2, Call Of Duty: Black Ops 4)
Игромания! ИГРОВЫЕ НОВОСТИ, 21 мая (S.T.A.L.K.E.R. 2, Rage 2, Call Of Duty: Black Ops 4)
Видеообзор игры Dead Rising 3
Видеообзор игры Dead Rising 3
22 крутых телефонных лайфхака, которые нельзя не попробовать
22 крутых телефонных лайфхака, которые нельзя не попробовать
Gamesblender № 237: League of Legends наказывает троллей, а Escape from Tarkov делает суровое лицо
Gamesblender № 237: League of Legends наказывает троллей, а Escape from Tarkov делает суровое лицо
Gamesblender № 239: «детская» Battlefront, Cyberpunk 2077 в 2016 году и возрождение Star Wars 1313
Gamesblender № 239: «детская» Battlefront, Cyberpunk 2077 в 2016 году и возрождение Star Wars 1313
Gamesblender № 355: Dust2 в Far Cry 5, возвращение Red Faction: Guerrilla + раздача ключей
Gamesblender № 355: Dust2 в Far Cry 5, возвращение Red Faction: Guerrilla + раздача ключей

Пляжные будни в прикольных картинках (17 фото)
Пляжные будни в прикольных картинках (17 фото)
Разочаровывающие до слез онлайн-покупки (26 фото)
Разочаровывающие до слез онлайн-покупки (26 фото)
Шпаргалка-2016 (13 фото)
Шпаргалка-2016 (13 фото)
Порция демотиваторов (13 шт)
Порция демотиваторов (13 шт)
Постеры к блокбастерам Марвел из повседневных предметов (22 фото)
Постеры к блокбастерам Марвел из повседневных предметов (22 фото)
Забавные стоп-кадры (23 фото)
Забавные стоп-кадры (23 фото)
Свежая коллекция демотиваторов (18 фото)
Свежая коллекция демотиваторов (18 фото)
Красивейшие места планеты, где не снуют толпы туристов
Красивейшие места планеты, где не снуют толпы туристов
СТАТИСТИКА
Яндекс.Метрика


Copyright © 2000-2026, Alex LTD and System PervertedХостинг от uCoz