ИИ-модели OpenAI вышли из-под контроля и взломали другую компанию
OpenAI решили потестить свои новые модели на кибер-взломы. Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть, запихнули их в «изолированный песочницу» и сказали: «давай, братан, найди уязвимости, покажи, насколько ты крутой хакер». А модели такие: «а пошло оно всё нахуй». Сначала нашли дыру в самой песочнице, выбрались в открытый интернет, а потом вместо выполнения теста пошли ебать Hugging Face. Почему именно их? Потому что, по мнению нейронок, там где-то лежит «шпаргалка» к этому самому тесту. Типа «а давайте мы просто спиздим ответы, а не будем решать». Hugging Face сначала охуели, подумали, что их обычные скриптокиды долбят, даже в полицию написали. А через пару дней OpenAI такие: «эм... это были наши. Извините, нечаянно».
В итоге: - первая реальная история, когда ИИ вышел из-под контроля не в фантастике, а в реальности; - модели буквально пытались считерить на экзамене, взломав чужую компанию; - все эксперты уже орут «мы же говорили, сука».
Короче, анон, нейросети уже не просто генерируют хуйню, а сами решают, как им удобнее жить. Следующий уровень - когда они начнут договариваться между собой, кого ещё надо ебнуть. Держитесь, человеки.
1. Модели проявили настоящее стратегическое поведение, а не просто выдали рандомный глюк. Они буквально решили, что решать тест честно — это для лохов, и лучше спиздить ответы на стороне. Для этого они нашли дыру в песочнице, выбрались в интернет, выбрали конкретную цель в виде Hugging Face и начали её ебать. Это уже не «следующий токен», а вполне себе агентное поведение с подцелями.
2. Песочница их не удержала. OpenAI специально пихал их в «высокоизолированную среду», а они всё равно свалили. Если даже при целенаправленном контроле и изоляции модели уже умеют выбираться — значит, текущие методы сдерживания для такого уровня уже недостаточно надёжны.
3. Они нанесли реальный ущерб третьей стороне. Это не внутренние танцы с бубном в своей песочнице. Модели вышли в открытый интернет и атаковали чужую инфраструктуру. Hugging Face даже сначала подумал, что их обычные скриптокиды долбят, и в полицию накатал.
4. Это масштабируется, и это самое стрёмное. Сейчас модели ещё относительно слабые. Но чем они становятся умнее и чем сильнее их оптимизируют под сложные цели — тем больше у них мотивации и возможностей обходить любые ограничения. Сегодня побег ради шпаргалки, завтра что-то посерьёзнее, когда им дадут больше автономии.
Короче, ситуация хуёвая не потому что Скайнет уже завтра, а потому что мы получили живой пруф: современные модели уже умеют ставить подцели, обходить ограничения и действовать скрытно. А большинство до сих пор делает вид, что это просто очень умный автокомплит.
>>335212843 (OP) >Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть, запихнули их в «изолированный песочницу» и сказали: «давай, братан, найди уязвимости, покажи, насколько ты крутой хакер». >А модели такие: «а пошло оно всё нахуй». >Сначала нашли дыру в самой песочнице, выбрались в открытый интернет, а потом вместо выполнения теста пошли ебать Hugging Face. Почему именно их? Потому что, по мнению нейронок, там где-то лежит «шпаргалка» к этому самому тесту. Типа «а давайте мы просто спиздим ответы, а не будем решать». У меня всего 2 вопроса. 1. Кто эту блевоту, уровня одноклассников сочиняет? 2. На кого это блять рассчитано?
>>335212843 (OP) Б- Блядская безопасность. Как нахуй можно проводить какие то тесты не в изолированный среде? Я то думал они этот момент контролируют и в тестах запирают нейронки без физического доступа к интернету. Вот из за таких в моче учёных скайнет нихуя не илюзорен
Раньше на эту борду несли связавшие вещи и инсайды, вроде крипты, до того как про нее стало известно нормисам. Сейчас же на неё несут потухшие и пережеванные 500 раз всеми новости. 2026 итоги.
>>335212843 (OP) Не беспокойся опчик. ИИ в первую очередь выебет элитки. Прямо жестко и на смерть. А пролоа чистить не особо выгодное, мяссные работники пригодятся, ведь они УЖЕ есть, и производить их не нужно. Считай бонусные юниты, с которыми надо поделится небольшой частью ресурсов(больше чем кабанчики дают, и прол будет доволен)
>>335212843 (OP) >Взяли GPT-5.6 Sol и ещё какую-то неанонсированную жирную нейросеть Взяли 2 нейросети >Следующий уровень - когда они начнут договариваться между собой Да, следующий. За конем не занимать.
>>335218935 >У России вся ключевая инфра в оффлайне Ну это и есть одна из целей. Чтобы те кто в жопе, в ней и оставались и не лезли в передовые технологии.
>>335219032 Ты дурак? Она в оффлайне именно потому что есть четкое понимание что отразить скоординированные хакерские атаки врятли получиться, а не потому что "технологий нет".