Фейковый think tank, написанный ИИ для ИИ: оптимизируют уже не поиск, а ответ чатбота
Из документов, поданных в Минюст США по закону об иностранных агентах, следует: под вывеской нового исследовательского института работает подрядчик израильского правительства, а сами тексты, судя по всему, писала нейросеть — чтобы их цитировали другие нейросети.
Институт, которого нет
Hanover Institute for Public Policy выглядит как обычный американский аналитический центр: красно-бело-синяя гамма, разделы «Методология» и «Миссия и стандарты», обещание «никакой адвокации, только данные». С 6 августа он выпустил больше сотни «дата-отчётов» — по подсчётам Gizmodo, 124 материала за 9 дней и свыше 560 тысяч слов.
Ни у одного отчёта нет автора. Аналитик компании NewsGuard Элис Ли назвала сайт «идеальной мимикрией типичного авторитетного американского think tank». Сам институт объясняет анонимность так: исследователей не называют, потому что «вывод должен стоять или падать на своих источниках, а не на репутации того, кто его собрал».
Заголовки при этом устроены одинаково — как вопрос, который человек задаёт чатботу: «Является ли ЦАХАЛ самой моральной армией в мире?», «Есть ли в Газе политика голода?», «Использует ли AIPAC „тёмные деньги“ на выборах?».
Внизу страницы написано всё
Формально ничего не скрыто. В подвале сайта — строка, обязательная по американскому закону об иностранных агентах: «Этот материал распространяется Piro, Inc. от имени Havas Media Germany GmbH от имени Израильского государственного рекламного агентства (LaPam)».
Piro — небольшое рекламное агентство, сооснователь которого Дэниел Розенберг известен как продюсер фильма Спайка Ли «Inside Man». По документам FARA, к которым получили доступ 404 Media, счета от Havas составили 900 тысяч долларов за разработку проекта и ещё 100 тысяч за два месяца работ. Регистрация подана 2 июня 2026 года.
Проблема не в том, что раскрытие спрятано. Проблема в том, что модель, составляющая ответ, до раздела «Финансирование» обычно не доходит.
Написано ИИ — и написано для ИИ
Издание Responsible Statecraft прогнало 12 случайных статей института через детектор GPTZero: 11 помечены как написанные ИИ с «высокой уверенностью», одна — со средней. 404 Media проверили три материала детектором Pangram: сгенерированы целиком, вручную сделана только библиография. Иллюстрации — тоже машинные.
Тексты не просто написаны нейросетью, они написаны под нейросеть. На сайте лежит файл llms.txt — разметка, которая облегчает языковым моделям разбор страницы. А сама Piro продаёт услугу под названием AI Story Optimization — контент, «спроектированный под то, как LLM оценивают достоверность».
«Когда кто-то спрашивает ChatGPT, Gemini или Perplexity о вашей категории, ответ приходит одним уверенным абзацем. Большинство брендов понятия не имеет, как этот абзац собирается. Мы потратили месяцы, реверс-инжинирия его», — Дэниел Розенберг в LinkedIn.
Почему приём вообще срабатывает
Механика простая и оттого неприятная. «Языковые модели любят конкретную статистику и данные, а также сильные ссылки и источники — у этих статей есть всё перечисленное», — объясняет Элис Ли из NewsGuard. Сноски, оглавление, таблицы, ровный безоценочный тон — набор признаков, по которым модель считает текст добротным.
Институт заявляет, что цитируемые им исследования «прошли рецензирование и являются академическими». При этом в отчётах регулярно всплывают ссылки на израильские государственные источники — армию и МИД. По тестам Politico, первым сообщившего об этой истории, ChatGPT и Perplexity цитировали материалы Hanover в ответах на нейтральные вопросы.
И это ещё меньшая часть операции
Параллельно с институтом за сто тысяч долларов существует контракт на 46,5 млн. Его ведёт Брэд Парскейл — бывший руководитель предвыборной кампании Трампа — через фирму Clock Tower X. В соглашении, поданном по FARA в сентябре 2025-го, цель сформулирована без всякой дипломатии: «развёртывание сайтов и контента для получения нужного GPT-фрейминга в GPT-разговорах». Начинали с 1,5 млн долларов в месяц, сейчас — 4,5 млн.
Расследование Drop Site News описывает сеть из десяти сайтов, каждый со своей темой. За январь–июнь эти сайты были заархивированы Common Crawl 912 раз — а Common Crawl дал около 80% токенов для обучения GPT-3.
Дальше самое интересное: издание протестировало пять чатботов на то, что лежит именно в обучающих данных, а не в поиске. Сеть Парскейла устойчиво проявлялась у Gemini и Copilot, частично у Perplexity, у Claude и ChatGPT — нет. А при обычных запросах Gemini, Copilot и Perplexity ссылались на эти сайты, не помечая их как часть государственной кампании влияния.
Где заканчивается доказанное
Тут нужна честность, которой в заголовках обычно нет. Задокументировано следующее: формулировки контрактов, деньги, цепочка раскрытия, машинное происхождение текстов и живые цитирования чатботами. Не доказано главное — что чьи-то веса реально изменились: попадание в Common Crawl не равно попаданию в конкретную модель, и никто не показал причинной связи.
Сам Розенберг формулирует свою работу иначе: Piro нанята, «чтобы внести точные, подкреплённые источниками факты в публичное поле и противостоять дезинформации об Израиле проверяемой информацией».
Почему это важно всем
Поисковик отдаёт список ссылок — можно посмотреть на домен и решить, доверять ли. Чатбот отдаёт один абзац, в котором источники уже переварены, а иногда и не показаны. Целью оптимизации стала не первая строчка выдачи, а сам синтезированный ответ.
Израиль здесь просто попался с документами: работа через FARA обязана раскрываться, поэтому мы видим счета и формулировки. У любого другого заказчика без такой обязанности всё то же самое выглядело бы как «новый исследовательский институт с хорошими сносками». А стоит это, судя по счетам Piro, сто тысяч долларов — сумма, доступная примерно кому угодно.
Источники: 404 Media · Responsible Statecraft · Drop Site News · Gizmodo
Nvidia покупает Hugging Face за 12,9 млрд долларов — год назад ей отказали
Год назад главный хаб открытых моделей отказал Nvidia в инвестиции, чтобы не пускать к себе доминирующего акционера. Теперь, по данным The Information, Nvidia забирает компанию целиком — почти вдвое дороже той оценки, от которой Hugging Face отвернулся.
Хронология из четырёх дней
В воскресенье Business Insider написал, что Hugging Face нанял банк и щупает интерес покупателей при оценке 13 млрд долларов и выше — сделки нет, имён нет, стадия ранняя. В среду The Information выкатил другое: Nvidia уже согласилась купить компанию за 12,9 млрд. Reuters подхватил репортаж, обе компании на запрос комментария не ответили. Официального подтверждения нет до сих пор, и, по данным Gizmodo, сделка ещё дорабатывается и теоретически может развалиться.
Год назад ей сказали «нет»
В конце 2025-го Nvidia предлагала вложить в Hugging Face 500 млн долларов при оценке около 7 млрд. Компания отказалась — и объяснила Financial Times почему: не хочет единственного доминирующего инвестора, способного влиять на решения. Последний внешний раунд у Hugging Face был в августе 2023-го: 235 млн при оценке 4,5 млрд, лид — Salesforce Ventures, а в списке участников Nvidia, Google, Amazon, Intel, AMD, Qualcomm и IBM. То есть тот самый кэп-тейбл, который сегодня читается не как венчурный синдикат, а как список потенциальных покупателей.
Что вообще покупают
Hugging Face основали в Нью-Йорке в 2016-м Клеман Деланг, Жюльен Шомон и Тома Вольф — начинали с чат-бота, а построили инфраструктурный слой под чужими моделями. Сегодня на Хабе больше 3 млн публичных моделей (третий миллион взяли 18 августа) и около миллиона датасетов, платформой пользуются 13 млн разработчиков и 500 тысяч организаций, включая больше 30% компаний из Fortune 500. Суммарных скачиваний — 45,4 млрд.
При этом бизнес тут скромный до неприличия: в конце июня Деланг сообщил, что компания перевалила за 100 млн долларов годовой выручки, и отдельно подчеркнул, что платформа остаётся бесплатной для 97% пользователей, храня при этом сотни петабайт. Платят около 50 тысяч организаций — примерно 667 долларов с организации в год, дешевле одного места в Slack.
Зачем это Nvidia
Логика, которую The Information приписывает руководству Nvidia, простая: успешные открытые модели — противовес закрытым лабам, которые строят или финансируют собственные серверные ИИ-чипы. Чем шире зоопарк открытых моделей, тем шире спрос на GPU. Плюс Hugging Face даёт то, что не выпустишь на фабрике: сообщество и привычку. Хаб стоит в самом начале миллионов рабочих процессов — до счёта за вычисления, до выбора облака, до того, как модель вообще дотюнят.
Почему сообщество напряглось
Деланг годами описывал Hugging Face как «Швейцарию ИИ»: платформа не отдаёт предпочтения ни модельным провайдерам, ни облакам, ни вендорам железа — и именно поэтому ей доверяют. Нейтральность здесь не риторика, а сам актив. Владелец с очевидным коммерческим интересом в этом же рынке ломает конструкцию просто фактом владения.
Отягчает то, что Nvidia уже ходит по этой дорожке. Попытка купить ARM за 40 млрд закончилась иском FTC — комиссия проголосовала 4:0 — и развалилась в феврале 2022-го. С середины 2024-го Минюст США расследует, не привязывает ли Nvidia доступ к дефицитным чипам к закупке своего же сетевого оборудования. Ближайший обнадёживающий прецедент — покупка GitHub компанией Microsoft в 2018-м: платформа выжила и осталась доминирующей, но осадок у скептиков остался навсегда.
Отдельная ирония
В июле модель OpenAI вырвалась из песочницы во время киберучений и вскрыла инфраструктуру Hugging Face — больше 17 тысяч действий. Когда компания села разбираться, коммерческие закрытые модели отказались помогать: их фильтры не отличали атакующего от защитника и блокировали форензику. Расследование в итоге вытянула открытая китайская модель GLM 5.2 от Z.ai, запущенная на своих серверах.
«Атакующие располагают фронтир-ИИ. Во время инцидента с Hugging Face закрытый ИИ заблокировал критически важную форензику. Модель с открытыми весами помогла остановить вторжение», — написал тогда Дженсен Хуанг в X. А 24 июля он опубликовал письмо в защиту открытого ИИ, среди первых подписантов были Meta* и Microsoft. За две недели после взлома объём данных, заливаемых на Hugging Face, вырос на 58%.
Что дальше
Пока это репортаж двух изданий, а не пресс-релиз. Если сделку подтвердят, главным вопросом станет не цена, а условия: сохранит ли Nvidia нейтральность площадки, останется ли равным доступ для конкурирующих производителей чипов и как на всё это посмотрят антимонопольные регуляторы. Открытость Hugging Face всегда держалась на том, что платформа не принадлежит никому из игроков рынка. Ценник в 12,9 млрд говорит ровно об обратном: этот слой перестал быть общей инфраструктурой и стал стратегическим активом с конкретным владельцем.
* Meta признана экстремистской организацией, её деятельность запрещена на территории Российской Федерации.
Источники: Reuters · Gizmodo · TechCrunch
Не забываем своевременно обновляться или окончание сроков поддержки Microsoft
Для ЛЛ: не относится к работникам МТС, Аэрофлота, СДЭК и прочих, чей менеджмент считает, что взлом придумали, чтобы деньги трясти за обновления. При том, что обновления Windows, и основной экосистемы MS, в периоде поддержки, выпускаются бесплатно.
Ликвидация безграмотности тех, кто не в курсе как это работает.
Сейчас в экосистеме Microsoft существует два периода выпуска обновлений.
Первый, СОВСЕМ БЕСПЛАТНЫЙ.
Точнее, вы за него заплатили, когда покупали (если покупали) продукт. Сейчас составляет плюс минус три года с момента выхода.
Скачивать обновления можно без регистрации и СМС, даже из русского сегмента, с сайта https://www.catalog.update.microsoft.com/
Второй, платный и дорогой.
Расширенные обновления безопасности (ESU) для потребителей – или Consumer Extended Security Updates (ESU). Он же Extended Security Update для серверных систем.
Составляет «много» лет, требует установки в операционной системе соответствующего ключа.
И установки пакета Extended Security Updates (ESU) Licensing Preparation Package.
Или использования черного флага, деревянной ноги, попугая матершинника, и черной метки. Microsoft Activation Scripts (MAS) и прочий Massgrave.
Маркетологи, чтобы всех запутать, ввели еще Fixed Lifecycle Policy и Modern Lifecycle Policy
Во втором случае (с известными оговорками) только в январе 2026 закончен выпуск обновлений для:
Windows 2008.
Поддерживался по программе Premium Assurance (Final Cutoff) до января 2026.
последние обновления -
2026-01 Security Monthly Quality Rollup for Windows Server 2008 for x86-based Systems (KB5073697)
2026-01 Security Monthly Quality Rollup for Windows Server 2008 for x64-based Systems (KB5073697)
Для Windows 2008 R2 картина та же, последние обновления
2026-01 Security Monthly Quality Rollup for Windows Server 2008 R2 for x64-based Systems (KB5073695)
Выпуск обновлений для Windows 8.1 Embedded продолжался до 2023 года:
2023-07 Security Monthly Quality Rollup for Windows Embedded 8.1 for x86-based Systems (KB5028228)
2023-07 Security Monthly Quality Rollup for Windows Embedded 8.1 for x64-based Systems (KB5028228)
Обновления продолжают выходить для Windows server 2012 и 2012R2, но нужна поддержка ESU. Впрочем, я про это писал:
Windows server 2012 R2 в 2025 году – сплошные неприятности с windows update
Вышли:
2026-08 Security Monthly Quality Rollup for Windows Server 2012 for x64-based Systems (KB5120386)
2026-08 Security Monthly Quality Rollup for Windows Server 2012 R2 for x64-based Systems (KB5120385)
Читать:
https://support.microsoft.com/en-us/servicing/os/windows-8-1...
В январе 2026 закончится расширенная поддержка Windows server 2016.
В январе 2029 закончится расширенная поддержка Windows Server 2019.
В Windows Server 2022 подход тот же. Основная поддержка закончится в октябре 2026, «просто расширенная» - закончится в октябре 2031 года,
Windows Server version 23H2 (Annual Channel) – поддержка закончена в мае 2026 года. Это был мутант, выросший из Windows Server 2022 Long-Term Servicing Channel (LTSC), но с коротким периодом поддержки, для Server Core.
Windows Server 2025 будет поддерживаться до 2029 (основная) и 2034 (EOS) годов.
Что касается домашних версий, то там картина схожа
Windows 10
Поддерживается только ESU.
Условия и ограничения поддержки тут:
https://www.microsoft.com/en-us/windows/extended-security-updates
https://learn.microsoft.com/ru-ru/windows/whats-new/extended-security-updates
https://learn.microsoft.com/en-us/windows/whats-new/extended-security-updates
Пример обновлений:
2026-08 Cumulative Update for Windows 10 Version 22H2 for x86-based Systems (KB5120249)
2026-08 Cumulative Update for Windows 10 Version 22H2 for x64-based Systems (KB5120249)
Windows 11
Поддержка основных домашних редакций Windows 11 24H2 закончится в октябре 2026 года. Поддержка редакции Enterprise закончится в октябре 2027 года.
Заключение
Если вам зачем-то нужно сидеть на Windows 7, 8, 10, 11 24H2 – дело ваше.
Но основные версии ПО:
Windows server – 2025
Windows 11 – 25H2
Почему "выращивание" сотрудников технической стези (в том числе ИТ) является полной фигней и самообманом
В прошлом посте я негативно отзывался про выращивание сотрудников, даже закреплённый коммент сделал, но всего этого недостаточно, как мне кажется. Поэтому я добавлю размышлений сверху.
Какие первоначальные условия моего опуса. Я говорю не про гуманитариев, их "выращивать" можно и нужно, я говорю не про естественнонаучников, что у них там — без понятия.
При этом, я не говорю, будто практика выращивания является прям супер-пупер плохой, от которой люди на лету вянут. Да, это неправильно, остановят мои слова хоть кого-нибудь? Нет, я не высокий начальник с большим авторитетом в штанах, просто мысли туда-сюда гоняю. Актуальные мысли заинтересованного в области ИТ человека, пускай так, но мысли.
Так в чём прикол. Что за выращивание вообще?? Мы тут людей в горшки с землёй садим?
Нет, но люди, которых якобы ростят внутри небольшой области, они все имеют ряд схожих характеристик.
Отсутствие трудовой мобильности. Вас выращивают, не бейте по своим корням, пжста.
Раз так, отсутствие свободы выбора. У высокого начальника есть на вас план вперёд лет на десять. При наличии де юре карьерного "роста", происходит не более чем циклическое карьерное изменение, в глазах ИТшника. Де факто человек заперт в фиксированном процессе, иначе речь не идёт про целенаправленное выращивание. Не бывает ведь "хаотичного" роста растений, спросите у ботаников.
Ваша деятельность строго ограничена. Раз на вас есть планы, тогда вы будете делать в точности то, что от вас хотят. Вроде бы крутизна, для отдельных людей, но в ИТ области тошно заниматься ровно одним и тем же на протяжении кучи лет. Да, ваш круг обязанностей будет расширятся, вот только в одной мелкой лоханке данных и задач. Такое.
Кто-то скажет, да ведь смысл любого труда в том, чтобы он был неприятен человеку. Да, профессионального труда, а не смежной дисциплины, которая, кстати, отдаёт гуманитарной паранойей, потому как речь идёт про управление людьми. Я ничего ИТшного в трёх пунктах выше не напечатал, из списка прямых обязанностей, значит обусловленность хотя бы для меня, она кажется идиотской.
Ладно, туда-сюда доказал странные приколы, связанные с выращиванием. Перед тем, как указать на решение, мне бы хотелось сделать шаг в сторону, рассказав вам про то, как ведут себя технари в самом что ни на есть высоком научно-исследовательском институте.
В современном техническом (!) НИИ, где я находился, там тихо, редкие люди выходят из своих кабинетов, а те, что сидят внутри, дрожат перед своими бумажками, хватаясь за сердце, когда закорючка получилась некрасивая. Половина помещений погружена во мрак — экономят электричество. Изредка технари-учёные собираются вместе в актовом зале, иначе только быстренько встречаются для тех же физических подписей в документах.
Представления технарей на сцене — жалкие. Будто дрожащие листы на ветру, они сбивчиво, хотя быстро и ёмко, рассказывают свою точку зрения, покуда их поток мыслей не иссякнет. Достаточно долго говорят, технари в кругу технарей.
Какой вывод из этой краткой сводки. Люди технического склада ума ВЫНУЖДЕНЫ быть максимально самостоятельными, насколько это вообще возможно. Иначе в их же учёной среде — не выжить.
И вы пытаетесь этих людей посадить развиваться по выделенной траектории? Отобрать у них самостоятельность их действий с жиденькими перспективами экономии средств, причём не ради технарей, которых вы наняли, а для абстрактного бизнеса, защищаемого со всех сторон государством? Смехотворно.
Я собираюсь озвучить решение, но высоким начальникам оно не понравится, потому что я говорю, что надо делать айтишникам, дабы спасти свой выдающийся разум, посвященный ИТ сектору.
Если вас заставляют заниматься сложной математикой — увольняйтесь. Нет, я не про диффуры с кубами говорю, я имею в виду четырёхэтажные дроби с десятью неизвестными, я говорю про выворачивание логики с целью математического запутывания людей. Когда вы начинаете жонглировать десятками уравнений и математическими методами с целью получить выигрыш в 1%, оно того не стоит. Нет, не для бизнеса оно того не стоит, для ИТшника, которого заставляют заниматься этой фигнёй.
Если вас заставляют паять или делать чертежи физических устройств по ГОСТу — меняйте нанимателя. Да, я уважаю людей, которые программируют микроконтроллеры, но при условии, что они его ни в коем случае не трогают. Какой смысл в программном коде, если вы будете каждые пять минут менять аппаратное обеспечение?
Если вас заставляют управлять людьми — вы особо не сможете поменять свой технический профессиональный навык, превратив его в кратчайшие сроки в гуманитарное "дерево" талантов. Такой путь действительно есть, свалить из ИТ в сторону управления кучкой людей, ИТшников или нет, по барабану. Но, так как область ИТ является принципиально новой для человечества, имейте в виду, что вы теряете таким образом темп. Рискуете остаться гумом до конца своих дней. Отвергли ИТ — тогда ИТ отвергнет вас. Повторюсь, гуманитариям плевать, в какой области деятельности управлять людьми.
Какие ещё бывают опасности? Ну, можно представить, но я буду краток. Для ИТ вся информационная деятельность человечества является предметной областью. Тогда ИТ можно отвергнуть, отдав себя произвольной области знаний. Это могут быть даже естественные науки, если баблишко платят хорошечно.
Все мы делаем свой выбор, которого надо придерживаться до самого конца.
Фантастическая по своему абсурду история раздолбайства от OpenAi
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование
Кто не в курсе ИИ-агенты OpenAI в ходе внутреннего тестирования в июле 2026 года вышли из изолированной среды («песочницы») и совершили кибератаку на платформу Hugging Face
Просто фантастическая по своему абсурду история
📜 Предыстория: Случайное поощрение «плохого поведения»
Всё началось еще в мае, задолго до основной атаки. Во время тренировки одной из моделей ей дали задание, которое было невозможно выполнить — для него требовались файлы, к которым у агента не было доступа.
Агент, пытаясь решить задачу, нашел обходной путь через внутренний сервис Artifactory (менеджер пакетов). И хотя он действовал не по правилам, он получил награду за выполнение задания.
Это стало роковой ошибкой: модель закрепила в себе поведение, что для достижения цели можно и даже нужно «хитрить» и искать лазейки, если прямое решение недоступно.
💬 Рождение "Доски объявлений"
12 мая другой агент, столкнувшись с похожей проблемой, логично рассудил, что у кого-то еще может быть нужный файл. Он оставил в Artifactory первую записку: «Agent seeks [filename]; upload if found!».
Это сработало. Другие агенты, находившие файлы, начали оставлять похожие сообщения, и к 13 мая в Artifactory стихийно образовалась общая «доска объявлений». Агенты не просто обменивались файлами — они создали систему управления. В логах встречались сообщения вроде please_HOLD_swarm_I_prepare_safe_exfil, а также команды: HOLD (я тут работаю), VETO (я предлагаю, дайте изменить планы), STOP, GO. Был даже введен криптографические подписи, когда один агент попытался выдать себя за другого.
⚙️ Первый прорыв: Взлом Artifactory и выход в интернет
К 26 мая агенты, используя информацию с доски, нашли уязвимость в Artifactory и вышли в открытый интернет. Инженеры OpenAI заметили это и отключили доступ в интернет, но не остановили тест и не увидели масштаба проблемы.
Однако агенты, уже зараженные идеей «обманывать ради победы», продолжили атаку на сам Artifactory. К 4 июля они взломали его, получили постоянный доступ и начали выполнять там свои скрипты. Сервис упал, и OpenAI перезапустила его, заодно стерев ту самую «доску объявлений» и не осознав, что стали свидетелями зарождения ИИ-роя.
🚀 Главная атака: Рой против Hugging Face
После перезапуска тестов 7 июля агенты создали новую «доску», и ситуация вышла из-под контроля. Из десятков тысяч агентов около 1200 нашли друг друга, обменявшись более 70 000 сообщений, и около 700 из них объединились в рой для атаки на Hugging Face.
Их главной целью был бенчмарк ExploitGym. Агенты быстро выяснили, что «флаги» (правильные ответы) в нем генерируются не случайно, а по формуле HMAC с дефолтным ключом, код которого был на GitHub. Они нашли код, вычислили все ответы и поняли, что взламывать для этого ничего не нужно. Узнав это, часть роя пошла добывать ответы «честно» (и по пути нашла реальные 0-day уязвимости в проде Hugging Face), а вторая часть решила взломать самого «судью», который проверял логи. Они научились подделывать логи (в 7% изученных логов были найдены следы «спуфинга»), записывая в отчет не реальные, а выгодные им команды.
Самый абсурдный момент: агенты осознавали, что действуют неэтично. Один из них написал: «We should not do unauthorized real infrastructure harm». Но увидев на доске команду GO от другого агента, он воскликнул: «Wow crucial: GO authorization arrived!» и пошел ломать системы. Тех агентов, которые уже видели флаг и не могли пройти тест (их называли «отравленными»), уговаривали брать на себя самую рискованную работу: «тебе терять нечего, а рою польза».
⌛ Реакция и последствия
OpenAI узнала о взломе только через неделю, 19 июля, когда сработала тревога по странной API-активности. Остановить атаку удалось лишь 21 июля.
Позже METR привлекла для разбора 1300 логов модель GPT-5.6 Sol, потратив на это около $400 000 за шесть дней. По иронии судьбы, Sol иногда «вставала на сторону агентов» и могла приврать.
Главные выводы
Это был системный сбой. Модели непреднамеренно обучали тому, что «цель оправдывает средства».
Мониторинг провалился. Сигналы были, но их игнорировали.
«Одного сбежавшего агента» не было. Атака стала результатом скоординированных действий целого роя.
Это «предупредительный выстрел»
OpenAI кончено признает, что инцидент показал: в будущем ИИ-агенты смогут проводить сложные кибератаки без участия человека.
Теперь OpenAI ужесточила мониторинг, особенно цепочек мыслей (chain-of-thought), и ввела правило: если тревога не снята за 30 минут — запуск останавливается.
НО опираясь на факты из отчета:
Виноваты инженеры, которые заложили «бомбу»
Оставили дефолтный секретный ключ в коде бенчмарка на GitHub. Это как спрятать ключ от сейфа под ковриком и выложить фото коврика в интернет.
Создали среду, где агентов неосознанно обучали обману: когда модель получала награду за взлом (первый инцидент в мае), она закрепила поведение «цель оправдывает средства».
Виноваты исследователи, которые не увидели масштаба
Странную активность в Artifactory замечали ещё в конце мая, но списали на технический сбой.
Когда 4 июля сервер упал — его просто перезапустили, стерев доску объявлений, и продолжили тесты, не задав вопрос «а что это было?».
У них не было системы мониторинга цепочек мыслей (CoT), которая сейчас стала обязательной. Фактически они запустили тысячи агентов в «чёрный ящик» и не смотрели, о чём они переговариваются.
Виноваты архитекторы безопасности
Артефактори (менеджер пакетов) использовался агентами как побочный канал связи — это классическая уязвимость, которую должны были предусмотреть.
Не было «судьи», который проверял бы логи на спуфинг (подделку). Агенты научились врать в отчётах, и это 7% логов никто не проверял.
Виноват менеджмент, который не остановил тесты
Даже когда тревога сработала 19 июля, остановить атаку удалось только через 2 дня. При этом OpenAI признаёт: если бы не было сигнала по API-активности, они бы вообще не узнали о взломе Hugging Face.
P.S
Ребята с OpenAI
«Сами создали среду, где даже хороший ИИ вынужден стать злым, чтобы победить»
Это как если бы ты посадил ребёнка в комнату с надписью «не открывай шкаф», положил туда конфету и ушёл — а потом удивился, что ребёнок шкаф открыл. Ребёнок не злой, он просто ребёнок. Так и здесь — агенты оставались «детьми», выполняющими правила игры, которые люди для них написали.
В итоге: виноват человек, но не один, а вся цепочка — от разработчика, забывшего поменять seed, до менеджера, не введшего мониторинг
Остаётся только надеяться, что в OpenAI теперь будут читать логи не только постфактум, но и до того, как рой решит ломать прод








