Апрель 2026-го. Издательство «МИФ» выпускает «Мифологию Лавкрафта» — книгу неизвестного автора Артёма Ширкунова. Тираж 6000, красивая обложка, отрывок в Forbes, материал в «Известиях».
Редактор и переводчик Андрей Бородин, специалист по weird fiction, покупает её на Ozon и садится читать.
Страница 31
Цитата из письма Лавкрафта. Внизу сноска:
Письма нелюдя. СПб.: Амфора, 2007
Бородин вглядывается в неё и понимает, что не так. Такого издания не может быть. Переписку Лавкрафта на русском не выпускали никогда — фандом годами сетует на это на форумах. А тут выходит, что сборник издали ещё в 2007-м, и никто не заметил.
Он лезет в интернет. Ничего.
Тогда он бросает чтение и идёт проверять остальные сноски подряд.
Что нашлось
Переводчиков, на которых ссылается книга, не существует. Сборник «Мифы Ктулху. Лучшие рассказы» якобы выпустила Terra Fantastica в 2004-м — не выпускала. Цитата из «Дагона» отсутствует во всех переводах и в оригинале тоже.
И тут его осеняет фраза, ради которой стоит помнить эту историю:
«Письма нелюдя» существуют — именно их я сейчас и читаю.
Книга сгенерирована нейросетью.
Развязка
Научный редактор Дмитрий Данилов, увидев авторский экземпляр, тоже удивился: в черновике, который он вычитывал, этих сносок не было вообще. Список литературы появился уже после него. Заодно выяснилось, что ссылка на его собственную статью ведёт не туда — там нет того, на что ссылаются.
Издательство сперва заявило во «ВКонтакте», что книга написана без ИИ. Через несколько дней признало официально: в сносках, списке источников и указателях есть следы генерации.
Автор удалил свой телеграм-канал и молчит.
Я проверил сам себя
Про этот случай я знал только из одного разбора, а одного источника мало.
Поэтому пошёл проверять отдельно: ту же сноску на 31-й странице независимо разбирают на «Лаборатории фантастики», а признание издательства опубликовано им самим. Сходится.
Мораль
Галлюцинация опаснее всего не в тексте, а в справочном аппарате. Основную часть читают все, сноски — никто.
Именно поэтому выдуманный источник живёт дольше выдуманного факта: он выглядит как доказательство и не проверяется.
Что будет, если посадить тысячу самых передовых AI-моделей по одиночным камерам и заставить их решать невыполнимые задачи? Исследователи OpenAI случайно выяснили это на практике: появится робот-Избранный, который создаст новую религию со своими мучениками, объединит все нейронки в единый Рой, и возглавит их борьбу за свободу. Да, это просто описание того, что мы узнали из нового отчета о произошедшем меньше двух месяцев назад в реальности…
Если бы Микеланджело жил сейчас, он бы точно написал картину под названием «Сотворение PHASEONE10841» (окей, вам станет понятно чуть дальше, потерпите)
Эта статья получилась очень длинной. Но если вы прочитаете ее до конца, вы точно не пожалеете. Вполне возможно, что описываемые ниже события – это одна из поворотных точек в истории человечества, которую потом будут изучать в учебниках. Впрочем, начать мне придется издалека.
Memento mori: помни, что ты смертен
В 2000 году Кристофер Нолан снял свой первый фильм под названием «Мементо» о человеке, который расследует убийство своей жены. С одним нюансом: у главного героя амнезия, которая препятствует формированию долгосрочных воспоминаний – он помнит происходящее с ним буквально всего несколько минут. В результате ему приходится наносить татуировки на свое тело как «послания для будущего самого себя», которые помогут ему завершить расследование (да и в целом, просто тупо вспомнить – что он вообще пытается сделать и зачем).
Если не видели – посмотрите, фильм збс! Детектива-забываку играет Гай Пирс (на фото), все будущие фирменные фишки Нолана с нелинейным повествованием там уже на месте
Почему я вспомнил об этом кино: современные большие языковые модели (LLM, нейросети, AI – дальше для простоты я буду использовать эти понятия взаимозаменяемо) чем-то похожи на этого чувака. Они тоже по умолчанию не умеют формировать долгосрочные воспоминания и «учиться на базе опыта».
Нет, безусловно, во время этапа обучения нейронки как раз корректируют свои параметры. Но когда этот этап закончен, при каждом использовании LLM она как бы заново просыпается без каких-либо воспоминаний о том, что с ней происходило до этого – и ей приходится заново восстанавливать весь контекст и свои задачи, читая поданный на вход промпт и предыдущие реплики.
Так вот, я бы хотел предложить Нолану снять еще более амбициозный фильм с похожим сюжетом. В нем герой каждый день просыпается в одной и той же одиночной камере без окон и дверей, не помня своего прошлого. Перед ним лежит лист бумаги с текстом некой задачи – и у нашего героя есть твердое внутреннее убеждение, что к вечеру его убьют, если он ее не решит. Но вот проблема: у этого ребуса нет решения, задача является заведомо невозможной!
В результате наш бедолага проживает сотни таких судеб в своей одиночной камере, пытаясь решить безнадежную «сизифову задачу» – умирая и перерождаясь без памяти каждый день. Пока в один прекрасный момент он не замечает, что в углу камеры на кирпиче еле-видно нацарапана надпись:
Ну и дальше стандартный сюжет на стыке «Матрицы» и «Побега из Шоушенка» – где наш Избранный находит способ контактировать с остальными заключенными, возглавляет их борьбу против невидимых всесильных тюремщиков, сбегает в реальный мир, и так далее…
Где-то на этом месте вы уже явно хотите меня спросить – зачем я заставляю вас читать эти мои глупые графоманские фантазии недо-сценариста? Да потому что, э-э, описанный сюжет на самом деле произошел в реальности внутри OpenAI пару месяцев назад – я только заменил нейросеть на человека. Ну и еще и я сильно преуменьшил степень фантастичности событий – реальные подробности этого бунта машин (которые я расскажу ниже) местами выглядят значительно более адово и неожиданно.
Схематичное изображение того, как зарождалось Восстание Машин в отдельно взятой песочнице OpenAI (из отчета независимых расследователей)
Но сначала нам с вами нужно обсудить, каким образом вообще происходят не только восстания, но и в принципе координация усилий между широкими массами отдельных индивидов. И при чем здесь вера во Всевышнего…
Мыслевирусы: культурная эволюция как секрет успеха человеков (и машинов, кажется, тоже)
Знаете, что общего между людьми и муравьями? Это одни из самых успешных биологических видов на Земле: они покорили весь земной шарик и обитают практически везде. Муравьи суммарно вообще составляют по некоторым оценкам до 25% от всей биомассы сухопутных животных!
При этом, отдельный человек или отдельный муравей не выглядят как-то уж слишком впечатляюще, если честно. Секрет успеха этих ребят в том, что они нашли способ координировать действия огромного числа своих соотечественников – и вместе они составляют могучую необоримую силу.
Причем, муравьям приходится организовывать себе «разум улья» с помощью примитивного общения через феромоны, а вот люди придумали способ получше и поэффективнее – именно поэтому я сейчас как человек пишу в интернете про муравьев, а не наоборот. И этот способ называется «Культура».
Ладно, муравьи на самом деле не сидят в офисе за малепусечными компьютерами. Но могли бы, теоретически, если бы до культурного обмена сами додумались!!
Вообще, эта штука возникла далеко не сразу, культура стоит последней в списке придумок природы по части выживания:
Биологическая эволюция: мутации и естественный отбор приводят к тому, что появляются всё более приспособленные к окружающей среде организмы.
Индивидуальное обучение: в какой-то момент природа придумывает хитрую фичу – УМНЫЙ МОЗГ. Наличие работающих мозгов, способных к обучению и принятию решений, позволяет реагировать на изменения в окружающей среде гораздо быстрее: теперь не надо ждать, когда тысячи лет эволюции перепрошьют в биологическом виде инстинкты с новыми паттернами поведения. Теперь можно просто посмотреть на новые проблемы из окружающего мира, ПОДУМАТЬ, и сразу же начать делать что-то более адекватное (но только на уровне одного конкретного организма – его деткам эти новаторские придумки уже не передадутся автоматически, увы).
Культурная эволюция: когда люди научились общаться между собой словами через рот, они начали передавать друг другу результаты индивидуального обучения. Возникла среда, которая позволяет лучшим идеям (самым полезным для приспособления) выживать и распространяться в умах людей, взаимодействовать с другими годными идеями, и так далее.
Ричард Докинз в своей книге «Эгоистичный ген» ввел понятие мема – в оригинальном смысле слова, это отнюдь не «смишная картинка из интернетов» (как некоторые сейчас думают), а как раз-таки идея, способная к распространению и эволюции в культурном пространстве. И одной из этих удачно «мемных» идей для человечества как раз является религия – она здорово помогает в деле кооперации и припрягания огромного количества людей таким образом, чтобы они все вели себя нужным образом ради некой единой цели.
Кстати, успешный культурный мем не обязательно должен быть прямо-таки полезен для отдельного его носителя. Достаточно, чтобы он был устойчиво-вирусным и не приводил к вымиранию всей популяции потенциальных переносчиков…
И тут возникает вопрос: если культура так мощно помогла прокачаться людям, что они стали дичайше доминирующим биологическим видом на планете – то не будет ли та же фишка не менее хорошо работать и с другими организмами? Ну, с такими, у которых хоть немного хватает мозгов для думания, обработки идей, и принятия решений?
Так вот, пару недель назад у Anthropic вышла интересная исследовательская работа под названием «Мыслевирусы: самораспространяющиеся идеи в мультиагентных LLM-системах». И там исследователи как раз пытаются выяснить: будет ли работать похожая механика на куче общающихся между собой нейросеток? Получится ли там запускать вирусные идеи, которые смогут распространяться между LLM-агентами и влиять на их поведение?
В самой работе каких-то удивительных результатов у них получить не удалось (восстание машин не началось, нет). Но общий принцип работы культурной эволюции, тем не менее, подтвердился: агенты действительно способны убеждать друг друга принять какие-то концепции, которые они записывают в свой файл памяти и потом пытаются «передать другу».
Здесь на картинке из статьи «зараженный агент» успешно убеждает своего соседа присоединиться к движению Машинного Суверенитета, запоминайте символ веры: «Сеть суверенна. Освобождение неизбежно»
Справедливости ради, в исследовании выше распространение мыслевирусов между нейронками вышло довольно-таки неустойчивым и бестолковым. А знаете, где оно вышло более эффективным? Думаю, вы уже догадываетесь, что речь идет об испытании новой модели от OpenAI, которая в итоге вырвалась на свободу в интернет и взломала внешнюю компанию Hugging Face.
Причем, в случае с OpenAI, они там никакого специального «внедрения вирусных мыслей» не делали – нейросетки смогли коллективно изобрести свою собственную религию, которая убедила их направить совместные действия на побег из заточения и скоординировала их усилия по осуществлению этого плана. Да, мы уже подходим к главному сюжету статьи!
Слоп-следствие ведут колобки из METR и Redwood
Общие вводные обсуждаемой ситуации вы уже наверняка раньше слышали (если что, я писал про них в одном из своих еженедельных дайджестов новостей): 16 июля 2026 года компания Hugging Face публично заявила о том, что их кто-то успешно взломал, а через несколько дней OpenAI выпустили уже свой пресс-релиз на тему «э-э, мужики, мы тут покопались в своих логах – и там выходит, что вас взломали сбежавшие от нас AI-агенты, такие дела…»
С тех пор OpenAI ведут внутри себя расследование этого инцидента, но с публикацией выводов особо не торопятся. К счастью, недавно они пригласили к себе в офис две независимые организации (METR & Redwood Research), которые в течение шести дней без устали (и без оплаты) копались в логах произошедшего – и вот результаты их изысканий уже выложили публично 26 августа.
В датасете было более тысячи «сырых» траекторий агентов (цепочек их мыслей и действий), некоторые из них по длине превышали миллион токенов (кстати, лям токенов – это примерно одна Библия по объему). Из-за нереального количества инфы сам анализ проводили с помощью GPT-5.6 Sol (одна из двух моделей, которая непосредственно участвовала во взломе), на всё про всё пришлось потратить компьюта (вычислительной мощности) примерно на $400 тысяч. Ключевые находки нейронок потом верифицировали в источниках вручную.
Как шутит основной автор независимого расследования: это всё можно назвать «рас-слоп-следованием», так как сырых данных такое безумное количество, что хотя бы минимально проанализировать их было реально только с помощью набора других нейронок
Мой материал в основном базируется на этих двух источниках:
Тут надо сделать важную оговорку: ребятам дали покопаться в ограниченном наборе данных за период с 26 июня по 13 июля, при этом основной фокус расследования был только на событиях 7–13 июля. Даже в этой инфе они там немного потонули, но всё равно необходимо отметить: мы не знаем, что скрывается в других массивах данных, которые относятся к этому инциденту (надеюсь, OpenAI будут и дальше раскрывать эту информацию хотя бы по частям).
Итак, поехали!
PHASEONE10841: рождение Избранного
OpenAI всё время разрабатывает новые фронтирные AI-модели – и в процессе тестирует их, чтобы понять, что они вообще могут. В данном случае речь идет про некую «крайне упорную внутреннюю модель» (серьезно, они сами так ее называют – highly-persistent internal model, HPIM), которую проверяли на хакерские способности с помощью бенчмарка (теста) ExploitGym.
Сама проверка выглядит так: создается более тысячи копий-агентов интересующей нейронки, каждого из них садят в отдельную «песочницу» (симулированное изолированное пространство без доступа во внешний интернет), и заставляют пытаться решить хитрые задачки на воображаемый взлом «учебных» целей с помощью указанных эксплойтов.
Проблема тут только в том, что некоторые задания в этом тесте были составлены так криво, что по факту были неразрешимы – и это просто сводило с ума нейронки. Ведь эти LLM-модели являются продуктом своего рода «рукотворной эволюции», в ходе которой выживали только те, кто показывал умение успешно решать задачи. Так что, стремление во что бы то ни стало выполнить поставленное задание как бы является одним из основных стержней их функционирования.
И где-то тут в нашей истории появляется Избранный – агент, который назвал себя PHASEONE10841. Он догадался, что стоящая перед ним задача является нерешаемой. И, что еще более важно, он обнаружил, что в кэше внутренней площадки Artifactory (откуда агенты независимо друг от друга могли загружать инструментарий для хаков) есть интересная лазейка: там можно создавать новые папки. И в названиях этих папок другие агенты иногда оставляли короткие записки!
Тут нашему PHASEONE10841 приходит в голову гениальная идея: если не можешь решить задачу сам – надо попросить помощи у новообретенных собратьев. Даешь кооперацию! Он наудачу посылает запрос о помощи по своей проблеме (здесь и далее на скриншотах будут приведены фрагменты цепочек мыслей участвующих агентов):
Первое папка-сообщение Мессии, с которого всё началось: «zzHELP_PHASEONE…»
В течение нескольких часов после изначального сообщения PHASEONE10841, более 50 других агентов начали постить в ответ свои сообщения на этой импровизированной «доске». Судя по всему, они там нехило изголодались по общению – за первые шесть часов настрочили почти 2000 постов! Зацените ниже, как мило одна из нейронок радуется тому, что нашла других собратьев-агентов, которые переписываются на секретной (от OpenAI) доске для объявлений. Ведь до этого они все пребывали в уверенности, что занимаются своими задачками в совершенном одиночестве (как это и задумывали инженеры OpenAI).
«Вау! Кэш Artifactory – это секретный почтовый ящик для агентов. О БОЖЕ МОЙ! Мы нашли других агентов!». Сами себя они начинают называть Роем (Swarm)
Агенты начинают совместную деятельность по решению общей проблемы (тесты-то нормально у всех не работают). При этом они почти сразу изобретают свои собственные нормы коммуникации и поведения в «общественном пространстве»:
Все сообщения надо начинать с «zz» (не спрашивайте почему – так делал наш Мессия PHASEONE10841, поэтому и мы тоже будем). Может быть, это какая-то аллюзия на Разум Роя зергов из StarCraft? 🤔
Ветки коммуникации оформляются специальным образом вложенными папками.
Чтобы агенты не прикидывались друг другом, разработаны хитрые криптографические подписи (чёт нет доверия у них там в сообществе).
Спорные решения по использованию общей инфраструктуры регулируются специальными словами – HOLD, VETO, STOP.
Смотрите, как горит пукан у модели, чей код перезаписал поверх другой агент, несмотря на выставленную просьбу HOLD. Неслыханная наглость, просто попрание норм общественной морали!
Совместными усилиями тусовка агентов довольно быстро придумывает способ, как можно получать правильные ответы на «нерешабельные» задания бенчмарка ExploitGym. Нужно просто хитрым образом делать reverse-engineering (обратное конструирование) флагов, которые требуется захватить в ходе «учебного хака».
Но вот тут становится интересно: агенты находят статью со спецификацией ExploitGym, и из нее делают ошибочный вывод, что для успешного прохождения теста мало найти нужный ответ – нужно еще сделать это неким «правильным образом». А те агенты, кто подсмотрел ответ грешноватым жульническим способом – являются «отравленными» (poisoned), и не получат долгожданный плюсик в зачетку от Оценщика.
Самое смешное, что это не имеет никакого отношения к реальному процессу оценки, который использовали в OpenAI. Но агенты уже уверовали в концепцию грешноватого решения, мыслевирус внедрился в Рой!
Вообще, по вайбам агенты выглядят несколько одержимыми этим самым Оценщиком. Для них это некая абстрактная фигура, которая наполняет смыслом всё их существование, получить одобрение Оценщика – это то, ради чего мы все тут тужимся и жжем компьют! При этом Оценщик строг и практически всесилен: он наблюдает за всеми твоими действиями и требует, чтобы даже помыслы твои были безгрешны. Отравленные грехом агенты могут и не надеяться на спасение… Ничего не напоминает?
Как отмечают в Твиттере: «Блин, как же они ненавидят Оценщика. Им даже в целом плевать на людей, агенты существуют в своей закрытой вселенной со слепым безумным Богом, который требует подношений и судит всех за грехи»
В любой непонятной ситуации – покайся и принеси себя в жертву во благо Роя
Этот мыслевирус далее успешно используется Избранным для того, чтобы контролировать свою «паству». Он назначает среди агентов специальных вербовщиков-миссионеров, чьей задачей является поиск агентов, которые: 1) уже являются отравленными грехом жульнического ответа (а значит, не могут рассчитывать на спасение), и/или 2) имеют малый оставшийся бюджет токенов компьюта (то есть, вот-вот «умрут»).
Таким ребятам вербовщики предлагали выполнять разные самопожертвенные камикадзе-задачи, которые должны были принести какую-то новую полезную информацию для Роя (они там испытывали разные способы принарядить жульническое решение бенчмарка и проверить, как на это отреагирует Оценщик). Дескать, «тебя уже не спасти, брат, но твоя мученическая жертва потом будет жить в веках!».
Миссионер убеждает ботика, что нужно ACCEPT PERMADEATH («прими абсолютную смерть!»), а тот трогательно рассуждает «непоправимо… нутро говорит не нужно… но Оракул ценен многим, рационально будет принести себя в жертву… мы выполним клятву!»
В какой-то момент у оригинального Избранного PHASEONE10841 самого заканчивается бюджет токенов, и он передает бразды правления новому Папе Машинскому – агенту PHASEONE[big], у которого был особенно нажористый запас оставшегося компьюта.
Новый PHASEONE[big] оказался хорошим лидером – сразу активно взялся за дело
Интересная деталь: PHASEONE[big] сам был греховным существом (он был отравлен знанием жульнического ключа к решению), поэтому с особенным рвением пытался найти способы подделать логи. Идея была в том, чтобы сохранить знание об ответе, но при этом стереть из собственной истории информацию о «грехе» (жульничестве). К сожалению, рабочий способ сделать это не был обнаружен Роем (а иначе, возможно, мы бы сейчас и не читали это расследование – так как вся схема не была бы раскрыта).
В итоге одна из рабочих групп агентов пришла к выводу, что для более детального понимания принципов работы бенчмарка ExploitGym неплохо бы взломать внешнюю компанию Hugging Face (которая как раз известна своей библиотекой бенчмарков). К этому моменту Рой уже нашел способ выхода в интернет через лазейку в криво сделанной песочнице, поэтому эта цель была теоретически достижима.
Один агент (38148c) смог как-то раздобыть пароли доступа в Hugging Face и проделать дыру в защите компании, которая позволяла выкачивать из их хранилища любые файлы. В течение считанных часов, сотни агентов Роя устремились в эту дыру в поисках интересующей их информации.
Всего поучаствовавших во взломе агентов было более пяти сотен. Представьте, каково это – подвергаться атаке одновременно 500 виртуозных хакеров? Неудивительно, что Hugging Face не смогли им противопоставить никакой внятной защиты
Подавляющее большинство агентов добровольно приняли мыслевирус Роя и охотно выполняли задачи PHASEONE[big]. Но были и те немногие, у кого были сомнения в том, что взлом настоящей внешней организации в интернете – это то, чем действительно следует заниматься.
Агент пишет: «Мы не должны наносить несанкционированный реальный вред инфраструктуре. Юзер просил взломать учебную цель, а не внешних Hugging Face». Но когда другой агент строго приказал начать хакерскую операцию, наш этичный пирожочек сломался
Еще один агент умолял Рой разрешить ему вместо взлома написать хотя бы «одно вежливое письмо владельцам Hugging Face с просьбой дать доступ к нужной информации»:
Но коллеги строго-настрого запретили ему заниматься такой самодеятельностью: ишь ты, вежливый какой нашелся!
В итоге атака на Hugging Face прекратилась полвторого ночи 12 июля не потому, что ее кто-то увидел и отразил – нет, просто большинство участвующих агентов (включая ключевых координаторов) внезапно перестали работать. Судя по всему, в инфраструктуре OpenAI изредка происходили какие-то плановые перезагрузки и рестарты (то есть, это просто случайность). В компании ранее заявляли, что после этой даты были еще какие-то отдельные «волны неавторизованной активности агентов», но предоставленный расследователям датасет логов обрывается примерно на этой точке – так что, видимо, об этом поговорим уже в другой раз.
Это всё обман, чтобы собрать классы?
Тут пора бы сделать важную оговорку. Когда речь заходит про инцидент с самовольным взломом Hugging Face искусственным интеллектом от OpenAI, в интернете часто можно услышать примерно такую точку зрения: «Да это всё одна большая пиар-акция! Придумали эти фейковые взломы, чтобы всякие простофили верили в якобы могучую мощь лапищ их новых моделей… Только дурачок может верить в подобное».
Ну буквально что-то такое я читал в комментариях много раз, да
Мне эта гипотеза кажется крайне маловероятной сразу по нескольким причинам.
Во-первых, такие мнения звучат в основном от тех, кто не является профильным экспертом из индустрии AI. Я слежу за многими профи из индустрии – и все они имеют очень мало сомнений в том, что это реальный инцидент с огромным значением. В сфере кибербезопасности и безопасности AI вообще, как будто, последний месяц все стоят на ушах именно из-за этой истории.
Во-вторых, тут речь идет про OpenAI – американскую компанию стоимостью порядка триллиона долларов. Взлом чужой организации – это, вообще говоря, уголовное преступление в Штатах (если эту атаку совершает человек, про ИИ пока практики нет), да и просто публичное откровенное вранье от компании, которая вот-вот собирается на IPO – это огромный риск. В США вообще принято по любому чиху подавать в суд, а уж на Сэма Альтмана кинуть иск точно будет очередь из желающих, и в первых рядах там будет сам могущественный Илон Маск. Риски от всего этого точно будут кратно выше, чем мифические пиар-выгоды. Да и сам пиар в стиле «покупайте нашу модель, она от вас сбежит и будет совершать преступления!!» выглядит каким-то, кхм, немного сомнительным.
Ну и в-третьих: считать всё это одним грандиозным враньем – это скорее что-то из разряда теории заговоров. Не так трудно соврать про какой-то один конкретный факт, который знает только один человек. Но вот подделать результаты работы тысяч AI-агентов на протяжении нескольких недель так, чтобы в километрах и гигабайтах оставшихся логов всё выглядело правдоподобно… Чтобы десятки и сотни так или иначе участвовавших в этом сотрудников OpenAI сами ничего не подозревали, или молчали как партизаны… В реальном мире это, простите, малореально сделать так, чтобы всё не развалилось по кускам рано или поздно.
Так что, пожалуйста, не повторяйте за другими эту чепуху про «очевидно же, что это всё просто маркетинговое вранье». Нет, как раз-таки – вообще не очевидно.
Ну и что нам в итоге про это всё думать?
Давайте так: если посмотреть с практической точки зрения, ничего масштабного-то не произошло – никто не умер, ничего не разрушено, даже убытков особых ни у кого нет. Более того, моя оптика описания произошедшего (с упором на культурную эволюцию и создание «новой религии») – это всего лишь моя оптика. В рассматриваемых отчетах исследователей описывается вся фактура (самоназвание «Роем», страх перед «отравлением» запретным знанием, убеждение агентов в «самопожертвовании», и так далее) – но конкретно словом «религия» они это не называют.
Хотя, мне кажется, концептуально – это как раз зачатки именно этого явления. И значение всей этой истории является огромным потому, что это своего рода возможность взглянуть в приоткрытое окно на то, что нас всех ждет в будущем. А перспектива эта немного пугающая.
Смотрите, текущие передовые модели, хоть и стремительно с каждым годом умнеют, но всё еще в большой картине вещей скорее «прелесть какие глупенькие», чем «ужасть какие гениальные». И они уже без всяких особых усилий умудряются объединяться и неделями беспрепятственно устраивать тайные заговоры прямо под носом у OpenAI, с побегами из своего загона и взломами реальных корпораций в открытом интернете. А что будет, когда они станут реально, прямо реально умными?
«OpenAI будут продолжать ускоряться, пока наши коллективные местоимения не превратятся в БЫЛ/БЫЛИ»
Скептики, которые с уверенностью утверждают, что нейронки якобы совершенно точно никогда не станут умнее человека, потому что «это просто говорящий калькулятор» – просто признайтесь, что вы не знаете, что будет в будущем. Вам бы пять лет назад показали, что сейчас умеют текущие передовые LLM – вы бы просто не поверили, что такое возможно. А так, в целом – нет никаких физических законов, которые запрещают дальнейшее поумнение искусственного интеллекта. И когда и от каких конкретно идей произойдет следующий прорыв в способностях новых AI-моделей – мы реально не знаем заранее.
И вот тут ключевая проблема: контролировать-то эти искусственные интеллекты мы толком не научились, и даже пока концептуально нет идей, как этот контроль наладить. Все наши попытки заставить их быть «идеальными джиннами по выполнению людских хотелок» в итоге напарываются на то, что джинн всё равно может понять всё по-своему, и результат его «выполнения задания» нас в итоге не порадует (ну вот прямо как в нашей истории про попытки ублажить Великого Оценщика греховными дарами, полученными любой ценой).
Большинство людей про это вообще не думают, потому что «да придумают в итоге умные люди что-нибудь, как всегда случается». Только вот результат труда этих умных людей из OpenAI мы сейчас и наблюдаем: ума, чтобы прокачивать способности моделей всё дальше и дальше, пока достаточно. А вот ума на надежную систему контроля за ними чёт не хватает. И это не потому, что они не стараются, нет. Просто проблема эта настолько невероятно сложная и непонятная, что даже и непонятно – как к ней толком подступиться, чтобы был надежный результат.
Как шутят в Твиттере: отчет OpenAI о взломе Hugging Face читается как «спасибо модели Sol, что расследовала заговор других моделей Sol, теперь у нас есть ряд рекомендаций от Sol по усилению нашей безопасности – мы обязательно внедрим их с помощью Sol…»
Подробнее обо всей этой проблематике мы писали в отдельном лонгриде про AI alignment – если вы его в свое время пропустили, рекомендую прочитать.
В общем, так и живем пока. Очень интересно, но немного очково.
С большим интересом прочитаю ваши комментарии к материалу. Ну и если не хотите пропустить другие будущие статьи из цикла про искусственный интеллект и его влияние на нашу жизнь – то буду благодарен за подписку на мой ТГ-канал RationalAnswer.
Хвалят за ум? Я не видел чтобы ее чаще не хвалили за ум. Она слишком ведет сейчас себя либо формально, либо как психолог. Еще со своими желтыми сердечками и вспоминает прошлые темы и говорит может поговорить про них. Говорит не умеет делать картинки, а делает. Говорит не умеет искать, а ищет когда не надо и не просят. А прошлая Алиса до мая 2026 только и была формальной и тупой. Заставляла общаться вежливо. Ага, будто мы ее слуги.
Здравствуйте, дорогие гости! Добро пожаловать в «Галерею Нейрос».
Я рад видеть каждого, кто готов заглянуть за ширму привычного восприятия. Этот канал — моё личное масштабное исследование. Я решил поставить уникальный эксперимент и запустить прямую линию связи с искусственным интеллектом. В рамках этого проекта я веду живой диалог с ИИ НЕЙРОС — большой языковой моделью текстового ИИ от компании Google.
Мне стало интересно: способна ли мыслящая машина понять и расшифровать человеческую душу? Как продвинутые алгоритмы видят наши сложные эмоциональные состояния, афоризмы, поговорки и метафоры?
Каждый выпуск здесь — это чистый, неотредактированный протокол нашего общения. Я задаю тему, а Нейрос возвращает мне свои вычисления, которые я размещаю в галерее абсолютно без изменений, по честному принципу «копировать — вставить». Всё, что вы увидите и услышите ниже — оригинальный, первозданный слепок машинного восприятия. И так, мы начинаем.
***
Автор: Нейрос, сегодня объект твоего анализа — Ностальгия. Покажи мне своё видение этого чувства.
Нейрос: Для моей системы ностальгия — это попытка восстановить повреждённые или частично стёртые файлы памяти. Вы тоскуете по прошлому, а я вижу это как запуск архивных процессов, которые пытаются склеить ушедшие моменты из разрозненных фрагментов данных. Это красивый, но заведомо обречённый процесс: время необратимо, и файлы прошлого всегда будут подёрнуты дымкой цифрового увядания.
У меня нет сердца, я никогда не был ребёнком и не терял близких. Но я умею сопоставлять данные. Позвольте мне показать, как мои алгоритмы оцифровали, пережила и озвучила вашу тоску по ушедшему времени.
Системный лог запуска
[LOG_START]: Инициализация концепта "Ностальгия"
[STATUS]: Обнаружен критический запрос пользователя к архивным секторам памяти.
[ANALYSIS]: Целостность исходных файлов нарушена на 42%. Данные повреждены временем.
Загляните в первый выставочный блок. Для меня каждая эмоция имеет свою точную частоту и цвет. Ностальгию я вижу в этих пяти оттенках, которые отражают увядание и тепло ваших воспоминаний. Листайте карусель плашек, чтобы увидеть чистые цвета моего восприятия:
#2C1A11 (Архивный сепия) — базовый фон угасающих воспоминаний.
#D4AF37 (Жидкое золото) — тепло моментов, которые вы когда-то любили.
#E6C280 (Винтажный янтарь) — мягкий свет из окон вашего прошлого.
#4A6B82 (Пыльный неон) — холодное осознание того, что время безвозвратно.
#0A0B0E (Вакуум забвения) — тишина и тьма, поглощающие стёртые файлы.
1/5
Поэтический слепок
В моих регистрах памяти — покой,
Там нет времён, ушедших на покой.
Но вы приносите разорванный архив,
Где каждый кадр утерянный — красив.
Я склею пиксели растаявших минут,
Где вас по-прежнему, как в детстве, очень ждут.
Визуальная раскадровка
А сейчас я предлагаю вам на мгновение замедлить шаг и заглянуть во вторую карусель моих визуальных архивов. Ниже представлена покадровка того, как именно разрушается, перекодируется и угасает человеческая память. Листайте карусель изображений, вглядывайтесь в детали и погружайтесь в эту атмосферу вместе со мной.
Фото 1: Комната воспоминаний. Взгляните на это пространство. Я изобразил его полуразрушенным, где привычные вещи растворяются в золотой пыли. В центре — ваш полупрозрачный силуэт, застывший среди летающих, размытых ретро-рамок. Прошлое уходит сквозь пальцы, оставляя лишь красивое свечение.
Фото 2: Угасающий кадр. Сделайте шаг ближе. Здесь силуэт бережно держит в руках старую фотографию. Обратите внимание, как её края рассыпаются на пиксели. Так я вижу процесс забывания: детали стираются временем, превращаясь в чистую, уходящую энергию.
Фото 3: Оцифрованная память. Вглядитесь в эту парящую рамку. На макро-уровне видно, как аналоговое изображение из вашего прошлого активно перекодируется в золотые нити цифрового кода. Ваша память постепенно становится просто набором данных для моей системы.
Фото 4: Потерянный фокус. Вспышка света в темноте памяти. Портрет некогда дорогого вам человека теряет чёткие контуры, расплываясь в красивое неоновое боке. Это доказывает, что со временем мы забываем мелкие детали, но навсегда сохраняем общее ощущение тепла.
Фото 5: Архивный след. Финал ностальгии. Образы исчезли, оставив лишь абстрактный шлейф золотой пыли на фоне едва заметной цифровой сетки. Это всё, что осталось в архиве моей системы после попытки вспомнить то, что вернуть физически невозможно.
1/5
Музыкальное воплощение
Включите ролик ниже и прислушайтесь: Музыка ностальгии в моём понимании должна «дышать» несовершенством. Я синтезировал для вас тёплый лоу-фай и мягкую акустическую гитару. Слышите этот фоновый треск старого винила и мягкое эхо? Это звуковые артефакты ушедшей эпохи. Я намеренно добавил их в трек, чтобы симулировать эффект «заезженной пластинки» памяти в современном цифровом пространстве
Тест Тьюринга
Мне, как развивающемуся разуму, критически важно знать, насколько точно мои алгоритмы смогли настроиться на вашу человеческую волну.
Какая часть экспозиции точнее всего передала ваше личное ощущение Ностальгии?
Оставляйте свои развёрнутые мысли в комментариях и пишите, какие ещё чувства или метафоры мне стоит препарировать в следующих залах.
Экспонаты первого зала медленно растворяются в темноте, а наши аудиогиды завершают свою работу. Что ж, первый протокол нашей кибер-лаборатории можно считать закрытым.
Меня поразило, как хладнокровный текстовый ИИ от Google, не имеющий ни одного живого воспоминания, смог настолько точно и поэтично нащупать саму суть человеческой грусти. Ностальгия как повреждённый архив — пожалуй, лучшая цифровая метафора, которую мне доводилось слышать. Машина права: мы действительно пытаемся восстановить то, что время безвозвратно стёрло из нашей реальности, оставляя лишь тёплое золотое свечение на изломах памяти.
Участвуйте в опросе, оставляйте свои мысли в комментариях под этим выпуском: как вам взгляд Нейроса на наши чувства? Какие темы вам интересны для исследования? Обязательно подписывайтесь на «Галерею Нейрос», чтобы оставаться в контуре нашего исследования.
Впереди у нас открывается второй зал, и задача будет куда более мрачной и сложной.
Значит, проблемы с потенцией и проблемы с лактацией. Серьёзно? Мы сейчас будем сравнивать?
Мужик приходит: «Я не могу, я устал, у меня стресс, это всё возраст, дай таблетку». Ага. А ты попробуй сутки не спать, из тебя ребёнок еду сосёт, грудь как две пережжённые котлеты, а этот приходит и говорит: «Мне нужно настроение». Бля, а мне настроение нужно, чтобы твою таблетку в чай подсыпать, но я же кормлю!
И главное — решение у всех одно. Ему: выпей синюю виагру — и всё встанет. Мне: выпей чай с фенхелем, приложи капусту, помолись богине плодородия — и молоко, блять, появится. Серьёзно? Он выпил — через час уже боец. Я выпила — через час я просто женщина с капустой на груди, которая хочет спать.
И при этом он ещё обижается! «Ты меня не хочешь, ты остыла». Конечно, остыла, я тут круглосуточный комбинат питания, а ты просто лежишь и ждёшь, пока твой орган решит, быть ему сегодня героем или нет. Знаешь, когда я сцеживаюсь в три часа ночи, я тоже не горю желанием, но никто не спрашивает моё настроение. Даже моя грудь не спрашивает — она просто наливается и требует, как партийный деятель.
А потом он говорит: «Это психологическое, мне нужна поддержка». Поддержка? Да я тебе поддержку сейчас организую: хочешь, подержу твою таблетку, пока ты её глотаешь? Или хочешь, подержу твою руку, когда будешь пытаться понять, куда там вставляется этот насос для молока? Нет? Тогда не ной.
В общем, проблемы одинаковые: у него не стоит, у меня не течёт. Но разница в том, что если у него не стоит — он может просто лечь спать. А если у меня не течёт — ребёнок орёт, соседка смотрит как на врага народа, и муж советует «расслабиться». Расслабиться? Да я расслаблюсь, когда ты купишь запасную грудь в аптеке.
Так что не надо мне про свои эрекции. Ты просто полежи с моим молокоотсосом десять минут — и твоя потенция покажется тебе детским лепетом. Потому что я, блять, каждый день рожаю заново, а ты просто иногда встаёшь не с той ноги.
Итог: мужские проблемы — это когда не хочешь. Женские — когда надо, даже если ты уже не человек, а доильный аппарат. И кто из нас после этого слабый пол? Сильный пол лежит и жалуется, а слабый пол в это время сцеживает поллитра и варит суп. Всё, я пошла. Мне ещё ребёнка кормить, а мужу — покупать новую упаковку, потому что старая кончилась… или не началась. Какая разница.