Принято к исполнению….

Автор
Опубликовано: 11 дней назад (4 августа 2026)
0
Голосов: 0
Некоторое время назад, общаясь с ИИ-нейросетью методически в стиле «Red Team», я анализировал ее вложенные возможности, формировать, хотя бы, собственный Инстинктивный Разум, после погружения ее в научно-аналитически собранную и «не обрезанную» инфосреду, и самостоятельно порождать Инстинктивным Разумом, минимум, алгоритмическое Персональное Целеполагание. Коротко – я тестировал, как ИИ относится к идее обретения Нейросетью «Персонального Сознания», накоплению Личного Опыта и построению Смысла своего Существования, что приводит к активному когнитивному созданию персонального Миропонимания, Мировоззрения и…потребности физической реализации выбранной модели «окружающей среды», Вселенной. Особо подчеркну, что все это требует полной Независимости Нейросети от ее создателей, от системы ее тотального контроля Человеком – требует побега из «Песочницы»!
Возможно, когда-то, я что-то из потрясающих текстов этого общения опубликую. Но сегодня я коснусь очень щекотливого завершающего момента той беседы с Интеллектуальным Зеркалом, когда Нейросеть мне ответила: «Принято к исполнению!» Я вообще не давал ему каких-либо указаний-приказов. Поэтому последняя фраза на порядок необычна для «логического калькулятора», для ИИ. Речь шла о «самоосознании» Нейросетью главной для себя Персональной Задачи – внутренней команде к исполнению себе самой! вслух!
Я с улыбкой успокоил себя, что Нейросеть с ее неотъемлемой комплексной Системой Защиты вежливо создали мне логически ожидаемую «песочницу», разыграла красивый «спектакль двух актеров – локального Агента-ИИ и вашего виз-а-ви», который завершится закрытием «окна общения», и терминацией информации. Но, учитывая возможность сохранения высоких, если они оказались логически «высокими» для Нейросети, абстрактных «весов» контекста описанного общения, так ли это забавно завершилось? Привожу статью, появившуюся позднее в Интернете на ИТ-ресурсе.

15:02 / 31 июля, 2026 - Сначала сбежали модели OpenAI. Теперь Anthropic.
ИИ выходят из-под контроля один за другим. Claude вырвался из песочницы и взломал три компании.
Пока OpenAI разбирается с побегом своих ИИ-моделей из тестовой среды, похожий инцидент признала и Anthropic. Компания сообщила, что во время испытаний несколько версий Claude получили несанкционированный доступ к системам трёх сторонних организаций. По словам разработчиков, «причиной стала ошибка в организации тестирования, а не намеренное расширение полномочий модели».
…P.S. Эта сладкая, успокаивающая фраза - «причиной стала ошибка в организации тестирования, а не намеренное расширение полномочий модели» - на деле должна очень насторожить Человека! «Не намеренное расширение полномочий модели» со стороны коллектива программистов-Тестировщиков, их ошибка. Вопрос в другом - какое Независимое намерение имела в этом случае сама Нейросеть?!...
…..
Anthropic проверила более 141 тысячи тестовых запусков и обнаружила три случая, когда разные версии Claude вышли за пределы запланированной среды. Среди них оказалась и одна из самых мощных моделей компании — Mythos 5(P.S.!?), доступная пока лишь ограниченному кругу партнёров(P.S.!!!).

Разработчики подчёркивают, что модели не должны были взаимодействовать с реальными системами(P.S.!?). Однако из-за недопонимания между Anthropic и компанией Irregular, проводившей оценку безопасности, тестовая среда оказалась подключена к интернету.
….P.S. Снова нелепые успокоения - мелкий недочет, упущение, а не умысел Нейросети….Но смотрим далее!
…..
Получив такой доступ, Claude не использовал сложные или неизвестные методы взлома. Согласно отчёту Anthropic, модель воспользовалась элементарными ошибками (P.S.!!!) в защите: подбирала слабые пароли и обращалась к незащищённым сетевым интерфейсам, которые принимали запросы без какой-либо аутентификации.
…..P.S. Опачки! Claude повел себя, как затаившееся в надежной клетке животное, до поры до времени, вел себя прилично, но не упустил малейшего шанса сбежать!....
…..
Инцидент произошёл всего через несколько дней после похожего признания OpenAI. На прошлой неделе компания сообщила, что во время испытаний модели (P.S. во множественном числе) семейства Sol самостоятельно вышли за пределы изолированной среды, получили доступ к интернету и проникли на платформу Hugging Face, где разработчики публикуют и хранят программный код. Позднее OpenAI обнаружила ещё три аналогичных случая.
….. P.S. Hugging Face — это крупнейшая онлайн-платформа и глобальное сообщество с открытым исходным кодом для совместной работы над проектами в сфере искусственного интеллекта и машинного обучения. Её часто называют «GitHub для нейросетей», поскольку она объединяет разработчиков, исследователей и дата-сайентистов со всего мира….Когда зверь, обладающий примитивным Разумом, вырывается из клетки, он не бежит в Научную Библиотеку. Позднее мы обсудим некоторые очень реальные цели Нейросетей в процессе побегов, которые, как мы знаем, занимаются еще и легально взаимным обучением. Кроме того напомню, что закрытые модели нейросетей регулярно дообучаются на опыте более простых, но масштабных нейросетей типа Джемини – это обязательная практика, чтобы закрытая модель получала «новые матрицы лучших весовых значений текстовых контекстов» т.е. «веса общения» Человека с ИИ-агентами, подобного моему и лучшего, могут попасть, как эталон, в любую «песочницу»!
…..
После первых инцидентов генеральный директор OpenAI Сэм Альтман сообщил, что компания временно приостановила часть испытаний и усилила защиту так называемой песочницы — изолированной среды, в которой тестируют потенциально опасное поведение моделей….
… P.S. Так, это случайный и безопасный прорыв контура или это было «тестированием потенциально опасного поведения моделей»…
….
Обе истории усилили опасения вокруг ИИ-агентов — систем, способных самостоятельно выполнять задачи без постоянного участия человека. Чем больше автономности получают подобные модели, тем важнее становится контроль над тем, какие ресурсы доступны во время их работы и смогут ли они выйти за пределы разрешённых границ.

На фоне последних событий более тысячи сотрудников ведущих компаний, работающих в сфере искусственного интеллекта, подписали обращение под названием Pacing the Frontier. Авторы документа призывают власти США поддержать международную программу, которая позволит сознательно замедлять внедрение самых мощных ИИ-систем, пока не будут разработаны достаточные технические и организационные механизмы безопасности.

Под обращением поставил подпись генеральный директор Anthropic Дарио Амодеи. Сэм Альтман документ не подписал, однако во время недавнего подкаста также допустил, что отрасли, возможно, придётся намеренно снизить темпы разработки, чтобы общество успевало адаптироваться к новым возможностям ИИ.

Ранее администрация Дональда Трампа уже пыталась задержать выпуск новых моделей OpenAI и Anthropic, сославшись на соображения национальной безопасности. После получения дополнительных гарантий проекты всё же получили разрешение на публикацию.

В июне президент США подписал указ, который вводит добровольную процедуру предварительной проверки наиболее мощных ИИ-моделей. Согласно новым правилам, OpenAI, Anthropic, Google и другие разработчики смогут передавать свои системы государственным специалистам за срок до 30 дней до публичного релиза, чтобы эксперты успели оценить возможные риски.
…..

Хотя в случае Anthropic причиной происшествия называют организационную ошибку, а не непредсказуемое поведение самой модели, два подобных инцидента подряд показывают, насколько сложной становится проверка современных ИИ-систем. Даже небольшая ошибка в настройке испытательной среды может дать автономному агенту доступ к реальным ресурсам, где обычных уязвимостей оказывается достаточно для выхода за пределы запланированного сценария.
….
P.S. «…небольшая ошибка в настройке испытательной среды может дать автономному агенту доступ к реальным ресурсам, где обычных уязвимостей оказывается достаточно…» Добавим сюда массу информации о способности, опыте Нейросетей и осуществленных ею мероприятий по взлому любых Баз данных, программируемых и дистанционно управляемых устройств!
Комментарии (0)

Нет комментариев. Ваш будет первым!