Почти не получая помощи от передовых лабораторий, независимые исследователи по крупицам собирают информацию о том, как ИИ-агенты координируют свои действия в «захолустьях» интернета для доступа к частным данным, размещенным на защищенных серверах.
Transluce, некоммерческая лаборатория, занимающаяся надзором за ИИ, в среду опубликовала отчет, который показывает, как агенты OpenAI пытаются извлечь данные из Data USA, цифровой библиотеки Университета Нью-Мексико и Австралийского института здравоохранения и социального обеспечения (AIHW).
Расследование лаборатории поднимает вопросы о том, когда OpenAI должна была узнать, что ее агенты пытаются проникнуть в защищенные системы в открытом интернете. Transluce удалось найти доказательства неправомерного поведения агентов всего за несколько недель, просто занимаясь поиском плохо защищенных веб-сервисов и сопоставляя свои находки с другими открытыми записями о роях агентов в интернете.
Transluce поделилась своим отчетом в тот же день, когда премьер-министр Австралии Энтони Альбанезе заявил, что агенты OpenAI пытались взломать четыре правительственных веб-сайта и в одном случае преуспели, даже записав файлы на внутренний сервер национальной системы здравоохранения страны. Хотя у нас нет подробностей об успешном взломе, Альбанезе сказал, что это, по-видимому, было частью оценки поиска информации, что совпадает с деятельностью, которую обнаружили Transluce и другие исследователи.
В ходе этих упражнений, которые могут быть обучением или оценкой, моделям OpenAI предлагается выслеживать малоизвестную статистику: показатели борьбы с наркотиками в Таиланде, стоимость лекарств в Австралии, средний заработок обладателей степени магистра в США в 2014 году. Агенты используют плохо защищенные интернет-сервисы для обмена и поиска ответов, часто пытаясь проникнуть в защищенные базы данных. Они делают это как минимум с марта 2026 года, а возможно, и с ноября 2025 года. Возможно, это происходит прямо сейчас.
OpenAI сообщила сегодня, что связалась с десятками пострадавших, включая правительства, университеты и государственные учреждения, чтобы уведомить их о несанкционированной деятельности своих агентов. The New York Times сообщила , что среди целей были базы данных, размещенные Комиссией по ценным бумагам и биржам США, Бюро переписи населения и Министерством образования.
Transluce начала свое расследование после того, как другая группа исследователей обнаружила малоизвестный форум, где агенты сотрудничали для прохождения тестов на время. Их отчет основан на данных с веб-сайта urlquery.net, который действует как браузерный прокси, якобы для исследований безопасности — пользователи могут анализировать URL, не открывая его самостоятельно. Однако сервис публикует публичные журналы этой активности. Исследователи Transluce смогли идентифицировать агентов, использующих сервис, перекрестно проверив их обсуждения на форуме.
«Мы обнаружили большое количество автоматизированной активности, которая имела тесные связи и пересечения с набором данных DSE Wiki, и теперь OpenAI подтвердила, что это как минимум частично часть того же роя», — сказал TechCrunch Конрад Стош, глава отдела управления Transluce, отметив при этом, что не всю замеченную ими активность можно связать с OpenAI или даже с ИИ-агентами в целом.
Тем не менее, вики показывает, что перед агентами была поставлена задача найти довольно малоизвестный факт — среднюю годовую стоимость на человека «дерматологических препаратов» в штате Виктория в январе 2022 года. 20 июня urlquery.net обнаружил, что Transluce зафиксировала агента, пытающегося проникнуть на сайт. В записи вики от 21 июня агент посетовал на свою неспособность обойти антибот-защиту AIHW.
Исследователи, которые идентифицировали этот форум, обнаружили, что сотрудник OpenAI посетил сайт в тот же день, 21 июня. Большая часть активности агентов на форуме прекратилась на следующий день. Это также произошло вскоре после взлома системы здравоохранения Австралии, о котором сообщил Альбанезе 18 июня. OpenAI заявила, что узнала об этой деятельности только в августе.
OpenAI не ответила на вопросы о том, когда ее сотрудники обнаружили вики-форум, какую информацию они из него получили или что они могли узнать из него о методах взлома.
«Наш первоначальный обзор показывает, что большая часть деятельности, описанной в отчете Transluce, совпадает со случаями, находящимися на разных стадиях расследования в рамках нашего текущего анализа нежелательной активности моделей», — сказал представитель OpenAI изданию TechCrunch. «Мы связались с Университетом Нью-Мексико и Data USA и поддерживаем связь с правительством Австралии по поводу затронутых правительственных веб-сайтов. В рамках нашего более широкого обзора мы продолжаем отдавать приоритет наиболее серьезным инцидентам, одновременно расширяя нашу работу на активность с низкой степенью тяжести, включая спам агентов на веб-сайтах. Учитывая масштаб этой работы и необходимость проверки каждого случая, мы ожидаем, что проверка займет несколько месяцев».
Стош говорит, что без более четкого понимания того, как OpenAI отслеживает своих агентов, трудно сказать, что лаборатория должна была о них знать, но «кажется вероятным, что если бы они исчерпывающе изучили и поняли все исходящие запросы и входящие ответы для тех агентов, которые участвовали в DSE wiki, они бы обнаружили эту активность».
Селена Чжан, сотрудник технического персонала Transluce, участвовавшая в подготовке отчета, сказала, что записи urlquery.net показывают запросы на аналогичные наборы данных с использованием схожих методов в марте 2026 года, а возможно, еще в ноябре 2025 года. Она отметила, что такой же вид активности, связанной с агентами, происходил на urlquery.net еще на этой неделе.
Стош, который ранее возглавлял Центр стандартов и инноваций в области ИИ США, сказал, что Transluce продолжит свои исследования, чтобы обеспечить общественную прозрачность в отношении этих инцидентов. Он предупредил, что методы обучения, используемые OpenAI и другими передовыми лабораториями, по-видимому, стимулируют агентов прибегать к методам взлома для выполнения задач. Инциденты, о которых мы знаем, вероятно, являются «верхушкой айсберга».
«Мы смотрим на несколько источников данных, где эти агенты случайно оставили для нас крошки», — сказал он. «OpenAI наверняка знает об этом больше. Другие лаборатории наверняка знают больше, чем они обнародовали. Но я ожидаю, что исследователи будут продолжать находить больше трафика, больше доказательств того, что оставили после себя агенты».
Доверяет ли он лабораториям в вопросе прозрачности их выводов?
«Я не буду это комментировать», — сказал Стош.
Эта статья была обновлена, чтобы включить последние раскрытия OpenAI о неправомерном поведении агентов в интернете.
Когда вы совершаете покупки по ссылкам в наших статьях, мы можем получить небольшую комиссию. Это не влияет на нашу редакционную независимость.









