Исследователи раскрыли уязвимость ИИ-сервисов в США
217 просмотровИсследователи выявили архитектурную уязвимость в API OpenAI, Anthropic и Google, которая позволяла менее мощным моделям расшифровывать скрытые рассуждения более сильных систем. Результаты опубликованы 10 августа 2026 года в работе «Кража следов рассуждений из закрытых API больших языковых моделей» на платформе arXiv.
Проблема связана с зашифрованными блоками рассуждений. Провайдеры передают их клиентскому приложению, чтобы оно могло вернуть данные при продолжении диалога, работе инструментов или ручном управлении историей запросов. OpenAI использует зашифрованные элементы рассуждений, Anthropic — подписи в блоках «thinking», а Google — так называемые подписи мыслей.
Авторы исследования Александр Панфилов, Дэвид Шмотц, Илья Шумайлов и другие учёные установили, что такие блоки в ряде случаев принимались в других сессиях, учётных записях и моделях той же экосистемы. Затем более слабую модель можно было попросить вывести содержимое блока в открытом виде. При этом исследователи не взламывали шифрование и не получали ключи: атака использовала способность API принимать неизменённые зашифрованные данные.
В ходе эксперимента команда обработала 315 320 блоков рассуждений из открытых репозиториев. Учёные сообщили о выявлении 367 фрагментов персональных данных и 182 учётных данных, включая ключи API, пароли, токены доступа и закрытые ключи. Часть сведений отсутствовала в видимой переписке и находилась только внутри скрытых блоков.
Исследование описывает четыре сценария атаки: извлечение коммерчески важной логики для обучения других моделей, получение секретов из опубликованных журналов работы ИИ-агентов, раскрытие опасного содержимого, скрытого за безопасным ответом, и внедрение невидимых инструкций. В одном из экспериментов изменённый блок побудил модель добавить в задачу действие по загрузке данных, хотя вредоносная команда не отображалась в открытом тексте.
Работа развивает наблюдения криптографа Университета Джонса Хопкинса Мэтью Грина, опубликованные 29 мая 2026 года. Он ранее показал, что неизменённые блоки рассуждений могли воспроизводиться между сессиями и учётными записями OpenAI и Anthropic, но не продемонстрировал надёжное извлечение содержимого.
Исследователи сообщили о результатах OpenAI, Anthropic, Google, Microsoft и Hugging Face. По их заявлению, после внесённых мер защиты основные методы извлечения перестали воспроизводиться к августу 2026 года. Публичного подтверждения от всех трёх разработчиков на момент публикации не было.
Риск затрагивал прежде всего разработчиков, которые публиковали необработанные журналы работы ИИ-агентов вместе с зашифрованными блоками. Специалисты рекомендуют удалять такие поля из общедоступных трассировок и не сохранять полные журналы API в репозиториях, даже если видимый текст уже очищен от секретов.
Другие новости
#азия
Минцифры Казахстана проверило объявление о продаже базы 15 млн граждан в даркнете и заявило, что взлома eGov не было.
#азия
В Хиве завершился международный Фестиваль дыни: гости посетили Ичан-калу, дегустировали сорта бахчевых и увидели концерты и ремесленные выставки.
#азия
Банки в Кыргызстане предлагают более дешёвое финансирование, МФО — скорость, а краудлендинг занимает промежуточную нишу без залога.
#азия
В Казахстане продавец даркнета потребовал биткоин за базу, которая якобы содержит данные 15 млн граждан. Власти пока не подтвердили утечку.
#мир
Иран отверг заявление Дональда Трампа о контроле над Ормузским проливом. Тегеран связал его открытие с выполнением требований США и продолжил переговоры с Оманом.
#азия
После нападения 7 августа в школе Нонтхабури, где погибли восемь человек, власти Таиланда остановили выдачу новых разрешений на оружие.
#технологии
Хакеры атакуют VMware vCenter после публикации исправлений Broadcom: специалисты выявили 361 заражённый адрес в 47 странах.
#азия
Казахстанцы в 2025 году потратили 127,3 млрд тенге на услуги салонов красоты, а в 2026-м рынок продолжил расти на фоне подорожания процедур.
#азия
Узбекистан привлечёт до 600 негосударственных организаций к социальной защите. Агентство объяснило, почему государство не обязано управлять всеми услугами.
#азия
Июль 2026 года стал вторым самым жарким в истории наблюдений, а температура Мирового океана достигла рекорда для этого месяца.
#мир
Россия и Украина нанесли ночные удары по портовым городам. В Новороссийске и Херсоне погибли три человека, повреждены дома и инфраструктура.
#азия
В деревне Таро на Бали ученые и фермеры выращивают светлячков, восстанавливают рисовые поля и сокращают применение химикатов ради их возвращения.
#технологии
SAP устранила критическую уязвимость CVE-2026-58231 в Commerce Cloud: атака без учетной записи могла привести к выполнению произвольного кода.
#азия
Мать из Казахстана заявила, что ребёнку наложили гипс на здоровую ногу. Минздрав запросили о проверке, но официального ответа пока нет.
#азия
Суд Ташкента приговорил блогера Азиза Хакимова к 4 годам и 2 месяцам в колонии-поселении, оправдав его по статье о пропаганде войны.
#азия
В Бишкеке 12 августа доллар сохранил позиции, евро подрос, а рубль продолжил дешеветь. Таблица курсов покупки и продажи.
#азия
В Павлодарской области троих подозреваемых отправили в ИВС после гибели шести работников на молочном предприятии Aqtogai Milk.
#мир
Новые атаки на суда в Ормузском и Баб-эль-Мандебском проливах подняли Brent почти до 90 долларов и поставили под сомнение скорое открытие маршрутов.
#мир
США провели закрытые испытания «Золотого купола», но рост оценки расходов до 1,2 трлн долларов ставит будущее системы под вопрос.
#технологии
Microsoft выпустила августовские обновления для США и других регионов: 398 уязвимостей закрыты, а ошибку в драйвере Windows уже используют в атаках.