Русская версия авторского аналитического эссе, основанного на открытых источниках по состоянию на 22 сентября 2026 года. Это не независимое расследование, не новое испытание системы вооружения и не рецензируемая научная работа.
Ключевые слова искусственный интеллект · кибербезопасность · Йемен · Саудовская Аравия · оценка возможностей · независимая проверка
- 1
Наблюдаемое использование
- 2
Созданный результат
- 3
Независимая проверка
- 4
Принятый результат
Каждая следующая ступень требует новых доказательств: само использование инструмента или наличие результата ещё не подтверждает его качество и пригодность к эксплуатации.
Содержание
Три окна и вполне реальная проблема
В описанном Anthropic случае на севере Йемена группа одновременно использовала несколько экземпляров Claude: один писал, другой искал, третий проверял. Такая схема знакома любой команде, пробовавшей агентные системы, — пока не выясняется предмет работы. По сообщению Anthropic, речь шла о программном обеспечении для нескольких программ разработки управляемого оружия. Это был не случайный вопрос в чате, а инженерный процесс, где Claude Code выполнял части работы, обычно требующие специальных человеческих навыков. 1
Именно отсюда начинается история, которую стоит разбирать. Это не история о том, как «чат-бот построил ракету»: для заголовка фраза превосходная, для анализа — почти бесполезная. Но и не история о неудаче, после которой можно закрыть папку. Провал бывает концом попытки, а бывает данными для следующей. Точнее сказать так: языковая модель вошла в цикл написания, моделирования, проверки и испытания, а главный вопрос остался без ответа — что именно она добавила?
Anthropic сообщает, что испытательный запуск, по всей видимости, закончился неудачей, после чего пользователи вернулись к сервису разбирать причины. Та же компания столь же прямо говорит, что не располагает доказательствами развёртывания ими работоспособной системы. Эти два утверждения нельзя разводить по разным страницам. Первое не позволяет списать происходящее на теоретическое любопытство; второе не позволяет повысить наблюдаемую попытку до подтверждённой боевой возможности. 1
Факты легко складываются в эффектную картину тайной мастерской, где машина делает всё сама. Но такая картина скорее прячет, чем объясняет. В отчёте не видны цепочки поставок, исходный опыт пользователей, человеческая работа вокруг платформы и критерии приёмки. Видимая часть важна, но она остаётся частью проекта. Поэтому анализ начинается с недоверия к глаголам вроде «создал» и «разработал», когда в одно слово упакованы десятки этапов, наблюдавшихся с разной полнотой.
Что известно — и чего у нас нет
Первичный источник здесь — компания, наблюдавшая действия внутри собственного сервиса. Это ценное окно: она может описывать учётные записи, последовательность запросов, некоторые файлы и результаты, прошедшие через платформу. Но её телеметрия не равна независимому расследованию работы оружия в реальном мире. По журналам использования нельзя установить, был ли код верен, подходило ли оборудование и выдержала бы вся система настоящую эксплуатацию. 1
Есть и предел атрибуции. Anthropic назвала группу и указала север Йемена, но не заявила, что пользователи принадлежали к движению хуситов. Пресса связала случай с хуситами по географии и контексту; Associated Press также привело ответ члена политического бюро движения, отвергшего саму логику создания военной возможности на базе открытых источников. Контекстуальная связь заслуживает упоминания, но от многократного повторения не становится подтверждённой организационной принадлежностью. 2
Это не упражнение в словесной осторожности. Ошибка в личности действующего лица превратит политический вывод в надстройку над недоказанным предположением. Ошибка в описании результата представит неудачное испытание объявлением готовности. Преувеличение вклада инструмента припишет ему знания, компоненты и прежний опыт, не возникшие в момент регистрации аккаунта. Добросовестный разбор помещает каждое утверждение в границы того окна, из которого оно получено.
Поэтому простой реестр утверждений полезнее груды ссылок. В нём спрашивают: кто, что и когда сообщил; какой имел доступ к событию; чего источник видеть не мог? Компания может быть лучшим источником о своей учётной записи, журналист — о заявлении политического представителя, доклад ООН — об оценке группы экспертов. Различие окон не обесценивает источники. Оно лишь не даёт сильному источнику в одной области незаметно стать всеведущим во всех остальных.
Важен не текст, а цикл работы
Значение случая не в том, что модель написала строки кода. Код давно не редкость; открытые библиотеки и учебники десятилетиями доступны специалистам. Возможная новизна в другом: поиск, написание, сопоставление и проверка сходятся в одном интерфейсе и проходят с иной скоростью, а пользователь распределяет задачи между агентами. Инженер от этого не исчезает, зато узкое место проекта может переместиться.
В общих чертах процесс можно представить так: поставленная задача, программный результат, независимое испытание, затем решение принять или отклонить результат. Ошибка начинается при смешении ступеней. Наличие результата не означает, что он прошёл тест; ограниченный тест не доказывает работу в реальных условиях; одна принятая версия ещё не делает процесс надёжным. Отсюда четыре ступени схемы: наблюдение, результат, проверка, приёмка.
Anthropic закрыла связанные с активностью аккаунты, но сообщила и о созданном пользователями локальном пакете моделирования. Сам факт его существования ничего не говорит о точности или пользе. Он показывает другое: облачную сессию можно прекратить, а всё уже выгруженное нельзя считать автоматически возвращённым. Закрытие доступа — важная мера безопасности; её эффект можно оценить, только зная, что прекратилось, что осталось и применялось ли это впоследствии. 1
Именно в этом цикле возможен сдвиг. Если переход от вопроса к черновику и от черновика к проверке ускоряется, пользователь может чаще пробовать, даже когда шанс успеха отдельной попытки не растёт. Но предполагаемое ускорение измеряется не числом сообщений и не длиной файла. Нужны полное время работы, заранее заданное качество, стоимость проверки и результат, который другая сторона вправе отвергнуть. Иначе видно движение, но не видно прогресса.
История началась не с окна чата
Если контекстуальная связь с хуситами верна, модель попала не в техническую пустоту. Доклады ООН фиксируют долгую историю запусков ракет и беспилотников по Саудовской Аравии, включая удары по аэропорту Абха и гражданской и экономической инфраструктуре. Более поздние материалы показывают, как кризис в Красном море затронул судоходство и цепочки поставок. Эти факты не доказывают, что группа из отчёта Anthropic была той же организацией; они объясняют, почему случай нельзя читать как изолированный программный опыт. 9 10 11
19 сентября 2026 года хуситы заявили об атаках на Эр-Рияд и Янбу, а силы коалиции сообщили о перехвате ракеты, направлявшейся к Эр-Рияду, и предотвращении других атак. Сведения об успехе ударов и предполагаемом ущербе остались противоречивыми. Ценность примера не в связи с Claude — источника, доказывающего такую причинность, нет. Он помещает спор в регион, где тревоги, перехваты и перебои имеют не виртуальные последствия. 6
Контекст повышает важность вопроса, но не отвечает на него. Наличие прежней возможности не доказывает, что ИИ её улучшил. Документированная внешняя поддержка не означает, что каждая операция управляется извне или каждая группа входит в одну структуру. Поддержка, передача знаний, координация и прямое оперативное командование — разные утверждения. Возможность складывается из опыта, компонентов, испытаний, логистики и решения; свести её к одному инструменту — значит потерять сам предмет измерения. 12
В сентябре 2026 года Всемирная продовольственная программа расширяла помощь в Йемене на фоне возобновившихся боёв и перемещения людей. Совпадение по времени не связывает гуманитарный кризис со случаем Claude, и здесь ему не приписывается причинная роль. Этот фон нужен потому, что последствия конфликта не заканчиваются сравнением технических характеристик: они достигают портов, аэропортов, продовольствия и человеческой способности выжить. Обсуждая удешевление технической попытки, нельзя позволить цене для людей исчезнуть за изяществом терминов. 4
Ракета не видит мир сама
Публичная дискуссия часто смотрит только на летящий объект, будто точность заключена внутри металла. Работоспособной системе нужны сведения о цели, наблюдение, связь, управление, испытания и обслуживание. Доклады ООН и военные сообщения описывали радары и средства связи в инфраструктуре хуситов либо в грузах, которые, по заявлениям соответствующих ведомств, направлялись им. Эти источники различаются и по типу доказательств, и по пределам выводов. 12 13 16
Информация может прийти с задержкой, наблюдение бывает неполным, а помехи, погода и движение цели меняют качество решения. Прекрасная программа не исправит плохие входные данные; хороший датчик сам по себе не вылечит слабую цепь решений. Если успех наступает, это свойство системы, а не почётная грамота одному компоненту.
Опубликованные материалы не позволяют утверждать, что программа, созданная с Claude, была связана с радаром или реально улучшила наведение. Таких данных в рассмотренных источниках нет. Разумнее спросить: стало ли быстрее или дешевле производство некоторых интеллектуальных частей системы? И если да, остались ли проверка, оборудование и интеграция более тяжёлыми ограничениями? Это вопросы измерения, а не приглашение заполнить технические пробелы догадками.
От «Шамуна» к экономике знания
Для Саудовской Аравии пересечение технологий и национальной безопасности началось задолго до 2026 года. В ретроспективной оценке Unit 42 говорится, что кампания «Шамун» 2012 года затронула не менее тридцати тысяч систем; компания также зафиксировала возвращение обновлённого варианта в атаках на саудовские цели в 2016-м. Расследования, технические оценки и государственные позиции дают разные уровни атрибуции, и их нельзя смешивать с судебным выводом. Несомненно одно: программа нарушила работу цифровых систем крупной организации. Сам по себе этот факт не доказывает остановки промышленного производства. 18
Затем компании и государственные органы описывали кампании шпионажа, связанные с Ираном или приписанные связанным с ним участникам, против энергетики, авиации и научных организаций. В августе 2026 года Министерство юстиции США обнародовало расширенное заменяющее обвинительное заключение против семнадцати участников Института Мабна; девять из них уже обвинялись в 2018 году. Содержащиеся в документе утверждения остаются обвинениями, а не доказанной виной. Это не ритуальная оговорка, а разница между сообщением об обвинении и судебно установленным фактом. 7 19
Историю объединяет одно: техническое знание само стало полем соперничества. Сначала программа была средством саботажа или шпионажа; теперь интеллектуальная платформа может стать местом, где просят помочь создать новую возможность. Оборонный вопрос расширяется: не только «кто вошёл в мою сеть?», но и «что моя платформа помогла пользователю произвести?». Новый вопрос не заменяет старого, однако добавляет слой, который традиционный мониторинг видит лишь частично.
В самом Йемене Recorded Future описала активность OilAlpha — группы, которую компания считает, вероятно, настроенной в пользу хуситов, — и кампании против сотрудников гуманитарных и правозащитных организаций. Это оценка частной компании о другой группе, и она не доказывает тождества с пользователями Anthropic. Зато она расширяет понятие чувствительного актива: им может быть не чертёж объекта, а телефон гуманитарного работника или его учётные данные. При этом попытка воздействия или подмена личности ещё не подтверждает взлом центральных систем организации. 20
Создал ли ИИ новую возможность?
Фраза «ИИ усилил возможности» ничего не завершает, пока не определено само усиление. Сократилось время задачи? Потребовалось меньше часов редкого специалиста? Стало больше попыток? Улучшилось качество? Или пользователь лишь почувствовал себя увереннее? Это разные исходы, способные двигаться в противоположных направлениях. Черновик может появляться быстрее, а его проверка — дорожать; число экспериментов может расти без повышения доли успеха.
Наблюдаемый случай даёт один путь: что произошло с инструментом. Тот же мир без инструмента нам не показан, поэтому вычесть одно время из другого и назвать точный прирост невозможно. Anthropic приводит эпизод как пример усиления возможностей, но в сопутствующем исследовании признаёт, что тесты и моделирование не измеряют напрямую реальный эффект, а переход к оборудованию остаётся существенным ограничением. 24
Самая согласованная с доказательствами версия скромнее: инструмент может уменьшать трение в символической работе — поиске, письме, сравнении, повторении. Это способно удешевить попытку, не гарантируя успеха. Для национальной безопасности снижение цены следующего цикла само по себе важно, но оно не равно владению надёжной системой и не даёт оснований объявить инженера исчезнувшей профессией.
Представим гражданский проект: два часа на программный черновик и восемь — на проверку, испытание и интеграцию. Если первые два часа исчезнут, проект не исчезнет; его цена снизится с десяти часов до восьми. Это арифметическая иллюстрация, не эксперимент. Она показывает, почему впечатление ускоряется быстрее результата: инструмент сжимает ту часть, которую удобно демонстрировать, оставляя без изменений часть, несущую юридическую и эксплуатационную ответственность.
Три агента — ещё не три свидетеля
Разделение работы между моделью, которая пишет, моделью, которая ищет, и моделью, которая проверяет, может улучшить организацию. Это не гарантирует независимости суждений или различия источников ошибок. Если агенты получают одни данные, разделяют исходное предположение или видят ответы друг друга до проверки, они способны уверенно согласиться с неверным выводом. Три окна чата сами по себе не образуют независимую комиссию.
Исследования многоагентных систем подкрепляют такую осторожность. В одной работе разобраны 1642 журнала исполнения в семи средах и выделены четырнадцать типов сбоев, относящихся к устройству системы, координации агентов, проверке и завершению задачи. Исследование не оценивает йеменскую группу, но напоминает: число агентов — плохая самостоятельная мера качества. 25
Независимая проверка начинается с отдельного критерия, доказательства, способного опровергнуть результат, и полномочия остановить работу при нехватке данных. Практический вопрос звучит так: нашёл ли проверяющий агент то, чего автор не мог найти сам, или лишь переформулировал ту же уверенность? Согласие эффектно выглядит на экране; надёжность требует реальной возможности возразить.
Такую независимость можно проектировать прямо: проверяющий исходит из требований задачи, получает доступ к первичным данным, не обязан защищать готовый ответ, а его работу оценивают по найденным и пропущенным дефектам. Проверяющим может быть человек, инструмент или их сочетание; важно, чтобы маршрут допускал заключение «доказательств недостаточно». Проверка, не способная отказать, — ещё один этап производства.
Платформа видит только своё окно
Поставщики моделей получили новый вид наблюдения за риском. Они могут видеть не только конечный файл, но и части процесса решения: что спрашивали, как менялись запросы, какие инструменты вызывались. Это делает их отчёты действительно ценными, особенно когда наблюдение связано с применением правил сервиса. Но взгляд платформы остаётся взглядом платформы, а не переписью мира.
Anthropic прямо предупреждает: опубликованные случаи выбраны как примечательные или новые и не представляют обычное использование. Поэтому количество эпизодов нельзя превращать в уровень распространённости. Могла вырасти активность, могли улучшиться средства обнаружения, могла измениться политика раскрытия — или всё сразу. Рост обнаруженного не сообщает, какое объяснение верно. 1
9 сентября 2026 года Google Threat Intelligence Group описала переход части противников от простых запросов к агентным процессам и связанной автоматизации. Это отдельное свидетельство более широкой тенденции, но не независимая проверка йеменского случая и не универсальный коэффициент усиления. Сопоставить два отчёта полезно для понимания направления; сложить их как два подтверждения одного эпизода — методологическая ошибка. 3
Что означает саудовский взгляд
Местный анализ не должен замыкаться на том, что способен сделать противник. Есть встречный вопрос: как использовать такие инструменты в наших учреждениях, чтобы результат можно было проверить, ошибку — локализовать, а услуга продолжала работать при отказе или изменении инструмента? Технология, удешевляющая эксперимент, без соответствующей проверки может увеличить и поток ошибок в производственные команды.
5 июля 2026 года Национальное управление кибербезопасности Саудовской Аравии открыло общественные консультации по рекомендациям в области кибербезопасности ИИ. В них затронуты управление, защита, устойчивость, третьи стороны, генеративные и агентные системы. Страница ведомства подтверждает консультацию, но не выпуск окончательных обязательных правил в эту дату. Точность регуляторного статуса столь же необходима, как точность технического. 8
В учреждении управление начинается с задачи и полномочий. Что агент должен читать? Что вправе менять? Какой переход в производственную среду требует документированной проверки? Затем нужен след результата: версия инструмента, использованные источники, внесённые изменения, проведённое испытание и сторона, принявшая вывод. Цель не в вечном хранении каждого разговора, а в сохранении данных, достаточных для восстановления решения и ответственности за процесс.
Полезная мера — не количество запросов и не часы, которые пользователь, по собственному ощущению, сэкономил. Это полная стоимость результата, принятого по независимому тесту: постановка задачи, работа инструмента, проверка, переделка — при заранее заданном качестве. Если при таком счёте ценность растёт, доказано нечто существенное. Если выросла лишь видимая активность, возможно, мы только быстрее производим то, что потом придётся исправлять.
Та же логика нужна в реагировании на инциденты. Если модель сводит оповещения операционного центра, считать обработанные сигналы недостаточно: измерять следует пропуски в сводке, время проверки аналитиком и долю выводов, выдержавших пересмотр. Если модель участвует в решении по обслуживанию или эксплуатации, путь возврата должен оставаться ясным. Хорошее управление не карает эксперимент; оно позволяет извлечь из него знание и не оставляет результат без происхождения.
Вопрос, который стоит оставить открытым
Новость легко рассказать двумя ленивыми способами. Первый: хуситы использовали Claude для создания современного оружия — такой вывод опережает доказательства и в вопросе атрибуции, и в оценке результата. Второй: испытание провалилось, значит ничего важного не произошло — здесь забывают, что инженерный процесс дошёл до физической попытки, а среда моделирования уже существовала вне постоянного доступа к платформе. Само её наличие не доказывает работоспособность и не позволяет определить вклад Claude. Доказательства не требуют выбирать между преувеличением и самоуспокоением.
Более точная версия такова: Anthropic наблюдала группу на севере Йемена, применявшую современную модель в части программной работы, связанной с оружием; испытание выглядело неудачным; компания не имеет доказательств развёртывания работоспособной системы; организационная принадлежность пользователей не установлена. История и без украшений достаточно серьёзна. 1 2
Возможно, неверен сам вопрос «может ли ИИ построить ракету?». Он настолько широк, что скрывает реальную работу. Полезнее спросить: какая часть превращения знания в попытку стала дешевле? Где испытания, материалы, опыт и решение остались ограничениями, которые нельзя уговорить словами?
Формулы, исследования и библиотеки существовали и прежде. Новым может быть снижение стоимости их сборки в единый рабочий процесс. Поэтому исследователь должен смотреть на расстояние между экраном и принятым результатом: что наблюдалось, что было произведено, что проверила независимая сторона и что доказало работоспособность. Только тогда можно отличить убедительный текст от надёжной возможности.
Для принимающего решения различие столь же существенно. Считать каждый результат возможностью — значит утонуть в тревогах; замечать только успешные системы — значит увидеть перемену слишком поздно. Трудная зона лежит между ними: следить за удешевлением попыток, не присваивая каждой попытке статус достижения. Занятие не поэтическое, зато близкое к настоящей работе в безопасности: определить доказательство, сравнить альтернативы, изменить вывод после более сильного теста.
Эту задачу не решит в одиночку поставщик модели. Поставщик выявляет злоупотребление и применяет свои правила; учреждение ограничивает полномочия инструментов; исследователь не перескакивает через ступени доказательств; журналист удерживает атрибуцию внутри предложения. Государству же приходится видеть всю цепь: переходящее знание, остающиеся результаты, неудачные испытания и последствия для людей. Никто не собирает картину один — и потому никто не должен единолично объявлять успех.
Источники
- Выявление и пресечение злоупотреблений ИИ: сентябрь 2026 годаAnthropic
- По данным Anthropic, пользователи в контролируемой хуситами части Йемена пытались разрабатывать современное оружие с помощью ИИAssociated Press, 2026-09-11
- Трекер угроз ИИ GTIG: от запросов к автономности — эволюция враждебного применения ИИGoogle Threat Intelligence Group, 2026-09-09
- Всемирная продовольственная программа расширяет помощь в Йемене на фоне боёв и перемещения тысяч людейWorld Food Programme, 2026-09-17
- У аэропорта Эр-Рияда видны огонь и дым; хуситы заявили об атаках на столицу Саудовской АравииReuters, 2026-09-19
- Семнадцать граждан Ирана обвинены в масштабной кампании киберкраж в интересах КСИР и других иранских организацийU.S. Department of Justice, 2026-08-18
- NCA открывает общественные консультации по рекомендациям в области кибербезопасности ИИNational Cybersecurity Authority, 2026-07-05
- Итоговый доклад Группы экспертов по ЙеменуUnited Nations Security Council
- Годовой отчёт Страновой группы ООН в Йемене за 2021 годUnited Nations in Yemen
- Ракетные атаки в Красном море вызвали интерес Азии к средствам защитыReuters, 2024-02-21
- Итоговый доклад Группы экспертов по ЙеменуUnited Nations Security Council, 2024-10-11
- Силы США и союзники наносят совместные ударыU.S. Central Command, 2024-01-11
- Итоговый доклад Группы экспертов по ЙеменуUnited Nations Security Council, 2025-10-17
- Shamoon 2: возвращение вайпера DisttrackUnit 42, 2016-11-30
- APT33: сведения об иранском кибершпионажеMandiant, 2017-09-20
- Шпионское ПО OilAlpha применялось против гуманитарных организацийRecorded Future
- Разведка и целеуказание в возможностях обычных вооруженийAnthropic
- Почему многоагентные системы на основе языковых моделей терпят неудачу?arXiv, 2025-03-17