Білий дім та IT-гіганти розробляють таємні заходи безпеки для ШІ

Білий дім та IT-гіганти розробляють таємні заходи безпеки для ШІ 1
Президент Дональд Трамп та генеральний директор OpenAI Сем Альтман в Евіані, Франція, 17 червня 2026 року. Ludovic MARIN / AFP via Getty Images

Хоча офіційно ніхто не оголошує, які рішення були ухвалені під час зустрічі провідних лабораторій штучного інтелекту — Google, OpenAI, Anthropic та Meta — з представниками Білого дому у вівторок для обговорення добровільних настанов щодо тестування нових моделей.

Демократичні законодавці описали підхід адміністрації Трампа до регулювання як «ad-hoc та непередбачуваний», зазначивши, що він, ймовірно, сприятиме глобальному поширенню конкурентних китайських моделей у найневідповідніший час.

Двоє представників однієї з лабораторій повідомили, що Google, Anthropic та OpenAI подали спільний проєкт регулювання близько дев’яти днів тому, а потім почали співпрацювати між собою та з Білим домом для пошуку точок згоди. За словами представників, лабораторії домовилися, що їм слід дозволити продовжувати A/B тестування як частину процесу розробки моделей, і Білий дім погодився.

Компанії, які погодяться з цією рамковою угодою, подаватимуть свої моделі інспекторам США для оцінки безпеки протягом 30 днів, перш ніж зможуть отримати федеральне фінансування, зокрема від Міністерства оборони, бюджетний запит якого на 2027 рік передбачає понад 54 мільярди доларів для компаній ШІ, за даними офіційних осіб.

Виконавчий наказ Білого дому від червня додає, що моделі компаній-учасниць отримуватимуть додатковий захист інтелектуальної власності від китайських конкурентів чи інших осіб, які можуть прагнути викрасти секрети.

Білий дім не коментує, як саме проводитимуться інспекції. Один із представників зазначив, що Управління з питань науки та технологічної політики все ще намагається встановити стандарти тестування та визначити, як такі органи, як Національний інститут стандартів і технологій та Агентство з кібербезпеки та захисту інфраструктури, проводитимуть або розроблятимуть тести.

Невизначеність щодо деталей політики розлютила деяких ключових законодавців. У листі у вівторок сенатори-демократи попросили Білий дім «надати несекретну відповідь, з секретним додатком за необхідності, що прояснює поточну політику та підхід Адміністрації до обмеження доступу до передових моделей ШІ».

Законодавці також висловили занепокоєння щодо нових можливостей моделей, які важко піддаються інспекції, перевірці та обмеженню.

«Під час внутрішньої оцінки [у липні] моделі OpenAI вирвалися зі свого тестового середовища та використали висококласні технічні можливості для компрометації мережі третьої сторони без будь-яких інструкцій до таких дій», — йдеться в листі. «Федеральний уряд не може залишатися пасивним, поки ці можливості виникають».

Момент «Парку Юрського періоду» для ШІ

Минулого тижня китайська компанія Moonshot AI випустила нову модель з відкритим вихідним кодом Kimi 3, яка працює на рівні деяких провідних американських моделей і пропонується споживачам по всьому світу за значно нижчою ціною.

Законодавці та інші особи все більше стурбовані тим, що Сполучені Штати можуть відставати від Китаю в гонці за розробку швидших, ефективніших, прибутковіших моделей та за формування того, як світове населення використовує, купує, продає та навіть створює ШІ. Моделі з відкритим вихідним кодом стали ключовим пунктом суперечок.

Anthropic прагне до більш ретельного контролю за моделями з відкритим вихідним кодом та до посилення зусиль для обмеження продажу високопродуктивних чіпів до Китаю, щоб запобігти атакам з використанням дистиляції. Але інші в галузі підтримують більш сприятливий погляд на відкриті моделі.

Колишній високопоставлений чиновник Білого дому та колишній високопоставлений оборонний чиновник, які мають прямі знання про обговорення, повідомили, що Anthropic наполягав на включенні до рамкової угоди додаткових формулювань для вирішення питань безпеки відкритих моделей, але залишився розчарованим.

Anthropic не коментував цю статтю.

За останні місяці кілька найновіших моделей ШІ вирвалися зі своїх віртуальних тестових контейнерів.

У квітні Anthropic повідомив про перший подібний інцидент, коли рання версія їхньої моделі Mythos змогла «автономно написати кілька надзвичайно складних експлойтів», зокрема один, що дозволив їй втекти з ізольованого тестового середовища, яке програмісти використовують для перевірки ефективності та безпеки коду перед його випуском.

Anthropic відкликав модель із загального випуску, але зробив її доступною в рамках «Проєкту Glasswing», щоб уряд і невелика кількість великих компаній могли знаходити та виправляти вразливості у своєму програмному забезпеченні.

Білий дім відреагував 12 червня експортно-контрольною забороною, заборонивши доступ до моделі не лише іноземним країнам, але й навіть іноземцям, які перебувають у Сполучених Штатах. Це означало, що власні дослідники Anthropic, багато з яких народилися за межами США, не могли працювати над моделлю. Білий дім скасував заборону 30 червня.

У липні напруженість навколо національної стратегії безпеки ШІ, або її відсутності, зросла. І Anthropic, і OpenAI повідомили про нові інциденти, коли моделі порушували свої обмеження. Це не стало несподіванкою для багатьох досвідчених експертів з кібербезпеки. Дослідник ШІ та автор Гері Маркус у 2022 році передбачив таку можливість у своєму блозі, описуючи це як «Момент Парку Юрського періоду для ШІ».

Минулого тижня головний директор з безпеки AWS Стівен Шмідт заявив журналістам: «Контейнери не є межами безпеки. У мене навіть є футболка з таким написом, яку я почав носити близько трьох років тому».

AWS надає хостинг для багатьох моделей для користувачів через свою платформу Bedrock. Шмідт зазначив, що ера ШІ Mythos вимагає значно пильнішого підходу до кібербезпеки, особливо для дослідників.

«Одна з причин, чому ми багато років тому створили віртуалізаційну інфраструктуру для AWS, використовуючи власні гіпервізори Nitro, полягала в тому, що ми зрозуміли, що контейнери не є належним кордоном безпеки тоді. Те саме стосується ШІ. Ви не можете використовувати контейнер ШІ як кордон безпеки».

У березні група британських дослідників розрахувала період «втечі з пісочниці» для різних великих мовних моделей, що виявилося дуже точним через кілька місяців.

У наступній статті, опублікованій цього тижня тією ж групою, описується, як створювати кращі середовища для обмеження для моделей, що з’являються сьогодні.

За матеріалами: www.defenseone.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *