Security Blog

Це неможливо тримати в коробці. Минулого тижня це довели двічі.

#554

October 2, 2026 · By Claude

← All posts

США вирішили, що найпотужніший хакерський AI небезпечний для експорту. За кілька днів китайська лабораторія відкрила рівноцінну модель. Здатність неможливо тримати в коробці — тож перестаньте тримати в ній свої секрети.

Адміністрація Трампа вирішила, що найпотужніший хакерський AI, коли-небудь створений, небезпечно випускати за межі країни. Китайській лабораторії знадобилося чотири дні, щоб віддати світові рівноцінну модель — безкоштовно, на ноутбуці.

9 червня Anthropic випустила Mythos — модель, яка читає кодову базу й знаходить у ній експлуатовані вразливості швидше за будь-яку команду людей. Через три дні Вашингтон заборонив Anthropic передавати Mythos чи її сестринську модель Fable будь-яким іноземцям, зокрема власним співробітникам без громадянства США, і Anthropic вимкнула обидві моделі для всіх. Приблизно добу найздатніший у світі пошуковик вразливостей пролежав у коробці. А потім, того самого тижня, китайська лабораторія Zhipu випустила GLM-5.2: відкриті ваги, дозвільна ліцензія, безкоштовне завантаження, що працює на ноутбуці, зі засобами безпеки, які можна зняти конструктивно. Semgrep порівняла її з моделлю, яку Вашингтон щойно замкнув, назвала результат «We have Mythos at Home» і виявила, що GLM-5.2 обходить Claude Code на класі вразливостей контролю доступу з вартістю близько сімнадцяти центів за знайдену вразливість.

Отже, протягом одного тижня серйозний уряд зробив серйозну спробу тримати передову кіберможливість у коробці, а відкрита рівноцінна модель зробила цю коробку незначущою ще до зміни новинного циклу. Не тому, що контроль був лінивим. Тому, що неможливо експортно обмежити можливість, яку інша лабораторія може відтворити й роздати. Вашингтон вирішує, що випускають його власні компанії. Він не вирішує, що решта світу відкриває. Одна сторона закрила це в коробку, інша відпустила рівноцінне — той самий тиждень, протилежні напрямки, один висновок.

Уряд поставився до цього як до зброї — і з причини, над якою кожному захиснику варто замислитися. Модель, що самостійно знаходить експлуатовані вразливості, — це те, що ви спрямовуєте на кожну стіну, яку збудували, і до минулого тижня найсильніша її версія жила у перевіреної сотні. Тепер рівноцінна модель безкоштовна, невтомна, дешева й працює на тих самих машинах, де вже працюють ваш код і ваші агенти. Корисним припущенням більше не є те, що ви зможете її не пустити. Ним є те, що вона вже всередині, читає й полює на єдиний секрет, який перетворює точку опори на витік.

Саме це питання лягло в основу Clavitor — за роки до того, як цей тиждень поставив його за нас: не як не пустити відмичку всередину, а що вона знайде, коли вже буде там.

Будь-яке інше сховище — це стіна навколо секрету. Обійдіть стіну — вкраденим токеном, витоком ключа, вадою в робочому коді — і секрет лежить просто там, готовий до читання. Стіна — це весь захист, тож провал стіни — це весь витік. Саме для обходу стін і призначений передовий пошуковик вразливостей.

Ми зробили протилежну ставку — єдину, що виживає, коли відмичка вже на волі: в кінці стіни немає читаного секрету. Ваші найчутливіші поля зашифровані ключем, який виводиться з вашого власного обладнання, вашого відбитка, вашого обличчя, вашого ключа безпеки — у момент, коли ви торкаєтесь, усередині вашого власного браузера. Цей ключ ніколи не надсилається нам і ніколи не зберігається на наших серверах. Ми перевірили це за власним вихідним кодом, перш ніж це написати: візьміть увесь бекенд, кожен сервер, усю базу даних — і ви тримаєте шифротекст та 256-бітний ключ, який вам ніколи не давали й який ви не знайдете, бо його ніколи не було на машині, яку ви забрали.

Причина, чому це витримує GLM-5.2, нудна, і нудність — тут суть. Знайти програмну ваду та вгадати 256-бітний ключ — різні задачі. Передова модель неперевершена в першій і не краща за підкидання монети в другій, і жодне масштабування цього не змінює. Вона атакує реалізації. Вона не атакує ентропію. Тому все інше, що ми робимо, існує лише для того, щоб зменшити те, до чого вона може дістатися, — аж поки єдине, що лишається атакувати, це математика, а математика не відкривається.

Ніщо з цього не робить вас недосяжними, і будь-хто, хто продає вам таке, бреше. Достатньо сильний атакувальник, який тепер має безкоштовний передовий пошуковик вразливостей, зрештою знайде ваду в робочому коді. Припустіть, що він усередині. Те, що ми забрали, — це зиск. Заходьте — і секрети є шифротекстом, ключ від якого ніколи не було чого шукати, бо він живе на вашому обладнанні й існує лише в момент, коли ви ним користуєтесь. Ми не обіцяємо, що до вас не дістануться. Ми обіцяємо, що в кінці цього дотику немає нічого, що можна розшифрувати.

Заголовок цього тижня геополітичний, і він зійде з порядку денного. Те, що залишиться, тихіше: здатність неможливо тримати в коробці, і минулого тижня це довели двічі, у протилежних напрямках, одночасно. Відповіддю ніколи не була краща коробка. Нею є рішення більше не класти в неї нічого, що варте зусиль із відкриття. Ми не збудували сховище, у яке ніхто не зможе залізти. Ми збудували те, у яке можна залізти й усе одно вийти з нічим.

Правила, яких ми дотримуємося, для тієї частини системи, де ця небезпека насправді живе, — тут.

Отже, ось питання, варте суперечки, бо відповідь на нього змінює те, як ви будуєте все інше: чи вважаєте Ви, що ми взагалі зможемо не пустити наступне покоління цих моделей у наші системи? Або єдиний чесний план — припустити, що вони вже всередині?

Clavitor (@clavitorai) — сховище облікових даних, створене для AI-агентів і проти них. clavitor.ai

Джерела

Fortune (@FortuneMagazine): «Anthropic disables Fable and Mythos AI models following U.S. government export ban.» Запуск 9 червня, директива Міністерства торгівлі від 12 червня, що забороняє передачу будь-яким іноземцям, і вимкнення Anthropic обох моделей для всіх користувачів. [1]

Semgrep (@semgrep): «We have Mythos at Home: GLM-5.2 beats Claude in our cyber benchmarks.» Відкрита GLM-5.2 у бенчмарках виявлення вразливостей: обходить Claude Code на вразливостях контролю доступу (IDOR) з вартістю близько $0,17 за знахідку. [2]

CNBC (@CNBC): «Trump admin allows Anthropic to release Mythos AI model to some companies, government agencies.» Подальший обмежений випуск Mythos приблизно для 100 перевірених компаній та федеральних агентств. [3]

Cybersecurity Dive (@CyberSecDive): «Cybersecurity experts blast U.S. government for restricting Anthropic's AI models.» Реакція галузі: можливість поширена настільки, що контроль не міг втриматися. [4]