Onu bir kutuda tutamazsınız. Geçen hafta bunu iki kez kanıtladı.
ABD, en güçlü sızma yapay zekâsının ihracatı için fazla tehlikeli olduğuna karar verdi. Günler sonra bir Çin laboratuvarı eşdeğerini açık kaynak yayımladı. Bir yeteneği kutuda tutamazsınız; sırlarınızı da bir kutuda tutmayı bırakın.
Trump yönetimi, şimdiye kadar geliştirilmiş en güçlü sızma yapay zekâsının ülkeden çıkması için fazla tehlikeli olduğuna karar verdi. Bir Çin laboratuvarının dünyaya eşdeğerini, ücretsiz biçimde ve bir dizüstü bilgisayarda çalışacak şekilde sunması dört gün aldı.
9 Haziran'da Anthropic, bir kod tabanını okuyup içindeki istismar edilebilir açıkları herhangi bir insan ekibinden daha hızlı bulan bir model olan Mythos'u yayımladı. Üç gün sonra Washington, Anthropic'in Mythos'u ya da kardeşi Fable'ı kendi vatandaş olmayan personeli de dâhil hiçbir yabancı uyrukluya vermesini yasakladı ve Anthropic her iki modeli de herkes için kapattı. Yaklaşık bir gün boyunca dünyanın en yetenekli hata bulma yapay zekâsı bir kutunun içinde kaldı. Ardından, aynı hafta içinde Çin laboratuvarı Zhipu, GLM-5.2'yi yayımladı: açık ağırlıklar, geniş izinler veren bir lisans, dizüstü bilgisayarda çalışan ücretsiz bir indirme ve güvenlik denetimleri tasarım gereği çıkarılabilir biçimde. Semgrep bunu Washington'ın az önce kilitlemiş olduğu modelle karşılaştırdı, sonucu "We have Mythos at Home" başlığıyla yayımladı ve GLM-5.2'nin bir erişim denetimi hatası sınıfında Claude Code'u, bulunan her açık için yaklaşık on yedi sent maliyetle geçtiğini tespit etti.
Yani tek bir hafta içinde ciddi bir hükümet, ileri düzey bir siber yeteneği kutuda tutmak için ciddi bir girişimde bulundu; açık ağırlıklı eşdeğeri ise haber döngüsü dönmeden kutuyu anlamsız kıldı. Denetim özensiz olduğu için değil. Başka bir laboratuvarın yeniden inşa edip bedava dağıtabileceği bir yeteneği ihracat denetimine tabi tutamazsınız. Washington kendi şirketlerinin neyi dağıtıp dağıtacağına karar verir. Dünyanın geri kalanının neyi açık kaynak yayımladığına karar vermez. Bir taraf onu kutuya kapattı, diğer taraf eşdeğerini özgür bıraktı; aynı hafta, zıt yönlerde, tek bir sonuç.
Bir hükümet bunu bir silah gibi gördü; her savunmacının üzerine düşünmesi gereken bir nedenle. Otonom olarak istismar edilebilir açıklar bulan bir model, kurduğunuz her duvara doğrultacağınız modeldir ve geçen haftaya kadar bunun en güçlü sürümü, hakları doğrulanmış yüz kişiyle birlikte yaşıyordu. Şimdi eşdeğeri ücretsiz, yorulmaz, ucuz ve kodunuzun ile ajanlarınızın zaten üzerinde çalıştığı makinelerde çalışıyor. Artık işe yarayan varsayım, onu dışarıda tutabileceğiniz değil. Zaten içeride olduğu, okuduğu, ilk dayanak noktasını bir ihlale dönüştürecek o tek sırrı avladığıdır.
Clavitor'u etrafında kurduğumuz soru budur ve bunu bu haftanın bizim yerimize sormasından yıllar önce sorduk: maymuncuğu dışarıda nasıl tutarız değil, içeri girdiğinde ne bulur.
Diğer her kasa, bir sırrın etrafına örülmüş bir duvardır. Çalınmış bir belirteç, sızdırılmış bir anahtar, çalışan koddaki bir açık yoluyla duvarı aşın; sır okunmayı bekler. Duvar savunmanın tamamıdır, dolayısıyla duvarın düşmesi ihlalin tamamıdır. Duvarları aşmak tam da ileri düzey bir açık bulucusunun işidir.
Biz zıt bahsi oynadık; maymuncuk etrafa salındığında ayakta kalan tek bahsi: duvarın sonunda okunabilir bir sır yoktur. En hassas alanlarınız, kendi donanımınızdan, parmak izinizden, yüzünüzden, güvenlik anahtarınızdan — kendi tarayıcınızın içinde ve ona dokunduğunuz anda — türetilen bir anahtarla şifrelenir. Bu anahtar bize asla gönderilmez ve sunucularımızda asla saklanmaz. Bunu yazmadan önce kendi kaynak kodumuza karşı kontrol ettik: tüm arka ucu, her sunucuyu, tüm veritabanını alın; elinizde kalan, şifreli metin ve size hiç verilmemiş olan ve bulamayacağınız 256 bitlik bir anahtardır — çünkü o anahtar, aldığınız makinede hiç bulunmamıştır.
GLM-5.2'ye karşı ayakta kalmasının nedeni sıkıcıdır; sıkıcı olması da asıl noktadır. Bir yazılım açığı bulmak ile 256 bitlik bir anahtarı tahmin etmek farklı sorunlardır. Bir sınır modeli ilkinde olağanüstüdür, ikincisinde yazı tura atmak kadar iyidir ve ölçekleme bunu değiştirmez. Uygulamalara saldırır. Entropiye saldırmaz. Bu yüzden çalıştırdığımız diğer her şey, ulaşabileceği alanı küçültmek için vardır; ta ki geriye saldıracak tek şey matematik kalsın ve matematik açılmasın.
Bunların hiçbiri sizi dokunulmaz yapmaz; size bunu satan yalan söyler. Yeterince iyi bir saldırgan —artık elinde bedava bir sınır bulucusu tutan bir saldırgan— eninde sonunda çalışan kodda bir açık bulacaktır. İçeri girdiğini varsayın. Bizim ortadan kaldırdığımız şey kazançtır. İçeri girin; sırlar, anahtarı hiç bulunacak yerde olmayan şifreli metindir, çünkü o anahtar sizin donanımınızda yaşar ve yalnızca onu kullandığınız anda var olur. Size erişilemeyeceğinizi vaat etmiyoruz. Erişimin sonunda çözülebilir hiçbir şey olmadığını vaat ediyoruz.
Bu haftanın manşeti jeopolitiktir ve döngüden çıkacaktır. Kalıcı olan kısım daha sessizdir: bir yetenek bir kutuda tutulamaz ve geçen hafta bunu iki kez, zıt yönlerde, aynı anda kanıtladı. Cevap hiçbir zaman daha iyi bir kutu olmadı. Cevap, açılmasına değecek hiçbir şeyi bir kutuya koymayı bırakmaktır. Hiç kimsenin giremeyeceği bir kasa yapmadık. İçine girilebilen ama eli boş çıkılan kasayı yaptık.
Bu tehlikenin gerçekten yaşadığı taraf için kendimize uyguladığımız kurallar burada.
Tartışmaya değer soru şu —çünkü cevap, diğer her şeyi nasıl kurduğunuzu değiştiriyor: bu modellerin bir sonraki kuşağını sistemlerimizden uzak tutabileceğimizi düşünüyor musunuz? Yoksa tek dürüst plan, zaten içeride olduklarını varsaymak mı?
Clavitor (@clavitorai), yapay zekâ ajanları için ve onlara karşı geliştirilmiş kimlik bilgisi kasasıdır. clavitor.ai
Kaynaklar
Fortune (@FortuneMagazine): "Anthropic disables Fable and Mythos AI models following U.S. government export ban." 9 Haziran'daki lansman, 12 Haziran'da herhangi bir yabancı uyruğa dağıtımı yasaklayan Ticaret Bakanlığı yönergesi ve Anthropic'in her iki modeli de tüm kullanıcılar için devre dışı bırakması. [1]
Semgrep (@semgrep): "We have Mythos at Home: GLM-5.2 beats Claude in our cyber benchmarks." Açık ağırlıklı GLM-5.2'nin açık tespiti üzerinde ölçülen başarımı; erişim denetimi (IDOR) hatalarında Claude Code'u bulgu başına yaklaşık 0,17 USD maliyetle geçiyor. [2]
CNBC (@CNBC): "Trump admin allows Anthropic to release Mythos AI model to some companies, government agencies." Mythos'un daha sonra yaklaşık 100 doğrulanmış şirkete ve federal kuruma sınırlı biçimde dağıtılması. [3]
Cybersecurity Dive (@CyberSecDive): "Cybersecurity experts blast U.S. government for restricting Anthropic's AI models." Yeteneğin yeterince yaygın olduğu, dolayısıyla denetimin tutunamayacağı yönündeki sektör tepkisi. [4]