상자에 담아둘 수는 없어요. 지난주가 두 번 증명했죠.
미국은 지금까지 만든 가장 강력한 해킹 AI를 수출하기엔 너무 위험하다고 판정했어요. 며칠 뒤 중국의 한 랩은 동등한 모델을 무료로 공개했죠. 역량은 상자에 가둘 수 없어요. 비밀을 상자에 넣어두는 것도 그만둬야 해요.
트럼프 행정부는 지금까지 만들어진 가장 강력한 해킹 AI가 국외로 나가기엔 너무 위험하다고 판단했어요. 중국의 한 랩은 그것을 동등한 성능으로, 무료로, 노트북에서 돌아가게 만들어 세상에 내놓는 데 나흘이 걸렸죠.
6월 9일, Anthropic은 Mythos를 출시했어요. 코드베이스를 읽고 악용 가능한 결함을 어떤 인간 팀보다 빠르게 찾아내는 모델이에요. 사흘 뒤 워싱턴은 Anthropic이 Mythos와 그 형제 모델 Fable을 외국 국적자에게 제공하는 것을 금지했고, 자사의 비시민권 직원도 포함됐어요. Anthropic은 두 모델 모두를 모든 사용자에게 끈겼죠. 대략 하루 동안 지구상에서 가장 뛰어난 버그 탐지 AI는 상자 안에 있었어요. 그러다 같은 주에 중국 랩 Zhipu가 GLM-5.2를 공개했어요. 가중치를 공개하고, 허용 범위가 넓은 라이선스를 붙였고, 노트북에서 돌아가는 무료 다운로드를 제공했으며, 안전장치는 설계부터 제거할 수 있게 만들었죠. Semgrep이 방금 워싱턴이 잠가둔 모델과 벤치마크를 비교하면서 결과에 "우리 집에 Mythos가 있잖아요"("We have Mythos at Home")라는 제목을 붙였는데, GLM-5.2가 접근 제어 버그 한 종류에서 Claude Code를 이겼고, 발견한 취약점 하나당 비용은 약 17센트였어요.
즉 일주일 안에, 진지한 정부가 최첨단 사이버 역량을 상자에 가두는 진지한 시도를 했고, 공개 가중치의 동급 모델은 뉴스 사이클이 바뀌기도 전에 그 상자를 무의미하게 만들었어요. 통제가 느슨해서가 아니에요. 다른 랩이 다시 만들어서 무료로 나눠줄 수 있는 역량은 수출 통제를 할 수 없기 때문이에요. 워싱턴은 자국 기업이 무엇을 내보낼지는 결정해요. 나머지 세상이 무엇을 오픈소스로 내놓을지는 결정하지 못해요. 한쪽은 상자에 넣었고, 다른 쪽은 동급 모델을 풀어줬어요. 같은 주에, 반대 방향으로, 하나의 결론.
정부가 이것을 무기처럼 다룬 데에는 이유가 있고, 모든 방어자는 그 이유를 곱씹어볼 만해요. 악용 가능한 결함을 자율적으로 찾아내는 모델은 당신이 쌓아온 모든 벽을 향해 겨누게 되는 모델이에요. 그리고 지난주까지 그 모델의 최강 버전은 심사를 통과한 100곳 손에 있었죠. 이제 동급 모델은 무료이고, 지치지 않으며, 싸고, 이미 당신의 코드와 당신의 에이전트가 돌아가는 바로 그 기기 위에서 돌아가요. 이제 유용한 가정은 "막아낼 수 있다"가 아니에요. "이미 안에 들어와서 읽고 있으며, 거점을 침해로 바꾸는 단 하나의 비밀을 찾고 있다"예요.
바로 그 질문을 중심으로 Clavitor를 만들었고, 이번 주가 그 질문을 대신 던지기 훨씬 전이었어요. 자물쇠 따개를 막는 방법이 아니라, 자물쇠 따개가 들어왔을 때 무엇을 찾아내느냐의 문제예요.
다른 모든 볼트는 비밀을 둘러싼 벽이에요. 훔친 토큰으로, 유출된 키로, 실행 중인 코드의 결함으로 그 벽을 넘으면 비밀이 바로 그 자리에서 읽히죠. 벽이 방어의 전부이므로, 벽이 무너지는 것이 침해의 전부예요. 벽을 넘는 것이야말로 최첨단 취약점 탐지기가 하는 일이에요.
우리는 반대쪽에 걸었어요. 자물쇠 따개가 풀려 나온 뒤에도 살아남는 유일한 선택지예요. 벽 끝에 읽을 수 있는 비밀은 없습니다. 가장 민감한 필드는 당신 자신의 하드웨어, 지문, 얼굴, 보안 키에서 도출한 키로 암호화돼요. 탭하는 바로 그 순간, 당신 자신의 브라우저 안에서요. 그 키는 우리에게 전송되지 않고, 우리 서버에 저장되지도 않아요. 이 문장을 쓰기 전에 우리 소스코드로 직접 확인했어요. 백엔드 전체, 모든 서버, 데이터베이스 전체를 가져가도 당신이 손에 쥐는 것은 암호문과, 한 번도 받은 적이 없고 찾을 수도 없는 256비트 키예요. 가져간 그 기기에 있었던 적이 없거든요.
GLM-5.2에도 통하는 이유는 지루하고, 지루한 것이 핵심이에요. 소프트웨어 결함을 찾는 것과 256비트 키를 추측하는 것은 다른 문제예요. 최첨단 모델은 전자에선 탁월하고, 동전 던지기보다 나을 바 없어요. 그리고 아무리 스케일링해도 이건 바뀌지 않아요. 그것은 구현을 공격하지, 엔트로피를 공격하지 않아요. 그래서 우리가 운영하는 나머지 모든 것은 그것이 닿을 수 있는 범위를 줄이기 위해서만 존재해요. 남은 공격 대상이 결국 수학뿐이 되도록, 그리고 그 수학은 열리지 않아요.
이것이 당신을 무적이게 만들지는 않아요. 그렇게 파는 사람은 거짓말하는 거예요. 충분히 실력 있는 공격자는, 이제 무료인 최첨단 버그 탐지기를 손에 넣은 채로, 결국 실행 중인 코드에서 결함을 찾아낼 거예요. 들어온다고 가정하세요. 우리가 없앤 것은 그 대가예요. 들어와도 비밀은 암호문일 뿐이고, 그 키는 애초에 찾을 곳에 없어요. 당신의 하드웨어에 살고, 사용하는 순간에만 존재하거든요. 우리는 공격을 받지 않는다고 약속하지 않아요. 공격이 닿는 끝에 복호화할 수 있는 것은 아무것도 없다고 약속해요.
이번 주 헤드라인은 지정학적이고, 곧 지나갈 거예요. 남는 부분은 더 조용해요. 역량은 상자에 가둘 수 없고, 지난주는 그것을 반대되는 두 방향으로, 동시에, 두 번 증명했어요. 답은 언제나 더 나은 상자가 아니었어요. 열어볼 가치가 있는 것을 상자에 넣는 것을 그만두는 것이 답이에요. 우리는 아무도 못 들어오는 볼트를 만들지 않았어요. 들어와도 빈손으로 나가게 되는 볼트를 만들었어요.
이 위험이 실제로 존재하는 하우스의 한쪽을 위해 우리가 스스로에게 적용하는 규칙은 여기에 있어요.
그러니 논쟁할 가치가 있는 질문은 이거예요. 답이 나머지 모든 것을 만드는 방식을 바꾸거든요. 다음 세대의 이런 모델들을 애초에 우리 시스템 밖으로 막아낼 수 있다고 보시나요? 아니면 이미 안에 들어와 있다고 가정하는 것만이 정직한 계획인가요?
Clavitor(@clavitorai)는 AI 에이전트를 위해, 그리고 에이전트에 맞서기 위해 만든 자격 증명 볼트예요. clavitor.ai
출처
Fortune(@FortuneMagazine): "Anthropic disables Fable and Mythos AI models following U.S. government export ban."(미국 정부의 수출 금지 조치 이후 Anthropic이 Fable과 Mythos AI 모델을 비활성화) 6월 9일 출시, 6월 12일 상무부가 외국 국적자에 대한 배포를 금지한 지시, 그리고 Anthropic이 두 모델을 모든 사용자에 대해 비활성화한 내용. [1]
Semgrep(@semgrep): "We have Mythos at Home: GLM-5.2 beats Claude in our cyber benchmarks."("우리 집에 Mythos가 있잖아요: GLM-5.2가 사이버 벤치마크에서 Claude를 이깁니다") 취약점 탐지 벤치마크를 돌린 공개 가중치 GLM-5.2가 접근 제어(IDOR) 버그에서 Claude Code를 이기고, 발견 건당 약 $0.17이 든 결과. [2]
CNBC(@CNBC): "Trump admin allows Anthropic to release Mythos AI model to some companies, government agencies."(트럼프 행정부, 일부 기업과 정부 기관에 Mythos AI 모델 공개 허용) 이후 약 100곳의 심사 통과 기업과 연방 기관으로 Mythos를 한정 공개한 내용. [3]
Cybersecurity Dive(@CyberSecDive): "Cybersecurity experts blast U.S. government for restricting Anthropic's AI models."(사이버보안 전문가들, Anthropic AI 모델 제한한 미국 정부 비판) 해당 역량이 이미 널리 퍼져 있어 통제가 유지될 수 없다는 업계 반응. [4]The request was rejected because it was considered high risk