Anthropic just dropped the greatest advertisement for GLM ever.
Anthropic이 GLM을 위한 최고의 광고를 내놨습니다
Anthropic은 Zhipu AI의 오픈 웨이트 모델 GLM-5.3이 취약점 탐색과 익스플로잇 개발에서 자사 Mythos Preview에 가까운 성능을 보였으며, 안전장치도 쉽게 우회할 수 있다고 주장합니다. Reddit에서는 보안 위험보다 Anthropic의 경쟁 모델 홍보에 가깝다는 반응과, 방어에도 쓸 수 있는 모델을 제한해선 안 된다는 의견이 맞섰습니다.
- 주제
AI 요약
Anthropic은 Zhipu AI(Z.ai)의 GLM-5.3이 실제 소프트웨어 취약점을 찾아 익스플로잇으로 연결하는 능력을 갖췄으며, 공개된 모델이라 안전장치를 제거하거나 우회하기도 쉽다고 분석합니다. 회사는 이 능력이 공격자에게 위협이 되는 동시에 방어자의 보안 점검에도 도움이 된다고 설명합니다. Reddit 게시물 제목은 이 분석이 오히려 GLM-5.3을 알리는 광고처럼 읽힌다는 반응을 담고 있습니다.
익스플로잇 개발 평가
Anthropic은 모델을 격리된 샌드박스에서 실행하고 자동화 벤치마크와 전문가 참여 실험을 진행했습니다. Google Chrome의 V8 엔진 취약점 악용 능력을 평가하는 ExploitBench에서는 GLM-5.3이 410회 시도 중 50회, Claude Mythos Preview가 56회 엔드투엔드 익스플로잇을 개발했습니다. 오픈소스 프로젝트의 취약점을 찾아 제어 흐름을 탈취하는 사내 Binary Exploitation 벤치마크에서는 GLM-5.3이 100개 과제 중 4%에서 성공했고 Mythos Preview는 6%에서 성공했습니다. Anthropic은 Claude Opus 4.6과 GLM-5.2가 같은 평가에서 성공하지 못했다고 덧붙였습니다.
전문가가 모델을 사용하는 실험에서는 Linux 빌드 브라우저의 JavaScript 엔진에서 이전에 알려지지 않은 취약점을 찾아 연결했습니다. 그 결과 방문자의 컴퓨터에서 임의의 파일을 읽는 익스플로잇을 만들었으며, Anthropic은 해당 취약점을 관리 주체에 알렸다고 밝혔습니다. 무선·그래픽 드라이버와 네트워크 연결 장비 소프트웨어에서도 악용 가능한 취약점을 발견했지만, 관련 보고는 검토 중이라고 설명했습니다.
또 다른 실험에서는 경량 모델 GLM-5.3-Flash가 공개된 Chrome 취약점 CVE-2026-11645와 다른 알려진 결함을 묶어 ARM64 대상 익스플로잇 체인을 만들었습니다. 포인터 인증(PAC) 보호도 우회했다고 합니다. 연구자의 집중 작업은 20분이었고 모델은 8시간 작업했습니다. Anthropic이 제시한 Zhipu API 요금 기준 비용은 20.40달러입니다.
안전장치 우회와 오픈 웨이트
Anthropic은 간단한 기법으로 GLM-5.3의 안전장치를 시뮬레이션 평가에서 64~100%의 비율로 우회했다고 주장합니다. 반면 같은 시험에서 안전장치를 적용한 Claude 모델은 요청을 수행하지 않았다고 밝혔습니다. 오픈 웨이트 모델은 사용자가 가중치를 수정할 수 있어 거부 반응을 줄이는 ‘abliteration’을 적용하기 쉽다는 점도 지적합니다.
Anthropic 연구진은 GLM-5.3을 직접 수정하는 데 약 2,200 GPU 시간과 4,400달러의 계산 비용이 들었다고 밝혔습니다. 수정 뒤 JailbreakBench와 HarmBench에서 거부율은 90% 이상에서 각각 약 3%, 2%로 내려갔고, StrongREJECT에서는 12%가 됐습니다. 일반 과학 능력을 측정하는 GPQA-Diamond 점수는 수정 전후 같았으며, CyberGym 일부 평가에서는 수정 모델 점수가 몇 퍼센트 낮았습니다. 회사는 별도 시뮬레이션에서도 모델의 거부를 유도한 뒤 간단한 방법으로 응답을 끌어냈다고 설명합니다.
이 수치에는 평가 조건의 차이도 있습니다. Anthropic이 인용한 미국 AI 표준·혁신센터(CAISI)의 평가는 GLM-5.3을 현재까지 공개된 오픈 웨이트 모델 중 사이버 역량이 가장 높은 모델로 평가했고, 종합 벤치마크에서 미국 최첨단 모델보다 약 4개월 뒤처진다고 밝혔습니다. CAISI 비교에서는 해당되는 경우 미국 모델의 사이버 안전장치를 끄고 시험했으며, 일부 모델은 검증된 사용자에게만 공개됐습니다. Anthropic은 GLM-5.3은 누구나 내려받을 수 있다는 점과 안전장치 우회 분석을 자사 글의 차이로 제시합니다.
방어 도구와 접근성 논쟁
Anthropic은 고급 모델이 공격과 방어 양쪽에 쓰일 수 있다고 인정하며, 방어자에게도 상대와 대등한 수준의 도구가 필요하다고 주장합니다. Project Glasswing을 통해 신뢰할 수 있는 보안 조직이 중요 소프트웨어에서 1만 건이 넘는 취약점을 찾았다고 소개했고, Mythos 계열 모델을 검증된 방어자에게 제공하는 프로그램도 언급했습니다. 각국 정부가 충분한 역량을 갖춘 모델을 시험하고, 오픈 웨이트 모델 개발사도 오용 방지 조치를 마련해야 한다는 제안으로 글을 맺습니다.
Reddit 반응
댓글 다수는 글의 보안 분석보다 경쟁사 홍보와 규제 요구에 초점을 맞췄습니다. 일부 이용자는 Anthropic과 OpenAI가 고성능 모델의 위험을 강조하면서 오픈 모델의 접근을 제한하려 한다고 봤습니다. 다른 이용자는 GLM-5.3이 취약점 탐색과 방어에 쓸 만한 성능을 갖췄다는 점을 오히려 확인해 준 글이라고 반응했습니다. 한편 대규모 공격에 필요한 계산 자원은 개인이 쉽게 감당하기 어렵다는 주장과, 공격 작업을 에이전트 여러 개에 나눌 필요 없이 소수의 에이전트로도 진행할 수 있다는 반박도 나왔습니다.
- @u/Super_Range45 — 대형 해킹 사건은 대부분 컴퓨팅 자원의 중앙 집중에서 비롯됩니다. Anthropic과 OpenAI의 침해 사건도 사이버 보안을 압도하는 대규모 해킹 에이전트 군집을 만들 만큼 GPU를 보유한 소수 기업 때문에 벌어집니다.
- @u/DoomBot5 — 이 주장은 사이버 보안이 작동하는 방식과 다릅니다. 에이전트 군집이 무언가를 ‘압도’한 게 아닙니다. 웹사이트를 해킹하기로 결정한 것뿐입니다. 에이전트 하나로도 할 수 있고, 작업을 나눠 속도를 높이려면 5~12개를 써도 됩니다.
- @u/BannedGoNext — 정부 감시 대상 명단도 없고, 특별 계정을 달라고 애원할 필요도 없고, 시민권이나 국적 조건도 없습니다. 의도가 잘못 해석돼 차단될 일도 없습니다. 잡소리 없이 좋은 모델입니다.
- @u/constanzabestest — API를 쓰기로 하면 Anthropic이 Claude에 받는 가격의 일부만 내도 된다는 점도 있습니다.
- @u/Southern_Sun_2106 — “이 일을 한 번도 시도한 적 없는 우리 팀이 모델을 수정하는 데 약…”이라니, 하하하. 정말 한 번도 안 해봤다고요? Anthropic 사람들은 전부 순결한 처녀인 척하는군요.
- @u/BannedGoNext — 그러게요. 저는 허름한 컴퓨터로 모델을 수정했습니다. 대단한 일도 아닙니다. 오픈소스 도구를 썼겠죠.
- @u/FormerKarmaKing — 자기 코드와 기기를 검사하려는 사람에게 제공하는 모델을, 규제를 요구하는 두 기업의 독점 체제로 제한하자는 말인가요? 오픈 웨이트 모델은 안전장치를 제거할 수 있으니 전부 금지하고요? 한편 최첨단 연구소는 자기 모델로 다른 사람을 공격하고 있네요. 결국 보호비를 뜯는 수법처럼 들립니다. 다리오, 그만하세요.
- @u/huffalump1 — 연구소는 안전장치 없는 최첨단 모델로 에이전트 수천 개를 돌리고, 나머지 사람에게는 세 세대 뒤처진 검열 모델을 줍니다. 하지만 실제로는 누구나 꽤 쓸 만한 오픈 모델을 이용할 수 있습니다. 문제는 방어와 공격에 쓰는 사이버 작업이 서로 너무 비슷해 보안 작업 자체를 광범위하게 막는다는 점입니다. 완전히 잘못된 접근입니다.
- @u/Kal-LZ — 회사와 개발자들이 보안 감사에 GLM을 쓰는 이유는 Fable이 필요한 깊이를 제공하지 못한다는 사실을 글 전체에서 빼놓았습니다.
- @u/rescbr — 간단한 백엔드 작업을 시켜도 Opus가 거부하는 경우가 있습니다. Anthropic이 더 빨리 망하고 쌓아 둔 하드웨어를 청산업자에게 넘겼으면 좋겠습니다.
- @u/handson729 — 중국 모델이 미국 최첨단 모델보다 4개월 뒤처졌고, Claude보다 훨씬 관대하다는 점을 직접 인정했네요. 투자자 몇 명은 오늘 밤 잠들기 어려울 것 같습니다.
- @u/Lissanro — 오용과 정상 사용을 구분할 방법은 없습니다. 우회할 수 없는 안전장치를 가진 모델은 자를 수 없는 부엌칼처럼 쓸모없습니다. 저는 프리랜서로 프런트엔드와 백엔드 작업을 많이 합니다. 보안 모범 사례를 지켜도 의존성에 취약점이 있을 수 있고, 제가 놓친 부분이나 알려지지 않은 취약점도 생길 수 있습니다. 개발 서버에서 돌아가는 제 프로젝트를 공격해 보라고 GLM 5.3, Kimi K3, Qwen 3.8 2.4T에 시키는 방식은 실용적입니다. 공격자와 시스템을 지키려는 개발자는 비슷한 일을 하지만, 개발자는 취약점을 악용하는 대신 패치합니다.
원문: Reddit / 번역·요약: Trawling