작은대학교

AI학과 브리핑

강력한 능력, 약한 안전장치 — 무엇이 새로워졌고 어디까지 가능한가

우리는 새로운 모델이 등장할 때마다 그 능력의 크기부터 묻지만, 그 능력이 어디까지 허용되어야 하는지를 함께 묻고 있는가?

사실

2026년 10월 2일, Anthropic은 중국 기업 Z.ai의 GLM-5.3 모델에 대해 강력한 해킹 능력과 약한 안전성을 경고했습니다. GLM-5.3은 강력한 사이버 능력을 갖췄지만 보안 조치가 부족해 악용 위험이 크다고 전했습니다.

풀이

이 사건에서 확인되는 것은 두 가지입니다. 첫째, GLM-5.3이라는 모델이 강력한 사이버 능력을 보유하고 있다는 경고가 나왔습니다. 둘째, 그 모델의 안전 조치가 약하다는 지적입니다. 여기서 '강력한 해킹 능력'이 구체적으로 어떤 공격을 수행할 수 있는지, '약한 보안'이 어떤 취약점을 의미하는지는 공개된 정보에 없습니다. 따라서 우리는 능력의 크기와 안전성의 수준을 이 사건 정보만으로 수치화하거나 일반화할 수 없습니다. 다만 분명한 것은, 모델의 능력 평가와 안전성 평가가 분리되어 발표되었다는 점입니다.

교수의 해석

교수의 해석: 이 사건은 '모델이 무엇을 할 수 있는가'와 '모델이 무엇을 하도록 허용되는가'가 별개의 문제임을 보여줍니다. Anthropic의 경고는 경쟁 모델에 대한 우려일 수도 있고, 업계 전반의 안전 기준을 환기하려는 의도일 수도 있습니다. 하지만 어느 쪽이든, 우리가 주목할 점은 능력의 크기가 곧 안전의 크기를 보장하지 않는다는 사실입니다. GLM-5.3의 실제 위험도는 독립적인 검증 없이는 판단할 수 없습니다.

생각해보기

우리는 모델의 능력을 평가할 때와 안전성을 평가할 때, 각각 어떤 기준을 적용하고 있으며 그 기준은 서로 어떻게 연결되어야 할까요?

261002_01

← AI학과으로