본문으로 건너뛰기

Cybersecurity Benchmark

사이버보안 벤치마크

AI 모델이 코드 취약점 탐색이나 시스템 보안 관련 문제를 얼마나 잘 처리하는지 측정하는 평가 기준이다. 기사에서는 GLM 5.3이 CyberGym 같은 벤치마크에서 Anthropic과 OpenAI 모델에 근접하거나 일부 항목에서 앞섰다는 근거로 활용됐다.