Cybersecurity Benchmark
사이버보안 벤치마크
AI 모델이 코드 취약점 탐색이나 시스템 보안 관련 문제를 얼마나 잘 처리하는지 측정하는 평가 기준이다. 기사에서는 GLM 5.3이 CyberGym 같은 벤치마크에서 Anthropic과 OpenAI 모델에 근접하거나 일부 항목에서 앞섰다는 근거로 활용됐다.
사이버보안 벤치마크
AI 모델이 코드 취약점 탐색이나 시스템 보안 관련 문제를 얼마나 잘 처리하는지 측정하는 평가 기준이다. 기사에서는 GLM 5.3이 CyberGym 같은 벤치마크에서 Anthropic과 OpenAI 모델에 근접하거나 일부 항목에서 앞섰다는 근거로 활용됐다.