ExploitBench (1) 썸네일형 리스트형 GLM-5.3, 같은 기반 모델로 코딩과 보안 성능을 끌어올렸어요 GLM-5.3, 같은 기반 모델로 코딩과 보안 성능을 끌어올렸어요AI 뉴스 썸네일Z.ai가 GLM-5.2의 기반 모델을 그대로 두고 포스트 트레이닝을 확장한 GLM-5.3을 공개했어요. 코딩 과제 성능이 크게 올랐고, 취약점을 찾은 뒤 공격 단계를 연결하는 사이버 보안 능력도 빠르게 향상됐어요. 1핵심 요약구분확인된 내용읽을 때 볼 점훈련 방식기반 모델은 GLM-5.2와 같고 환경·과제·연산을 늘렸어요모델 크기보다 훈련 환경과 검증 설계가 성능 차이를 만들었어요코딩 성능Terminal Bench 3.0은 4.6에서 28.3, DeepSWE v1.1은 46.2에서 66.9로 올랐어요실제 개발 흐름에 가까운 장기 과제를 훈련에 넣은 결과예요사이버 보안CyberGym 84.5%, ExploitBench 54... 이전 1 다음