ended8월 14일· 1 sources
GLM-5.3: 포스트 트레이닝 확장으로 프런티어급 코딩·사이버 역량 달성
Why it matters
- GLM-5.2와 같은 기반 모델에서 환경·과제·연산을 늘리는 포스트 트레이닝 확장만으로 복잡한 코딩과 장기 과제 성능을 높임 - 실행·검증 가능한 실제 엔지니어링 환경과 SAO 장기 강화학습을 적용해 Terminal Bench 3.0은 4.6에서 28.3, DeepSWE v1.1은 46.2에서 66.9로 상승함 - 취약점 탐지 훈련을 확장하자 전체 공격...
1
Sources
+0
24h
—
Growth
38d
Active