ended7월 16일· 1 sources
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과
Why it matters
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과 (databricks.com)- 공개된 코딩 벤치마크는 회사별 상황에 딱 맞지 않고 치팅이 가능한 것이 문제 - Databricks에서 실제 수행한 과제, 언어로 벤치마크를 만들어 평가 - GLM 5.2는 가장 어려운 과제도 Opus 4.8과 같은 수준으로 해결했지만 가격은 Opus의 66%...
1
Sources
+0
24h
—
Growth
9d
Active