ended2월 21일· 1 sources

Opus 4.6, 사람 기준 14.5시간짜리 문제를 푼다는 것의 의미 (METR Time Horizon)

Why it matters

METR은 프론티어 AI 모델의 장기적·자율적 작업 수행 능력을 평가하는 비영리 연구 기관입니다. METR의 시간 지평 연구에 따르면 AI 에이전트의 작업 완료 능력이 지난 6년간 지수적으로 증가해왔으며, 이를 통해 AI가 언제 변혁적 영향을 미칠지 예측할 수 있습니다. 이 연구는 AI 에이전트가 인간 전문가 기준으로 50% 확률로 약 14.5시간 분량의 복잡한 문제를 해결할 수 있다는 것을 보여줍니다.

1
Sources
+0
24h
Growth
212d
Active
METRfrontier AI modelstime horizontask completionautonomous capabilitiesAI safety

Sources

Related Issues