ended7월 12일· 1 sources

GPT-5.6, Grok 4.5, Claude, Muse Spark로 동일한 앱 4개를 만든 결과

Why it matters

- 12개 모델에 레이캐스터 미로, 3D 루빅스 큐브, 계산기, Conway’s Game of Life를 만들게 한 결과, GPT-5.6 Sol과 Claude Fable 5가 복잡한 과제의 선두를 나눠 가짐 - 모델마다 과제별로 5회씩 시도해 성공 횟수·비용·시간과 모든 결과물을 공개했지만, 과학적 평가가 아니라 생성물을 직접 살펴본 주관적 비교라는 한계가...

1
Sources
+0
24h
Growth
71d
Active

Sources

Related Issues