ended3월 13일· 1 sources
트랜스포머 내부에서 프로그램을 실행해 지수적으로 빠른 추론 달성
Why it matters
트랜스포머 내부에서 프로그램을 실행해 지수적으로 빠른 추론 달성 (percepta.ai)- 최신 언어 모델(LLM) 은 복잡한 수학 문제를 풀 수 있지만, 단순한 계산 작업에서는 긴 추론 단계와 문맥 길이 때문에 실패율이 높음 - 연구팀은 트랜스포머 내부에 실제 컴퓨터를 구현, 외부 도구 없이 C 코드나 WebAssembly 프로그램을 모델이 직접 실행하도...
1
Sources
+0
24h
—
Growth
191d
Active
Transformerin-model executionWebAssemblyconvex hull attentionHullKVCacheTuring completeness