ended6월 28일· 1 sources
DSpark: Speculative decoding을 활용한 LLM 추론 가속화 [pdf]
Why it matters
Hacker News 의견들 - DeepSeek는 한계를 넓히는 데서 그치지 않고, 성능 향상을 어떻게 달성했는지 설명하는 훌륭한 논문까지 공개하고 있음 안타깝게도 미국 연구소들은 더 이상 이런 공개를 잘 하지 않고, 지금 AI에서 가장 흥미로운 작업은 중국 연구소들이 하고 있는 듯함- Google도 여전히 LLM 아키텍처 연구를 많이 공개하고 있음 202...
1
Sources
+0
24h
—
Growth
6d
Active