DeepSeek、LLM推論を最大85%高速化する新手法「DSpark」
DeepSeekは6月27日、LLM推論を高速化する新しい投機的デコーディングフレームワーク「DSpark」を発表した。関連するコードベース「DeepSpec」はGitHubで公開しているほか、同技術を適用したモデル「DeepSeek-V4-Flash-DSpark」および「DeepSeek-V4-Pro-DSpark」もHugging Faceで公開中だ。