DGX Spark向け新推論サーバー:大規模モデルで55-90トークン/秒、スペキュレーティブデコード不要
Launchソース: hackernews投稿者: medicis123人気度: 4公開日 2026年7月23日
DGX Spark向けの新しい推論サーバーが、大規模モデルで55-90トークン/秒を達成し、スペキュレーティブデコードを必要としない。
- DGX Spark
- large model
- inference server
- token speed
コメント
コメントするにはログイン
まだコメントはありません。最初の 1 件を投稿しましょう。