← AI ニュース

DGX Spark向け新推論サーバー:大規模モデルで55-90トークン/秒、スペキュレーティブデコード不要

Launchソース: hackernews投稿者: medicis123人気度: 4公開日 2026年7月23日

DGX Spark向けの新しい推論サーバーが、大規模モデルで55-90トークン/秒を達成し、スペキュレーティブデコードを必要としない。

  • DGX Spark
  • large model
  • inference server
  • token speed
ソースを見る →

コメント

コメントするにはログイン

まだコメントはありません。最初の 1 件を投稿しましょう。