← AI 情报

DGX Spark新推理服务器发布:大模型推理速度55-90 tok/s,无需投机解码

产品发布来源: hackernews作者: medicis123热度: 4发布于 2026年7月23日

介绍一款专为DGX Spark设计的新推理服务器,运行大模型时速度可达55-90 tok/s,且无需投机解码技术。

  • DGX Spark
  • large model
  • inference server
  • token speed
查看原文 →

评论

登录后即可评论

还没有评论,来发第一条吧。