← AI 情报

ThinkingCap-Qwen3.6-27B:减少过度思考,在M5 Max上跑出44 t/s速度

产品发布来源: x作者: ivanfioravanti热度: 132发布于 2026年7月24日

BottleCapAI推出了ThinkingCap-Qwen3.6-27B模型,在M5 Max上测试显示速度快(44 t/s),生成token少,非常适合需要效率的场景。

  • benchmark
  • GGUF
  • Qwen 3.6
  • M5 Max
  • ThinkingCap
查看原文 →

评论

登录后即可评论

还没有评论,来发第一条吧。