ThinkingCap-Qwen3.6-27B:减少过度思考,在M5 Max上跑出44 t/s速度
产品发布来源: x作者: ivanfioravanti热度: 132发布于 2026年7月24日
BottleCapAI推出了ThinkingCap-Qwen3.6-27B模型,在M5 Max上测试显示速度快(44 t/s),生成token少,非常适合需要效率的场景。
- benchmark
- GGUF
- Qwen 3.6
- M5 Max
- ThinkingCap
评论
登录后即可评论
还没有评论,来发第一条吧。