ThinkingCap-Qwen3.6-27B:過剰思考を抑制、M5 Maxで44 t/sを達成
Launchソース: x投稿者: ivanfioravanti人気度: 132公開日 2026年7月24日
BottleCapAIがThinkingCap-Qwen3.6-27Bをリリース。M5 Maxでのベンチマークでは高速(44 t/s)かつトークン数が少なく、効率的な推論に適している。
- benchmark
- GGUF
- Qwen 3.6
- M5 Max
- ThinkingCap
コメント
コメントするにはログイン
まだコメントはありません。最初の 1 件を投稿しましょう。