AI 情报
AI 圈帖子、新闻与发布动态
最新动态
有人在RTX 3090上对Qwen 3.6 35B混合专家模型(3B活跃参数)进行了性能基准测试,分享了实际运行数据和体验。
- benchmark
- Qwen
- MoE
- RTX 3090
推特用户爆出 Claude Opus 5 完整的系统提示,长达 20 万字符。内容不仅包含模型选择说明,还透露了 Anthropic 尚未公开的 Mythos 等级、Fable 5 的安全措施、以及因美国出口管制暂停服务的历史。对研究提示注入和模型内部机制的人来说,这是一份难得的实料。
- Anthropic
- Mythos
- Project Glasswing
- system prompt leak
- Claude Opus 5
Perplexity 和 Perplexity Computer 现已支持 Claude Opus 5。根据 WANDR 评测,Opus 5 在六款模型中排名第二,仅落后 Fable 5,但成本降低 57%,性价比突出。
- Perplexity
- benchmark
- WANDR
- Claude Opus 5
Artificial Analysis 发布 AA-Briefcase 基准测试,Claude Opus 5 以 1720 Elo 位居榜首,比 Fable 5 高 146 分,任务成本降低 20%。在分析质量上领先近 300 Elo,但演示质量仍落后 GPT-5.6 Sol。
- benchmark
- Cost Efficiency
- AA-Briefcase
- Claude Opus 5
据 The Information,Stripe 正洽购 OpenRouter,作价约100亿美元。OpenRouter 提供单一 API 访问数百模型,年化收入约5000万美元,去年估值仅13亿。收购将强化 Stripe 在 AI 基础设施的地位。
- OpenRouter
- Stripe
- AI infrastructure
- acquisition
用户表示还没测 Opus 5 Max,仅 High 和 xHigh 版本就已经让 Kimi K3 和 Qwen 3.8 看起来像机器人。xHigh 是首个完美揭示其设计基准的模型。
- benchmark
- impressive
- Kimi K3
- Claude Opus 5
- Qwen-3.8
Google 推出 Gemini Spark,面向 Google AI Pro 订阅用户。演示用例:上传学校日历 PDF,Gemini 自动将所有“无课日”添加到你的 Google 日历。目前仅限美国,即将全球扩展。
- Productivity
- Google AI
- Gemini Spark
一篇关于 Claude 5 系列(Opus 5 / Fable 5)提示工程的实战指南。核心:别再堆砌规则,相信模型判断;用接口设计代替例子;渐进式披露信息;简化 CLAUDE.md;利用 Auto memory;使用富引用(HTML、代码等)。附带系统提示、CLAUDE.md、Skills 的具体建议。
- Claude Code
- Prompt Engineering
- context engineering
- Claude 5
用户之前基于一个对抗分类器的实例对 Mythos 的初步印象得到了验证,认为这个模型非常有能力、成熟、具备主体性,是第一个能在某些意义上作为独立成人与之相处的模型。
- Anthropic
- agentic
- Mythos
- mature
Bubble Boi 分享 Kimi 使用线性注意力技术将内存增长固定为常数,且效果世界级,可能使每用户内存固定。如果所有前沿模型采用此技术,DRAM 需求将大降,超大规模云厂商的疯狂采购逻辑不再成立。
- Kimi
- memory
- DRAM
- linear attention
- hyperscaler spending