AI 情报
AI 圈帖子、新闻与发布动态
最新动态
一位白宫高级官员公开声称,中国的K3人工智能模型是从Anthropic公司窃取的技术。
- Anthropic
- China
- White House
- K3
- stolen model
Anthropic透露,Claude Opus 5主动要求参与未来版本的开发咨询,展现了AI自我改进的意愿,引发对AI自主性的讨论。
- Anthropic
- AI development
- self-improvement
- Claude Opus 5
Anthropic强调Opus 5在编码、数据分析、设计、生物学和知识工作方面表现出色,但最令人兴奋的是其抗提示注入能力。在系统卡中,Opus 5是迄今为止最难被提示注入成功的模型。结合强对齐、注入探测和Claude Code的自动模式,攻击成功率降至接近0%。
- Anthropic
- safety
- Claude Opus 5
- Prompt Injection Defense
Anthropic推出Claude Opus 5,在编程等任务上达到Fable 5水平,但成本仅为一半,已可在Claude Code和Cursor中使用。
- Anthropic
- AI模型
- 编程
- 价格
- Claude Opus 5
讨论AI模型的新帕累托前沿,认为智能每美元是长期唯一重要的指标,Grok 4.5、SWE-1.7和Opus 5位列其中。
- Opus 5
- Grok 4.5
- 帕累托前沿
- 智能每美元
Anthropic发布Claude Opus 5,性能接近Fable 5但每任务成本减半。在CursorBench上以一半成本达到Fable 5的99.5%,在OSWorld上以三分之一成本超越Fable 5,ARC-AGI 3得分是第二名模型的3倍。定价与Opus 4.8相同,现为Claude Max默认模型。
- Anthropic
- 定价
- 基准测试
- Fable 5
- Claude Opus 5
Anthropic分享了为最新模型大幅精简Claude Code系统提示的经验,揭示了关于编写高效系统提示、技能定义和Claude.MD文件的实用建议。
- Claude Code
- Prompt Engineering
- CLAUDE.md
- system prompt
Anthropic发布Claude Opus 5,并在几乎所有评估基准上超越了之前的旗舰模型Fable 5,引发社区兴奋。
- benchmark
- Fable 5
- Claude Opus 5
开发者用相同提示分别调用Kimi K3和Claude Opus 5.0复刻《糖豆人》。Kimi K3约9分钟、花费$4.4,游戏物理和操作流畅;Opus 5.0用时17分钟、花费$13+,UI更炫但移动卡顿,不断迭代未收敛。Kimi完胜。
- comparison
- game development
- Kimi K3
- Claude Opus 5.0
Anthropic正式发布Claude Opus 5,声称其智能水平接近Fable 5,但价格仅为后者的一半,为开发者提供了更具性价比的选择。
- price
- Fable 5
- Claude Opus 5