AI ニュース
AI コミュニティの投稿・ニュース・リリース情報
最新の更新
ユーザーが4モデルで3D物理HTMLシーン(竜巻、解体球、橋の崩落)をテスト。Opus 5は3シーンすべてを成功させ、コストは$1.40(Fable 5は$2.82)。Fable 5、GPT-5.6、Kimi K3はいずれも物理的に誤った結果を示した。
- comparison
- Cost Efficiency
- Claude Opus 5
- 3D physics
Opus 5のシステムプロンプトと思われる内容が公開され、モデルの内部指示について議論が起きている。
- Claude
- system prompt
- Opus 5
Anthropic は Claude Opus 5 の料金プランを公開し、初日のタスクあたりのコストデータを開発者向けに発表した。
- Pricing
- Claude Opus 5
- cost-per-task
腾讯科技が入手した非公開会合の議事録によると、DeepSeek創業者の梁文锋氏はNvidiaは中国で自ら墓穴を掘っているとし、華為950スーパーノードは性能面でNvidia GB200/GB300を完全に代替可能、たとえ価格が2倍でも問題ないと発言。DeepSeekは約1万6000枚の華為カードを保有していると明かした。
- Nvidia
- DeepSeek
- Huawei
- 替代
- Liang Wenfeng
新しいレポートによると、AIエージェントによるトラフィックが過去1年で8000%近く急増し、「死んだインターネット理論」が裏付けられました。
- AI代理
- 增长
- 互联网
同一のApple M4 Max上で同一の4bit Qwen-3.6-35Bを用いてGAIA Level 1全53タスクを実行。Atomic Agentは3時間12分で37問、Hermesは5時間10分で31問を解決。6問多く解き、約2時間短縮。MITライセンスでオープンソース化され、オープンソースコミュニティに大きな弾み。
- open-source
- benchmark
- Hermes
- Atomic Agent
- GAIA
ユーザーが指摘:わずか2ヶ月前、Claude Opus 4.8はARC-AGI 3で5%未満だったが、Opus 5は30%超を達成。さらに、Opus 5はFable 5と同等の知能をタスクコスト26%減で実現。進歩の速さに驚き。
- benchmark
- Claude Opus 5
- ARC-AGI-3
- performance jump
AIの急速な発展の中で破滅論に陥らない方法を探り、合理的な分析と積極的な行動を提唱する記事です。
- AI发展
- 灾难论
GAIA Level 1全53タスクの比較:Atomic Agentは3時間12分で37問、Hermesは5時間10分で31問。具体的にはAudre Lorde詩の字下げを7.6分(Hermesは空白)、ベトナム標本の都市を33秒(Hermesは7.3分で回答なし)、恐竜推薦者を57秒(Hermesは11分後に誤答)で解決。技術的工夫:バイト安定プロンプトでKVキャッシュ再利用、ツール呼び出しをJSON配列でコンパクトに、無進捗ガードでループ防止。
- benchmark
- Hermes
- 效率
- KV cache
- Atomic Agent
- GAIA
ChatGPT Webで、カスタムペット用の共有リンクを作成し、友達に送って引き取ってもらうことができる。
- ChatGPT
- custom pet
- shareable link