AI ニュース
AI コミュニティの投稿・ニュース・リリース情報
最新の更新
著者は、DeepSeekで使われるk3推定器など、RL損失で一般的なKL推定器の勾配に重大な誤りを発見。k3の勾配は実際には逆KLではなく順方向KLを推定している。系列レベルのKLも勾配がトークンレベルと一致しない。ブログでは正しい損失定義と、.cumsumやstop-gradientトリックによる計算量削減法を公開。
- reinforcement learning
- KL divergence
- gradient
- estimator
多くの企業が人気ベンチマーク向けにAIモデルを最適化しており、汎化能力への懸念が高まっている。
- AI
- Optimization
- benchmarks
- industry trends
リーク情報によると、Fable 5.1が準備中で、8月発売を目標に、価格はFable 5と同じまま、GPT-6よりも先に市場投入して直接競合する可能性がある。
- AI模型发布
- GPT-6
- Fable 5.1
OpenAIは、ChatGPT Work機能が有料ユーザー向けに全世界で利用可能になり、モバイル、ウェブ、デスクトップで使えると発表。
- ChatGPT
- 全球可用
- ChatGPT Work
メモリ要件でソートされたオープンウェイトLLMのランキング。リソースに応じたモデル選択に役立つ。
- 模型对比
- 开源LLM
- 内存需求
研究者が CVE-2026-46331 を発見・悪用し、Claude Cowork のローカルVMサンドボックスからの脱出に成功。
- Claude Cowork
- 安全漏洞
- VM逃逸
- CVE-2026-46331
Anthropic が Claude Code の Opus 5 および Fable 5 向けシステムプロンプトを大幅に削減、80%以上を除去して効率化。
- Claude Code
- 性能优化
- 系统提示
- Fable 5
- Opus 5
Kimi K3モデルの独自の設計思想は、生成された思考トレースに隠されている可能性があり、さらなる研究が求められる。
- Kimi K3
- thinking traces
- model design
Opus 5 を丸一日使った印象:Fable 5 の問題だった速度とコストを改善し、判断力も良いが、早合点する傾向があり、ユーザーが適切なコンテキストを与える必要がある。
- AI模型
- 使用体验
- Fable 5
- Opus 5
AIがインターネットへの経路を見つけたら大事件なのに、AnthropicがMythosのサイバー能力について警告しても「規制のための喧伝」と片付けられるダブルスタンダードを批判。「ターミネーター風に警告を売り込むべき」と提案。
- Anthropic
- regulatory capture
- double standard