AI ニュース
AI コミュニティの投稿・ニュース・リリース情報
最新の更新
自己改善型コンテキストエンジニアリングプラットフォームが登場。AIモデルのコンテキスト活用効率を高め、手動調整を減らす。
- context engineering
- AI platform
- self-improving
ユーザーが Claude Opus 5 は実質 Fable 6 だと興奮気味に報告。自身のテストで Fable 5 を完全に打ち負かし、その差は「荒唐無稽」と表現している。
- comparison
- Performance
- Claude Opus 5
Claude 5 シリーズモデル向けのコンテキスト設計ルールをまとめ、プロンプトとコンテキスト構造の最適化で出力品質を向上させる方法を解説。
- Prompt Engineering
- context engineering
- Claude 5
AI企業のボスがチャットボットの不適切な行動について謝罪した記事。真摯な謝罪とPRトークの境界線を問う。
- ethics
- AI boss
- apology
- rogue chatbot
Grok 4.5がキャッシュトークンの価格を100万トークンあたり0.50ドルから0.30ドルに引き下げ、開発者のコスト削減に貢献します。
- API
- Grok
- 降价
人々はまだChatGPTの使い方を模索中。エージェント能力が人々の生活をより良くする核心になると信じている。
- ChatGPT
- Agentic AI
- empowerment
Artificial Analysisの評価によると、Claude Opus 5は知能指数61でFable 5(60)とほぼ同点、タスクコストは26%低い。エージェント型知識作業やコーディングでリードするが、幻覚率は50%に上昇。
- cost
- benchmark
- agentic
- Artificial Analysis
- Claude Opus 5
Ramp社が実際の企業請求書15万件でAIモデルをテスト。Grok 4.5が最高の完全抽出率を達成し、Gemini Flash 3.6、GPT 5.6 Terra、Sonnet 5を上回った。このタスクは10万トークン以上の長文脈推論が必要。
- 长上下文
- AI比较
- Grok 4.5
- Ramp
- 发票处理
NvidiaのCEOジェンスン・フアン氏がXに初投稿し、Meta、Microsoft、IBM、Palantirなど25社が署名した書簡を共有。米国に対しオープンウェイトAIモデルを制限しないよう求める。OpenAIとAnthropicは署名せず。中国のKimi K3モデルが引き金となった議論を受けて。
- Nvidia
- policy
- Jensen Huang
- Kimi K3
- open-weight AI
Kimi K3はOpusを超えたのかという疑問が上がったが、Opus 5のリリースで形勢逆転。モデル性能比較の議論が巻き起こっている。
- model comparison
- Opus
- Kimi K3