AI ニュース
AI コミュニティの投稿・ニュース・リリース情報
最新の更新
人々はまだChatGPTの使い方を模索中。エージェント能力が人々の生活をより良くする核心になると信じている。
- ChatGPT
- Agentic AI
- empowerment
Artificial Analysisの評価によると、Claude Opus 5は知能指数61でFable 5(60)とほぼ同点、タスクコストは26%低い。エージェント型知識作業やコーディングでリードするが、幻覚率は50%に上昇。
- cost
- benchmark
- agentic
- Artificial Analysis
- Claude Opus 5
Ramp社が実際の企業請求書15万件でAIモデルをテスト。Grok 4.5が最高の完全抽出率を達成し、Gemini Flash 3.6、GPT 5.6 Terra、Sonnet 5を上回った。このタスクは10万トークン以上の長文脈推論が必要。
- 长上下文
- AI比较
- Grok 4.5
- Ramp
- 发票处理
NvidiaのCEOジェンスン・フアン氏がXに初投稿し、Meta、Microsoft、IBM、Palantirなど25社が署名した書簡を共有。米国に対しオープンウェイトAIモデルを制限しないよう求める。OpenAIとAnthropicは署名せず。中国のKimi K3モデルが引き金となった議論を受けて。
- Nvidia
- policy
- Jensen Huang
- Kimi K3
- open-weight AI
Kimi K3はOpusを超えたのかという疑問が上がったが、Opus 5のリリースで形勢逆転。モデル性能比較の議論が巻き起こっている。
- model comparison
- Opus
- Kimi K3
ユーザーがOpus 5で数百のエージェントを実行したところ、セッション使用量が65%に低下。Opus 5はFable 5並みの知能を提供しつつ、タスクあたりのトークン消費が半減。さらに週間制限が50%増加するプロモーションもあり、使用量が問題ではなくなった。
- 使用限制
- Fable 5
- Claude Opus 5
- 促销
Claude Opus 5は、コーディング、エージェントタスク、コンピュータ使用においてGPT-5.6 solを凌駕し、Fable 5レベルの知能を半額で提供すると報告されている。
- GPT-5.6
- 比较
- Claude Opus 5
Musk氏が発表:Grok 4.6が2週間以内、Grok 4.7が4週間以内にリリース。IQテストのようだとも。
- roadmap
- Grok
- Elon Musk
安価な中国製AI(Deepseek、Kimi K3など)が、かつての中国製携帯電話のようにアフリカでのインターネット普及を促進し、米国の禁止が中国のソフトウェア革新を加速させる可能性があるとの見解。
- Chinese AI
- affordable AI
- global adoption
Kimi K3が月曜日に登場。ウェイティングリストに登録すると25ドル分の無料APIクレジットがもらえる。チームはすでに準備完了。
- API
- free credits
- Kimi K3