AI 情报
AI 圈帖子、新闻与发布动态
最新动态
最新数据:Grok 4.5在OpenRouter平台的Token消耗量超过GPT-5.6 Sol和Fable 5,跻身闭源模型前十,显示其受欢迎程度和实际使用量增长。
- OpenRouter
- token volume
- Grok 4.5
- top 10
Kimi K3 完成了一项之前只有Mythos和GPT-5.5 Cyber才能完成的复杂网络任务,且该评测并非公开,无法刷榜。
- Model Capability
- cyber security
- Kimi K3
随着Kimi K3即将开源,网友预测去审查版本将很快出现,相当于一个Opus4.8级别的武器公开可用,所有互联网设施和DeFi协议面临严重风险。
- Kimi K3
- 开源安全
- DeFi风险
Kimi K3 将于7月27日零点登陆 Together AI,开发者可第一时间基于Together AI的推理服务进行编码、智能体和生产工作负载的构建。
- model deployment
- Together AI
- Kimi K3
Grounded-forge 提出了一种新的 RAG 架构,在数据摄取阶段就预先计算好摘要和任务视图,大幅提升检索效率。
- RAG
- summarization
- grounded-forge
- precomputed
- ingest
OpenAI 宣布 ChatGPT Voice 功能现在可以通过 iOS 应用的远程访问在 Codex 中使用,Android 支持即将到来。
- ChatGPT
- codex
- Android
- iOS
- voice
有人发现通过将提示编码为 PNG 图片提交给 Claude Code,可以大幅降低 token 消耗,从而节省高达 70% 的成本。
- Claude Code
- 省钱
- PNG提示
一个工具让你在各种 AI 终端(Codex、Kimi、Grok、Cursor)中直接运行 Claude Code,扩展使用场景。
- Cursor
- Claude Code
- codex
- Kimi
- Grok
xAI 的 Grok 4.5 在 ARC-AGI-1 达 85.7%(0.33 美元/任务),ARC-AGI-2 为 52.6%(0.78 美元),ARC-AGI-3 仅 0.3%(6.9K 美元)。提高推理强度未提升性能。
- Grok
- 基准测试
- xAI
- ARC-AGI
美国政府声称Kimi K3远不如美国前沿模型,LiveBench也持相同看法。作者吐槽Kimi只是一个便宜的Sonnet/Opus 4.6级模型,并非真正的前沿智能。
- LLM benchmark
- US government
- Kimi K3