AI 情报
AI 圈帖子、新闻与发布动态
最新动态
Kimi CEO上台打开笔记本,在11分钟内用K3独立构建了一个完整应用。他指出过去需要团队、预算和数月,现在只需一个周末和15美元计划,测试创意的成本降至午餐价格。
- AI编程
- 效率
- 应用开发
- Kimi K3
- CEO演示
一篇分析指出,2万亿美元的AI循环融资都押注在Anthropic和OpenAI等前沿公司能兑现1.5万亿美元的未融资承诺上。如果中国开源LLM抢占市场份额,他们可能无法兑现,这解释了为什么会有针对中国LLM的打压。
- frontier models
- AI financing
- Chinese LLMs
文章指出测试套件通过并不代表模型真实可靠,可能隐藏深层缺陷,引发对评估方法的反思。
- 测试
- 陷阱
- 模型评估
Core MCP 现已上线,允许 Claude、ChatGPT 等兼容 MCP 的代理连接 Core 无种子钱包,用户可自行设置安全护栏,实现 AI 代理使用加密钱包的功能。
- MCP
- AI代理
- 加密钱包
SpaceXAI 宣布 Grok 4.5 已在 Web、X、iOS、Android 全平台上线,号称迄今最智能的模型。
- 模型发布
- SpaceXAI
- Grok 4.5
Google 推出 Gemini 3.5 Flash Cyber 模型,帮助安全专家检查更多代码路径。在 Chrome 和 Android 代码库测试中,它能持续发现标准模型遗漏的复杂、独特漏洞。
- Gemini
- security
- code analysis
- 3.5 Flash Cyber
Google 推出 Gemini 3.5 Flash Cyber,一个专门为安全团队设计的轻量级模型,帮助在漏洞被利用前发现并修补。
- Gemini
- security
- vulnerability
- 3.5 Flash Cyber
Merge API推出Fusion服务,一次提示发给多个模型独立回答,再由裁判模型整合生成最终答案。基准测试显示,开源模型组合(GLM-5.2+DeepSeek V4 Pro+Qwen 3.7)比单独使用GPT-5.5高出10.5分,而以约四分之一成本达到Claude Fable 5级别质量。这不是任务拆分,而是每位模型都回答整个提示,类似专家评审团。
- multi-model
- Fusion
- ensemble
- merge
作者为了用Claude处理再贷款事宜,为英格兰银行的数据构建了一个模型上下文协议(MCP)接口。展示了Claude在金融领域的实际应用。
- MCP
- Claude
- finance
- Bank of England
月之暗面最新模型 Kimi K3 已登陆 Pieverse 全家桶,支持通过 OpenAI 兼容 API 调用(百万上下文、图文输入、推理和工具调用),也可在 Purr-Fect Claw 中直接设为智能体默认模型,无需自带密钥。
- 大模型
- AI Gateway
- Kimi K3
- Pieverse