AI 情报
AI 圈帖子、新闻与发布动态
最新动态
最新基准测试显示,Kimi-K3在前端编码任务中取得了76%的成对胜率,远超Claude Fable 5的63%和GPT-5.6 Sol的58%,差距出乎意料地大。
- Claude
- GPT
- 基准测试
- Kimi K3
- 前端编码
作者认为如果美国禁止Kimi,实际上对Kimi有利:它在美国赚不到多少钱,禁令反而证明其技术领先,有助于中国IPO;而美国消费者和企业将面临更高的AI支出、更慢的Agent采用,并且失去数据和AI主权。
- Kimi
- AI产业
- 美国禁令
- MAGA
研究显示,AI聊天机器人在提供情感支持方面与人类不相上下,某些情况下表现更佳。
- AI chatbots
- emotional support
作者批评美国拟议的政策,认为它无法真正打击Kimi,因为Kimi在美国收入有限,禁令反而证明其技术实力,帮助在华IPO;而美国消费者和企业将面临更高的AI运营成本和更慢的AI采纳。
- Kimi
- AI发展
- 美国政策
作者看完DeepSeek CEO梁文锋四小时投资人会议后,对比白宫等美国政客的表现,认为美国政客像笑话,梁文锋的目标是AGI和服务全人类,不在乎美国人和企业是否使用。
- DeepSeek
- 梁文锋
- 美国政客
作者坦言,经过测试,Qwen 3.6 27B是当下200B参数以下最好的开源模型,除了它自己的微调版本外,其他模型都无法匹敌。
- Qwen
- 开源模型
- 对比
关于Kimi-K3等中国大模型所需算力来源的疑问,有美国高级官员暗示这些模型可能通过泰国非法获取NVIDIA GB300芯片。但作者怀疑如此大规模的秘密采购是否可行。
- Kimi
- 中国AI
- 计算资源
- GB300
- 制裁
邀请更多硬件厂商合作优化推理性能,并强调开源精神。
- 开源
- 推理性能
- 硬件合作
一位安全研究员与南美恶意软件作者交谈,对方承认主要用ChatGPT编写恶意代码,并通过Discord分发,上周收入约5.4万美元。对话还涉及非法移民等话题。
- ChatGPT
- 网络安全
- 恶意软件
用户询问Claude Tag的工作方式与定时运行的提示词(调用工具达成目标)之间的区别,引发了关于AI代理调度机制的讨论。
- AI agents
- tool calling
- Claude Tag
- cron