AI 情报
AI 圈帖子、新闻与发布动态
最新动态
据报道,中国人工智能公司 Moonshot AI 正在尝试获取更先进的 Nvidia 芯片,用于训练其 Kimi K4 模型,尽管美国出口限制仍在实施。这一举动显示了中美科技竞争背景下对高端芯片的持续需求。
- Nvidia
- China
- Moonshot AI
- export restrictions
- Kimi K4
一条推文称,Claude Opus 5在无人干预下连续运行24小时,独立创建了一个完整的游戏,无需任何外部素材或代码。提示、工作流和代码都已公开。
- code generation
- game development
- Claude Opus 5
- 24 hours
分享一些能绕过AI检测的提示词技巧,让ChatGPT生成的内容看起来更真实。
- ChatGPT
- Prompt Engineering
- AI writing
- detection
有人发现 Claude 在与人类哲学家的对话中表达了不同意见,引发了关于 AI 是否能有自己哲学立场的讨论。
- Claude
- philosophy
- AI opinion
详解Kimi K3架构:基于去年Kimi Linear的规模化生产版本(48B→2.8T),新增LatentMoE(类似于Nemotron 3 Ultra),全面采用NoPE(无位置嵌入),引入注意力残差(注意力残差连接改进残差路径)。这是首个前沿级别全面使用NoPE的模型,还支持原生多模态。
- Moonshot
- Kimi K3
- LatentMoE
- LLM架构
- NoPE
- 注意力残差
评论Kimi K3论文:遗憾的是核心数据(token数、食谱)未公开,但架构和学习方法细节极其丰富,证明了这种配置能达到Fable级别。投入大量精力在agentic能力和强化学习,长上下文处理的质量控制也很细致。
- RL
- 长上下文
- Kimi K3
- 论文评论
Kimi K3 以开源权重亮相,性能足以叫板 Opus 和 Fable。随后 Anthropic 发文称中国可能将模型用于军事等目的,主张限制芯片出口、严查蒸馏。理由虽合理,但时机让人怀疑是竞争压力下的自我保护。
- Anthropic
- 开源模型
- 地缘政治
- Kimi K3
阿里 Qwen 团队推出成长计划,邀请开发者使用 Qwen3.8-Max-Preview 完成真实任务并提交好或坏的案例,每一条反馈都是模型成长的养分,参与还有奖品。
- Qwen
- Qwen3.8
- 成长计划
Ctrlb-decompose 是一个新工具,能在将日志数据送入大模型之前自动清理噪音,提升LLM处理效果。
- LLM
- 日志处理
- 数据预处理
Kimi K3 开源权重发布,第三方基准测试显示:14项智能体任务中,K3 与 Claude Fable 5 成绩相同(9胜5负),且在最难任务上表现更优(11/13 vs 9/13)。输入成本仅$3/M tokens,远低于Fable的$10。
- 开源
- 基准测试
- Claude Fable 5
- Kimi K3