AI 情报
AI 圈帖子、新闻与发布动态
最新动态
Kimi K3 是一个拥有2.8T总参数、104B激活参数的MoE模型,通过架构、数据、训练方法的综合改进,在验证损失相同的情况下训练计算量仅为K2的1/2.5。报告详细介绍了KDA、Attention Residuals、Stable LatentMoE等创新。
- MoE
- オープンウェイト
- Kimi K3
- Attention Residuals
- Stable LatentMoE
- 技術報告
Anthropic CEO Dario回应Nvidia CEO黄仁勋的公开信,声明从未主张禁止开源模型,但支持不向中国出售芯片、打击走私、强制安全测试等措施,并表达对开源模型在生物武器方面风险的担忧。
- Anthropic
- AI safety
- Nvidia
- regulation
- open weights
- Dario
- Jensen
Venice 提供基于 DIEM 的免费 API 密钥,每天 $1000 额度,有效一周,可用于 Kimi K3 模型,无需审批。
- Venice
- free API
- Kimi K3
一位推理工程师分享,在100K-1M token的输入长度且前缀缓存命中率高的场景下,分词耗时变得显著,影响首词延迟。为此,Michael 已为 Kimi K3 优化了分词步骤。
- tokenization
- Optimization
- inference
- Kimi K3
Dario Amodei在新文章里声称中国哪怕只落后两年也是噩梦,作者批评这种观点完全是扯淡。文章还提到他之前关于出口管制和AI指数的论述,表明他认为中国必须被远远甩在后面才行。
- Anthropic
- AI policy
- China
- export controls
用户批评Anthropic认为可以自由使用全球所有内容训练模型,即使作者反对;但若有人付费使用Anthropic的输出进行训练,则被视为盗窃知识产权。
- Anthropic
- copyright
- IP
- hypocrisy
- training data
展示了如何在 AMD MI350X GPU 上使用 SGLang 部署 Kimi K3 模型。
- SGLang
- AMD
- Kimi K3
- MI350X
针对外界关于开源权重模型立场的猜测,我们发布了完整声明阐述观点。
- AI policy
- open-weights models
- position
Moonshot AI的Kimi-K3模型已完成1比特量化,模型大小仅246GB,作者声称这是世界最快模型。
- Kimi K3
- 1-bit quantization
- 模型量化
原油价格下跌,但半导体板块却大跌,原因是市场担心中国企业在浸没式DUV光刻机上的突破将加剧存储芯片竞争,同时AI模型Kimi K3可能降低算力需求预期。
- AI
- 中国
- 半導体
- 株価