AI 日报 · 2026-07-28
月之暗面发布参数达 2.8T 的原生多模态模型 Kimi K3,采用 KDA 和 AttnRes 新架构,支持百万 token 上下文,在长程知识和多模态基准上直接对标 Claude Fable 5、GPT-5.6 Sol 等顶级模型,权重以「开放权重」许可公开;不过许可以收入门槛要求商业实体另行签…
月之暗面发布参数达 2.8T 的原生多模态模型 Kimi K3,采用 KDA 和 AttnRes 新架构,支持百万 token 上下文,在长程知识和多模态基准上直接对标 Claude Fable 5、GPT-5.6 Sol 等顶级模型,权重以「开放权重」许可公开;不过许可以收入门槛要求商业实体另行签约,第三方推理服务已同步上线。其它产品动态包括 Cursor 在印度推出 ₹649 月付 Start 计划、LangChain 将内部数据团队转向 Agent 优先的自助分析栈并公开全文搜索实现等。
东亚一手(中国厂商官方 & 模型发布)
月之暗面(Kimi)
⭐⭐⭐⭐⭐ [模型发布] moonshotai/Kimi-K3
Moonshot Kimi Models (HuggingFace) · 2026-07-27 · 原文 ↗
月之暗面(Moonshot AI)发布了其迄今最强模型 Kimi K3,这是一个参数规模达 2.8T 的开源原生多模态智能体模型,采用 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes) 新架构,支持 100 万 token 上下文窗口,并原生处理图像和文本。Kimi K3 在长程编码、智能体知识工作和多模态任务上展现前沿能力,评估中在多项基准测试与 Claude Fable 5、GPT-5.6 Sol 等顶尖模型竞争。模型权重在 Kimi K3 许可证下完全开源,旨在推动研究、部署与创新。
打分理由
月之暗面旗舰模型 Kimi K3 以 2.8T 参数规模开源,架构创新,并在众多基准上对标国际顶尖模型,行业影响力显著。
衍生 & 周边(产品 / Agent / Tools / 观点)
模型发布
⭐⭐⭐ [模型发布] moonshotai/Kimi-K3
Simon Willison's Weblog · 2026-07-27 · 原文 ↗
月之暗面 Moonshot 发布了 Kimi K3 模型的权重,这款 2.8 万亿参数模型的 1.56TB 文件已托管在 Hugging Face。相比此前的 K2 许可,K3 的许可不再称「修改版 MIT」,对运营「模型即服务」业务且收入达到门槛的商业实体要求与月之暗面另行签署协议,官方始终使用「开放权重」而非「开源」来定位。OpenRouter 已有 7 家提供商以每百万 tokens 输入 3 美元 / 输出 15 美元的价格提供 K3 服务,价格与 Moonshot 自身一致。
打分理由
月之暗面发布 2.8 万亿参数模型的开放权重并调整商业许可,是开源/开放权重生态中一项值得关注的动态。
产品更新
⭐⭐ [产品更新] Cursor Start
Cursor Changelog · 2026-07-28 · 原文 ↗
Cursor 推出面向印度开发者的「Start」月付计划,定价 ₹649,支持本地支付方式 UPI。该计划包含 Grok 4.5 和 Composer 模型的充足用量、始终在线的云代理、iOS 远程控制、插件与 MCP 等扩展功能。现有免费用户可在仪表板升级,新用户注册时即可选择。即日起生效,每月自动续费。
打分理由
仅针对印度市场推出新的地区定价与支付方案,属常规产品更新,行业影响有限。
⭐⭐ [产品更新] How LangChain Built an Agent-First Data Stack
LangChain Blog · 2026-07-28 · 原文 ↗
LangChain 的数据团队从传统 BI 工具迁移到一个「Agent 优先」的自服务数据栈,通过提供清晰的数据模型、指标定义、业务上下文和可信来源,使数据 Agent 能更准确地回答公司内部的大量问题。目前该 Agent 处理的请求量约为三人数据团队直接响应量的 40 倍,近 30 天内几乎所有有权限的用户(占公司三分之一)都使用了它,共产生约 2200 次对话。数据团队的角色从逐一回答问题转变为持续改进系统、构建模型和反馈闭环。这一架构迁移展示了如何为 Agent 注入足够上下文来提升分析可信度和自服务覆盖范围。
打分理由
该文章分享了 LangChain 内部构建 Agent 优先数据栈的具体实践与量化结果,对正在打造数据 Agent 的团队有参考价值,属于值得关注的行业案例。
⭐⭐ [产品更新] Full Text Search in SmithDB: Designing an Inverted Index for Object Storage
LangChain Blog · 2026-07-27 · 原文 ↗
LangChain 的 SmithDB 为代理跟踪数据新增了全文搜索与 JSON 过滤功能,可在对象存储中的大型、深度嵌套 JSON 文档上实现 P50 延迟 400 毫秒的查询性能。该功能通过设计倒排索引来适配对象存储环境,兼顾了灵活性与响应速度。文章详细介绍了索引结构的设计思路,对使用 LangChain 生态的开发者具有实操参考价值。
打分理由
SmithDB 新增搜索与过滤能力的实现细节,对使用该平台的开发者有参考价值,但属于常规产品功能补充,行业影响有限。
观点
⭐⭐ [观点] Own Your Intelligence: The Key to Lasting AI Advantage
LangChain Blog · 2026-07-27 · 原文 ↗
通用AI不足以构建长久优势,企业必须「拥有自己的智能」——即掌控模型、代理系统、上下文和记忆等关键环节。这意味着不仅要控制成本、质量、风险和行为,还要建立反馈循环,让智能随使用不断累积和优化。文章以保险理赔和垂直AI创业为例,说明定制化智能才是差异化来源,而通用基础设施可以采购,真正的壁垒在于企业自身沉淀的智能系统。
打分理由
这是一篇关于企业如何通过拥有定制化AI智能获得持久优势的深度观点文章,分析透彻但属于常规行业分析,无重大新闻性。
⭐⭐ [观点] An opinionated guide to which AI to use to do stuff
Simon Willison's Weblog · 2026-07-27 · 原文 ↗
西蒙·威利森评论了伊桑·莫利克的 AI 使用指南的演化:过去一年核心是聊天模型,如今重心转向能自主完成数小时工作的智能体系统。谷歌 Gemini 因缺乏成熟的「代理」产品而跌出推荐列表,Gemini Spark 尚未证明自己。文章详细剖析了 ChatGPT 与 Claude 中「Work」「Cowork」「Codex」等模式的命名混乱,指出移动端与桌面端同名模式的行为差异,例如移动端 ChatGPT Work 模式实际上是开启了代码解释器的互联网访问,令人困惑。
打分理由
深度解析了 AI 代理功能的命名混乱与平台差异,对了解产品现状有参考价值,但属于衍生评论,非重大发布或产品更新。
每天 3–5 条 agent 生态一手信号,中英双语。不错过重要更新 → 订阅邮件
Loading...