AI 日报 · 2026-09-14
今日主线是 AI agent 从内部实验走向可运营:LangChain 同时公开 GTM 与付费媒体两个内部代理的成效,并用托管凭证 Connections 把权限、审计和轮换从代码中解耦。它们与 Perplexity 的 Windows 版 Portable Computer 共同反映一个趋势——…
今日主线是 AI agent 从内部实验走向可运营:LangChain 同时公开 GTM 与付费媒体两个内部代理的成效,并用托管凭证 Connections 把权限、审计和轮换从代码中解耦。它们与 Perplexity 的 Windows 版 Portable Computer 共同反映一个趋势——把代理部署到真实工作流,同时把模型判断、代码计算和人工审批边界做清楚。研究方面,腾讯混元发布 Simple Attention Sparsification 注意力门控检查点,以可学习的 KV 块排序和连续门控实现长上下文稀疏解码,需配合 Qwen3 基座和 seer_attn 后端使用。其余更新包括 Credit Genie 用 OpenWiki 自动维护代码库文档,以及 Simon Willison 发布 commit-rewriter 和 shot-scraper 1.12 的 WebP 截图支持。
东亚一手(中国厂商官方 & 模型发布)
腾讯(混元)
⭐⭐ [研究] tencent/Simple-Attention-Sparsification
Tencent Hunyuan Models (HuggingFace) · 2026-09-14 · 原文 ↗
腾讯混元在 HuggingFace 发布 Simple Attention Sparsification(SAS)的注意力门控检查点。该方法让模型为每个 query 学习对 KV 块进行排序与选择;与通过蒸馏稠密注意力分数来训练稀疏注意力选择器不同,SAS 在选中的块上加入连续门控,使语言建模损失能够端到端优化上下文排序。发布的三个检查点分别基于 Qwen3-4B、Qwen3-8B、Qwen3-14B,门控参数量为 33.0M/33.0M/42.0M,对应 64/64/81 MiB。官方说明这些只是路由检查点而非独立语言模型,Qwen3 骨干在训练中被冻结且未包含在内,需配合对应 Qwen3 基座与 sglang-blocksparse 分支中的 seer_attn 后端才能推理。配置上三个检查点一致:KV 块大小 64 token、训练 Top-K 为 31 个历史块、门控隐藏维度 128、在 OpenR1-Math-220k 上以 32,768 token 序列长度训练,默认稀疏解码预算 2,048 token,且同一检查点可在 1,024/2,048/4,096 token 预算下免重训评测。
打分理由
这是一手厂商发布的稀疏注意力路由权重与配套推理方案,并非旗舰模型发布,属于面向长上下文效率的技术性开源,行业影响面有限。
衍生 & 周边(产品 / Agent / Tools / 观点)
产品更新
⭐⭐ [产品更新] Perplexity Portable Computer Is Now Available on Windows, Powered by NVIDIA RTX
NVIDIA Blog · 2026-09-14 · 原文 ↗
NVIDIA 博客介绍,Perplexity 的 Portable Computer 现已在 Windows PC 上可用,并由 NVIDIA RTX 提供加速。文中称 Portable Computer 是 Perplexity Computer 智能体的本地版本,能够规划并执行多步骤任务。随着本地模型能力提升,AI 智能体可以在 PC 上直接处理更多工作,同时把敏感信息保留在设备本地。它使用本地模型分析数据并汇总信息。
打分理由
衍生信源的产品可用性公告,属于常规产品更新,正文未给出 benchmark 数据或版本细节,值得一读但不构成必读。
⭐⭐ [产品更新] Connections: managed credentials and per-caller identity for Managed Deep Agents
LangChain Blog · 2026-09-14 · 原文 ↗
LangChain 为 Managed Deep Agents 推出 Connections 功能(v0.7.0+),将凭证存放在 LangSmith 工作区而非 .env 或构建产物中,轮换或撤销凭证无需改代码、无需重新部署。每个连接由两个相互独立维度定义:归属方(agent 或 caller)与凭证类型(静态密钥或 OAuth 授权)——agent 归属的凭证由所有调用方共享,用户归属的凭证在运行时按人解析,使 agent 以请求者本人的身份行动。连接通过 `mda connections create` 创建,工具在运行时以 `connections.get()` 按 slug 读取凭证。OAuth 授权往返由 Managed Deep Agents 负责,项目内无需回调路由、令牌存储、刷新逻辑或同意页面。GitHub 已进入连接目录(另有 22 个服务),也可自带 OAuth 元数据接入任意提供方。
打分理由
LangChain 开发者工具的产品更新,含具体版本号与 API,但属常规凭证管理能力增强,未改变行业格局。
⭐⭐ [产品更新] commit-rewriter 0.1
Simon Willison's Weblog · 2026-09-14 · 原文 ↗
Simon Willison 发布了一个名为 commit-rewriter 0.1 的小型 Python web 应用,用于编辑 git 仓库的提交信息。他最初开发这个工具是为了编辑 Datasette 安全版本发布时的提交信息,因为原始提交中充斥着编码 agent 留下的杂乱内容和私有仓库的 issue ID 引用,不适合公开发布。使用方式为运行 uvx commit-rewriter 加上仓库路径,若已在目标仓库目录下则可省略路径。提交编辑后,工具会对当前仓库状态创建一个带时间戳的分支以便需要时回滚,然后重写从第一个被编辑的提交到最新提交之间的所有提交。
打分理由
作者发布了一个可运行的开源小工具(含明确使用方式与行为说明),但属于个人辅助性工具,影响范围有限。
⭐⭐ [产品更新] shot-scraper 1.12
Simon Willison's Weblog · 2026-09-13 · 原文 ↗
Simon Willison 发布了 shot-scraper 1.12,为其用于网站截图、录制视频演示和用 JavaScript 抓取站点的命令行工具新增了 WebP 截图支持。使用方式为在命令中加入 -o screenshot.webp 并可用 --quality 指定质量,不指定该参数时 WebP 文件为无损。作者表示在他自己的经验中,WebP 截图的文件体积几乎总是明显小于同等 JPEG 或 PNG。他还说明加入这一功能是为了给新工具 commit-rewriter 生成截图。
打分理由
个人开源截图工具的一次小幅功能更新,新增 WebP 输出格式并给出可复现的用法,对该工具的用户有实际用处,但影响范围有限。
其他
⭐⭐ [其他] How We Built LangChain’s Paid Media Agent
LangChain Blog · 2026-09-14 · 原文 ↗
LangChain 撰文介绍其自建的 Paid Media Agent:为了在六个月内把付费渠道从 0 扩展到 5 个,团队构建了一个常驻 Slack、每周一运行的长期运行代理,把各广告平台数据与业务上下文结合起来,用于跟进新产品、起草活动、添加关键词、测试变体,并把实验提案提交给团队审批。文章给出三条工程经验:把代理当作知识工作者,为它准备沙盒、软件与清晰的操作说明;让模型负责判断、让代码负责计算与一致性;围绕完整工作流设计,包含明确权限与人工审批环节。结果上,付费媒体从占营销管道的 0% 升到 20%,6 至 8 月单条合格线索成本下降 30%(同期月支出增加约 60%),LinkedIn 上的 CPL 比 1 月低 40%,把分析与报告收回自建后每月省下约 5000 美元;通过把计算移入代码并减少模型调用,一个早期报告流程成本降低约 40 倍、速度快 13 倍,运行时间从 18 分钟降到 85 秒。该代理已开源,团队将于 9 月 23 日举办线上分享。
打分理由
厂商工程博文,含可复现的量化结果(CPL、管道占比、成本与耗时)并开源了可用产物,讲清了具体做法,但属衍生内容且非模型发布或行业级事件。
⭐⭐ [其他] How Credit Genie keeps codebase docs fresh with OpenWiki
LangChain Blog · 2026-09-14 · 原文 ↗
LangChain 博客发布客户案例,介绍移动端金融健康平台 Credit Genie 如何用 LangChain 开源仓库文档代理 OpenWiki 维护代码库知识。此前该团队依赖 Notion 页面、README 和 AGENTS.md,文档很快过时且难查找,知识逐渐集中在个人手上,人和编码代理都容易基于过期上下文行动。Credit Genie 用 OpenWiki 根据代码变更自动生成并更新仓库级文档,并把各仓库的 OpenWiki 文档聚合到一个托管在 GitHub Pages 的可搜索门户。运维上通过每晚运行 OpenWiki、自动提交 PR、自动合并工作流和每日重建门户来保持文档更新;工程师用门户理解不熟悉的系统,编码代理在改动前被提示先查看 openwiki/ 文件夹。团队下一步计划把 OpenWiki 与内部知识图谱打通,以体现仓库之间的依赖关系及其变更影响。
打分理由
属于厂商客户案例,描述了用 OpenWiki 自动生成仓库文档、夜间运行、自动 PR 与门户聚合的具体做法,但无评测数据或新产品功能发布,按衍生内容给 2 分。
⭐⭐ [其他] How we built LangChain’s GTM Agent
LangChain Blog · 2026-09-14 · 原文 ↗
LangChain 团队撰文介绍其内部构建的 GTM Agent:该 agent 基于 Deep Agents 搭建,在新线索进入 Salesforce 时触发,先检查是否应当外联(例如是否刚提交工单、同事是否近期已联系),再收集包括会议历史在内的上下文,最后在 Slack 中生成带推理过程与来源的邮件草稿,交由销售代表审核发送。团队设定的硬性要求包括人工审核后才发送、检查联系历史、草稿体现账户当前状态、展示关键输入以确保可解释,并能从代表的修改中持续学习;每一次发送、修改、取消操作都会记录到 LangSmith 并关联到底层 trace。除撰写草稿外,该 agent 还聚合网页活动、开发者生态、产品使用和市场营销触点等账户级信号,提示交易风险、扩展机会和竞争动向。文中给出的结果包括:2025 年 12 月至 2026 年 3 月线索到合格商机转化率提升 250%、同期 pipeline 金额增长 3 倍,代表对低意向线索的跟进增加 97%、对高意向线索增加 18%,每人每月节省 40 小时(团队合计 1,320 小时),销售团队成员日活使用率 50%、周活使用率 86%。
打分理由
这是 LangChain 的工程实践博文,给出了可复现的量化结果(如转化率提升 250%、每人每月省 40 小时)和具体实现办法,按 secondary 标准属于值得一读。
每天 3–5 条 agent 生态一手信号,中英双语。不错过重要更新 → 订阅邮件
Loading...