AI 日报 · 2026-09-10

OpenAI 今天发布 GPT-6 Astra,主打工作场景与直接操作无 API 应用,并同时公开政策主张、宣布 Paul Christiano 加入董事会,显示出模型能力、企业落地与安全治理同步加速。DeepSeek 则放出多模态 MoE 模型 DeepSeek-V4.1-Flash,以 552B…

OpenAI 今天发布 GPT-6 Astra,主打工作场景与直接操作无 API 应用,并同时公开政策主张、宣布 Paul Christiano 加入董事会,显示出模型能力、企业落地与安全治理同步加速。DeepSeek 则放出多模态 MoE 模型 DeepSeek-V4.1-Flash,以 552B 骨干、百万 token 上下文和极低 KV 缓存强调推理效率。产业侧,NVIDIA 继续扩大推理芯片互连与澳大利亚算力容量,d-Matrix 接入 NVLink Fusion;Hugging Face、IBM、LangChain、Replit/Databricks 等则分别更新工作流、时序模型、凭据管理和全栈应用集成。消费与安全方面,Google Search 增加橄榄球实时观赛功能,而 Calif Research 展示的微信零点击蠕虫引起对 AI 加速漏洞利用的警惕。

北美一手(LLMs 官方 & 关联账号)

OpenAI

⭐⭐⭐⭐⭐ [模型发布] GPT-6 Astra: The next generation in intelligence for work

OpenAI News · 2026-09-09 · 原文 ↗
OpenAI 发布 GPT‑6 Astra,称其为面向工作场景的最强模型,现已在 ChatGPT Work、Codex 和 API 中提供。官方称 Astra 在计算机操作、浏览、专业工作、软件工程、网络安全和科学等任务上处于业界领先水平。该模型可直接操作人们日常使用的应用,即使这些应用没有 API,从而无需大量前期准备或工程改造即可嵌入企业现有流程。Cognition、Databricks、Hebbia、Box、Figma 和 Thomson Reuters Labs 等合作方给出了评测与使用反馈,例如 Databricks 称其在 OfficeQA Pro 与 Pro V2 基准上取得新的最优结果;OpenAI 内部则用它把三小时多机位素材剪成视频,并通过更换内存分配器定位 Codex 测试环境中的内存分配瓶颈,实现轮次延迟降低 25 倍、峰值内存占用增加约 30%。
打分理由
这是一手厂商发布的主力旗舰模型,并同步上线 ChatGPT Work、Codex 与 API,属于最高层级的产品发布。

⭐⭐⭐ [观点] The AI policy window is open. We need to act.

OpenAI News · 2026-09-09 · 原文 ↗
OpenAI 首席全球事务官 Chris Lehane 发文称 AI 能力进入新阶段,需要与之匹配的新政策,主张「以有意义的行动优先于政策完美」。OpenAI 表示希望与国会合作,推动强制性的、基于能力的国家级 AI 安全监管;在国会行动之前,将继续支持各州立法,并宣布支持四项加州法案:SB 813(独立安全评估的基础设施)、AB 1405(AI 审计师标准)、SB 1119(对年轻人的保护)和 AB 1864(针对 AI 相关生物威胁的防护)。公司还表示将与其他前沿实验室共同推进前沿 AI 标准,先建立自愿机制,并倡导在能力测量、风险管理、保持人类控制以及何时放缓或停止开发等方面形成兼容的国际做法。文中援引首席科学家 Jakub Pachocki 关于机器智能快速发展和递归自我改进潜力需要「极度谨慎」的观点,并提到已在模型开发生命周期加强监控、对齐与安全保障,包括对 Astra 引入对完整轨迹(含思维链)的普遍监控,以及扩大内部部署前的强制性对齐评估关口。OpenAI 表示当推进将带来不可接受的安全风险时,会放缓或停止无法充分保障的系统的开发或部署。
打分理由
一手厂商的重要政策表态:宣布支持四项加州法案并呼吁强制性的国家级 AI 安全监管,属于重大安全/政策动向,但非模型或产品发布,按非模型内容上限给 3。

⭐⭐ [其他] Paul Christiano joins OpenAI Foundation Board

OpenAI News · 2026-09-09 · 原文 ↗
OpenAI 宣布任命 Paul Christiano 加入 OpenAI Foundation 董事会,他将作为无投票权观察员列席 OpenAI Group PBC 董事会。Christianos 还将加入 Foundation 董事会的安全与安全委员会(SSC),与主席 Zico Kolter 共事;该委员会对所有 OpenAI(含 OpenAI Group PBC)的安全与安保实践行使治理。他目前在美国商务部 NIST 下属的人工智能标准与创新中心(CAISI)任高级技术顾问,此前在该机构及其前身美国人工智能安全研究所从事前沿模型评估(包括涉及国家安全的能力)与风险缓解工作,同时是对齐研究中心(ARC)创始人。2017 至 2021 年他曾在 OpenAI 领导对齐研究,并对基于人类反馈的强化学习(RLHF)作出基础性贡献。Bret Taylor 表示其经验将加强董事会监督与 SSC 的工作,Christiano 则称 AI 能力近一年进步很快、对齐仍是困难的技术问题。
打分理由
属于人事与治理层面的任命,非模型或产品发布;但涉及 OpenAI 安全与安全委员会这一关键治理机构,且当事人是对齐领域重要研究者,故给 2 分。

Google

⭐⭐ [产品更新] Get ready for the game with new football features in Search

Google AI (The Keyword) · 2026-09-09 · 原文 ↗
Google 在 Search 中推出多项橄榄球相关新功能。新增的 Live Game Feed 可让用户搜索正在进行的比赛并实时跟进,内容包括比赛整体回顾、逐回合动态时间线、社交评论、关键视频集锦以及 AI 生成的洞察,该功能目前面向美国移动端英文用户,本月晚些时候将支持大学球队并扩展到更多地区。Search 还新增了对阵轮播,方便查看同联盟其他比赛的比分,并推出更详细的球员与联盟数据(如传球达阵、冲球码数、擒杀、掉球、接球后推进码数),未来还将显示夺冠热门和季后赛对阵表,这些更新将在全球移动端提供。此外,用户可将 Yahoo Fantasy 或 Sleeper 账号与 Search 关联,通过 AI Mode 获取基于实际阵容的定制建议,如首发/替补选择和 waiver 目标,目前面向美国英文用户开放。
打分理由
Google 搜索的消费级体育功能更新,含 Live Game Feed 与 AI Mode 的梦幻橄榄球账号关联,属常规产品迭代,对 AI 行业影响有限。

东亚一手(中国厂商官方 & 模型发布)

DeepSeek

⭐⭐⭐⭐ [模型发布] deepseek-ai/DeepSeek-V4.1-Flash

DeepSeek Models (HuggingFace) · 2026-09-10 · 原文 ↗
DeepSeek 在 HuggingFace 发布 DeepSeek-V4.1-Flash,一个原生处理图像与文本的多模态 MoE 模型,骨干参数 552B,支持最长 100 万 token 上下文,采用 MIT 许可。模型使用因果编码器-解码器(CED)架构,由 20 层因果编码器和 20 层解码器组成,prefill 阶段每 token 仅激活 8B 参数、decode 阶段激活 16B。通过 SWA Bounded Replay、压缩稀疏注意力 CSA2、以及 FP4 主 KV 缓存(E2M1 格式,每 16 通道一个 E4M3 scale)等设计,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4;其他组件包括 Single-Pass mHC、Engram 条件记忆(196B 参数)和 DSpark 投机解码,每个 MoE 层含 1 个共享专家与 384 个路由专家、每 token 激活 6 个。视觉侧由从零训练的 DeepSeek-ViT 编码器和两层 MLP projector 将图像转为视觉嵌入,与文本嵌入在语言模型预训练开始即联合处理。模型在 45T token 多模态语料上从零预训练(稀疏注意力以 64K 序列长度训练,在 34T token 时扩展至 1M 上下文),后训练沿用 SFT → RL → on-policy distillation 流程,主要改动在数据管线,即大规模自动化合成 agent 任务与环境,并支持 1–100 的连续可控推理力度设置。
打分理由
一手厂商的新模型发布:V4 系列新版本,原生多模态、百万级上下文,并把全局 KV 缓存压缩到 V4-Flash 的约 1/4,属厂商主线的重要迭代。

衍生 & 周边(产品 / Agent / Tools / 观点)

模型发布

⭐⭐ [模型发布] IBM releases SOTA Granite Time Series PatchTST-FM-r2 model with commercial-friendly license

Hugging Face Blog · 2026-09-09 · 原文 ↗
IBM 发布 Granite Time Series PatchTST-FM-r2,是 Granite TSFM 家族的最新模型,也是 PatchTST-FM-r1 的升级版。新版本采用更新后的架构、更大的预训练语料,支持概率预测与缺失值插补,参数量约 3.85 亿,上下文长度最高 8,192,预测长度灵活,并通过 99 分位数预测头输出概率预测,骨干由结合多头自注意力与时序卷积的 conformer 模块构成。模型以 Apache-2.0 与 OpenMDW-1.0 双重许可发布,用户可任选其一。截至 2026 年 9 月 8 日,在 GIFT-Eval 基准的可复现零样本模型中,其 CRPS 与 MASE 均排名第二,同时也是同类中许可最宽松(商业友好)的模型中表现最好的;文中给出其 CRPS 几何均值为 0.467、MASE 几何均值为 0.6846。模型权重、架构、推理流程及复现基准结果的代码均已开放。
打分理由
这是垂类时序基础模型的新版本发布,带可复现基准数据与开放权重,但并非主线 LLM,且为二次信源,影响面有限。

产品更新

⭐⭐ [产品更新] Rebuilding AUTOMATIC1111 with Gradio Workflow

Hugging Face Blog · 2026-09-10 · 原文 ↗
Hugging Face 博客介绍 Workflow1111,把 AUTOMATIC1111 的 stable-diffusion-webui 的大部分功能重建为单一工作流画布。该画布由 11 条媒体流水线、73 个节点组成,覆盖文生图、高分辨率修复、图生图、prompt-matrix 网格、VLM interrogate、检测生成 inpaint 蒙版、ControlNet 风格标注器、背景移除、PNG Info 存储以及图生视频。用户用 Hugging Face 账号登录或提供 access token 即可运行任一流水线,模型调用消耗自己的配额,也可以复制该 Space 自行改造。画布上的每个节点封装一种算子,共四种:fn(Python 函数)、model(通过 InferenceClient 调用的模型)、space(另一个 Gradio Space)、dataset(Hub 数据集中的一行)。文中逐条说明了各条流水线的结构,例如文生图先经 prompt-builder 节点拼接风格预设并清理文本,再由 model 节点调用 checkpoint,最后用 fn 节点把生成参数写入 PNG 元数据。
打分理由
属于厂商的产品/工程宣传博文,发布了可试用和可复制的 Gradio Space,但为衍生周边内容,不涉及新模型发布或量化 benchmark 数据。

⭐⭐ [产品更新] Connections: managed credentials and per-caller identity for Managed Deep Agents

LangChain Blog · 2026-09-09 · 原文 ↗
LangChain 为 Managed Deep Agents 推出 Connections 功能,把凭据移出项目代码和 .env,存放于 LangSmith 工作区,工具在运行时通过 slug 调用 connections.get() 读取,轮换或撤销凭据无需改代码或重新部署。连接包含两个相互独立的维度:所有者(agent 或 caller)与凭据类型(静态密钥或 OAuth 授权)。agent 拥有的密钥由所有调用者共享,适用于网络搜索等不区分用户的场景;用户拥有的凭据则在运行时按人解析,使 agent 发起的操作带上该用户的身份。OAuth 授权的往返流程由 Managed Deep Agents 代为完成,无需回调路由、token 存储、刷新逻辑或同意页面。connections 目录已内置 GitHub 等 23 个服务,该功能在 Managed Deep Agents v0.7.0+ 中可用。
打分理由
这是 LangChain 框架层面面向开发者的凭据与调用者身份管理功能更新,非模型发布,属常规但有实际可用产物的产品更新,值得一读。

⭐⭐ [产品更新] Replit | Databricks Integration is Now Generally Available with Native Lakebase Support

Replit Blog · 2026-09-10 · 原文 ↗
Replit 与 Databricks 的集成正式全面可用(GA),并新增原生 Databricks Lakebase 支持。该集成此前于今年 6 月进入公开预览,此次是在其基础上的正式发布。官方描述的整体路径是:Replit 负责加速应用创建,Databricks 负责托管企业实时数据并提供受治理的访问与安全控制,Lakebase 则提供用于存储和更新应用数据的托管数据库。借助原生 Lakebase 支持,团队可以构建结合 Databricks 仓库实时数据与应用内产生数据的全栈应用;当应用准备部署时,Replit Agent 会自动为其配置 Lakebase 数据库,无需手动设置。此外还新增自动化预览部署能力,Replit 会自动创建独立的预览环境,将测试数据与 Databricks 中的实时业务数据隔离。
打分理由
这是一手厂商之外的产品集成 GA 公告,属于常规产品更新,未见可复现数据或重大行业影响,按 secondary 标准给 2。

⭐⭐ [产品更新] .blend URL Viewer

Simon Willison's Weblog · 2026-09-09 · 原文 ↗
Simon Willison 发布了一个 .blend URL 查看器工具,粘贴指向支持 CORS 的 .blend 文件或 GitHub 仓库链接,即可在浏览器中直接查看 Blender 文件。该查看器渲染网格几何体、材质与灯光,并支持 Blender 5.x 文件中保存的可选相机位置,还提供交互式环绕控制、线框模式和模型适配功能。他用 ChatGPT Images 2.5 生成了一张以电视剧 Pluribus 为主题的复活节彩蛋图片,随后把该图片粘贴进运行 GPT-6 Astra(high)的 Codex,让它用本地 Blender skill 建模,整个过程耗时 17 分 51 秒,产出多个 .blend 文件。他把这个查看器加入了自己的工具集,现在可以用它在浏览器里查看这个 Pluribus 的 Blender 模型。
打分理由
博主个人发布的小型浏览器查看工具,附带一次 GPT-6 Astra 通过 Codex 加 Blender skill 生成模型的实操记录,有一定参考价值但影响面有限。

研究

⭐⭐ [研究] Quoting Calif Research

Simon Willison's Weblog · 2026-09-10 · 原文 ↗
Calif Research 发布了一个名为 WeWorm 的演示,称其是首个通过微信通话在 iOS 和安卓上传播的零点击蠕虫。据称受害者无需接听电话、也无需对手机做任何操作;即使接听,也听不到任何声音,攻击仍然成功。该团队表示,在 AI 协助下,他们在大约两天内找到漏洞并写出首个远程代码执行(RCE)漏洞利用,构建蠕虫又花了一周时间。他们称这种规模的蠕虫过去需要更大的团队花上数月,AI 已能完成其中大部分工作,团队负责判断攻击目标以及如何安全测试。这是 Simon Willison 收集的一条引文。
打分理由
二手信源的一条引文,转述了一项安全研究演示:给出零点击微信通话蠕虫与 AI 协助开发漏洞利用时间线等具体说法,但未提供可复现的方法或技术细节。

其他

⭐⭐ [其他] d-Matrix Adopts NVIDIA NVLink Fusion for Rack-Scale XPU Deployment

NVIDIA Blog · 2026-09-10 · 原文 ↗
AI 推理芯片厂商 d-Matrix 宣布,将采用 NVIDIA NVLink Fusion,把其下一代 Raptor XPU 接入 NVIDIA 的 AI 基础设施平台,从而加入该生态合作伙伴名单。通过这一对接,Raptor 可连接 NVIDIA NVLink 纵向扩展(scale-up)与 Spectrum-X 横向扩展(scale-out)网络、NVIDIA MGX 机架架构以及更广泛的 NVIDIA AI 平台。原文正文在此处截断,未披露更多技术细节或时间表。
打分理由
这是一则有具体参与方与产品名的产业生态合作消息,但内容仅为平台对接,没有金额、性能数据或时间表,按衍生信源标准给 2。

⭐⭐ [其他] NVIDIA Expands AI Infrastructure Capacity in Partnership With Australia’s Data Center Ecosystem

NVIDIA Newsroom · 2026-09-10 · 原文 ↗
NVIDIA 宣布与不断扩大的澳大利亚 NVIDIA Cloud Partners(NCP)生态及 AI 基础设施合作伙伴展开协作,扩充土地、电力与建筑外壳(shell)容量,用于承载多代 NVIDIA DSX AI 工厂。公告称此举旨在满足澳大利亚持续增长的 AI 算力需求,到 2027 年规模最高可达 2 吉瓦。
打分理由
属区域性的数据中心与算力基建合作公告,给出了到 2027 年最高 2 吉瓦的规模,但仅限澳大利亚一地、正文信息量有限,按产业投入类事件给 2 分。

📬
每天 3–5 条 agent 生态一手信号,中英双语。不错过重要更新 → 订阅邮件
Loading...