AI 日报 · 2026-07-30
OpenAI 宣布向 10 万学术研究者免费开放 ChatGPT 最先进模型,加速科研与协作。Google DeepMind 同步发布音乐生成模型 Lyria 3.5,显著提升旋律、歌词、人声与创作控制。安全方面,首次公开的「文档蠕虫」攻击利用 Word Copilot 的提示注入实现自我复制,微软…
OpenAI 宣布向 10 万学术研究者免费开放 ChatGPT 最先进模型,加速科研与协作。Google DeepMind 同步发布音乐生成模型 Lyria 3.5,显著提升旋律、歌词、人声与创作控制。安全方面,首次公开的「文档蠕虫」攻击利用 Word Copilot 的提示注入实现自我复制,微软在 144 天后仍无法完全修复。此外,LangChain 的 Deep Agents v0.7 通过精简系统提示将输入 token 降低 65%,Similarweb 也分享了用评分标准与忠实度检查评估长报告代理的实战经验。
北美一手(LLMs 官方 & 关联账号)
OpenAI
⭐⭐⭐ [产品更新] Accelerating scientific discovery with ChatGPT for Academic Researchers
OpenAI News · 2026-07-29 · 原文 ↗
OpenAI 宣布向 10 万名学术研究者免费提供 ChatGPT 的最先进模型,旨在加速科学研究、协作与发现。此举将帮助研究者更高效地利用 AI 进行科研工作。
打分理由
面向学术研究者的免费计划惠及10万人,对科研社区有较大实际帮助,但非模型发布,属于产品/合作层面的利好。
⭐⭐⭐ [模型发布] We’re launching Lyria 3.5 in Google Flow Music, with advances across musicality, lyrics, vocals, and creative control
Google DeepMind Blog · 2026-07-29 · 原文 ↗
Google DeepMind 在 Google Flow Music 中推出音乐生成模型 Lyria 3.5,在音乐性、歌词、人声和创作控制方面均有显著提升。新模型能生成更自然复杂的旋律结构,改进了歌词的提示遵循度和结构感。人声更具表现力和情感,发音也更清晰;同时增强了用户对节奏和时长的控制能力。
打分理由
Lyria 3.5 是 Google 在 AI 音乐生成方向的重大更新,直接集成到 Flow Music 产品中,具备多项创作能力提升,属于非主力但垂直领域有影响力的模型发布。
衍生 & 周边(产品 / Agent / Tools / 观点)
产品更新
⭐⭐ [产品更新] Deep Agents v0.7
LangChain Blog · 2026-07-29 · 原文 ↗
LangChain 发布 Deep Agents v0.7,通过移除系统提示、精简工具描述并将待办列表改为可选,将基础输入 token 减少 65%(约 6k 降至 2k),在 GPT-5.6-Luna、Gemini-3.6-Flash、Claude Sonnet 和 Opus 四个模型上验证性能保持稳定。设计受到 Anthropic 最新上下文工程指南启发,强调工具接口优于示例、避免重复。待办列表变为可选项,在多数评估中关闭待办可获得稍好的奖励和更低成本,仅在长多步任务、弱模型或需要可见进度的 UI 场景下仍有价值。整体上,新 harness 更精简、可配置,显著提升了 token 和成本效率。
打分理由
该版本通过精简提示大幅降低输入 token 和成本,性能稳定,对 Deep Agents 开发者有实用价值,但属于常规框架迭代,未改变行业格局。
⭐⭐ [产品更新] Introducing Replit Design
Replit Blog · 2026-07-29 · 原文 ↗
Replit 推出全新创意套件 「Replit Design」,旨在让任何人以最快速度将脑海中的想法转化为设计。该套件内置 「环境智能」(Ambient Intelligence)功能,在每个步骤中提供指导与灵感。由于一切都在 Replit 平台上完成,无需交接、导出或重建,创作者可以完整保留设计的原始美感。这一发布标志着 Replit 向赋能非设计师创意人群又迈进一步。
打分理由
Replit 发布设计套件属于常规产品更新,降低了创意实现门槛,对开发者社区有一定价值,但尚未达到改变行业格局的程度。
研究
⭐⭐ [研究] AI Worming through Word
Simon Willison's Weblog · 2026-07-29 · 原文 ↗
安全研究人员发现一种新型提示注入攻击,能在 Microsoft Word 的 Copilot 中实现自我复制传播。攻击者在文档中嵌入隐藏指令,当 Copilot 引用该文档时会将其解释为用户请求的一部分,从而操纵当前文档并将恶意指令复制到新文档中,形成文档蠕虫。微软在收到漏洞报告 144 天后仍未能提供覆盖全部攻击类型的缓解措施。这是首次公开的针对 AI 生产力工具的自复制提示注入实例。
打分理由
证明了 AI 助手存在自我复制安全风险,但影响范围有限,属于值得关注的安全研究。
观点
⭐⭐⭐ [观点] How Similarweb Evaluates Agent Reports with LangSmith
LangChain Blog · 2026-07-29 · 原文 ↗
Similarweb 在构建 Data Studio 代理时,发现用黄金答案评估长报告不可行,转向评分标准、忠实度检查和基线比较。他们利用 LangSmith 将分数与评审评论、执行轨迹和 A/B 对比串联,把分数当作信号而非最终答案。文章强调评估标准必须校准,并分享了因权重偏颇导致误判“退化”的教训。整体方法结合了确定性工具检查与 LLM 作为评委的定性评分,为开放型、长文本代理输出提供了可审查的评估框架。
打分理由
提供了实用的代理评估方法论和教训,对构建 LLM 代理的开发者有直接参考价值。
⭐⭐ [观点] Quoting Matthew Green
Simon Willison's Weblog · 2026-07-29 · 原文 ↗
当前密码学正处于从基于椭圆曲线和RSA的传统算法向后量子算法过渡的历史时刻,HAWK等新标准正在评估中。如果AI在密码分析方面取得进展,这正是验证新算法抗攻击能力的绝佳时机。Matthew Green认为,除非AI能彻底摧毁所有难题,否则当前环境最有利于AI密码分析能力的提升,其最好结果是让研究者对所选问题获得真实信心,并使密码分析文献更加稳健。这番评论是针对Anthropic近期密码学工作发表的。
打分理由
引用知名密码学家对AI密码分析时机的评论,涉及后量子过渡期的安全意义,有参考价值但属于二手观点。
每天 3–5 条 agent 生态一手信号,中英双语。不错过重要更新 → 订阅邮件
Loading...