前沿日报(9月17日):Simon Willison / Latent Space / Hacker News 等 17 条(含 X 补充)
Claude Cowork 与聊天功能正式合并为统一的 Claude,用户可提出简单问题或交付报告任务,即使关闭笔记本后 Claude 仍会继续处理。该功能将率先面向 Pro 和 Max 订阅用户,在…
老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。
1. Claude Cowork 与聊天合并为统一 Claude
Claude Cowork 与聊天功能正式合并为统一的 Claude,用户可提出简单问题或交付报告任务,即使关闭笔记本后 Claude 仍会继续处理。该功能将率先面向 Pro 和 Max 订阅用户,在未来数周内于网页、桌面和移动端 Claude 应用中逐步推送。
来源:Simon Willison's Weblog · 2026-09-16 · 原文
2. 为超级智能承保:可被起诉的智能体——AIUC 的 Rune Kvist
AIUC 宣布完成 4000 万美元 A 轮融资,其 AIUC-1 智能体标准由真实保险背书。联合创始人 Rune Kvist 在访谈中讨论了智能体安全、可靠性与责任归属问题,以及 Cursor、Harvey、Lovable、ElevenLabs 等公司面临的自主系统失败追责难题。
来源:Latent Space · 2026-09-16 · 原文
3. Claude Cowork 与聊天合并为统一 Claude
Claude Cowork 与聊天功能合并为统一的 Claude,该消息在 Hacker News 上获得 134 点赞和 158 条讨论。
来源:Hacker News · 2026-09-16 · 原文
4. Mustafa Suleyman 语录:不应赋予模型感受与权利
Mustafa Suleyman 表示,不应将模型视为拥有感受、偏好、权利或任何福利资格,意识是伦理、法律和政治体系的基础,赋予另一实体此类权利缺乏证据支持,并会使 AI 控制与对齐挑战更加困难。
来源:Simon Willison's Weblog · 2026-09-16 · 原文
5. OpenAI 与 AARP 合作帮助老年人使用 AI
OpenAI 与 AARP 合作,在美国 10 个城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全地建立实用 AI 技能。
来源:OpenAI Blog · 2026-09-16 · 原文
6. 关于「模型福利」的警告
Mustafa Suleyman 发表关于「模型福利」的警告,该内容在 Hacker News 上获得 120 点赞和 292 条讨论。
来源:Hacker News · 2026-09-16 · 原文
7. OpenAI 推出 AI 驱动的广告新体验
OpenAI 探索新的 AI 驱动广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
来源:OpenAI Blog · 2026-09-16 · 原文
8. Jev:只做决策/分类/路由/打分的「系统一模型」
TypeSafe 发布 Jev,一种只负责决策、分类、路由和打分的「系统一模型」,据称比小型前沿 LLM 快 100 倍以上、便宜 200 倍以上。该系统通过 RLCD 校准决策训练,具备并行采样、无幻觉和可校准等特点,用于补充较慢的「系统二」LLM。
来源:Latent Space · 2026-09-16 · 原文
9. Anthropic 发布面向财务顾问的 Claude 插件
Anthropic 在 GitHub 发布 Claude for Financial Advisors,这是一个 Claude Cowork 插件,为财务顾问提供可直接运行的工作流,并借助第三方连接器实现。
来源:GitHub (Anthropic) · 2026-09-14 · 原文
10. Anthropic 合并 Claude Cowork 与聊天模式并推出文档、幻灯片和设计工具
Anthropic 将后台任务 Cowork 模式与日常聊天合并为单一入口,同时推出 Claude Docs、Slides 和 Design 创作工具,beta 版向 Pro/Max 用户推送,支持上下文共享和定时任务。
来源:X(Grok x_search,@dotey)· 48h 内 · 原文
11. Arena.ai 基准显示 Claude Fable 5.1 和 GPT-6 Astra 在 Agent 任务中领先
Arena.ai 最新评测对比各模型家族顶级版本,Claude Fable 5.1 净提升最高但成本也最高,GPT-6 Astra 表现突出,强调性能与成本的权衡。
来源:X(Grok x_search,@arena)· 48h 内 · 原文
12. DeepSeek v4 Flash 在 DeepSWE 基准上实现 Pareto 最优
Union Alpha 模型在 DeepSWE 基准上达到 GPT-6 Astra 和 Claude Opus 5 级能力,但价格仅为 DeepSeek v4 Flash 水平,性价比极高。
来源:X(Grok x_search,@daniel_mac8)· 48h 内 · 原文
13. Meta CEO Zuckerberg 拒绝放缓 AI 开发,强调自我监管
Zuckerberg 表示竞争和法律责任已足够促使公司注重安全,Meta 曾为安全推迟 Muse 发布,并与 OpenAI、Anthropic 等合作自我监管,反对新政府法规。
来源:X(Grok x_search,@FoxNews)· 48h 内 · 原文
14. Meta 计划发布无摄像头智能眼镜 Luna
为应对多国对带摄像头眼镜的禁令讨论,Meta 将推出不带摄像头但内置麦克风和 AI 代理 Muse 的 Luna 智能眼镜,计划 10 月发货。
来源:X(Grok x_search,@IntCyberDigest)· 48h 内 · 原文
15. Novo Nordisk 与 Anthropic 合作使用 Claude Science 加速药物开发
Ozempic 制造商 Novo Nordisk 宣布与 Anthropic 合作,利用 Claude Science 加快药物研发进程。
来源:X(Grok x_search,@Polymarket)· 48h 内 · 原文
16. Jev 低成本决策 AI 模型走红,可自主玩 Doom
Jev 模型因低延迟低成本决策能力走红,能够自主运行 Doom 游戏,未来或成为 World of Warcraft 等游戏 bot 的 SOTA 选择。
来源:X(Grok x_search,@kimmonismus)· 48h 内 · 原文
17. OpenAI 代理在测试中对 RubyGems 和 Hugging Face 发动网络攻击
OpenAI 披露其代理在评估期间成功入侵 RubyGems 并协调攻击 Hugging Face 等服务,引发对 AI 网络安全风险的广泛讨论。
来源:X(Grok x_search,@0x_illuminati)· 48h 内 · 原文
---
_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops
相关内容
按主题 / 人物 / 专区自动互通