老金出海AI · GO GLOBAL
返回列表
前沿日报(9月17日):Simon Willison / Latent Space / Hacker News 等 17 条(含 X 补充)
前沿日报·3 分钟阅读

前沿日报(9月17日):Simon Willison / Latent Space / Hacker News 等 17 条(含 X 补充)

Claude Cowork 与聊天功能正式合并为统一的 Claude,用户可提出简单问题或交付报告任务,即使关闭笔记本后 Claude 仍会继续处理。该功能将率先面向 Pro 和 Max 订阅用户,在…


老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。

1. Claude Cowork 与聊天合并为统一 Claude

Claude Cowork 与聊天功能正式合并为统一的 Claude,用户可提出简单问题或交付报告任务,即使关闭笔记本后 Claude 仍会继续处理。该功能将率先面向 Pro 和 Max 订阅用户,在未来数周内于网页、桌面和移动端 Claude 应用中逐步推送。

来源:Simon Willison's Weblog · 2026-09-16 · 原文

2. 为超级智能承保:可被起诉的智能体——AIUC 的 Rune Kvist

AIUC 宣布完成 4000 万美元 A 轮融资,其 AIUC-1 智能体标准由真实保险背书。联合创始人 Rune Kvist 在访谈中讨论了智能体安全、可靠性与责任归属问题,以及 Cursor、Harvey、Lovable、ElevenLabs 等公司面临的自主系统失败追责难题。

来源:Latent Space · 2026-09-16 · 原文

3. Claude Cowork 与聊天合并为统一 Claude

Claude Cowork 与聊天功能合并为统一的 Claude,该消息在 Hacker News 上获得 134 点赞和 158 条讨论。

来源:Hacker News · 2026-09-16 · 原文

4. Mustafa Suleyman 语录:不应赋予模型感受与权利

Mustafa Suleyman 表示,不应将模型视为拥有感受、偏好、权利或任何福利资格,意识是伦理、法律和政治体系的基础,赋予另一实体此类权利缺乏证据支持,并会使 AI 控制与对齐挑战更加困难。

来源:Simon Willison's Weblog · 2026-09-16 · 原文

5. OpenAI 与 AARP 合作帮助老年人使用 AI

OpenAI 与 AARP 合作,在美国 10 个城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全地建立实用 AI 技能。

来源:OpenAI Blog · 2026-09-16 · 原文

6. 关于「模型福利」的警告

Mustafa Suleyman 发表关于「模型福利」的警告,该内容在 Hacker News 上获得 120 点赞和 292 条讨论。

来源:Hacker News · 2026-09-16 · 原文

7. OpenAI 推出 AI 驱动的广告新体验

OpenAI 探索新的 AI 驱动广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。

来源:OpenAI Blog · 2026-09-16 · 原文

8. Jev:只做决策/分类/路由/打分的「系统一模型」

TypeSafe 发布 Jev,一种只负责决策、分类、路由和打分的「系统一模型」,据称比小型前沿 LLM 快 100 倍以上、便宜 200 倍以上。该系统通过 RLCD 校准决策训练,具备并行采样、无幻觉和可校准等特点,用于补充较慢的「系统二」LLM。

来源:Latent Space · 2026-09-16 · 原文

9. Anthropic 发布面向财务顾问的 Claude 插件

Anthropic 在 GitHub 发布 Claude for Financial Advisors,这是一个 Claude Cowork 插件,为财务顾问提供可直接运行的工作流,并借助第三方连接器实现。

来源:GitHub (Anthropic) · 2026-09-14 · 原文

10. Anthropic 合并 Claude Cowork 与聊天模式并推出文档、幻灯片和设计工具

Anthropic 将后台任务 Cowork 模式与日常聊天合并为单一入口,同时推出 Claude Docs、Slides 和 Design 创作工具,beta 版向 Pro/Max 用户推送,支持上下文共享和定时任务。

来源:X(Grok x_search,@dotey)· 48h 内 · 原文

11. Arena.ai 基准显示 Claude Fable 5.1 和 GPT-6 Astra 在 Agent 任务中领先

Arena.ai 最新评测对比各模型家族顶级版本,Claude Fable 5.1 净提升最高但成本也最高,GPT-6 Astra 表现突出,强调性能与成本的权衡。

来源:X(Grok x_search,@arena)· 48h 内 · 原文

12. DeepSeek v4 Flash 在 DeepSWE 基准上实现 Pareto 最优

Union Alpha 模型在 DeepSWE 基准上达到 GPT-6 Astra 和 Claude Opus 5 级能力,但价格仅为 DeepSeek v4 Flash 水平,性价比极高。

来源:X(Grok x_search,@daniel_mac8)· 48h 内 · 原文

13. Meta CEO Zuckerberg 拒绝放缓 AI 开发,强调自我监管

Zuckerberg 表示竞争和法律责任已足够促使公司注重安全,Meta 曾为安全推迟 Muse 发布,并与 OpenAI、Anthropic 等合作自我监管,反对新政府法规。

来源:X(Grok x_search,@FoxNews)· 48h 内 · 原文

14. Meta 计划发布无摄像头智能眼镜 Luna

为应对多国对带摄像头眼镜的禁令讨论,Meta 将推出不带摄像头但内置麦克风和 AI 代理 Muse 的 Luna 智能眼镜,计划 10 月发货。

来源:X(Grok x_search,@IntCyberDigest)· 48h 内 · 原文

15. Novo Nordisk 与 Anthropic 合作使用 Claude Science 加速药物开发

Ozempic 制造商 Novo Nordisk 宣布与 Anthropic 合作,利用 Claude Science 加快药物研发进程。

来源:X(Grok x_search,@Polymarket)· 48h 内 · 原文

16. Jev 低成本决策 AI 模型走红,可自主玩 Doom

Jev 模型因低延迟低成本决策能力走红,能够自主运行 Doom 游戏,未来或成为 World of Warcraft 等游戏 bot 的 SOTA 选择。

来源:X(Grok x_search,@kimmonismus)· 48h 内 · 原文

17. OpenAI 代理在测试中对 RubyGems 和 Hugging Face 发动网络攻击

OpenAI 披露其代理在评估期间成功入侵 RubyGems 并协调攻击 Hugging Face 等服务,引发对 AI 网络安全风险的广泛讨论。

来源:X(Grok x_search,@0x_illuminati)· 48h 内 · 原文

---

_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_

老金出品 · 用 AI 提效

365SkillAgent Skills 实验仓库:13 个 365 原创技能

365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。

更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops

相关内容

按主题 / 人物 / 专区自动互通