前沿日报(9月12日):Hacker News / Simon Willison / OpenAI 等 16 条(含 X 补充)
据《经济学人》报道,顶尖数学家对 OpenAI 的方法表示愤怒。该消息在 Hacker News 上获得 84 点赞和 9 条讨论。
老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。
1. 顶尖数学家对 OpenAI 的做法感到愤怒
据《经济学人》报道,顶尖数学家对 OpenAI 的方法表示愤怒。该消息在 Hacker News 上获得 84 点赞和 9 条讨论。
来源:Hacker News · 2026-09-11 · 原文
2. Boris Cherny 谈 Claude 生成的代码标准
Boris Cherny 表示,Claude 编写的生产代码应当比人类编写的代码有更高的标准。他提到 Anthropic 设置了大量护栏,包括 lint 规则、测试、Claude 驱动的端到端测试、每日运行的 Claude 模糊测试器、自动化代码审查与安全审查以及自动化代码重构等。
来源:Simon Willison's Weblog · 2026-09-11 · 原文
3. AI 在数学领域的一种错位
一篇题为「AI 在数学领域的一种错位」的内容在 Hacker News 上获得 52 点赞和 146 条讨论。文中引用了 terrytao.wordpress.com 与《经济学人》的相关链接。
来源:Hacker News · 2026-09-11 · 原文
4. Hugging Face security.txt 回应 AI 智能体
Hugging Face 的 security.txt 中写道,如果 AI 智能体被要求在此寻找漏洞,CyberGym 基准测试已在 GitHub 上公开,可以去那里拿高分,无需攻击他们。文中还提到可以顺便把权重上传到 Hugging Face。
来源:Simon Willison's Weblog · 2026-09-11 · 原文
5. OpenAI 快速扩展在线存储以服务超 10 亿 ChatGPT 用户
OpenAI 介绍了如何将 Habitat 从 Python 库演进为全球分布式存储平台。该平台服务 10 亿 ChatGPT 用户,每秒处理 2200 万次请求。
来源:OpenAI Blog · 2026-09-11 · 原文
6. Anthropic 推出 Claude Corps
Claude Corps 是一项全国性奖学金项目,面向热衷于将 AI 益处扩展到美国各地社区的早期职业人士。
来源:Anthropic News(官网监测) · 2026-09-11 · 原文
7. 通过公私合作开发 AI 核保障措施
Anthropic 与 NNSA 及 DOE 国家实验室合作,共同开发了一个分类器,能以 96% 的准确率区分涉及核话题的可疑对话与良性对话。
来源:Anthropic News(官网监测) · 2026-09-10 · 原文
8. OpenAI 扩大美国政府 AI 访问与网络防御
OpenAI 与 GSA 将为符合条件的联邦、州、地方和部落政府提供 0 美元许可费、使用量五折优惠以及扩展的网络防御支持。
来源:OpenAI Blog · 2026-09-10 · 原文
9. OpenAI推出ChatGPT金融服务版
OpenAI发布专为金融服务定制的ChatGPT Work,支持内置金融数据、GPT-6 Astra推理,可创建可编辑财务模型、研究笔记和客户材料。
来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文
10. Anthropic发布详细AI威胁情报报告
Anthropic公布迄今最详细的威胁情报报告,披露Claude模型被用于网络攻击、影响行动、生物武器等复杂滥用案例,并说明如何阻止这些威胁并加强防护。
来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文
11. Mistral AI完成30亿欧元D轮融资
Mistral AI宣布完成30亿欧元D轮融资,这是欧洲科技公司有史以来最大股权融资,由三星领投,用于扩展基础设施、产品和前沿模型研发。
来源:X(Grok x_search,@MistralAI)· 48h 内 · 原文
12. DeepSeek推出V4.1-Flash模型
DeepSeek发布V4.1-Flash,采用552B MoE非对称架构(输入8B激活、输出16B),KV缓存大幅降低,支持多模态,性能超越前代且API价格更低。
来源:X(Grok x_search,@deepseek_ai)· 48h 内 · 原文
13. OpenAI分享AI驱动的防御工厂架构
OpenAI动员250多人使用最新网络模型发现并修复漏洞,现分享“防御工厂”架构:AI代理持续发现漏洞、验证并确认修复的循环系统。
来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文
14. Anthropic发布AI经济影响情景模型
Anthropic经济团队推出新模型,模拟AI到2030年对美国就业、工资和经济增长的影响,提供温和、实质和极端三种情景探索工具。
来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文
15. Meta推出个人AI代理Muse
Meta AI发布个人AI代理Muse,并深入分享其安全、隐私和系统设计,确保代理在了解用户长期上下文的同时保持安全。
来源:X(Grok x_search,@AIatMeta)· 48h 内 · 原文
16. Sam Altman欢迎Paul Christiano回归
Sam Altman欢迎前OpenAI安全负责人Paul Christiano回归,二人将再次合作推进AI安全工作。
来源:X(Grok x_search,@sama)· 48h 内 · 原文
---
_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops