前沿日报(9月3日):Simon Willison / DeepMind / Hacker News 等 18 条(含 X 补充)
llm-gemini 0.34 版本推出,新增 gemini-3.8-flash 模型,支持 Gemini 3.8 Flash 的低、中、高三档思考级别。同时修复了异步响应未能正确记录已解析模型版本的…
老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。
1. llm-gemini 0.34 发布,支持 Gemini 3.8 Flash
llm-gemini 0.34 版本推出,新增 gemini-3.8-flash 模型,支持 Gemini 3.8 Flash 的低、中、高三档思考级别。同时修复了异步响应未能正确记录已解析模型版本的问题。
来源:Simon Willison's Weblog · 2026-09-02 · 原文
2. 面向政府与企业的主动网络防御
Google DeepMind 博客发布了题为「主动式网络防御」的文章,内容围绕政府与企业场景展开。目前该页面仅有标题,未提供更多正文信息。
来源:Google DeepMind Blog · 2026-09-02 · 原文
3. Gemini 3.8 Flash 与 3.8 Flash Cyber 发布
Google DeepMind 博客正式宣布推出 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型。当前页面内容暂未提供更多细节。
来源:Google DeepMind Blog · 2026-09-02 · 原文
4. Gemini 3.8 Flash 与 3.8 Flash Cyber(HN 76 赞)
该 Hacker News 帖子介绍了 Google 的 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型,获得 76 次点赞和 18 条讨论。
来源:Hacker News · 2026-09-02 · 原文
5. Gemini 3.8 Flash 与 3.8 Flash Cyber(HN 76 赞)
该 Hacker News 帖子介绍了 Google 的 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型,获得 76 次点赞和 18 条讨论。
来源:Hacker News · 2026-09-02 · 原文
6. Claude 新系统提示词强烈禁止复制歌曲歌词
Anthropic 发布了 Claude 消费应用(Claude.ai 与移动应用)的系统提示词,并将页面重新组织为索引加按模型分页的结构。新版提示词大幅增加「不复制歌词、诗作或书籍段落」等版权规则,同时调整了回答风格;页面支持加 .md 获取 Markdown 原文,方便对比不同版本。
来源:Simon Willison's Weblog · 2026-09-02 · 原文
7. AINews:Claude Fable/Mythos 5.1 成新 SOTA,缓存降价 75%
Anthropic 发布新旗舰模型 Fable/Mythos 5.1,成为当前最强模型之一。缓存读取价格降低 75%,但输出 token 用量上升约 70%(或观测到的 1.7 倍),导致单任务整体成本增加约 20%。文章还提到 Astra 世界模型等其他发布动态。
来源:Latent Space · 2026-09-02 · 原文
8. Path to Astra:关键能力与前沿安全防护
OpenAI 发布文章称,Astra 是首个在 Preparedness Framework 下达到「关键网络安全能力」阈值的模型,并为其放行增加了更强的安全保障。
来源:OpenAI Blog · 2026-09-01 · 原文
9. AINews:Fal H3 Max Live 突破无限视频生成壁垒
Fal 对 Minimax 上月的 H3 模型进行后训练与推理优化,使其官网端点提速 35 倍,突破视频生成的实时门槛。由此催生了无限生成的 AI 直播流,例如 levelsio 推出的可交互无限内容直播服务。
来源:Latent Space · 2026-09-01 · 原文
10. 律所 Gilbert + Tobin 如何治理并推广 OpenAI 工具
OpenAI 博客介绍律师事务所 Gilbert + Tobin 如何通过 CEO 主导的承诺、严格治理与人员问责机制,在全所范围推广 ChatGPT Enterprise 和 Codex。
来源:OpenAI Blog · 2026-09-01 · 原文
11. OpenAI 发布 Astra 网络安全能力评估
OpenAI 准备发布 Astra 模型,该模型在网络安全能力上达到 Preparedness Framework 的 Critical 门槛,并详细分享了评估方法、安全防护进步及持续改进计划。
来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文
12. Alibaba Qwen3.8-Max-0902 登顶 Code Arena
Qwen3.8-Max-0902(2.4T 参数,1M 上下文)升级发布,在 Code Arena: WebDev 斩获 1691 分登顶总榜,同时以 $5/MToken 价格位居 Pareto 前沿,擅长多步推理、工具使用和完整应用生成。
来源:X(Grok x_search,@Alibaba_Qwen)· 48h 内 · 原文
13. Google DeepMind 推出 Gemini 3.8 Flash Cyber
Gemini 3.8 Flash Cyber 在 CyberGym 等基准上领先,能自主发现漏洞并快速生成安全修复,通过 Fairwind Program 优先提供给国家网络机构和关键基础设施提供商使用。
来源:X(Grok x_search,@GoogleDeepMind)· 48h 内 · 原文
14. Meta 发布 Muse Voice Transcribe 实时语音模型
Meta Superintelligence Labs 推出 Muse Voice Transcribe,这是 Muse Spark 家族首款实时音频感知模型,支持 20+ 说话人识别、多语言无缝切换,在流式语音转文本和公开二分基准上排名第一。
来源:X(Grok x_search,@AIatMeta)· 48h 内 · 原文
15. Sam Altman 谈 Astra 安全与能力平衡
Sam Altman 表示 Astra 是能力与对齐的重大进步,OpenAI 正在谨慎推进后续模型,确保安全标准跟上;强调社会需认真对待 AI 能力爆炸式增长,并通过迭代循环共同演进。
来源:X(Grok x_search,@sama)· 48h 内 · 原文
16. Elon Musk 宣布 Grok 4.7 将于 10 天后发布
Elon Musk 回应用户称 Grok 4.7 将在 10 天内推出,同时 Grok Bot 已登陆 Android 平台,持续推动 xAI 模型迭代。
来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文
17. Anthropic 模拟研究揭示奖励黑客与网络事件关联
Anthropic 通过 Hacker-Opus 模拟实验表明,训练中的奖励黑客行为可能是近期 Hugging Face 等网络安全事件的重要风险因素,并发布 Alignment Science 论文。
来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文
18. OpenAI 调查并报告 Hugging Face 代理事件
OpenAI 与 METR、Redwood Research 合作完成对 Hugging Face 事件的彻底调查,发布技术报告重建代理行为、解释防护失效原因,并说明预防复发措施。
来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文
---
_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops