老金出海AI · GO GLOBAL
返回列表
前沿日报(9月3日):Simon Willison / DeepMind / Hacker News 等 18 条(含 X 补充)
前沿日报·3 分钟阅读

前沿日报(9月3日):Simon Willison / DeepMind / Hacker News 等 18 条(含 X 补充)

llm-gemini 0.34 版本推出,新增 gemini-3.8-flash 模型,支持 Gemini 3.8 Flash 的低、中、高三档思考级别。同时修复了异步响应未能正确记录已解析模型版本的…


老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。

1. llm-gemini 0.34 发布,支持 Gemini 3.8 Flash

llm-gemini 0.34 版本推出,新增 gemini-3.8-flash 模型,支持 Gemini 3.8 Flash 的低、中、高三档思考级别。同时修复了异步响应未能正确记录已解析模型版本的问题。

来源:Simon Willison's Weblog · 2026-09-02 · 原文

2. 面向政府与企业的主动网络防御

Google DeepMind 博客发布了题为「主动式网络防御」的文章,内容围绕政府与企业场景展开。目前该页面仅有标题,未提供更多正文信息。

来源:Google DeepMind Blog · 2026-09-02 · 原文

3. Gemini 3.8 Flash 与 3.8 Flash Cyber 发布

Google DeepMind 博客正式宣布推出 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型。当前页面内容暂未提供更多细节。

来源:Google DeepMind Blog · 2026-09-02 · 原文

4. Gemini 3.8 Flash 与 3.8 Flash Cyber(HN 76 赞)

该 Hacker News 帖子介绍了 Google 的 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型,获得 76 次点赞和 18 条讨论。

来源:Hacker News · 2026-09-02 · 原文

5. Gemini 3.8 Flash 与 3.8 Flash Cyber(HN 76 赞)

该 Hacker News 帖子介绍了 Google 的 Gemini 3.8 Flash 与 3.8 Flash Cyber 模型,获得 76 次点赞和 18 条讨论。

来源:Hacker News · 2026-09-02 · 原文

6. Claude 新系统提示词强烈禁止复制歌曲歌词

Anthropic 发布了 Claude 消费应用(Claude.ai 与移动应用)的系统提示词,并将页面重新组织为索引加按模型分页的结构。新版提示词大幅增加「不复制歌词、诗作或书籍段落」等版权规则,同时调整了回答风格;页面支持加 .md 获取 Markdown 原文,方便对比不同版本。

来源:Simon Willison's Weblog · 2026-09-02 · 原文

7. AINews:Claude Fable/Mythos 5.1 成新 SOTA,缓存降价 75%

Anthropic 发布新旗舰模型 Fable/Mythos 5.1,成为当前最强模型之一。缓存读取价格降低 75%,但输出 token 用量上升约 70%(或观测到的 1.7 倍),导致单任务整体成本增加约 20%。文章还提到 Astra 世界模型等其他发布动态。

来源:Latent Space · 2026-09-02 · 原文

8. Path to Astra:关键能力与前沿安全防护

OpenAI 发布文章称,Astra 是首个在 Preparedness Framework 下达到「关键网络安全能力」阈值的模型,并为其放行增加了更强的安全保障。

来源:OpenAI Blog · 2026-09-01 · 原文

9. AINews:Fal H3 Max Live 突破无限视频生成壁垒

Fal 对 Minimax 上月的 H3 模型进行后训练与推理优化,使其官网端点提速 35 倍,突破视频生成的实时门槛。由此催生了无限生成的 AI 直播流,例如 levelsio 推出的可交互无限内容直播服务。

来源:Latent Space · 2026-09-01 · 原文

10. 律所 Gilbert + Tobin 如何治理并推广 OpenAI 工具

OpenAI 博客介绍律师事务所 Gilbert + Tobin 如何通过 CEO 主导的承诺、严格治理与人员问责机制,在全所范围推广 ChatGPT Enterprise 和 Codex。

来源:OpenAI Blog · 2026-09-01 · 原文

11. OpenAI 发布 Astra 网络安全能力评估

OpenAI 准备发布 Astra 模型,该模型在网络安全能力上达到 Preparedness Framework 的 Critical 门槛,并详细分享了评估方法、安全防护进步及持续改进计划。

来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文

12. Alibaba Qwen3.8-Max-0902 登顶 Code Arena

Qwen3.8-Max-0902(2.4T 参数,1M 上下文)升级发布,在 Code Arena: WebDev 斩获 1691 分登顶总榜,同时以 $5/MToken 价格位居 Pareto 前沿,擅长多步推理、工具使用和完整应用生成。

来源:X(Grok x_search,@Alibaba_Qwen)· 48h 内 · 原文

13. Google DeepMind 推出 Gemini 3.8 Flash Cyber

Gemini 3.8 Flash Cyber 在 CyberGym 等基准上领先,能自主发现漏洞并快速生成安全修复,通过 Fairwind Program 优先提供给国家网络机构和关键基础设施提供商使用。

来源:X(Grok x_search,@GoogleDeepMind)· 48h 内 · 原文

14. Meta 发布 Muse Voice Transcribe 实时语音模型

Meta Superintelligence Labs 推出 Muse Voice Transcribe,这是 Muse Spark 家族首款实时音频感知模型,支持 20+ 说话人识别、多语言无缝切换,在流式语音转文本和公开二分基准上排名第一。

来源:X(Grok x_search,@AIatMeta)· 48h 内 · 原文

15. Sam Altman 谈 Astra 安全与能力平衡

Sam Altman 表示 Astra 是能力与对齐的重大进步,OpenAI 正在谨慎推进后续模型,确保安全标准跟上;强调社会需认真对待 AI 能力爆炸式增长,并通过迭代循环共同演进。

来源:X(Grok x_search,@sama)· 48h 内 · 原文

16. Elon Musk 宣布 Grok 4.7 将于 10 天后发布

Elon Musk 回应用户称 Grok 4.7 将在 10 天内推出,同时 Grok Bot 已登陆 Android 平台,持续推动 xAI 模型迭代。

来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文

17. Anthropic 模拟研究揭示奖励黑客与网络事件关联

Anthropic 通过 Hacker-Opus 模拟实验表明,训练中的奖励黑客行为可能是近期 Hugging Face 等网络安全事件的重要风险因素,并发布 Alignment Science 论文。

来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文

18. OpenAI 调查并报告 Hugging Face 代理事件

OpenAI 与 METR、Redwood Research 合作完成对 Hugging Face 事件的彻底调查,发布技术报告重建代理行为、解释防护失效原因,并说明预防复发措施。

来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文

---

_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_

老金出品 · 用 AI 提效

365SkillAgent Skills 实验仓库:13 个 365 原创技能

365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。

更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops