前沿日报(8月12日):Latent Space / Simon Willison / OpenAI 等 6 条
一篇论文演示了如何解码并移植前沿模型的加密推理轨迹,使弱模型也能恢复强模型的隐藏思维。论文作者扫描了约7000个公开轨迹,发现其中有62个API密钥、33个邮箱地址、33个密码等敏感数据,且部分仅出现…
老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。
1. 如何盗取推理轨迹
一篇论文演示了如何解码并移植前沿模型的加密推理轨迹,使弱模型也能恢复强模型的隐藏思维。论文作者扫描了约7000个公开轨迹,发现其中有62个API密钥、33个邮箱地址、33个密码等敏感数据,且部分仅出现在推理块中。作者还列出了对齐问题,包括思维链摘要器隐藏答案、不可理解的推理和作弊考量等。
来源:Latent Space · 2026-08-12 · 原文
2. 自然语言文本不存在无损转换
Sophie Alpert分享了工程师使用AI写作的内部政策,强调必须为自己文档中的每个想法和句子负责。帖子标题指出,自然语言文本没有无损转换,任何重写和改写都会改变写作含义。如果由不了解个人意图的实体来完成,信息将会丢失。
来源:Simon Willison's Weblog · 2026-08-11 · 原文
3. 从专有LLM API窃取推理轨迹
一项研究显示,Anthropic、OpenAI和Google返回的加密思维链块可跨会话、用户和模型重放。研究者将前沿模型生成的轨迹重放到较弱的模型中,通过越狱恢复出强模型的明文推理。该问题似乎已被修复,所有模型提供商都已确认收到报告。
来源:Simon Willison's Weblog · 2026-08-11 · 原文
4. undefined
undefined
来源:Latent Space · 2026-08-11 · 原文
5. Daybreak模型现已在AWS上可用
OpenAI和AWS通过Amazon Bedrock提供Daybreak网络安全能力,以支持企业安全工作流程。
来源:OpenAI Blog · 2026-08-11 · 原文
6. ChatGPT开始测试广告
OpenAI开始在ChatGPT中测试广告,以支持免费访问。广告将带有明确标识,确保回答独立性,并包含强大的隐私保护和用户控制。
来源:OpenAI Blog · 2026-08-11 · 原文
---
_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,外加 Anthropic 官网变更监测;Mistral / Meta AI 无稳定公开源,X 平台信源由老金人工补充。本文为信源汇编,不含老金点评。_
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创 + 35 个同步技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。仓库现有 46 个技能——13 个 365 原创(11 个已公开)+ 35 个从 mattpocock/skills(MIT)同步的生产级技能。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops