前沿日报(8月25日):GitHub (Anthropic) / Anthropic / GitHub (ModelScope) 等 15 条(含 X 补充)
Anthropic 为 Claude Cowork 和 Claude Code 建立了社区插件市场,这是一个只读镜像。用户可通过指定链接提交插件。
老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。
1. Anthropic 推出 Claude 插件社区市场
Anthropic 为 Claude Cowork 和 Claude Code 建立了社区插件市场,这是一个只读镜像。用户可通过指定链接提交插件。
来源:GitHub (Anthropic) · 2026-08-24 · 原文
2. Anthropic 详解 Claude 文本水印原理
未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性。这一改动是为了符合欧盟 AI 法案,与多家主要 AI 提供商一致。文章中回应了关于水印方法、是否影响输出以及原因等问题。
来源:Anthropic News(官网监测) · 2026-08-24 · 原文
3. FunASR:开源语音识别工具包
FunASR 是一个开源语音识别工具包,支持训练、推理、流式 ASR、VAD、标点、说话人分离等流水线。它同时提供 OpenAI 兼容和 MCP 服务。
来源:GitHub (ModelScope) · 2026-08-24 · 原文
4. 可执行文件即 SQLite 数据库
Farid Zakaria 描述了 Linux 中一种模式,可以让 SQLite 数据库文件直接作为可执行二进制运行。通过将 SQLite 文件格式的应用 ID 设为 SELF,并把 ELF 组件排布成 SQLite 表,再利用 binfmt_misc 让内核识别执行。
来源:Simon Willison's Weblog · 2026-08-24 · 原文
5. Anthropic 最强模型难获用户,廉价工具更吃香
据 FT 报道,Anthropic 7 月年化收入达 650 亿美元,5 月为 470 亿,并预计 Q3 盈利。OpenAI 年化收入已超 400 亿,GPT 5.6 带动增长。Ramp AI 指数显示 7 月 Anthropic 模型支出中 Opus 4.8 占 28%,而新模型 Fable 5 仅占 8%。
来源:Simon Willison's Weblog · 2026-08-23 · 原文
6. Show HN:让 Logo 在 HDR 屏幕更亮
作者发现 LinkedIn 上某些 Logo 比周围内容更亮,原因是原图在现有 JPEG 中加入了 gain-map,只有新 MacBook Pro 等 HDR 屏幕可见。LinkedIn 是作者发现唯一不会剥离该映射的社交网络。
来源:Hacker News · 2026-08-22 · 原文
7. 为何本地 LLM 感觉比实际更笨
该帖在 Hacker News 获得 417 个点赞和 171 条讨论,探讨本地 LLM 在实际使用中显得不如预期聪明的原因。
来源:Hacker News · 2026-08-22 · 原文
8. OpenAI大幅降低GPT-5.6 Sol API定价
OpenAI宣布GPT-5.6 Sol API及信用定价下调超过20%,为期3个月,同时在API和ChatGPT Work/Codex计划中可用,以提升效率并推动前沿能力发展。
来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文
9. Sam Altman宣布暂停部分前沿RL训练以加强安全
Sam Altman表示因模型能力快速进步,OpenAI暂停部分前沿强化学习训练,以确保对齐、安全和监控标准跟上步伐,并强调安全将日益决定AI进展速度。
来源:X(Grok x_search,@sama)· 48h 内 · 原文
10. DeepSeek推出V4-Flash-Vision-Exp多模态模型
DeepSeek API上线实验性多模态模型V4-Flash-Vision-Exp,文本能力与V4-Flash相当,多模态代理基准大幅领先,支持图像输入和Files API,解锁更多代理用例。
来源:X(Grok x_search,@deepseek_ai)· 48h 内 · 原文
11. Anthropic用Claude加速蛋白质结合剂设计
Anthropic发布研究显示Claude在蛋白质结合剂设计上成功率达22-35%,远超传统10-15%,并开源提示和数据,为AI辅助药物开发奠定基础。
来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文
12. Google DeepMind探索游戏中的持续学习与多代理
Google DeepMind与Fenris Creations合作,利用游戏作为测试床,研究AI的持续学习、深度记忆、长期规划和多代理动态,以推动真实世界和科学发现应用。
来源:X(Grok x_search,@GoogleDeepMind)· 48h 内 · 原文
13. Meta发布WildArtifactBench评估框架
AI at Meta预览WildArtifactBench,用于评估多模态代理在真实复杂任务中的表现,采用人类和代理偏好判断而非严格基准,并发布10个任务以推进实用多模态工作流测量。
来源:X(Grok x_search,@AIatMeta)· 48h 内 · 原文
14. Elon Musk展示Grok Bot的长时间代理能力
Elon Musk分享Grok Bot能够自主运行数小时完成复杂编码和网站 redesign 等任务,无需持续监督,标志着代理工作流从提示驱动转向委托执行。
来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文
15. Qwen3.8-27B量化与优化社区更新
Alibaba Qwen团队回应Unsloth发布的更高精度GGUF量化及SGLang的NVFP4+DFlash2配方,进一步提升Qwen3.8-27B的本地运行效率和社区可用性。
来源:X(Grok x_search,@Alibaba_Qwen)· 48h 内 · 原文
---
_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_
老金出品 · 用 AI 提效
365SkillAgent Skills 实验仓库:13 个 365 原创技能
365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。
更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops
相关内容
按主题 / 人物 / 专区自动互通