老金出海AI · GO GLOBAL
返回列表
前沿日报(8月25日):GitHub (Anthropic) / Anthropic / GitHub (ModelScope) 等 15 条(含 X 补充)
前沿日报·3 分钟阅读

前沿日报(8月25日):GitHub (Anthropic) / Anthropic / GitHub (ModelScope) 等 15 条(含 X 补充)

Anthropic 为 Claude Cowork 和 Claude Code 建立了社区插件市场,这是一个只读镜像。用户可通过指定链接提交插件。


老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。

1. Anthropic 推出 Claude 插件社区市场

Anthropic 为 Claude Cowork 和 Claude Code 建立了社区插件市场,这是一个只读镜像。用户可通过指定链接提交插件。

来源:GitHub (Anthropic) · 2026-08-24 · 原文

2. Anthropic 详解 Claude 文本水印原理

未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性。这一改动是为了符合欧盟 AI 法案,与多家主要 AI 提供商一致。文章中回应了关于水印方法、是否影响输出以及原因等问题。

来源:Anthropic News(官网监测) · 2026-08-24 · 原文

3. FunASR:开源语音识别工具包

FunASR 是一个开源语音识别工具包,支持训练、推理、流式 ASR、VAD、标点、说话人分离等流水线。它同时提供 OpenAI 兼容和 MCP 服务。

来源:GitHub (ModelScope) · 2026-08-24 · 原文

4. 可执行文件即 SQLite 数据库

Farid Zakaria 描述了 Linux 中一种模式,可以让 SQLite 数据库文件直接作为可执行二进制运行。通过将 SQLite 文件格式的应用 ID 设为 SELF,并把 ELF 组件排布成 SQLite 表,再利用 binfmt_misc 让内核识别执行。

来源:Simon Willison's Weblog · 2026-08-24 · 原文

5. Anthropic 最强模型难获用户,廉价工具更吃香

据 FT 报道,Anthropic 7 月年化收入达 650 亿美元,5 月为 470 亿,并预计 Q3 盈利。OpenAI 年化收入已超 400 亿,GPT 5.6 带动增长。Ramp AI 指数显示 7 月 Anthropic 模型支出中 Opus 4.8 占 28%,而新模型 Fable 5 仅占 8%。

来源:Simon Willison's Weblog · 2026-08-23 · 原文

6. Show HN:让 Logo 在 HDR 屏幕更亮

作者发现 LinkedIn 上某些 Logo 比周围内容更亮,原因是原图在现有 JPEG 中加入了 gain-map,只有新 MacBook Pro 等 HDR 屏幕可见。LinkedIn 是作者发现唯一不会剥离该映射的社交网络。

来源:Hacker News · 2026-08-22 · 原文

7. 为何本地 LLM 感觉比实际更笨

该帖在 Hacker News 获得 417 个点赞和 171 条讨论,探讨本地 LLM 在实际使用中显得不如预期聪明的原因。

来源:Hacker News · 2026-08-22 · 原文

8. OpenAI大幅降低GPT-5.6 Sol API定价

OpenAI宣布GPT-5.6 Sol API及信用定价下调超过20%,为期3个月,同时在API和ChatGPT Work/Codex计划中可用,以提升效率并推动前沿能力发展。

来源:X(Grok x_search,@OpenAI)· 48h 内 · 原文

9. Sam Altman宣布暂停部分前沿RL训练以加强安全

Sam Altman表示因模型能力快速进步,OpenAI暂停部分前沿强化学习训练,以确保对齐、安全和监控标准跟上步伐,并强调安全将日益决定AI进展速度。

来源:X(Grok x_search,@sama)· 48h 内 · 原文

10. DeepSeek推出V4-Flash-Vision-Exp多模态模型

DeepSeek API上线实验性多模态模型V4-Flash-Vision-Exp,文本能力与V4-Flash相当,多模态代理基准大幅领先,支持图像输入和Files API,解锁更多代理用例。

来源:X(Grok x_search,@deepseek_ai)· 48h 内 · 原文

11. Anthropic用Claude加速蛋白质结合剂设计

Anthropic发布研究显示Claude在蛋白质结合剂设计上成功率达22-35%,远超传统10-15%,并开源提示和数据,为AI辅助药物开发奠定基础。

来源:X(Grok x_search,@AnthropicAI)· 48h 内 · 原文

12. Google DeepMind探索游戏中的持续学习与多代理

Google DeepMind与Fenris Creations合作,利用游戏作为测试床,研究AI的持续学习、深度记忆、长期规划和多代理动态,以推动真实世界和科学发现应用。

来源:X(Grok x_search,@GoogleDeepMind)· 48h 内 · 原文

13. Meta发布WildArtifactBench评估框架

AI at Meta预览WildArtifactBench,用于评估多模态代理在真实复杂任务中的表现,采用人类和代理偏好判断而非严格基准,并发布10个任务以推进实用多模态工作流测量。

来源:X(Grok x_search,@AIatMeta)· 48h 内 · 原文

14. Elon Musk展示Grok Bot的长时间代理能力

Elon Musk分享Grok Bot能够自主运行数小时完成复杂编码和网站 redesign 等任务,无需持续监督,标志着代理工作流从提示驱动转向委托执行。

来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文

15. Qwen3.8-27B量化与优化社区更新

Alibaba Qwen团队回应Unsloth发布的更高精度GGUF量化及SGLang的NVFP4+DFlash2配方,进一步提升Qwen3.8-27B的本地运行效率和社区可用性。

来源:X(Grok x_search,@Alibaba_Qwen)· 48h 内 · 原文

---

_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,Anthropic 官网监测,Hacker News 高热讨论与 GitHub 重点 AI 组织开源动态;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_

老金出品 · 用 AI 提效

365SkillAgent Skills 实验仓库:13 个 365 原创技能

365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。

更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops

相关内容

按主题 / 人物 / 专区自动互通