老金出海AI · GO GLOBAL
返回列表
前沿日报(8月14日):DeepMind / OpenAI / Latent Space 等 11 条(含 X 补充)
前沿日报·3 分钟阅读

前沿日报(8月14日):DeepMind / OpenAI / Latent Space 等 11 条(含 X 补充)

Google DeepMind 在其官方博客上介绍了 Gemini 3.7 Flash。该公告发布于 2026年8月13日,但内容中未提供更多细节。


老金每天定点抓官方信源,把过去 48 小时值得知道的 AI 圈动态汇编成短报:只汇编、不点评,每条附原始链接与发布时间。

1. Google DeepMind 发布 Gemini 3.7 Flash

Google DeepMind 在其官方博客上介绍了 Gemini 3.7 Flash。该公告发布于 2026年8月13日,但内容中未提供更多细节。

来源:Google DeepMind Blog · 2026-08-13 · 原文

2. OpenAI 预览 Ultrafast 模式:GPT-5.6 Sol 提速至 14 倍

OpenAI 预览了全新 Ultrafast API 服务层级。该模式由 Cerebras 提供支持,让 GPT-5.6 Sol 运行速度最高提升至 14 倍,每秒可输出多达 750 个 token。

来源:OpenAI Blog · 2026-08-13 · 原文

3. OpenAI 任命 Dali Rajic 为首席营收官

OpenAI 任命 Dali Rajic 为首席营收官,负责领导其全球营收组织,帮助企业充分实现 AI 的价值。

来源:OpenAI Blog · 2026-08-13 · 原文

4. SpaceXAI 发布 Grok 4.6 与 Grok @Bot

SpaceXAI(原 Cursor 团队)发布了 Grok 4.6 模型及 Grok @Bot,获得积极评价,被认为是世界上第二好的知识工作模型,且在效率上领先。Grok 4.6 为 1.5T 参数模型,基于 Grok 4.5,重点提升长时间运行代理及交互式、可视化工作能力。该模型采用了更长的补充训练,使用模型生成的数据和优化后的训练配方。

来源:Latent Space · 2026-08-13 · 原文

5. DeepSeek V4 Pro 0813 上线 OpenRouter

DeepSeek 最新 V4 Pro 0813 模型已通过 API 开放,目前仅在 OpenRouter 上提供访问。Simon Willison 注意到该模型在不同推理级别下生成的输出差异明显,并推测开源权重可能即将发布,因为此前的两个版本均开放了权重。

来源:Simon Willison's Weblog · 2026-08-12 · 原文

6. alchemy-utils 0.1a0 发布

Simon Willison 发布了 alchemy-utils 0.1a0,这是其 sqlite-utils 库的数据库无关版本,基于 SQLAlchemy,可支持 PostgreSQL、SQLite 和 DuckDB。该原型由 Codex 和 GPT-5.6 Sol Ultra 在极少的后续提示下生成,已达到 alpha 发布状态。

来源:Simon Willison's Weblog · 2026-08-12 · 原文

7. Google DeepMind 发布 Gemini 3.7 Flash

Google DeepMind推出Gemini 3.7 Flash模型,在编码、知识工作和网页开发方面显著提升,Arena排行榜上Code WebDev从19名升至8名,Text Arena也有大幅进步,已在Gemini App和API中可用。

来源:X(Grok x_search,@GoogleDeepMind)· 48h 内 · 原文

8. Elon Musk 宣布 Grok 4.7 将在 3-4 周内发布

Elon Musk透露Grok 4.7训练初始阶段已完成,正在添加大量SpaceX数据,预计3-4周内发布,将显著优于4.6,并在真实世界工程领域超越当前所有模型。

来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文

9. Grok 4.6 在 Databricks OfficeQA Pro V2 基准上夺冠

xAI的Grok 4.6在Databricks最新OfficeQA Pro V2基准测试中取得SOTA成绩,尤其在文档理解和数据推理任务上表现出色,被誉为高智能性价比最高的AI模型。

来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文

10. Arena.ai 更新排行榜:Gemini 3.7 Flash 强势登榜

Arena.ai社区评测显示Gemini 3.7 Flash (High)在Code Arena WebDev得分1588分、Text Arena 1490分,多个类别进入前10,显著超越前代模型,重新定义Pareto前沿。

来源:X(Grok x_search,@arena)· 48h 内 · 原文

11. Elon Musk:Grok 4.6 是最高效的高智能 AI

Elon Musk回应称Grok 4.6在智能性价比上领先,是目前最高效的高性能AI模型,同时强调其幽默感和实际任务处理能力。

来源:X(Grok x_search,@elonmusk)· 48h 内 · 原文

---

_信源:OpenAI、Google DeepMind、Qwen 官方博客,Simon Willison、Latent Space、Import AI、One Useful Thing 官方 RSS,外加 Anthropic 官网变更监测;X 平台信源由 Grok x_search 实时检索并逐条核验链接。本文为信源汇编,不含老金点评。_

老金出品 · 用 AI 提效

365SkillAgent Skills 实验仓库:13 个 365 原创技能

365Skill 是我们探索 Agent 技能的公开仓库:SKILL.md 标准格式、deny-by-default 发布策略、evals 验证体系。365 原创技能共 13 个——11 个已公开,2 个内部使用中。Apache-2.0 开源,欢迎 star、安装、提 issue。

更多老金产品:Sellenca · 365AIOrg · AllModelsAPI · 365Loopa · 365 Ops