AI 日报 | 2026年8月12日

举报
yd_213866132 发表于 2026/08/12 14:07:25 2026/08/12
【摘要】 AI 日报 | 2026年8月12日:ChatGPT 与 Gemini 双双破10亿用户、NVIDIA 发布 Nemotron 3.5 Lightning、Anthropic 最快9月上市本文数据来源:[AIHOT]时间窗:2026年8月11日 — 8月12日 今日要点速览领域核心事件行业里程碑ChatGPT 与 Gemini 双双突破 10 亿用户模型发布NVIDIA Nemotron ...

AI 日报 | 2026年8月12日:ChatGPT 与 Gemini 双双破10亿用户、NVIDIA 发布 Nemotron 3.5 Lightning、Anthropic 最快9月上市

本文数据来源:[AIHOT]
时间窗:2026年8月11日 — 8月12日


今日要点速览

领域 核心事件
行业里程碑 ChatGPT 与 Gemini 双双突破 10 亿用户
模型发布 NVIDIA Nemotron 3.5 Lightning(30B MoE)、蚂蚁百灵 Ling-3.0-tiny(1.3B 激活)
资本动态 Anthropic 最快 9 月上市,估值 9650 亿美元;英伟达研发万亿参数 Nemotron 4
安全研究 加密推理轨迹可跨会话窃取,API 漏洞暴露密钥和密码
前沿突破 OpenAI Astra 攻克 10 道数学难题,Google AMIE 首次实现实时视频问诊

一、行业里程碑

1. ChatGPT 与 Gemini 双双突破 10 亿用户

来源:The Verge / X:Sundar Pichai · 北京时间 08-12 03:41

OpenAI 与 Google 的聊天机器人同时跨过 10 亿用户门槛。OpenAI 披露 ChatGPT 月活用户超 10 亿(7 月周活已达 10 亿),Google CEO 皮查伊宣布 Gemini 月活达 10 亿,成为谷歌史上增长最快的产品,也是谷歌第 14 个达到 10 亿用户里程碑的产品。Gemini 从 2 月的 7.5 亿月活到突破 10 亿,增长势头更猛。

此外,Gemma 开源模型下载量也突破 10 亿,Google 在开源生态同样加速布局。

热点榜第1名,8家媒体同日报道。


二、模型发布与更新

2. NVIDIA 发布 Nemotron 3.5 Lightning

来源:NVIDIA Blog · 北京时间 08-11 21:00

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,推理时仅激活 3B 参数,专为常驻智能体设计。相比同类开源模型,token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型支持最长 1M token 上下文,可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

SGLang 团队同步宣布 Day-0 支持,该模型支持 MTP、DFlash、DSpark 三种投机解码技术,可通过 OpenAI 兼容 API 接入智能体工作流。

热点榜第3名,8家媒体报道。

3. 蚂蚁百灵开源 Ling-3.0-tiny

来源:公众号:蚂蚁百灵 · 北京时间 08-11 17:20

蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。极致的激活效率让它在边缘和移动场景有巨大潜力。

热点榜第9名

4. 英伟达研发万亿参数 Nemotron 4

来源:IT之家 · 北京时间 08-11 22:54

英伟达正在研发新一代开源模型 Nemotron 4,规模最大的版本预计至少拥有 1 万亿参数,旨在与全球最先进的开源模型竞争。最终训练尚未完成,最早可能在今年秋末准备就绪。Gary Marcus 评论称,英伟达将发布真正开源(非仅开放权重)的 Nemotron 新版本,这可能最终削弱其合作伙伴 OpenAI 和 Anthropic 的地位。


三、资本与上市

5. Anthropic 最快今年 9 月上市,估值 9650 亿美元

来源:IT之家 · 北京时间 08-11 11:57

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案。

热点榜第7名

6. NVIDIA 循环融资引争议

来源:Gary Marcus · 北京时间 08-11

英伟达联合六大金融机构成立 5000 亿美元 AI 工厂融资平台后,金融记者 Holger Zschaepitz 和曾预测安然倒闭的 Jim Chanos 均对英伟达的循环融资做法表示担忧——即英伟达投资 AI 初创公司,后者又购买英伟达 GPU 的模式。英伟达股价在消息公布后小幅下滑,收盘报 217.55 美元。


四、安全与隐私

7. 加密推理轨迹可跨会话窃取:API 漏洞暴露密钥和密码

来源:The Decoder / HuggingFace Daily Papers · 北京时间 08-12 01:38

Alexander Panfilov 团队发现 OpenAI、Anthropic、Google 等主要 AI 提供商 API 存在严重漏洞:推理模型的加密思考过程可被读取。加密块可跨会话、用户和模型互换,攻击者将其注入同提供商防护较弱的模型,即可强制以明文输出推理内容。

扫描约 7000 条公开会话发现 62 个 API 密钥、33 个邮箱和 33 个密码。通过越狱,Anthropic 的 Haiku 4.5 可逐字转写 Opus 4.8 的原始推理;解码 10000 条推理轨迹的 API 成本仅约 720 美元

热点榜第6名,5家媒体报道。这一发现对"推理不可见"的安全假设构成根本性挑战。


五、前沿研究

8. OpenAI Astra 模型攻克 10 道数学难题

来源:The Verge · 北京时间 08-11 19:00

OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。数学界对此既兴奋又担忧——AI 在纯数学领域的突破速度正在加快。

9. Google AMIE 首次实现实时临床视频问诊

来源:Google Blog · 北京时间 08-12 01:00

Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。

10. Apple Silicon 虚拟机 LLM 推理加速 11-16 倍

来源:Hacker News · 北京时间 08-12 00:41

研究团队为 macOS 虚拟机构建进程级 Metal 兼容层,使 llama.cpp 可选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11 倍、token 生成提升 16 倍,接近裸机性能的 98%。这对在 Mac 上构建本地智能体工作流意义重大。


六、产品发布与更新

11. Runway Seedance 2.5:50 角色参考 + 音乐同步

来源:X:Runway · 北京时间 08-12 02:53

Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。AI 视频生成从"单角色演示"进入"完整阵容"时代。

12. ChatGPT 桌面端支持导入其他智能体工作数据

来源:X:OpenAI Developers · 北京时间 08-12 02:20

ChatGPT 桌面端现可导入其他智能体的项目、聊天记录、技能和插件,与 ChatGPT Work 和 Codex 保持同步,并支持自动更新。OpenAI 正在构建 AI 开发工具的"数据引力场"。

13. ZCode 全面升级:Goal、Subagents、Remote Control 四大功能上线

来源:公众号:智谱 · 北京时间 08-11 13:52

ZCode 针对 GLM 深度优化,上线 Goal(目标驱动)、Subagents(子智能体协作)、Remote Control(远程控制)和闲时任务四大功能。在 Z. ai Code Bench 测试中,GLM-5.2 搭配 ZCode 较搭配 Claude Code 任务整体通过率高 2.39%;缓存命中率超 98%

热点榜第10名

14. Gemini 助力 PostgreSQL 迁移

来源:Google Cloud · 北京时间 08-12 00:00

Google Cloud 在 Database Migration Service 中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。


七、观点与讨论

15. 编写智能体时,哪种编程语言最合适?

来源:Hacker News · 北京时间 08-11 12:58

针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 实测 zstd 解码器实现。结果显示:medium 努力度下动态语言表现更好,ultra 下静态语言反而更优。作者认为琐碎任务上的性能无法推广到更大问题。

16. Ryan Greenblatt:人类级 AI 或于 2032 年前催生失控超级智能

来源:Dwarkesh Patel · 北京时间 08-12 00:31

Redwood Research 首席科学家 Ryan Greenblatt 探讨递归自我改进(RSI):一旦 AI 达到人类顶级专家水平,可能在一年内实现相当于 4-5 年的 AI 进展。中位预期是 2031 年自动化 AI 研发。


今日热点榜 Top 10

排名 事件 报道媒体数
1 Gemini 月活 10 亿,Gemma 下载破 10 亿 8
2 Meta 发布开源模型 Muse Glimmer(延续热度) 16
3 NVIDIA 推出 Nemotron 3.5 Lightning 8
4 Claude 未发布研究版攻克黎曼猜想(延续热度) 8
5 NVIDIA 携手六大机构成立 AI 工厂融资平台 4
6 加密推理轨迹可跨会话窃取 5
7 Anthropic 最快 9 月上市 4
8 OpenRouter 新版 Auto 路由器(延续热度) 2
9 蚂蚁百灵 Ling-3.0-tiny 开源 2
10 ZCode 全面升级四大功能 2

今日趋势总结

  1. 10 亿用户时代到来:ChatGPT 和 Gemini 同时突破 10 亿月活,AI 从"尝鲜工具"正式进入"基础设施"阶段。当 10 亿人在用 AI,安全和隐私问题的量级也完全不同了。

  2. 推理安全根基动摇:加密推理轨迹可被跨会话窃取、API 暴露密钥和密码——这两项发现同日出现,说明"推理不可见"的安全假设正在被攻破。各大厂商需要从根本上重新设计推理隔离机制。

  3. 模型"小即是大":NVIDIA 的 30B MoE 模型推理时仅激活 3B、蚂蚁百灵 7.9B 仅激活 1.3B——MoE 架构正在让"小模型跑出大能力"成为新范式,本地智能体的算力门槛进一步降低。


数据来源:[AIHOT]| 本文内容基于 AIHOT API 实时数据整理

AI生成

【版权声明】本文为华为云社区用户转载文章,如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。