AI日报 | 2026年8月10日:中国模型调用量15周领跑,DeepSeek登顶全球,字节押注10万亿参数
2026年8月10日AI行业要闻速览:中国大模型调用量连续15周超美国、DeepSeek-V4-Flash登顶全球榜首;高盛预测全球AI投资今年破万亿美元;字节被曝训练10万亿参数大模型;OpenAI取消免费版对话次数限制并关停Atlas浏览器;蚂蚁开源Ling-3.0-flash。
头条:中国大模型调用量连续15周领跑,DeepSeek登顶全球
根据 OpenRouter 最新数据,上周(8月3日至9日)全球 AI 大模型总调用量达 69万亿 Token,环比增长21.48%。其中中国模型调用量 34.25万亿 Token,连续 15周 超过美国(同期美国9.17万亿 Token)。
更关键的是排名——全球调用量前四全部是中国模型:
- DeepSeek-V4-Flash 正式版:周调用 8.83万亿 Token,环比暴涨 570%,登顶全球榜首
- 腾讯 Hy3:8.05万亿 Token,环比增长67%
- DeepSeek-V4-Flash 预览版:5.88万亿 Token
- 小米 MiMo-V2.5 紧随其后
这意味着”国产模型只能做平替”的叙事正在被数据推翻——在成本、部署灵活性和 Agent 能力三重驱动下,中国模型已经拿下了全球流量入口。
一句话:选型逻辑变了。不再是”谁参数大谁赢”,而是”谁便宜、谁能本地部署、谁 Agent 能力强谁赢”。
高盛:今年全球 AI 投资将破万亿美元
8月10日,高盛发布报告预测:到2026年底,全球与 AI 相关的投资将达 1.019 万亿美元,其中美国部分约5810亿美元。报告特别强调,市场普遍引用的”超大型科技公司资本支出”指标严重低估了真实规模——2022年以来全球累计 AI 投资到年底将达 1.8万亿美元。
这对国内用户的启示是:算力基建进入10万卡时代。同日,国家超算互联网郑州核心节点首个全国产10万卡 AI 超集群正式投用,标志我国算力基建迈入10万卡级部署新阶段。
字节跳动被曝训练10万亿参数大模型
据《金融时报》8月7日报道(援引三位知情人士),字节跳动正在预训练参数规模高达 10万亿 的 AI 模型——是月之暗面 Kimi K3(2.8T)的3倍多,接近业界对 Anthropic Mythos 5(约8T)的估计。
背景值得玩味:在8月6日的全员会上,CEO 梁汝波承认”豆包 AI 编程不是强项”,明确以 Anthropic 的 Claude Code 为标杆;创始人张一鸣则三次否决模型蒸馏提案,表态”可以接受暂时落后,但不要蒸馏”。字节也是唯一坚持全闭源权重的中國实验室,豆包月活已达3.24亿。
一句话:张一鸣把公司命运押在”规模”上。这笔赌注2026下半年见分晓。
更多值得关注的动态
- OpenAI 取消免费版对话次数限制:自8月10日起,免费版与 Go 版用户纯文本对话取消次数上限,默认模型换为最小规模的 GPT-5.6 Luna 并新增”Think”思考按钮。此举意在提升免费用户黏性、对抗 Gemini 与 Claude(来源:IT之家)
- OpenAI 关停 AI 浏览器 Atlas:8月9日,上线不足十个月的 ChatGPT Atlas 正式停服。它既没颠覆 Chrome(全球份额约68%),也没跑通商业模式,反映 OpenAI 正收缩副业、聚焦编程与企业级主战场(来源:南方周末)
- 蚂蚁开源 Ling-3.0-flash:8月7日,蚂蚁百灵团队以宽松许可证开源 124B 参数的混合线性 MoE 模型,仅激活5.1B/token,256K 上下文可扩至1M,单任务成本约0.04美元,定位”生产环境 Agent 执行节点”(来源:Ant Group)
- 吴恩达1亿美元押注 AI 原生教育:其参投的 AI 原生学习公司 LearnVector 获 Coursera 1亿美元 A 轮投资,由 Agent 为学习者规划路径、动态陪练直至掌握技能(来源:前哨王煜全)
- 百度联合浙大揭示加速推理隐患:8月10日发布研究,系统揭示”有损验证”类投机解码在困难任务上的质量下滑风险,以 AIME 数学竞赛题测试最优方法准确率差距达6.67个百分点(来源:科技行者)
- Cloudflare:机器流量首超人类:其2026 Q2 财报显示,返回 HTML 的 HTTP 请求中机器流量占比 60.4%,超过人类的39.6%,AI Agent 流量一年暴涨 7851%(来源:Cloudflare)
- 中国开源模型掀起全球价格战:LLM 推理价格自6月初的2美元以上降至近期1.2美元,OpenAI 被迫将 GPT-5.6 Luna 开发者价格下调80%跟进(来源:手机中国)
一句话总结今日
今天的主线是**“中国模型全面领跑 + 全球资本疯狂下注”**。调用量、成本、开源生态三重优势叠加,国产模型正在改写全球选型规则;而高盛万亿美元预测和字节10万亿参数赌注,说明这场军备竞赛远未到终局。对普通用户而言,红利很直接——更好的模型、更低的价格、更强的本地部署能力,正在加速到来。
💬 评论与反馈
有什么想法?吐槽、建议、补充——直接说,每条都会看。
或者直接联系我们: