AI日报 | 2026年8月29日:腾讯开源混元Hy4,英伟达129亿美元买下Hugging Face
2026年8月29日AI行业要闻速览:腾讯开源混元Hy4 preview(770B总参、1M上下文、跑通递归自我改进);英伟达约129亿美元收购Hugging Face成其史上最大并购;Anthropic发布MHS标准让Claude直接操控实验设备;智谱GLM-5.3-Flash匿名打榜60万亿token登顶;我国日均词元调用量突破500万亿。
头条:腾讯开源混元 Hy4 preview,770B 参数跑通「模型训模型」闭环
8月28日下午,腾讯发布并开源新一代大语言模型 混元 Hy4 preview:总参数 770B、单次激活仅 49B 的 MoE 架构,上下文突破 100万 token,定价输入 6 元/百万 tokens、输出 18 元、缓存命中 0.3 元,已同步接入 WorkBuddy、CodeBuddy、元宝、ima 等腾讯产品。
真正的看点不在参数,而在训练方式:腾讯称 Hy4 已深度参与自身的训练方法设计、数据策略、评估体系与底层算子优化,端到端吞吐较基线提升 31.8%——这是国内首次公开声称跑通「递归自我改进」工程闭环。自今年2月重建基础设施以来,混元平均每两个月迭代一个大版本,下一版也已在路上。
为什么重要?如果模型能参与优化自己的训练链路,迭代速度将第一次摆脱对人力投入的线性依赖,这是工程范式的分水岭,而不只是又一次跑分刷新。同时 MoE 把激活参数压到 49B,意味着百万长上下文的推理成本真正落到可控区间。
对国内用户,好处很直接:开源权重 + 6 元档定价,做整库代码理解、长合同分析这类过去被 token 账单卡死的活,成本降到了能试的水平。但官方明确提示 preview 版存在「过度推理」等局限,生产环境需自己核验输出;另外 770B 是总参数、不是每次推理都激活的量,选型别照此估显存。(来源:新京报贝壳财经、腾讯混元官方)
英伟达约 129 亿美元收购 Hugging Face,把开源模型入口收进自家生态
据 The Information 报道,英伟达已同意以约 129 亿美元收购 Hugging Face(估值超 130 亿),这将是其迄今最大一笔收购,多家外媒称交易即将完成。Hugging Face 被称为「AI 界的 GitHub」,托管超 300 万个模型、近 100 万个开源数据集,服务超 1300 万开发者,Meta 的 Llama、阿里的 Qwen 都以它为首要分发渠道;而其年化收入仅约 1.5 亿美元,相当于 86 倍营收溢价。
英伟达买的不是营收,是入口。当 OpenAI、谷歌、Anthropic 都在自研芯片试图摆脱 GPU 依赖时,英伟达反手掌控模型分发端。耐人寻味的是同一天英伟达高调宣传「针对顶级开源模型的本地 AI 优化计划」,明确点名 DeepSeek V4 Flash、阿里 Qwen3.8,并警告美方若限制其支持中国模型将「对业务造成重大影响」。
对国内开发者,短期没有断供风险,但长期要留一手:国产模型的海外分发过度依赖单一平台,一旦平台策略随股东意志变化,被动的永远是上传方。魔搭等国内托管渠道该并行维护起来了。(来源:The Information、界面新闻)
Anthropic 发布 MHS 标准:让 Claude 直接操控显微镜和机械臂
8月28日,Anthropic 推出 模型硬件标准(MHS) 研究预览——智能体只需自然语言描述,就能发现并操控显微镜、液体处理仪、激光器、机械臂等可编程设备,把原本数周到数月的设备集成压缩到几小时。合作测试方包括霍华德·休斯医学研究所、卡内基梅隆大学、基因泰克与 QuEra,AWS、斗山机器人、优傲机器人已加入支持,计划年内开源。
一句话理解 MHS:它是 MCP 在物理世界的镜像——MCP 解决「AI 连软件」,MHS 想解决「AI 连机器」。商业含义在于接口标准化:谁定义了设备描述规范,谁就握住工业 AI 的入口。对制造业和实验室,24 小时无人值守的自主实验是实打实的产能杠杆;但 Anthropic 自己也承认「开源前须先做好防护」,误操作风险是这条路线最大的不确定性。(来源:财联社、科创板日报)
更多值得关注的动态
- 智谱「牛来」真身揭晓:匿名模型 Ox-Alpha 确认即 GLM-5.3-Flash(320B-A18B),6 天被调用超 60 万亿 token 登顶 OpenRouter 与 OpenCode 用量榜首,推理全程由超 10 万张国产芯片承载、无一张英伟达卡,定价仅为 Claude Opus 4.8 的 1/40。(来源:中国经营报)
- 阿里 Qwen3.8-Flash 发布次日再降价:125B 总参/6B 激活,输入价砍到 0.8 元/百万 tokens、输出 2.7 元,训练成本较前代降近 90%。(来源:21世纪经济报道)
- 我国日均词元调用量突破 500 万亿:中央网信办副主任王京涛在 2026 数博会披露,2024 年初约 1000 亿,两年增长上千倍。(来源:中国青年报)
- 超百家企业联名警告 AI 网络攻击:OpenAI、微软、谷歌、AMD、Visa、花旗等 100+ 企业签署联名信,称医院、水厂等关键基础设施面临迫近威胁,建议确保智能体身份可追溯、可问责。(来源:南方都市报)
- 美团 Q2 经营利润转正,AI 投入超 10 亿:收入 1046 亿元同比增 14.4%,研发开支 77 亿元;王兴称美团不会成为「Token 工厂」。(来源:南方都市报)
- 长鑫科技 LPDDR6 送样验证:峰值 12800Mbps、单芯片最高 16GB;上半年营收 1503.1 亿元同比增 873.64%,净利扭亏为盈。AI 瓶颈正从「算力」转向「存力」。(来源:每日经济新闻)
- 三笔天价交易同日落地:除英伟达收购 Hugging Face,软银拟以约 60 亿美元估值收购挪威人形机器人公司 1X 多数股权,Anthropic 与英国 Nscale 签下 450 亿美元、6 年、460 兆瓦算力租约。(来源:The Information)
- 中国模型成海外新模型的技术源头:美国法律 AI 公司 Harvey 基于 Kimi K3 推出 Tenet,OpenAI 前 CTO 穆拉蒂的 Inkling 沿用 DeepSeek V3 架构;中国大模型调用量已连续 17 周居全球第一。(来源:新华社)
- 工具侧更新:Midjourney 开放 V8.2 图像编辑测试(指令编辑、最多 4 张参考图、局部重绘);GitHub Copilot 代码审查取消 300 文件/2 万行上限;谷歌 AI Mode 升级为旅行 Agent,可比价 300+ 航司并完成酒店预订。(来源:Midjourney、GitHub、TechCrunch)
一句话总结今日
AI 正在从「会说话」走向「会动手」:腾讯让模型开始训练自己,Anthropic 让模型伸手去碰机器,而英伟达用 129 亿美元买下了所有模型的分发入口——能力越往前跑,缰绳和入口就越值钱。
💬 评论与反馈
有什么想法?吐槽、建议、补充——直接说,每条都会看。
或者直接联系我们: