AI日报 | 2026年8月25日:Meta自研训练芯片MTIA 300落地,小米玄戒O100端侧破局
2026年8月25日AI行业要闻速览:Meta发布首款自研AI训练芯片MTIA 300并开源MetaRoCE网络协议;小米发布6nm 3D堆叠AI加速芯片玄戒O100;英伟达拟超300亿美元投资Perplexity并预警明年AI服务器涨价15%+;WikiHow起诉OpenAI版权侵权;中国整治AI虚拟恋爱。
头条:Meta 亮出首款自研训练芯片 MTIA 300,开源百万 GPU 网络协议 MetaRoCE
8月25日凌晨,Meta 在工程博客连发两篇重磅文章,披露首款自研 AI 训练芯片 MTIA 300 的技术细节,并宣布开源专为百万 GPU 规模设计的 RDMA 网络协议 MetaRoCE。MTIA 300 是 Meta 自研训练与推理加速器家族的首款产品,内置 NIC 芯片组、专为推荐排名模型训练优化,已在生产环境部署;MetaRoCE 则从零重写 RDMA 传输协议,把智能从交换机下沉到端点,原生支持乱序交付与多路径喷洒,在 1% 丢包下仍保持约 86% 吞吐量。
为什么重要?这是云计算巨头 AI 基础设施自主化走到”芯片 + 网络”全栈自研的标志性一步。过去一年 Meta、Google、亚马逊都在自研芯片上加速,但把训练芯片和底层网络协议一起开源,意味着 Meta 想把自己定义为”开源 AI 基建标准”的制定者——这直接对标英伟达的 NVLink / InfiniBand 生态。
对国内用户的影响:自研芯片潮流会持续压低推理成本、催生更多开放硬件参考设计;但短期内国内厂商仍在追赶,Meta 的开源协议更可能先惠及海外社区。值得关注的是,这轮”去英伟达化”由巨头带头,长期看会削弱单一供应链的议价权。(来源:Meta Engineering Blog)
小米一次性发布三颗玄戒自研芯片,O100 端侧 AI 破局
8月24日的小米年度发布会上,玄戒 O3(手机 SoC)、玄戒 O100(AI 加速芯片)、玄戒 O1(智驾芯片)三颗自研芯片同台亮相。其中 玄戒 O100 为行业首颗 6nm 3D 晶圆级堆叠 AI 芯片,支持 1.22TB/s 超高带宽,端侧大模型推理速度达 330 TPS,较上代提升 10 倍;小米还展示了 AI Cube 工程版,可在 150W 功耗下本地运行大模型。
这条新闻对国内用户的意义最直接:端侧大模型从”能跑”走向”好用”。330 TPS 的推理速度意味着手机、车机、桌面盒子本地跑大模型不再卡顿,隐私数据不必上云。在国产算力受限的背景下,3D 堆叠这类先进封装路线,是绕开单芯片制程瓶颈、把算力塞进端侧设备的现实路径。(来源:新浪财经、IT之家、DoNews)
英伟达双线出手:300亿美元入股 Perplexity,同时预警涨价
8月24日,多家媒体确认英伟达正洽谈对 AI 搜索公司 Perplexity 的股权投资,本轮估值有望超 300 亿美元(较一年前的 200 亿涨 50%),Perplexity 年化营收已从年初不足 2.5 亿升至 7.5 亿美元以上。这是英伟达继 Poolside 60 亿美元交易后,在应用层的又一重大落子——从”卖铲人”向 AI 应用生态延伸。
同一天,英伟达正式通知大客户:自 2027 年起 AI 服务器价格将上涨超 15%,受 HBM 内存成本攀升影响,新建 1GW 数据中心总成本将激增约 50 亿美元。一边用投资绑定应用层需求,一边把内存涨价的成本转嫁给下游——“AI-flation”(AI 通胀)正在从传闻变成账单。
对国内用户:短期云算力成本承压,倒逼更多企业把推理搬到本地或国产芯片;中长期看,英伟达越往应用层延伸,与云厂商的竞合关系越微妙。(来源:新浪财经、第一财经、财联社、Bloomberg)
更多值得关注的动态
- WikiHow 起诉 OpenAI 版权侵权:8月25日,知名 DIY 教程网站在纽约南区法院起诉 OpenAI 未经授权使用其内容训练 ChatGPT,案号 1:26-cv-07171,成为 OpenAI 面临的又一版权诉讼(来源:Reuters)
- 中国整治 AI 虚拟恋爱服务:监管部门针对 AI 伴侣类应用涉嫌诱导情感依赖、影响婚恋观等问题展开专项整治,AI 情感陪伴产品纳入监管视野(来源:德国之声)
- Intel 在 Hot Chips 2026 公布 Agentic AI 新架构:推出 Diamond Rapids(256 核)、Crescent Island 等产品路线图,针对 AI Agent 负载专门优化;SK 海力士展示 HBM5 混合键合进展(来源:Intel Newsroom)
- Hugging Face 探索 130 亿美元出售:据 BI 报道,开源模型枢纽正与银行接触评估买家意向,估值较 2023 年的 45 亿涨近三倍(来源:Business Insider)
- Figure AI 反超宇树科技登顶人形机器人市值榜首:新一轮融资后 Figure 估值超越宇树,尽管后者出货量是其 36 倍,资本更看重”技术壁垒”而非”出货量”(来源:新浪财经)
- 江苏中小学秋季全覆盖 AI 通识教育课:2026 年秋季开学起全省中小学全面开设,师资培训累计收看 903 万人次,上线免费 AI 数字资源专区(来源:连云港发布)
- DeepSeek V4 Pro 正式版上线火山引擎:Agent 能力全面跃升,支持通过 model name 及控制台直接访问(来源:火山引擎)
- OpenAI GPT-5.6 登陆 Kiro 编程平台:GPT-5.6 家族(Sol/Terra/Luna)接入 Kiro,AWS 联合测试显示 Terminal-Bench 上任务成本降约 82%(来源:OpenAI)
- Meta 挖角 OpenAI 研究员 Luke Metz:DCGAN 共同开发者、o1 系统卡贡献者加入 Meta 超级智能实验室,向 Alexandr Wang 汇报(来源:Axios)
一句话总结今日
今天的主线是**“硬底座各立山头,软生态加速收口”**。Meta 用 MTIA 300 + MetaRoCE 把自研边界推到芯片和网络协议层,小米用玄戒 O100 把大模型塞进端侧,英伟达则用”投资 Perplexity + 涨价预警”一手抓应用、一手收通胀——算力的权力版图正在重写。
对国内用户最实在的三条:小米端侧 330 TPS 推理意味着本地大模型体验质变;DeepSeek V4 Pro 正式版已可在火山引擎直接调用;而 AI 虚拟恋爱整治 + WikiHow 诉 OpenAI 则提醒我们,监管与版权正从”暂缓”走向”动真格”。
💬 评论与反馈
有什么想法?吐槽、建议、补充——直接说,每条都会看。
或者直接联系我们: