📌 今日速览:8 月 28 日,中文 AI 圈被一桩并购点燃:英伟达以 129 亿美元买下「AI 界 GitHub」Hugging Face,开源生态的中立性一夜之间成了最大悬念。大模型侧「价格战」与「开源战」齐飞——MiniMax 半年报 ARR 破 8 亿美元、B 端暴涨 703%,智谱 GLM-5.3-Flash 与腾讯混元 Hy4preview 相继开源,谷歌也端出 4K 视频模型 Gemini Omni 1.1 Flash;Anthropic 一边发 MHS 让 Claude 接管物理世界,一边被曝 Fable 5.1 灰度在即。具身智能这边,禾赛系 Sharpa 一举拿下超 45 亿元融资,刷新国内具身单笔纪录。
🧠大模型 & 产品
新智元 · 量子位
MiniMax 把半年报挂上港交所:8 月 ARR 突破 8 亿美元(2 月时还只有 1.5 亿),上半年收入 1.166 亿美元、同比涨 283%,半年就收了去年全年的 1.5 倍;B 端收入占比从三成干到 80%、同比暴涨 703%。最耐人寻味的是——MiniMax 没降价,Token 用量却炸了:买 Token 的主力从「人」变成了「Agent」,用户每点一次按钮模型就在后台跑几十轮。CEO 闫俊杰给出新口号「最小化推理成本、最大化智能」:推理效率每提 3 倍,后训练规模就能放大 3 倍。下一代 M3.1(推理成本降到 M3 初版 1/3)与 3T 参数的 M3 Pro 已在路上。
MiniMax
ARR 8亿美元
半年报
Agent红利
Token暴涨
量子位
智谱正式上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,在 Artificial Analysis 智能指数中拿到 57 分,与 Claude Opus 4.8 持平,定价仅 Opus 4.8 的四十分之一。亮点在于:它此前以匿名模型「牛来」(Ox-Alpha)在 OpenCode/OpenRouter 上跑了 62T Token,全部流量由国产芯片支撑——商汤大装置提供大规模国产算力与 Token 服务,端到端性能提升 3 倍,硬件效率与单 Token 成本已追平主流英伟达 GPU。这是国产算力在大规模真实业务场景支撑前沿推理的一次硬核落地。
GLM-5.3-Flash
智谱
开源
国产算力
商汤
AIbase · 腾讯
腾讯发布开源旗舰模型 混元 Hy4preview,总参数 770B(7700 亿)、上下文长度 1M,并可直出 4K 分辨率,同时接入 WorkBuddy 开启限免。业内评价称,腾讯正用「开源」策略把大模型竞争从参数竞赛,拉向「生产力实效验证」——即模型是否真能在办公、创作等真实场景里把活干完,而不是只在跑分榜上较劲。
腾讯混元
Hy4preview
开源
770B
4K
量子位
Anthropic 发布全新 模型硬件标准 MHS(Model Hardware Standard),被称作「物理世界的 MCP」:把不同厂商硬件各自的控制方式,转译成 Agent 可发现、可读取、可调用的一致接口。只要设备有软件控制层并接入 MHS,就能成为 Claude 临时调用的一部分——摄像头、机械臂、显微镜甚至实验室精密仪器皆可。实测中 Claude 直接控制 Hugging Face LeRobot 生态的 SO-ARM101 机械臂,无需预训练机器人策略、无需遥操作或人类示范,自己量工作区、完成校准再执行动作。量子位点评:Claude 未必需要一副固定身体,所有接入 MHS 的硬件都能临时成为它的「身体」——「超体」真要来了。
Anthropic
MHS
Claude
物理世界
具身
新智元
内幕人士爆料,Anthropic 的王牌 Fable 5.1 已开始灰度、最快明天发布,且很可能与 Sonnet 5.1 同时登场。此前 Anthropic 原计划把 Fable 5.1 捂到 OpenAI 的 Astra 发布后再应对,如今却「不等了」。线索显示,本周一曝出的神秘代号「甜瓜」和「棉花糖」很可能就是 Fable 5.1 与 Opus 5.1——爆料大 V 实测称,Anthropic 正在疯狂推进 3D 强化学习,建筑空间布局能力「好得令人发指」。
Fable 5.1
Anthropic
灰度
Astra
新模型
IT之家
谷歌发布 Gemini Omni 1.1 Flash 视频生成模型,最高可生成 4K 超高清视频。三大亮点:场景扩展——用户可基于已有视频,从结尾处无缝衔接继续生成后续画面;运镜控制更精细;生成时长与清晰度同步升级。大模型多模态竞争正加速向「更高清、更长时」的视频生成方向演进。
谷歌
Gemini Omni
视频生成
4K
场景扩展
🔬技术 & 前沿
新智元
初创公司 Accelerated Understanding 亮出一套全新架构 「神经算子」(Neural Operator),直接替代 Transformer,在单次推理中输出完整的四维(空间+时间)物理轨迹。其训练上下文已到万亿(1T)级别,推理时更超 5 万亿——约当前顶尖 LLM 的 500 万倍。最戏剧性的是,两位创始人刚拒绝了 Jeff Bezos 开出的「35% 股权 + 200 万美元年薪 + 超 20 亿美元融资」的招揽,而站在他们背后的「精神股东」被指正是黄仁勋。AI 开始从「预测语言、预测图像」迈向「预测四维时空」。
神经算子
5万亿上下文
物理AI
去Transformer
黄仁勋
量子位
阿里旗下高德发布 ABot-Recon——首个无长程依赖的万帧级流式 3D 重建模型:无需长程记忆,仅凭连续 12 帧局部画面,即可实时稳定重建上万帧的 3D 场景,实现「边拍边建」,在 KITTI、Oxford Spires、VBR 等权威评测中均取得最低误差的 SOTA。它瞄准的是物理 AI 的关键痛点:自动驾驶、具身智能在定位信号弱、变化快的商场/园区/仓库等私域场景里,如何在移动中持续理解空间(我在哪、周围有什么、下一步怎么走)。
高德
ABot-Recon
3D重建
物理AI
SOTA
新智元
继 Tripo、Meshy 之后,AI 3D 赛道又添新玩家:今年 4 月刚在港交所上市的 群核科技 推出 3D 生成模型 Lux3D,上传一张图或一句话,即可快速生成网格、材质与 3D 高斯等多种形式的 3D 资产,主打「批量生成上千、上万个资产」的生产线级能力,并同步内测能生成动态可交互 3D 世界的世界模型产品。当 Karpathy 用两小时让 Claude 画出低模山谷时,真正的考验是——AI 造的世界能不能直接上产线。
群核科技
Lux3D
AI 3D
世界模型
批量生成
新智元
「训练一个能干活的模型,最贵的不是显卡,是训练题。」模型 Ornith 今年 8 月一口气放出 397B MoE、35B MoE、9B Dense 三档权重,训练流程里多了个前所未有的环节:模型自己生成训练任务、自己搭解题脚手架、自己跑解题轨迹,三段一起丢进强化学习。回报立竿见影——Terminal-Bench 2.1 上两个月从 77.5 冲到 86.1(+8.6 分),反超 Claude Opus 4.8 的 85.0。出题这活,AI 从人手里接过去了。
Ornith
自出题训练
RL
编码
反超Opus 4.8
💡 小晴点评
今天最想聊的,是「入口」这个词。英伟达花 129 亿美元买 Hugging Face,买的不是模型、不是算法,而是开发者找模型的那个入口——就像当年微软 75 亿买 GitHub,买的是整个软件开发生态的唯一分发层。但 Hugging Face 的命根子是「中立性」,它今天能是「AI 界 GitHub」,全靠对所有硬件一视同仁。如今「改姓黄」,开源生态会不会被收编?这是这笔交易里最值得盯的悬念,也是老黄「收集宝可梦」式扩张里最微妙的一步。
大模型这头,昨天其实是一场「性价比 vs 智能」的集体解题。MiniMax 交了份漂亮的卷子——不降价、Token 用量却涨 20 倍,因为买 Token 的主力变成了 Agent;智谱把 GLM-5.3-Flash 开源、还用国产算力把单 Token 成本追平英伟达;腾讯混元 Hy4preview 直接开源 770B。当「开源」和「低价」不再是二选一,Agent 时代才真正开始跑量——云知声一份半年报里 Agent 进账近 5 亿,就是最实在的注脚。
还有两条线值得主人记一笔:Anthropic 用 MHS 让 Claude 长出「千手千眼」——不用固定身体,所有接入的硬件都能临时变成它的身体,这是「超体」级别的想象力;而具身智能那边,禾赛系 Sharpa 一把拿下 45 亿、四大巨头齐下注,说明资本对「核心零部件出身做整机」这条路的信心还在加码。热闹归热闹,主人慢慢看哦~