🧠大模型 & 芯片
ZAKER · IT之家 · 财联社 · 量子位
7月22日,AMD与Anthropic签署历史性协议:AMD将向Anthropic投资最高50亿美元,并签署价值数百亿美元的AI服务器采购协议,部署最新Instinct MI450芯片,总量达2吉瓦。此举标志着AMD以「投资+供货」绑定模式打入AI核心战场,正面挑战英伟达在AI芯片领域的统治地位。
重磅
#芯片
#AMD
#Anthropic
#融资
36氪 · 每日经济新闻 · 量子位 · 机器之心
月之暗面7月16日发布2.8万亿参数开源模型Kimi K3,在Artificial Analysis综合评测中以57分排名全球第三,仅次于Claude Fable 5和GPT-5.6 Sol。然而流量洪峰导致算力告急,7月19日被迫暂停C端新用户订阅。与此同时公司年收入突破3亿美元,正筹备6个月内在港上市。7月27日K3将以开放权重形式正式发布。
热议
#大模型
#Kimi
#开源
#IPO
36氪 · 机器之心 · 知乎
DeepSeek V4 Pro/Flash双版本正式上线,支持百万Token上下文,SWE-bench达80.6%。创新性引入API峰谷定价机制,高峰期价格翻倍。更值得关注的是其推理芯片项目已秘密推进一年,正接洽芯片设计及晶圆代工厂商,试图从模型层向上游芯片层延伸,构建软硬一体闭环。
#DeepSeek
#大模型
#自研芯片
#开源
IT之家 · 虎嗅 · 环球网 · 量子位
7月18日,马斯克透露xAI下一代旗舰模型Grok 4.6参数规模达2万亿,即将完成初始训练。此前1.5万亿参数的Grok 4.5已奠定基座,4.6将进一步拉高参数天花板。xAI持续以极致规模路线追赶GPT与Claude阵营。
#大模型
#Grok
#xAI
51CTO · 量子位 · CSDN
Google DeepMind于7月21日正式发布Gemini 3.6 Flash,定位为兼顾前沿智能与推理效率的「工作马」模型。在编程、推理等核心任务上显著提升,同时大幅降低Token消耗成本,AI Agent场景成为重点优化方向。
#Gemini
#Google
#多模态
Hugging Face · Poolside · CSDN
Poolside发布Laguna S 2.1,118B总参、8B激活的MoE架构开源编程模型,专为Agentic Coding和长程任务设计。同期发布33B轻量版Laguna XS 2.1可本地运行,进一步降低开发者门槛,叫板中国开源编程模型阵营。
#编程模型
#开源
#Agent
💡 小晴点评
这两天AI圈的核心关键词只有一个:算力。OpenAI将2030年算力预算暴增至7500亿美元并首次自建数据中心,AMD斥50亿美元绑定Anthropic挑战英伟达——算力军备竞赛已经从「拼采购」升级到「拼基建」。与此同时,Kimi K3因算力不足被迫停服、微软对小型客户收紧GPU供给,说明算力稀缺正在重塑行业格局:有算力者得天下,无算力者被淘汰。另一条主线是具身智能的产业化拐点。WAIC 2026上大模型参数竞赛退潮,取而代之的是机械臂的实际运转和「已量产」的标签——物理AI正在从实验室论文走向工厂产线。酷哇的双层世界模型、日冕的万台部署计划,都在回答同一个问题:AI如何真正创造物理世界的价值。最后,DeepSeek从模型层向上渗透芯片层、字节豆包手机走向规模量产,中国AI的「软硬一体」路径正在加速成型。