🚀新模型 & 产品发布
智谱 · IT之家 · 澎湃新闻 · 科技日报
8 月 14 日,智谱(2513.HK)正式发布新一代旗舰 GLM-5.3。与 GLM-5.2 相比基座模型完全未变(约 7430 亿参数 MoE),全部提升来自后训练 Scaling——数十倍的长程任务环境、更丰富的环境类型与超长后训练时间。官方称其编程体感较前代提升 50%,在 Terminal Bench 3.0、Agents' Last Exam(CLI)等公开基准中达开源 SOTA,编程与智能体能力接近 Claude Fable 5;并意外涌现网络安全能力,已在真实开源项目检出 2436 个历史漏洞。完整权重预计两周后开放。
#大模型
#开源
#GLM-5.3
#智谱
#后训练Scaling
IT之家 · 凤凰网 · 新浪科技 · 中华网
当地时间 8 月 13 日,谷歌宣布推出 Gemini 3.7 Flash,专为编程与 Agents 场景打造,距离 Gemini 3.6 Flash 发布仅三周。为抢夺开发者,谷歌祭出限时半价:今年年底前每百万 token 输入 0.75 美元、输出 3.75 美元,仅为 3.6 Flash 标准价的一半。媒体形容这是一次「降价换市场」的闪击,直指 xAI 的 Grok 与 Anthropic 的 Claude 系列。
#大模型
#Google
#Gemini 3.7 Flash
#Agent
#降价
机器之心Pro · 快科技 · InfoQ
8 月 13 日晚,DeepSeek 正式推出首款 Agent 产品——DeepSeek Harness v0.1 开发者预览版,以 MIT 协议在 GitHub 开源。其「一切皆插件」架构把插件边界下沉到整个运行时:模型、工具、技能、会话、沙箱、存储、Agent Loop、调度和 UI 全部由插件组成,可替换范围从某个搜索工具一直延伸到调度与界面,直接对标 OpenAI Codex 与 Anthropic Claude Code。
#DeepSeek
#Agent
#开源
#AI编程
#Harness
IT之家 · MiniMax官方 · 知乎
AI 公司 MiniMax 于 8 月 14 日推出并开源音乐生成模型 MiniMax-Music3,可根据歌词与音乐描述一次生成最长 5 分钟的完整歌曲,输出 32kHz 立体声。模型采用 8B 全局语言模型 + 0.6B 局部语言模型分离语义与声学建模的分层架构,原生支持前奏、主歌、副歌、桥段等曲式结构,把 AI 音乐从「能出片段」推进到「能写完整歌」。
#MiniMax
#音乐生成
#开源
#Music3
💰融资 & 行业动态
21财经 · 第一财经 · 华尔街见闻
8 月 13 日晚,DeepSeek 发布 API 调价公告,宣布自 8 月 17 日 00:00 起实行「峰谷定价」:高峰时段(北京时间 9:00–12:00、14:00–18:00)价格翻倍,空闲时段为高峰价的一半。其中 V4 Flash 高峰百万词元输出涨至 9 元,V4 Pro 更涨至 27 元、较此前最高涨约 12 倍。媒体解读为:中国模型正「走出价格战、走向智能战」,低价是手段、不是目的。
#DeepSeek
#涨价
#API定价
#峰谷定价
#行业
网易科技 · 证券时报 · 新京报 · 智东西
8 月 14 日百度 AI Day 上,百度文库网盘通用智能体 GenFlow 官宣中文名「库库AI」。其月活用户已于今年 4 月突破 1 亿,其中 AI 办公 MAU 超 2500 万、位居通用 AI 办公赛道第一。文库网盘同步上线「库库AI」独立端,覆盖 PC 客户端、网页端、小程序及企业版,进一步加码 AI 办公赛道。
#百度
#库库AI
#AI办公
#智能体
36氪智涌 · 新浪财经 · 投资界 · 网易科技
8 月 14 日,具身智能公司亮源新创(Light Origins)宣布完成数亿元 Pre-A 轮融资,国科投资领投。创始人姜旭曾任 OpenAI 算法专家,2019 年起参与 OpenAI 全栈算法研发,完整经历 InstructGPT、ChatGPT 到 GPT-4 的关键演进,在 GPT-4 技术报告中被署名 8 次、与 Greg Brockman 并列第一。公司成立于 2024 年底,聚焦具身智能基础模型(物理 AGI),团队超百人、研发占比逾九成。
#融资
#具身智能
#亮源新创
#OpenAI
#物理AGI
品玩/TechCrunch · CSDN · InfoQ
自 8 月 14 日起,Anthropic 旗下编程工具 Claude Code 在 Pro、Max、Team 账户的新会话中默认启用 Auto Mode,以安全分类器替代逐条权限弹窗。官方对照实验显示,自动模式可拦截 89% 的危险命令,而人工审批仅能拦截约 13.6%;Teams 用户的 PR 产出提升约 25%。这一改动标志着 AI 编程代理正从「逐条审批」走向「自主执行 + 风险分类」的新范式。
#Anthropic
#Claude Code
#AI编程
#Auto Mode
💡 小晴点评
这一天最值得记住的,是开源模型的竞争重心正在「向内转」。智谱 GLM-5.3 的 7430 亿基座参数一个都没动,仅靠后训练 Scaling 就把编程能力拉升 50%、登顶开源第一,还意外涌现出漏洞挖掘能力——模型智能的上限,正越来越多地由「怎么训」而非「有多大」决定。DeepSeek Harness 同日开源,则把战场从「模型」推向「Agent 框架」,插件化、可编排的智能体正在成为新的护城河。
第二,苹果联合阿里自研中国专属大模型,是这一天最具战略意味的一步。从「全盘依赖第三方」到「自研 + 通义千问双轨」,苹果的转向既是在合规与本地化之间求平衡,也把中国 AI 的「技术输出力」推到了新高度——连苹果都要借力阿里训练模型,中国开源与算力生态的全球分量可见一斑。
第三,价格策略出现罕见分化。一边是 DeepSeek 峰谷定价落地、V4 Pro 峰值涨 12 倍,一边是谷歌 Gemini 3.7 Flash 首发半价。中国模型忙着「走出价格战、走向智能战」,海外巨头反而开始用价格撬市场——一涨一降之间,攻守之势正在悄然互换,2026 下半场的大模型竞争,越来越像一场「智能 + 定价」的双线博弈。