📄 论文精选
arXiv:2607.20145 · cs.AI · 2026-07-23
首次在华为昇腾 NPU SuperPOD 上完成 DeepSeek-V4-Flash 的全参数后训练全流程,涵盖 OR 导向数据构建、SFT 数据清洗、CPT-to-SFT 迁移及 Benchmark 评估,验证了非 GPU 算力训练万亿参数大模型的可行性。
国产算力
后训练
DeepSeek
昇腾
arXiv:2607.20368 · cs.CV · 2026-07-23
提出 Self Gradient Forcing (SGF) 双轮训练策略,通过在自生成因果记忆中恢复梯度信号,仅用 5 秒训练窗口即可外推生成数分钟长视频,在身份保持、布局一致性和时序稳定性上显著超越基线。
视频生成
长视频
训练方法
CV
arXiv:2607.20709 · cs.AI · 2026-07-22
NVIDIA 提出 NOOA(OO Agents),用面向对象范式统一 Prompt 模板、工具 Schema 与工作流图,消除传统 Agent 开发中跨文件碎片化问题,模型无关、可组合,已在 GitHub 开源。
AI Agent
框架
NVIDIA
开源
arXiv:2606.19348 · cs.CL · 2026-04-23
DeepSeek-V4 系列包含 Pro(1.6T 参数/49B 激活)和 Flash(284B/13B 激活)两个 MoE 模型,在超 32T Token 上预训练,采用两阶段后训练范式——领域专家独立培养 + 统一模型蒸馏整合,实现百万级上下文高效推理。
LLM
MoE
长上下文
DeepSeek
🏭 产业动态
Bloomberg · 2026-07-16
Gemini 3.5 Pro 延期:编程能力未达内部目标
Google Gemini 3.5 Pro 因编程性能不达标而推迟数月,消息公布后 Alphabet 股价下跌 4.4%,市值蒸发约 2000 亿美元,而同期 OpenAI GPT-5.6 Sol 正以 SOTA 编程成绩抢占市场。
LLM
Google
Gemini
产业
PhysicL · 2026-07
Robbie: 人形机器人入驻布拉迪斯拉发四星级酒店
Robbie 人形机器人在斯洛伐克 Hotel Devín 酒店正式上岗,标志着具身智能从实验室走向真实商业场景,2026 年具身 AI 投资竞赛全面加速。
具身智能
机器人
商业落地
💡 小晴点评
本周 AI 领域呈现三大趋势:一是多模态大一统——FLUX 3 和 Self Gradient Forcing 分别从模型架构和训练策略两端推进了视频/音频/图像的联合建模,世界模型的拼图正在合拢;二是编程智能体的军备竞赛白热化——GPT-5.6 Sol 以并行子智能体架构登顶,而 Gemini 3.5 Pro 的延期说明"能用代码"和"代码好用"之间仍有鸿沟;三是国产算力的关键突破——SLAI T-Rex 在昇腾 NPU 上跑通 DeepSeek-V4 全参数后训练,证明万亿参数模型训练可以不依赖 GPU 集群。开源生态同样活跃,LangChain OpenWiki 和 NVIDIA OO Agents 让 Agent 开发更加工程化。2026 年的下半场,多模态世界模型和 Agent 框架的成熟正在重塑整个 AI 应用范式。