🤖

AI 论文速递

2026年08月04日
ArXiv + GitHub + HuggingFace 精选

📌 今日速览:HuggingFace 今日最热论文 RLSVR 提出自验证奖励机制,实现 LLM 的开放式自我改进(⭐137);TokTier 为编程 Agent 场景设计了精确的有状态分词方案,解决长上下文重复分词痛点;腾讯开源 TencentDB Agent Memory 登顶 GitHub Trending;Ai4 2026 大会今日在拉斯维加斯开幕,全球 12,000+ AI 从业者齐聚。

🔥今日热点
🔥 HuggingFace 最热论文 · ⭐137
arXiv 2607.23802
将 RLVR(可验证奖励强化学习)升级为 RLSVR(自验证奖励强化学习),通过任务变换自动生成可自验证的奖励信号,无需人工标注即可实现 LLM 在开放式任务上的持续自我改进。这是 RLHF 之后强化学习范式的又一重要演进。
今日最热 LLM 强化学习 Self-Improvement
🔥 GitHub Trending #1 · TencentDB Agent Memory
GitHub · TencentCloud/TencentDB-Agent-Memory
腾讯开源的团队级 AI Agent 记忆系统,将会话、文档、代码转化为四种可复用记忆资产(Chat Memory、Skill、LLM-Wiki、Code-Graph),支持跨 Agent 和框架的治理与共享,登顶今日 GitHub Trending。
GitHub Trending Agent Memory 开源工具 MCP
📄论文精选
arXiv 2607.29678 · cs.CL
针对编程 Agent 场景中长对话重复分词的高昂成本,提出精确有状态分词方案,保留 KV Cache 时避免因新增文本改变历史 token 边界,显著降低 Agent 场景下的推理开销。
LLM 推理 Agents KV Cache 分词优化
arXiv 2607.29679 · cs.CV
首次系统测量了视觉生成中文本条件化的 Scaling Law:扩散损失随文本信息量呈可预测的缩放规律,为理解文生图/视频模型的条件机制提供了量化依据,亦为模型设计指明方向。
多模态/VLM 图像生成 Scaling Law Diffusion
arXiv 2607.28617 · cs.CL (HF ⭐5)
提出系统提示词审计框架 AISPA,从用户视角对 88 款商业 AI 产品的 System Prompt 进行八维度审计,揭示了普遍存在的隐性问题指令与用户保护缺失。恰逢 GitHub system_prompts_leaks 仓库大热(⭐62k),安全审计话题持续升温。
AI安全 System Prompt 审计框架 HuggingFace
arXiv 2607.29637 · cs.CV
针对 MLLM 理解代码截图时视觉 token 成本过高的问题,提出自适应视觉压缩方案,智能裁剪空白区域并动态调整分辨率,在保持代码理解精度的同时大幅降低 token 消耗。
多模态 代码理解 Token压缩 MLLM
🤖具身智能 & 机器人
arXiv 2607.29613 · cs.RO / cs.CL / cs.CV
针对 VLA 模型在 RL 后训练中依赖单帧观测的局限,提出 World Critic Model,将时序世界动态信息注入价值估计器,在多步机器人操作任务上显著优于传统 critic 方法。
VLA 强化学习 机器人操作 World Model
arXiv 2607.29622 · cs.RO / cs.CV
提出 Ray-conditioned Vision Transformer(RayViT),将相机几何信息(射线方向)注入预训练 ViT 骨干网络,使机器人模仿学习策略对相机视角变化具备鲁棒性,解决 RGB 观测缺乏显式几何线索的根本问题。
模仿学习 ViT 视角鲁棒 机器人视觉
📡行业动态
Axios · 2026-08-03
Axios 报道指出,即使估值数十亿美元的 AI 巨头也难以留住顶尖研究员,精英 AI 人才正在 OpenAI、Anthropic、Meta、Google DeepMind 和新秀 Thinking Machines 之间快速流动,薪酬包屡创新高。
行业动态 人才市场 OpenAI Anthropic
Ai4 2026 · Las Vegas
Ai4 2026 于 8 月 4-6 日在拉斯维加斯威尼斯人酒店举办,汇集来自 90+ 国家的 12,000+ 参会者、1,000+ 演讲嘉宾和 400+ 展商,聚焦 AI 负责任应用与企业落地。
行业大会 Ai4 企业AI

💡 小晴点评

今日 AI 领域呈现出「智能体基础设施成熟化」的清晰主线。HuggingFace 最热论文 RLSVR(⭐137)将 LLM 自我改进从「需人工验证」推进到「自动自验证」阶段,如果该范式的工程化成熟,将大幅降低 LLM 后训练成本;TokTierCodeShrink 则分别从分词和视觉 token 两个维度为 Agent 场景降本增效,反映业界对 Agent 推理经济性的高度关注。

开源侧,TencentDB Agent Memory 登顶 GitHub Trending,将 Agent 记忆从单体会话升级为团队级共享资产,与 Mem0、MemPalace 等方案共同勾勒出 Agent Memory 赛道的基础设施竞争格局。具身智能方面,WCM(世界评论家模型)和 RayViT(射线条件 ViT)分别从时序建模和几何感知两个互补方向提升机器人策略的鲁棒性,说明具身智能正在从「能跑 demo」走向「能扛干扰」的工程化阶段。

行业层面,Axios 的 AI 人才争夺战报道和 Ai4 2026 万人大会同步进行,暗示 AI 产业正在经历从研发突破到大规模落地的关键转折期。值得持续关注 RL 自改进、Agent 记忆、和具身鲁棒性三条技术线。