← 最新论文日报
8月8日· 周六
arXiv 论文日报
机器人世界模型与LLM推理新突破
今日论文聚焦两大热点:机器人操作领域,跨形态泛化与世界模型成为关键词,DyPES-VLA与GeniWorld分别从动力学先验和视频生成角度提升泛化能力;大模型推理方面,生成式奖励模型与选择性信任机制为强化学习和上下文可靠性提供新思路。
📄 10 篇精选</> 1 篇带代码🏆 3 篇 SOTA
📈 趋势速览本周热词显示,agentic与generation持续升温,智能体与生成式方法深度融合。机器人操作领域,世界模型与跨形态泛化成为新焦点,多篇论文探索利用预训练模型和共享先验提升适应性。同时,强化学习中的奖励建模与信任机制受到关注,旨在提升LLM的推理可靠性与效率。
1
DyPES-VLA:跨形态操作中的共享动力学先验与本体特定控制学习
机器人操作SOTA
DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation
💡 跨形态机器人操作泛化新框架,共享动力学先验提升适应性。
机器人
2
💡 量子增强与智能体AI结合,预测心脏骤停死亡率更精准。
大模型
3
MAS:基于权威共享状态的多玩家世界模型
世界模型SOTA
MASS: Multiplayer World Models with Authoritative Shared State
💡 分离世界动态与渲染,多玩家世界模型扩展性大增。
视觉
4
RRC: Unlocking Generative Reward Models in LLM Reinforcement Learning via Ranking-Based Reward Construction
💡 排序构建奖励,解锁生成式奖励模型在RL中的潜力。
推理
5
6
选择性上下文偏好优化:何时该信任模型
上下文学习
Learning When to Trust via Selective Context Preference Optimization
💡 选择性信任框架,解决模型对误导性上下文的过度信任。
推理
7
$ω$-0: A Latent Predictive World Action Model for Concurrent Humanoid Loco-Manipulation
💡 人形机器人全身协同操作,世界动作模型直接预测指令。
机器人
8
The Low Frequency Trap: Video Language Models Fail at Simple Event Bookkeeping
💡 揭示视频语言模型在简单事件计数上的低频陷阱。
推理
9
💡 基于预训练视频生成,机器人交互世界模型跨场景泛化。
机器人
10
Tytan: Interactive Neurosymbolic Construction of Analytic Semantic Schemas from Relational Data
💡 神经符号方法自动构建分析语义模式,解决手工瓶颈。
大模型
生成于 06:36 · 来源 arXiv · AI 编排