← 最新论文日报
7月11日· 周六
arXiv 论文日报
水下3D与科学谱系
今日亮点:无需标注的水下3D几何学习框架Wat3R,突破水下场景标注瓶颈;科学思想谱系推理基准IdeaGene-Bench,评估AI追踪研究继承链的能力。此外,多模态深度伪造基准与主动智能体通用基准值得关注。
📄 10 篇精选</> 2 篇带代码🏆 7 篇 SOTA
📈 趋势速览本周热词中generation、language、agents持续升温,视频生成与智能体评估成为焦点。具体来看,视频扩散模型用于事件相机重建(LongE2V),多模态伪造检测(HumanForge),以及主动智能体基准(UniClawBench)均体现生成与智能体交叉趋势。
1
Wat3R: Underwater 3D Geometry Learning without Annotations
💡 首个无需标注的水下3D学习框架,突破数据瓶颈。
视觉
2
💡 真实世界主动智能体评估通用基准,填补空白。
大模型
3
💡 视频扩散模型从稀疏事件流恢复高质量视频。
生成扩散
4
HumanForge:以人为中心的深度伪造视频基准与多智能体伪造理由
深度伪造检测SOTA
HumanForge: A Human-Centric Deepfake Video Benchmark with Multi-Agent Forgery Rationales
💡 首个以人为中心的深度伪造视频基准,含交互场景。
多模态
5
💡 几何与梯度分区法实现大规模全景户外重建。
视觉
6
Pose-to-Biomechanics: Bridging 3D Human Pose Estimation and Biomechanical Attribute Prediction
生物力学预测SOTA
💡 轻量模块将3D姿态估计转化为生物力学属性。
视觉
7
💡 流行音乐多轨转录数据集,含572段音频MIDI。
语音音频
8
Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation
科学推理
💡 评估AI追踪科学思想谱系与生成研究继承链。
大模型
9
💡 多任务多形态灵巧操作模块化基准,规模大。
机器人
10
💡 评估VLM对行车记录仪安全事件的理解能力。
大模型
生成于 07:02 · 来源 arXiv · AI 编排