AI EarlyView
Pro
AI EarlyView
← 最新论文日报
7月11日· 周六

arXiv 论文日报

水下3D与科学谱系

今日亮点:无需标注的水下3D几何学习框架Wat3R,突破水下场景标注瓶颈;科学思想谱系推理基准IdeaGene-Bench,评估AI追踪研究继承链的能力。此外,多模态深度伪造基准与主动智能体通用基准值得关注。

📄 10 篇精选</> 2 篇带代码🏆 7 篇 SOTA
📈 趋势速览本周热词中generation、language、agents持续升温,视频生成与智能体评估成为焦点。具体来看,视频扩散模型用于事件相机重建(LongE2V),多模态伪造检测(HumanForge),以及主动智能体基准(UniClawBench)均体现生成与智能体交叉趋势。
1
Wat3R: Underwater 3D Geometry Learning without Annotations
💡 首个无需标注的水下3D学习框架,突破数据瓶颈。
视觉Jiangwei Ren、Xingyu Jiang、Zijie Song
2
💡 真实世界主动智能体评估通用基准,填补空白。
大模型Zhekai Chen、Chengqi Duan、Kaiyue Sun
3
💡 视频扩散模型从稀疏事件流恢复高质量视频。
生成扩散Cheng-De Fan、Chun-Wei Tuan Mu、Chen-Wei Chang
4
HumanForge: A Human-Centric Deepfake Video Benchmark with Multi-Agent Forgery Rationales
💡 首个以人为中心的深度伪造视频基准,含交互场景。
多模态Wenbo Xu、Zhimin Chen、Xiaojie Liang
5
💡 几何与梯度分区法实现大规模全景户外重建。
视觉Weijian Chen、Weibo Yao、Yuhang Zhang
6
💡 轻量模块将3D姿态估计转化为生物力学属性。
视觉Ayda Eghbalian、Kevin Desai
7
💡 流行音乐多轨转录数据集,含572段音频MIDI。
语音音频Nathan Pruyne、Benjamin Stoler、William Chen
8
💡 评估AI追踪科学思想谱系与生成研究继承链。
大模型Yifan Zhou、Qihao Yang、Yan Li
9
💡 多任务多形态灵巧操作模块化基准,规模大。
机器人Yunchao Yao、Zhuxiu Xu、Tianqi Zhang
10
💡 评估VLM对行车记录仪安全事件的理解能力。
大模型Siddharth Damodharan、Radhika Gupta、Ali Alshami

生成于 07:02 · 来源 arXiv · AI 编排

往期日报