AI EarlyView
Pro
AI EarlyView
← 最新论文日报
7月15日· 周三

arXiv 论文日报

视频生成与智能体新突破

今日亮点:Cycle-World解决长视频生成误差累积;MM-ToolSandBox统一评估视觉工具调用智能体;LLM元认知综述揭示推理新方向。

📄 10 篇精选</> 4 篇带代码🏆 4 篇 SOTA
📈 趋势速览视频生成与智能体持续升温:Cycle-World通过反向预测循环一致性提升长视频质量;MM-ToolSandBox为视觉工具调用提供统一评估框架;LLM元认知研究推动模型自我反思能力。
1
💡 解决长视频生成误差累积难题
生成扩散Zihan Su、Teng Hu、Jiangning Zhang
2
💡 提升视频问答可解释性
大模型Shijie Wang、Honglu Zhou、Ziyang Wang
3
💡 统一评估视觉工具调用智能体
智能体Kaixin Ma、Di Feng、Alexander Metz
4
Requential Coding: Pushing the Limits of Model Compression with Self-Generated Training Data
💡 自生成数据突破模型压缩极限
大模型Shikai Qiu、Marc Finzi、Yujia Zheng
5
HASTE: A Platform for Rapid Post-Disaster Building Damage Assessment
💡 非AI专家快速评估灾后建筑损毁
多模态Caleb Robinson、Anthony Ortiz、Simone Fobi Nsutezo
6
Metacognition in LLMs: Foundations, Progress, and Opportunities
💡 系统梳理LLM元认知进展
大模型Gabrielle Kaili-May Liu、Areeb Gani、Jacqueline Lu
7
💡 零样本奖励函数评估文生图
多模态Runhui Huang、Qihui Zhang、Zhe Liu
8
💡 重定向演示学习灵巧操作
强化学习Yunhai Feng、Natalie Leung、Jiaxuan Wang
9
Inside the Unfair Judge: A Mechanistic Interpretability Account of LLM-as-Judge Bias
💡 揭示LLM裁判偏差的隐藏几何结构
大模型Zixiang Xu、Sixian Li、Huaxing Liu
10
💡 评估LLM对计算机架构论文的深度理解
智能体Nishant Aggarwal、Ayushi Dubal、Sreeraj Kannakarankodi

生成于 06:58 · 来源 arXiv · AI 编排

往期日报