EPISODE · Jul 10, 2026 · 14 MIN
2026.07.10 | Vidu S1实现实时视频对话交互;视频绿洲揭示理解评估缺陷
from HuggingFace 每日AI论文速递
【赞助商】OpenClaw快报每天五分钟,听听 OpenClaw 快报,带你了解最新动态和业内讨论传送门 https://www.xiaoyuzhoufm.com/podcast/6a1732a2dffa135d0ab5ef43【目录】本期的 15 篇论文如下:[00:31] 🎬 Vidu S1: A Real-Time Interactive Video Generation Model(Vidu S1:一种实时交互式视频生成模型)[01:29] 🔍 Video-Oasis: Rethinking Evaluation of Video Understanding(视频绿洲:重新思考视频理解的评估)[02:27] 🔑 Why Can't I Open My Drawer? Mitigating Object-Driven Shortcuts in Zero-Shot Compositional Action Recognition(为什么我打不开抽屉?缓解零样本组合动作识别中的对象驱动捷径)[03:21] 🤖 UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks(UniClawBench:面向真实世界任务中主动智能体的通用基准)[04:18] 🎥 LongE2V: Long-Horizon Event-based Video Reconstruction, Prediction, and Frame Interpolation with Video Diffusion Models(LongE2V:基于视频扩散模型的长时域事件驱动视频重建、预测与帧插值)[05:24] 🧬 Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation(思想具有基因组:科学谱系推理与基于谱系的创意生成基准测试)[06:13] 🌐 Enhancing In-context Panoramic Generation via Geometric-aware Pretraining(通过几何感知预训练增强上下文全景生成)[06:54] 🎬 CineMobile: On-Device Image-to-Video Diffusion for Cinematic Camera Motion Generation(CineMobile:面向电影级摄像机运动生成的设备端图像到视频扩散)[07:52] 🎬 OpenCoF: Learning to Reason Through Video Generation(OpenCoF:通过视频生成学习推理)[08:45] 🚀 Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE(Jet-Long:基于动态双焦点旋转位置编码的高效长上下文扩展)[09:39] ⚡ Linear Attention Architectures: Mechanisms, Trade-offs, and Cross-Layer Routing(线性注意力架构:机制、权衡与跨层路由)[10:38] 💊 DrugGen 2: A disease-aware language model for enhancing drug discovery(DrugGen 2:一种疾病感知型语言模型,用于增强药物发现)[11:23] ⚡ Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models(Flash-BoN:扩散模型中推理时缩放的即时草稿生成)[12:08] 🎵 A Quantized Native Runtime for On-Device Semantic Audio Generation(面向设备端语义音频生成的量化原生运行时)[13:01] 🚀 UP: Unbounded Positive Asymmetric Optimization for Breaking the Exploration-Stability Dilemma(UP:用于打破探索-稳定性困境的无界正向非对称优化)【关注我们】您还可以在以下平台找到我们,获得播客内容以外更多信息小红书: AI速递在小宇宙查看该单集文稿
Embed this episode
Ready to play
2026.07.10 | Vidu S1实现实时视频对话交互;视频绿洲揭示理解评估缺陷
No transcript for this episode yet
Similar Episodes
No similar episodes found.