[논문리뷰] Video2Roleplay: A Multimodal Dataset and Framework for Video-Guided Role-playing Agents
Chao Zhang이 [arXiv]에 게시한 ‘Video2Roleplay: A Multimodal Dataset and Framework for Video-Guided Role-playing Agents’ 논문에 대한 자세한 리뷰입니다.
Chao Zhang이 [arXiv]에 게시한 ‘Video2Roleplay: A Multimodal Dataset and Framework for Video-Guided Role-playing Agents’ 논문에 대한 자세한 리뷰입니다.
Yongsen Mao이 [arXiv]에 게시한 ‘SPATIALGEN: Layout-guided 3D Indoor Scene Generation’ 논문에 대한 자세한 리뷰입니다.
Steven Liu이 [arXiv]에 게시한 ‘RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation’ 논문에 대한 자세한 리뷰입니다.
Narendra Ahuja이 [arXiv]에 게시한 ‘RGB-Only Supervised Camera Parameter Optimization in Dynamic Scenes’ 논문에 대한 자세한 리뷰입니다.
jialingt이 [arXiv]에 게시한 ‘MANZANO: A Simple and Scalable Unified Multimodal Model with a Hybrid Vision Tokenizer’ 논문에 대한 자세한 리뷰입니다.