arxiv:2608.13556
Shengqiong Wu
ChocoWu
AI & ML interests
Large Language Model, Multimodal learning, Scene graph Generation
Recent Activity
upvoted a paper 6 days ago
OmniScientist: An Omni-Modal Omni-Discipline AI Scientist authored a paper 7 days ago
V-RAE: Rethinking Video Latent Spaces for Generation authored a paper 7 days ago
HoloGeo: Mitigating Landmark Bias in Geo-localization via Evidence-Driven Reasoning