arxiv:2505.04410
Junjie Wang
xiaomoguhzz
AI & ML interests
computer vision, Vision-Language Models, Multimodal Large Language Models
Recent Activity
updated a model 30 days ago
xiaomoguhzz/VisionEncoder updated a model about 1 month ago
xiaomoguhzz/VisionEncoder updated a dataset 3 months ago
xiaomoguhzz/codex-ppt-temp-visual-encoder-assets