Mika Hoshino
mikaevange
ยท
AI & ML interests
Multimodal learning, vision-language models, image captioning, cross-modal retrieval
Recent Activity
liked a model 2 days ago
TakalaWang/Discussion-Phi-4-multimodal-instruct-audio-dimp-reasoning upvoted a paper 2 days ago
All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts liked a dataset 3 days ago
multimodal-reasoning-lab/PhysicsOrganizations
None yet