SciForma: Structure-Faithful Generation of Scientific Diagrams Paper • 2607.18091 • Published 3 days ago • 15
CalliReader: Contextualizing Chinese Calligraphy via an Embedding-Aligned Vision-Language Model Paper • 2503.06472 • Published Mar 9, 2025 • 8
MMMG: A Massive, Multidisciplinary, Multi-Tier Generation Benchmark for Text-to-Image Reasoning Paper • 2506.10963 • Published Jun 12, 2025 • 9