Running 96 Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation 🌼 96 Depth, surface normals, and albedo from a single image
orcarouter/Qwen3.8-27B-Uncensored-GGUF Image-Text-to-Text • 27B • Updated 29 days ago • 206k • 1.19k
nvidia/Nemotron-3-Embed-1B-BF16 Sentence Similarity • 1B • Updated 28 days ago • 541k • • 154
RESOURCE2SKILL: Distilling Executable Agent Skills from Human-Created Multimodal Resources Paper • 2606.29538 • Published Jul 16 • 145
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF Text Generation • 1B • Updated Jul 13 • 328k • 219
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF Text Generation • 1B • Updated Jul 13 • 303k • 330
SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis Paper • 2506.02096 • Published Jun 2, 2025 • 53
FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation Paper • 2505.24714 • Published May 30, 2025 • 37