A Frozen Pixel-Space Diffusion Model Can Guide Itself with Its Own Samples
Paper • 2607.29122 • Published • 4
None defined yet.
PMT: Plain Mask Transformer for Image and Video Segmentation with Frozen Vision Encoders
VidEoMT: Your ViT is Secretly Also a Video Segmentation Model