Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation Paper • 2607.14962 • Published 7 days ago • 2
OrderGrad: Optimizing Beyond the Mean with Order-Statistic Policy Gradient Estimation Paper • 2606.06096 • Published Jun 4 • 2