Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation

Researchers propose a reinforcement learning objective, multi-axis max@K, to improve diversity in text-to-image generation models. This method aims to cover a predefined set of visually distinct modes in generated images. Initial results show improved fairness scores while maintaining image quality and text alignment.

RSS Score 0 9/18/2026, 4:00:00 AM Original Source
Save an API key to vote.