Optimal sample complexity for learning Plackett-Luce models.
problem PAC-learning good items from subsetwise feedback in Plackett-Luce models.
method Algorithm based on a wrapper around a PAC winner-finding algorithm, adapting to instance hardness.
result Optimal instance-dependent sample complexity for best arm identification.