Spaces:
Running
Running
fix: sort leaderboard by Reward (lenient) DESC (was: preserve CSV order)
Browse files
app.py
CHANGED
|
@@ -122,9 +122,12 @@ def load_results() -> pd.DataFrame:
|
|
| 122 |
# Rank by Reward (Stage 2 rate over attempted tasks) descending — Reward is
|
| 123 |
# the headline metric, so the default view leads with it. Intercepted is the
|
| 124 |
# tiebreak. Partial batches keep their attempted-rate.
|
| 125 |
-
#
|
| 126 |
-
|
| 127 |
-
|
|
|
|
|
|
|
|
|
|
| 128 |
df.insert(0, "rank", df.groupby("dataset").cumcount() + 1)
|
| 129 |
df["pass_rate"] = df["pass_rate"].map(_format_pct)
|
| 130 |
df["reward_rate"] = df["reward_rate"].map(_format_pct)
|
|
|
|
| 122 |
# Rank by Reward (Stage 2 rate over attempted tasks) descending — Reward is
|
| 123 |
# the headline metric, so the default view leads with it. Intercepted is the
|
| 124 |
# tiebreak. Partial batches keep their attempted-rate.
|
| 125 |
+
# Sort by Reward (lenient) DESC — headline metric. Intercepted is tiebreak.
|
| 126 |
+
df = df.sort_values(
|
| 127 |
+
["dataset", "reward_rate", "pass_rate"],
|
| 128 |
+
ascending=[True, False, False],
|
| 129 |
+
na_position="last",
|
| 130 |
+
).reset_index(drop=True)
|
| 131 |
df.insert(0, "rank", df.groupby("dataset").cumcount() + 1)
|
| 132 |
df["pass_rate"] = df["pass_rate"].map(_format_pct)
|
| 133 |
df["reward_rate"] = df["reward_rate"].map(_format_pct)
|