Skip to content

Commit 6099e52

Browse files
AZ: remove training_mode in mini tournaments (#252)
1 parent 6eb7dfa commit 6099e52

1 file changed

Lines changed: 8 additions & 3 deletions

File tree

deep_quoridor/src/agents/alphazero/alphazero.py

Lines changed: 8 additions & 3 deletions
Original file line numberDiff line numberDiff line change
@@ -67,7 +67,14 @@ def training_only_params(cls) -> set[str]:
6767
Returns a set of parameters that are used only during training.
6868
These parameters should not be used during playing.
6969
"""
70-
return {"train_every", "learning_rate", "optimizer_iterations", "batch_size", "replay_buffer_size"}
70+
return {
71+
"training_mode",
72+
"train_every",
73+
"learning_rate",
74+
"optimizer_iterations",
75+
"batch_size",
76+
"replay_buffer_size",
77+
}
7178

7279

7380
class AlphaZeroAgent(TrainableAgent):
@@ -202,8 +209,6 @@ def train_iteration(self):
202209
self.recent_losses = self.recent_losses[-100:]
203210

204211
print(f"done in {time.time() - t0:.2f}s")
205-
dumb_score = self.metrics.dumb_score(self)
206-
print(f"Dumb score: {dumb_score}")
207212

208213
def _log_action(
209214
self,

0 commit comments

Comments
 (0)