From 5ab644db6823491ffadb793162be36f4aa5edd04 Mon Sep 17 00:00:00 2001 From: YurenHao0426 Date: Mon, 10 Aug 2026 10:25:00 -0500 Subject: results: retain GoToObj as diagnostic only --- results/babyai_shared/b1/seed4102_sdil.json | 268 ++++++++++++++++++++++++++++ 1 file changed, 268 insertions(+) create mode 100644 results/babyai_shared/b1/seed4102_sdil.json (limited to 'results/babyai_shared/b1/seed4102_sdil.json') diff --git a/results/babyai_shared/b1/seed4102_sdil.json b/results/babyai_shared/b1/seed4102_sdil.json new file mode 100644 index 0000000..006a8c1 --- /dev/null +++ b/results/babyai_shared/b1/seed4102_sdil.json @@ -0,0 +1,268 @@ +{ + "condition": "sdil", + "config": { + "action_dim": 7, + "context_gain": 1.0, + "hidden_layers": 2, + "input_dim": 984, + "learning_rate": 0.01, + "mission_dim": 13, + "momentum": 0.9, + "reciprocal_learning_rate": 0.01, + "weight_decay": 0.0001, + "width": 256 + }, + "data": { + "color_cardinality": 6, + "elapsed_seconds": 37.730633020401, + "env_id": "BabyAI-GoToObjS6-v1", + "minigrid_version": "3.1.0", + "object_cardinality": 11, + "protocol": "babyai_shared_feedback_b0", + "rollout_episodes": 500, + "rollout_seed_start": 200000, + "state_cardinality": 3, + "train_episodes": 20000, + "train_steps": 70159, + "validation_episodes": 2000, + "validation_steps": 7019, + "vocabulary": [ + "", + "ball", + "blue", + "box", + "go", + "green", + "grey", + "key", + "purple", + "red", + "the", + "to", + "yellow" + ] + }, + "epoch_history": [ + { + "epoch": 1, + "train_loss": 0.7134594283320687 + }, + { + "epoch": 2, + "train_loss": 0.3401663822477514 + }, + { + "epoch": 3, + "train_loss": 0.19433609214696018 + }, + { + "epoch": 4, + "train_loss": 0.32963184771212667 + }, + { + "epoch": 5, + "train_loss": 0.08546664945103906 + }, + { + "epoch": 6, + "train_loss": 0.2630213478343053 + }, + { + "epoch": 7, + "train_loss": 0.11469778050075878 + }, + { + "epoch": 8, + "train_loss": 0.05664703453128988 + }, + { + "epoch": 9, + "train_loss": 0.04731606664982709 + }, + { + "epoch": 10, + "train_loss": 0.041082520572976636 + }, + { + "epoch": 11, + "train_loss": 0.20956628300926902 + }, + { + "epoch": 12, + "train_loss": 0.05752169869840145 + }, + { + "epoch": 13, + "train_loss": 0.03557884735817259 + }, + { + "epoch": 14, + "train_loss": 0.03279060132124207 + }, + { + "epoch": 15, + "train_loss": 0.031631635776297615 + }, + { + "epoch": 16, + "train_loss": 0.03048184691166336 + }, + { + "epoch": 17, + "train_loss": 0.3688752563975074 + }, + { + "epoch": 18, + "train_loss": 0.07081738247112794 + }, + { + "epoch": 19, + "train_loss": 0.054225066940892824 + }, + { + "epoch": 20, + "train_loss": 0.046492697589776734 + }, + { + "epoch": 21, + "train_loss": 0.047163276597857476 + }, + { + "epoch": 22, + "train_loss": 0.7845130688493902 + }, + { + "epoch": 23, + "train_loss": 0.3934751184691082 + }, + { + "epoch": 24, + "train_loss": 0.14599689253351905 + }, + { + "epoch": 25, + "train_loss": 0.3236034153672782 + }, + { + "epoch": 26, + "train_loss": 0.16323385662653228 + }, + { + "epoch": 27, + "train_loss": 0.09238848522305489 + }, + { + "epoch": 28, + "train_loss": 0.11827930971980095 + }, + { + "epoch": 29, + "train_loss": 0.15449962057850578 + }, + { + "epoch": 30, + "train_loss": 0.14310111538930373 + }, + { + "epoch": 31, + "train_loss": 0.12045336569574747 + }, + { + "epoch": 32, + "train_loss": 0.14461230769753455 + }, + { + "epoch": 33, + "train_loss": 0.08665146978064017 + }, + { + "epoch": 34, + "train_loss": 0.12435456068678336 + }, + { + "epoch": 35, + "train_loss": 0.15446093495596538 + }, + { + "epoch": 36, + "train_loss": 0.09183386780998924 + }, + { + "epoch": 37, + "train_loss": 0.06461878389120101 + }, + { + "epoch": 38, + "train_loss": 0.05828312648290938 + }, + { + "epoch": 39, + "train_loss": 0.15417793202129276 + }, + { + "epoch": 40, + "train_loss": 0.6200590939007022 + } + ], + "epochs_completed": 40, + "finite": true, + "first_nonfinite_epoch": null, + "mission_lesion_rollout": { + "episodes": 500, + "mean_length": 8.284, + "mean_return": 0.7789, + "success": 0.86 + }, + "mission_lesion_validation": { + "accuracy": 0.8928622310870494, + "loss": 0.36016965703859616 + }, + "predictor": [ + { + "action_observations": 0, + "context_rms": 0.2660917639732361, + "mean_per_cell_r2": 0.47728049755096436, + "neutral_observations": 4096, + "residual_context_rms_ratio": 0.3765350580215454, + "teaching_observations": 0 + }, + { + "action_observations": 0, + "context_rms": 0.2768581211566925, + "mean_per_cell_r2": 0.6187853217124939, + "neutral_observations": 4096, + "residual_context_rms_ratio": 0.3115047812461853, + "teaching_observations": 0 + } + ], + "provenance": { + "cuda_device_name": "NVIDIA GeForce GTX 1080", + "cuda_peak_allocated_bytes": 114644992, + "cuda_visible_devices": "7", + "device": "cuda:0", + "git_commit": "e3011f144a018f6415b3c2a636c0646e412b3ced", + "git_dirty_tracked": false, + "minigrid_version": "3.1.0", + "torch_version": "2.3.1+cu118" + }, + "rollout": { + "episodes": 500, + "mean_length": 5.956, + "mean_return": 0.8441000000000002, + "success": 0.93 + }, + "stage": "babyai_shared_b1", + "training": { + "batch_size": 256, + "model_seed": 4102, + "neutral_examples_per_epoch": 4096, + "parameter_count_including_reciprocal_context_predictor": 394759, + "shuffle_seed": 4102, + "total_wall_seconds_including_rollouts": 186.63246417045593, + "training_wall_seconds": 183.2198555469513 + }, + "validation": { + "accuracy": 0.9477133494799829, + "loss": 0.29150108231966915 + } +} -- cgit v1.2.3