diff options
| author | YurenHao0426 <Blackhao0426@gmail.com> | 2026-07-22 02:00:18 -0500 |
|---|---|---|
| committer | YurenHao0426 <Blackhao0426@gmail.com> | 2026-07-22 02:00:18 -0500 |
| commit | e60afe651eb1fbe60397413af4d0df43cf22f1d0 (patch) | |
| tree | 0b5526aac62b986c4c64c9157f0033086f2c8b4b /results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json | |
| parent | a0696a3d72cc5bf69876e1716b74f7e1ac525dd0 (diff) | |
results: record failed useful-depth BP screens
Diffstat (limited to 'results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json')
| -rw-r--r-- | results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json | 1 |
1 files changed, 1 insertions, 0 deletions
diff --git a/results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json b/results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json new file mode 100644 index 0000000..507179b --- /dev/null +++ b/results/depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0.json @@ -0,0 +1 @@ +{"args": {"mode": "bp", "dataset": "tentmap", "depth": 4, "width": 16, "act": "relu", "residual": 0, "epochs": 40, "batch_size": 128, "train_examples": 0, "val_examples": 5000, "split_seed": 2027, "eval_split": "validation", "task_seed": 0, "task_train_examples": 50000, "task_test_examples": 10000, "task_levels": 7, "task_n_in": 4, "task_classes": 10, "teacher_depth": 8, "teacher_width": 64, "teacher_residual": 1, "eta": 0.02, "eta_A": 0.02, "eta_P": 0.002, "momentum": 0.9, "w_scale": 1.0, "a_scale": 1.0, "feedback_scale": 1.0, "pert_sigma": 0.01, "pert_every": 4, "pert_ndirs": 16, "pert_mode": "simultaneous", "use_residual": 1, "raw_scale_control": "none", "learn_A": 1, "learn_P": 1, "p_neutral": 1, "p_warmup_steps": 200, "p_warmup_eta": 0.05, "nuis_rho": 0.0, "traffic_mode": "soma", "predictor_mode": "diagonal", "normalize_delta": 0, "settle_steps": 0, "kappa": 0.0, "feedback": "error", "seed": 0, "device": "cuda", "log_every": 200, "max_steps": 0, "probe_bs": 512, "outdir": "results", "tag": "depthtask_dev_v1_tentmap_bp_w16_d4_t0_s0", "n_in": 4, "n_out": 2}, "split": {"dataset": "tentmap", "task_seed": 0, "train_examples": 45000, "test_examples": 10000, "evaluation_split": "validation", "synthetic_generator": true, "split_seed": 2027, "validation_examples": 5000, "validation_index_sha256": "291d95d8a591bae65a0250e7365655c3fc52324bdc34677026467ce13bf433b9", "validation_class_counts": {"0": 2500, "1": 2500}, "split_from_training_only": true}, "provenance": {"git_commit": "a0696a3d72cc5bf69876e1716b74f7e1ac525dd0", "git_dirty": false}, "steps": [{"step": 0, "epoch": 0, "train_loss": 0.7022197246551514}, {"step": 200, "epoch": 0, "train_loss": 0.6925510764122009}, {"epoch_end": 0, "step": 352, "eval_split": "validation", "eval_acc": 0.49, "eval_loss": 0.6934619018554687, "val_acc": 0.49, "val_loss": 0.6934619018554687}, {"step": 400, "epoch": 1, "train_loss": 0.6936402916908264}, {"step": 600, "epoch": 1, "train_loss": 0.6925376653671265}, {"epoch_end": 1, "step": 704, "eval_split": "validation", "eval_acc": 0.4914, "eval_loss": 0.6933869140625, "val_acc": 0.4914, "val_loss": 0.6933869140625}, {"step": 800, "epoch": 2, "train_loss": 0.6937887668609619}, {"step": 1000, "epoch": 2, "train_loss": 0.6941705346107483}, {"epoch_end": 2, "step": 1056, "eval_split": "validation", "eval_acc": 0.5098, "eval_loss": 0.69330537109375, "val_acc": 0.5098, "val_loss": 0.69330537109375}, {"step": 1200, "epoch": 3, "train_loss": 0.6934511065483093}, {"step": 1400, "epoch": 3, "train_loss": 0.6938009858131409}, {"epoch_end": 3, "step": 1408, "eval_split": "validation", "eval_acc": 0.5026, "eval_loss": 0.6934269165039062, "val_acc": 0.5026, "val_loss": 0.6934269165039062}, {"step": 1600, "epoch": 4, "train_loss": 0.690829336643219}, {"epoch_end": 4, "step": 1760, "eval_split": "validation", "eval_acc": 0.5006, "eval_loss": 0.693430029296875, "val_acc": 0.5006, "val_loss": 0.693430029296875}, {"step": 1800, "epoch": 5, "train_loss": 0.6926023960113525}, {"step": 2000, "epoch": 5, "train_loss": 0.6927932500839233}, {"epoch_end": 5, "step": 2112, "eval_split": "validation", "eval_acc": 0.4986, "eval_loss": 0.6934110229492187, "val_acc": 0.4986, "val_loss": 0.6934110229492187}, {"step": 2200, "epoch": 6, "train_loss": 0.6911272406578064}, {"step": 2400, "epoch": 6, "train_loss": 0.6944061517715454}, {"epoch_end": 6, "step": 2464, "eval_split": "validation", "eval_acc": 0.4984, "eval_loss": 0.6933203735351563, "val_acc": 0.4984, "val_loss": 0.6933203735351563}, {"step": 2600, "epoch": 7, "train_loss": 0.6943874955177307}, {"step": 2800, "epoch": 7, "train_loss": 0.6926553249359131}, {"epoch_end": 7, "step": 2816, "eval_split": "validation", "eval_acc": 0.4986, "eval_loss": 0.6933603759765625, "val_acc": 0.4986, "val_loss": 0.6933603759765625}, {"step": 3000, "epoch": 8, "train_loss": 0.6917888522148132}, {"epoch_end": 8, "step": 3168, "eval_split": "validation", "eval_acc": 0.4988, "eval_loss": 0.6933662231445312, "val_acc": 0.4988, "val_loss": 0.6933662231445312}, {"step": 3200, "epoch": 9, "train_loss": 0.698246419429779}, {"step": 3400, "epoch": 9, "train_loss": 0.6951472759246826}, {"epoch_end": 9, "step": 3520, "eval_split": "validation", "eval_acc": 0.5004, "eval_loss": 0.69345, "val_acc": 0.5004, "val_loss": 0.69345}, {"step": 3600, "epoch": 10, "train_loss": 0.6905182003974915}, {"step": 3800, "epoch": 10, "train_loss": 0.6948990225791931}, {"epoch_end": 10, "step": 3872, "eval_split": "validation", "eval_acc": 0.4932, "eval_loss": 0.6933667358398438, "val_acc": 0.4932, "val_loss": 0.6933667358398438}, {"step": 4000, "epoch": 11, "train_loss": 0.6905462145805359}, {"step": 4200, "epoch": 11, "train_loss": 0.692357063293457}, {"epoch_end": 11, "step": 4224, "eval_split": "validation", "eval_acc": 0.499, "eval_loss": 0.6935945678710937, "val_acc": 0.499, "val_loss": 0.6935945678710937}, {"step": 4400, "epoch": 12, "train_loss": 0.6917365193367004}, {"epoch_end": 12, "step": 4576, "eval_split": "validation", "eval_acc": 0.498, "eval_loss": 0.6935004272460937, "val_acc": 0.498, "val_loss": 0.6935004272460937}, {"step": 4600, "epoch": 13, "train_loss": 0.692046046257019}, {"step": 4800, "epoch": 13, "train_loss": 0.6930823922157288}, {"epoch_end": 13, "step": 4928, "eval_split": "validation", "eval_acc": 0.4966, "eval_loss": 0.6934499877929687, "val_acc": 0.4966, "val_loss": 0.6934499877929687}, {"step": 5000, "epoch": 14, "train_loss": 0.693751871585846}, {"step": 5200, "epoch": 14, "train_loss": 0.6913657784461975}, {"epoch_end": 14, "step": 5280, "eval_split": "validation", "eval_acc": 0.4964, "eval_loss": 0.6933742797851562, "val_acc": 0.4964, "val_loss": 0.6933742797851562}, {"step": 5400, "epoch": 15, "train_loss": 0.6927146315574646}, {"step": 5600, "epoch": 15, "train_loss": 0.6928483843803406}, {"epoch_end": 15, "step": 5632, "eval_split": "validation", "eval_acc": 0.4836, "eval_loss": 0.6934332397460937, "val_acc": 0.4836, "val_loss": 0.6934332397460937}, {"step": 5800, "epoch": 16, "train_loss": 0.6919213533401489}, {"epoch_end": 16, "step": 5984, "eval_split": "validation", "eval_acc": 0.5008, "eval_loss": 0.6934302124023437, "val_acc": 0.5008, "val_loss": 0.6934302124023437}, {"step": 6000, "epoch": 17, "train_loss": 0.6956812739372253}, {"step": 6200, "epoch": 17, "train_loss": 0.6929510235786438}, {"epoch_end": 17, "step": 6336, "eval_split": "validation", "eval_acc": 0.4988, "eval_loss": 0.6935355834960938, "val_acc": 0.4988, "val_loss": 0.6935355834960938}, {"step": 6400, "epoch": 18, "train_loss": 0.6935717463493347}, {"step": 6600, "epoch": 18, "train_loss": 0.6900875568389893}, {"epoch_end": 18, "step": 6688, "eval_split": "validation", "eval_acc": 0.5016, "eval_loss": 0.6937994995117187, "val_acc": 0.5016, "val_loss": 0.6937994995117187}, {"step": 6800, "epoch": 19, "train_loss": 0.6928388476371765}, {"step": 7000, "epoch": 19, "train_loss": 0.6949319243431091}, {"epoch_end": 19, "step": 7040, "eval_split": "validation", "eval_acc": 0.4984, "eval_loss": 0.6934734130859375, "val_acc": 0.4984, "val_loss": 0.6934734130859375}, {"step": 7200, "epoch": 20, "train_loss": 0.6940304636955261}, {"epoch_end": 20, "step": 7392, "eval_split": "validation", "eval_acc": 0.4936, "eval_loss": 0.693409033203125, "val_acc": 0.4936, "val_loss": 0.693409033203125}, {"step": 7400, "epoch": 21, "train_loss": 0.6921476721763611}, {"step": 7600, "epoch": 21, "train_loss": 0.6907647252082825}, {"epoch_end": 21, "step": 7744, "eval_split": "validation", "eval_acc": 0.4998, "eval_loss": 0.6933627685546875, "val_acc": 0.4998, "val_loss": 0.6933627685546875}, {"step": 7800, "epoch": 22, "train_loss": 0.6935514211654663}, {"step": 8000, "epoch": 22, "train_loss": 0.6911067962646484}, {"epoch_end": 22, "step": 8096, "eval_split": "validation", "eval_acc": 0.4994, "eval_loss": 0.6938143432617188, "val_acc": 0.4994, "val_loss": 0.6938143432617188}, {"step": 8200, "epoch": 23, "train_loss": 0.6894157528877258}, {"step": 8400, "epoch": 23, "train_loss": 0.6921218633651733}, {"epoch_end": 23, "step": 8448, "eval_split": "validation", "eval_acc": 0.5006, "eval_loss": 0.6934918701171875, "val_acc": 0.5006, "val_loss": 0.6934918701171875}, {"step": 8600, "epoch": 24, "train_loss": 0.6922644376754761}, {"epoch_end": 24, "step": 8800, "eval_split": "validation", "eval_acc": 0.5, "eval_loss": 0.6942336547851562, "val_acc": 0.5, "val_loss": 0.6942336547851562}, {"step": 8800, "epoch": 25, "train_loss": 0.6897350549697876}, {"step": 9000, "epoch": 25, "train_loss": 0.6909540891647339}, {"epoch_end": 25, "step": 9152, "eval_split": "validation", "eval_acc": 0.5002, "eval_loss": 0.6941972290039062, "val_acc": 0.5002, "val_loss": 0.6941972290039062}, {"step": 9200, "epoch": 26, "train_loss": 0.6953274011611938}, {"step": 9400, "epoch": 26, "train_loss": 0.6913111805915833}, {"epoch_end": 26, "step": 9504, "eval_split": "validation", "eval_acc": 0.4982, "eval_loss": 0.6934556396484375, "val_acc": 0.4982, "val_loss": 0.6934556396484375}, {"step": 9600, "epoch": 27, "train_loss": 0.6937059760093689}, {"step": 9800, "epoch": 27, "train_loss": 0.693418562412262}, {"epoch_end": 27, "step": 9856, "eval_split": "validation", "eval_acc": 0.4926, "eval_loss": 0.6934234741210937, "val_acc": 0.4926, "val_loss": 0.6934234741210937}, {"step": 10000, "epoch": 28, "train_loss": 0.6936168670654297}, {"step": 10200, "epoch": 28, "train_loss": 0.6930007338523865}, {"epoch_end": 28, "step": 10208, "eval_split": "validation", "eval_acc": 0.498, "eval_loss": 0.69338193359375, "val_acc": 0.498, "val_loss": 0.69338193359375}, {"step": 10400, "epoch": 29, "train_loss": 0.691835880279541}, {"epoch_end": 29, "step": 10560, "eval_split": "validation", "eval_acc": 0.4914, "eval_loss": 0.6933900390625, "val_acc": 0.4914, "val_loss": 0.6933900390625}, {"step": 10600, "epoch": 30, "train_loss": 0.6983358263969421}, {"step": 10800, "epoch": 30, "train_loss": 0.7040852308273315}, {"epoch_end": 30, "step": 10912, "eval_split": "validation", "eval_acc": 0.4942, "eval_loss": 0.6934786987304687, "val_acc": 0.4942, "val_loss": 0.6934786987304687}, {"step": 11000, "epoch": 31, "train_loss": 0.69489985704422}, {"step": 11200, "epoch": 31, "train_loss": 0.693248450756073}, {"epoch_end": 31, "step": 11264, "eval_split": "validation", "eval_acc": 0.5, "eval_loss": 0.6946350952148438, "val_acc": 0.5, "val_loss": 0.6946350952148438}, {"step": 11400, "epoch": 32, "train_loss": 0.6915619969367981}, {"step": 11600, "epoch": 32, "train_loss": 0.691857099533081}, {"epoch_end": 32, "step": 11616, "eval_split": "validation", "eval_acc": 0.4976, "eval_loss": 0.6937075073242187, "val_acc": 0.4976, "val_loss": 0.6937075073242187}, {"step": 11800, "epoch": 33, "train_loss": 0.6887158751487732}, {"epoch_end": 33, "step": 11968, "eval_split": "validation", "eval_acc": 0.5008, "eval_loss": 0.6936916381835937, "val_acc": 0.5008, "val_loss": 0.6936916381835937}, {"step": 12000, "epoch": 34, "train_loss": 0.6929938793182373}, {"step": 12200, "epoch": 34, "train_loss": 0.6936434507369995}, {"epoch_end": 34, "step": 12320, "eval_split": "validation", "eval_acc": 0.498, "eval_loss": 0.6936242065429687, "val_acc": 0.498, "val_loss": 0.6936242065429687}, {"step": 12400, "epoch": 35, "train_loss": 0.6947640180587769}, {"step": 12600, "epoch": 35, "train_loss": 0.6921163201332092}, {"epoch_end": 35, "step": 12672, "eval_split": "validation", "eval_acc": 0.5002, "eval_loss": 0.6937748291015625, "val_acc": 0.5002, "val_loss": 0.6937748291015625}, {"step": 12800, "epoch": 36, "train_loss": 0.6961686015129089}, {"step": 13000, "epoch": 36, "train_loss": 0.6913411617279053}, {"epoch_end": 36, "step": 13024, "eval_split": "validation", "eval_acc": 0.4906, "eval_loss": 0.693613330078125, "val_acc": 0.4906, "val_loss": 0.693613330078125}, {"step": 13200, "epoch": 37, "train_loss": 0.6913988590240479}, {"epoch_end": 37, "step": 13376, "eval_split": "validation", "eval_acc": 0.4996, "eval_loss": 0.6934991577148437, "val_acc": 0.4996, "val_loss": 0.6934991577148437}, {"step": 13400, "epoch": 38, "train_loss": 0.6926538944244385}, {"step": 13600, "epoch": 38, "train_loss": 0.691521942615509}, {"epoch_end": 38, "step": 13728, "eval_split": "validation", "eval_acc": 0.501, "eval_loss": 0.6935242919921875, "val_acc": 0.501, "val_loss": 0.6935242919921875}, {"step": 13800, "epoch": 39, "train_loss": 0.693479597568512}, {"step": 14000, "epoch": 39, "train_loss": 0.6951172351837158}, {"epoch_end": 39, "step": 14080, "eval_split": "validation", "eval_acc": 0.5062, "eval_loss": 0.6936030395507813, "val_acc": 0.5062, "val_loss": 0.6936030395507813}], "final": {"eval_split": "validation", "eval_acc": 0.5062, "eval_loss": 0.6936030395507813, "wall_s": 38.0889253616333, "val_acc": 0.5062, "val_loss": 0.6936030395507813}}
\ No newline at end of file |
