{ "args": { "model_seed": 3, "outdir": "results/bci_v2_calibrated_confirmation", "r1_gate": "results/bci_v2_calibrated_dev_gate.json", "task_seed": 32 }, "assays": { "challenge": { "active_state_episode_steps_by_mode": { "acute_critic_lesion": 12936, "acute_outcome_lesion": 12936, "intact": 12936 }, "calibration": { "active_state_episode_steps": 14336, "episodes": 512, "maximum_cursor_summary": { "maximum": 1.8906066417694092, "median": 1.7748355865478516, "minimum": 1.6290333271026611 }, "quantiles": [ 0.2, 0.35, 0.5, 0.65, 0.8 ], "seed": 600032, "targets": [ 1.7369842052459716, 1.7613054513931274, 1.7748485207557678, 1.7908255577087402, 1.8147287607192992 ], "uses_outcome_labels": false }, "episodes_per_target": 128, "maximum_steps_per_episode": 28, "selection_over_evaluation_outcomes": false, "targets": [ 1.7369842052459716, 1.7613054513931274, 1.7748485207557678, 1.7908255577087402, 1.8147287607192992 ], "trajectory_seeds": { "1": 642000, "2": 642001, "3": 642002, "4": 642003, "5": 642004 } }, "performance_evaluation_episodes": 256, "performance_evaluation_seed": 590032 }, "conditions": { "critic_training_lesion": { "cost": { "active_state_episode_steps": 8326, "cursor_scalar_observations": 5088, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 2544, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.0, "daily_success": [ 0.0, 0.0, 0.03125, 0.34375, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0 ], "early_success": 0.010416666666666666, "evaluation_active_state_episode_steps": 256, "final_success": 1.0, "late_success": 1.0, "learning_gain": 0.9895833333333334, "role_cosine_after_training": 0.9884672164916992, "training_wall_s": 0.14801248162984848 }, "fixed_role": { "cost": { "active_state_episode_steps": 25079, "cursor_scalar_observations": 12540, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 6270, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.06553865224123001, "daily_success": [ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.015625, 0.0, 0.0 ], "early_success": 0.0, "evaluation_active_state_episode_steps": 7168, "final_success": 0.0, "late_success": 0.005208333333333333, "learning_gain": 0.005208333333333333, "role_cosine_after_training": -0.006882439833134413, "training_wall_s": 0.22043022140860558 }, "intact": { "cost": { "active_state_episode_steps": 8289, "cursor_scalar_observations": 5048, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 2524, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.5611994862556458, "daily_success": [ 0.0, 0.0, 0.03125, 0.4375, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0 ], "early_success": 0.010416666666666666, "evaluation_active_state_episode_steps": 256, "final_success": 1.0, "late_success": 1.0, "learning_gain": 0.9895833333333334, "role_cosine_after_training": 0.9723539352416992, "training_wall_s": 0.23410236462950706 }, "oracle_role": { "cost": { "active_state_episode_steps": 8230, "cursor_scalar_observations": 5016, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 2508, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.5559794306755066, "daily_success": [ 0.0, 0.0, 0.03125, 0.484375, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0 ], "early_success": 0.010416666666666666, "evaluation_active_state_episode_steps": 256, "final_success": 1.0, "late_success": 1.0, "learning_gain": 0.9895833333333334, "role_cosine_after_training": 1.0000001192092896, "training_wall_s": 0.16238350421190262 }, "outcome_training_lesion": { "cost": { "active_state_episode_steps": 15474, "cursor_scalar_observations": 8170, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 4085, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.299395352602005, "daily_success": [ 0.0, 0.0, 0.03125, 0.15625, 0.171875, 0.328125, 0.65625, 0.859375, 0.921875, 0.890625, 0.9375, 1.0, 1.0, 1.0 ], "early_success": 0.010416666666666666, "evaluation_active_state_episode_steps": 784, "final_success": 0.99609375, "late_success": 1.0, "learning_gain": 0.9895833333333334, "role_cosine_after_training": 0.9431062936782837, "training_wall_s": 0.21385130658745766 }, "plasticity_lesion": { "cost": { "active_state_episode_steps": 25079, "cursor_scalar_observations": 12540, "maximum_state_episode_steps": 25088, "reverse_mode_calls": 0, "role_probe_examples": 6270, "task_loss_queries": 0, "terminal_outcome_observations": 896 }, "critic_l2_after_training": 0.06586109101772308, "daily_success": [ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.015625, 0.0, 0.0 ], "early_success": 0.0, "evaluation_active_state_episode_steps": 7157, "final_success": 0.0078125, "late_success": 0.005208333333333333, "learning_gain": 0.005208333333333333, "role_cosine_after_training": 0.9962142109870911, "training_wall_s": 0.1938561424612999 } }, "config": { "context_ar": 0.8, "context_dim": 16, "coupling_scale": 1.0, "critic_eta": 0.03, "days": 14, "eligibility_decay": 0.8, "episodes_per_day": 64, "feedback": "performance_velocity", "forward_eta": 0.1, "gamma": 0.8, "inertia": 0.65, "kappa": 0.0, "n_background": 30, "n_minus": 5, "n_plus": 5, "perturb_every": 4, "perturb_sigma": 0.03, "predictor_eta": 0.2, "process_noise": 0.12, "steps_per_episode": 28, "target": 0.8, "terminal_reward": 1.0, "vectorizer_eta": 0.03, "velocity_reward_scale": 1.0 }, "finite": true, "hardware": { "device": "cpu", "platform": "Linux-5.15.0-161-generic-x86_64-with-glibc2.35", "threads": 1, "torch_version": "2.10.0+cu128" }, "peak_rss_mib": 936.9296875, "protocol": { "calibration_uses_outcome_labels": false, "confirmation_grid_size": 30, "fixed_config": { "critic_eta": 0.03, "forward_eta": 0.1, "gamma": 0.8, "velocity_reward_scale": 1.0 }, "model_seed": 3, "name": "oral_b_v2_calibrated_recovery_confirmation_v1", "no_further_selection": true, "protocol_sha256": "a175dc80fdb7218c010953d5d7e3c77fee0690d5f10fabaf9d700bb8505acde8", "r1_gate_sha256": "907648edaea040b0d7e6fbf74f96b9c5ff8fc19c0dc1063b054829d5f2aa9fbc", "split": "untouched_confirmation", "training_task_seed": 32 }, "provenance": { "git_commit": "70e180c5ef5f78679f2e163ed3ee30873ee523bf", "git_tracked_dirty": false, "input_sha256": { "base_dynamics": "d5a373314562af0daedf55baa04b975fe643236c7821be1560d2cfb4359688fc", "common_runner": "4157a57806dedfc2eb70ec84f7a7ca1f73ab684e5d8f0b227cd80465e8e97aa5", "confirmation_analyzer": "2536fa01f62c3b2d87e782b08075cb5948aa26bfdce71a1d8c2446d5b68bb34c", "confirmation_runner": "5e9beba106b4b29c4ee1568052d6e8c15690dbde92917a2497a52e43e7f557d1", "d4_gate": "636c587e47287338cdca7d9558dc3bfb99a2cec615badb23337025d85b8128ef", "development_analyzer": "dde4a2e4d62f5f9da94357b388139c50251b6863f9c991f1a006e71eeb7953e4", "development_runner": "446ad26fc015eb79d28e0bb442c8aef71bdd1d0320910494cac20f92e3c7dc18", "failed_target_gate": "1df37c0b639542bbee3017da54306b0d572cbf96230428f142fafed139ac92f1", "failed_v2_gate": "e53f46cf456d60ce4d33586ace4f4619fb1a31a58082b2b72943d4ed10cd25fd", "old_r2_gate": "4f6f969ceae88afa2523e3472a3373522991f5ecaab69440830c07479d2d3597", "protocol": "a175dc80fdb7218c010953d5d7e3c77fee0690d5f10fabaf9d700bb8505acde8", "r1_gate": "907648edaea040b0d7e6fbf74f96b9c5ff8fc19c0dc1063b054829d5f2aa9fbc", "recovery_confirmation_analyzer": "29a168143266bc7078e5229183bb7ea45283973592fecd1fcd715488f5d6242b", "recovery_development_analyzer": "2768b877132ece6d612d2a5f1e483c495b277e26fdf54fb8a716aa8de6fd67e2", "recovery_metrics": "371cb6a7e2192d25ddbfad69c0ce7a1150aa1c21ca98e141bedb2afc2acbdbaa", "recovery_runner": "cea0ef658c698c376b1fda0cf2f7f910ee44f7bcde153f2fbaf18e66a2d3661a", "runner": "5e9beba106b4b29c4ee1568052d6e8c15690dbde92917a2497a52e43e7f557d1", "v2_dynamics": "786c5aed3091644272ae0a740913ac3cc38cdb02a8cacb6dfc8496e36836cdae", "v2_metrics": "421da9287b92e62c742f9eeefbfdccba582c6a4ad5cf92ade4709689120fa1ee" }, "tracked_inputs": { "base_dynamics": true, "common_runner": true, "confirmation_analyzer": true, "confirmation_runner": true, "d4_gate": true, "development_analyzer": true, "development_runner": true, "failed_target_gate": true, "failed_v2_gate": true, "old_r2_gate": true, "protocol": true, "r1_gate": true, "recovery_confirmation_analyzer": true, "recovery_development_analyzer": true, "recovery_metrics": true, "recovery_runner": true, "runner": true, "v2_dynamics": true, "v2_metrics": true } }, "schema_version": 4, "signatures": { "acute_outcome_lesion_outcome_balanced_acc": 0.5844393011650504, "acute_outcome_lesion_role_aligned_separation": -0.0054868800776807225, "causal_role_sign_inversion_index": 0.04282685276465098, "challenge_episodes": 640, "challenge_failure_count": 319, "challenge_success_count": 321, "challenge_success_fraction": 0.5015625, "critic_contribution_value_prediction_corr": 0.9999999999994792, "decoder_distance_residual_corr": 0.14779486236004197, "mean_abs_raw_soma_corr": 0.9988550372755418, "mean_abs_residual_soma_corr": 0.06102132627162356, "mean_critic_expectedness_contribution": 0.4046042795350481, "nonterminal_training_events": 7393, "raw_minus_residual_abs_soma_corr": 0.9378337110039182, "role_aligned_error_cv_corr": 0.38251224209011886, "role_aligned_velocity_cv_corr": 0.9968255795268922, "surrounding_event_decoder_balanced_acc": 0.5441025609227946, "target_success_fraction": { "1.7369842052459716": 0.765625, "1.7613054513931274": 0.6328125, "1.7748485207557678": 0.5390625, "1.7908255577087402": 0.390625, "1.8147287607192992": 0.1796875 }, "terminal_outcome_separation_drop_under_acute_lesion": 0.40831209855047074, "terminal_previous_soma_outcome_balanced_acc": 0.7560718366390297, "terminal_residual_minus_previous_soma_acc": 0.24236076524184813, "terminal_residual_outcome_balanced_acc": 0.9984326018808778, "terminal_role_aligned_outcome_separation": 0.40282521847279, "terminal_training_events": 896, "velocity_minus_error_abs_cv_corr": 0.6143133374367733 }, "split": "untouched_confirmation", "wall_s": 2.176859501749277, "warmup": { "critic_training_lesion": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": 0.9955039620399475, "role_cursor_scalar_observations": 12800, "role_update_enabled": true }, "fixed_role": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": -0.006882439833134413, "role_cursor_scalar_observations": 12800, "role_update_enabled": false }, "intact": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": 0.9955039620399475, "role_cursor_scalar_observations": 12800, "role_update_enabled": true }, "oracle_role": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": 1.0000001192092896, "role_cursor_scalar_observations": 12800, "role_update_enabled": false }, "outcome_training_lesion": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": 0.9955039620399475, "role_cursor_scalar_observations": 12800, "role_update_enabled": true }, "plasticity_lesion": { "batches": 100, "examples": 6400, "instruction_present": false, "predictor_max_abs_error": 2.384185791015625e-07, "rng_seed": 603203, "role_cosine_after_warmup": 0.9955039620399475, "role_cursor_scalar_observations": 12800, "role_update_enabled": true } } }