summaryrefslogtreecommitdiff
path: root/results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json
diff options
context:
space:
mode:
authorYurenHao0426 <Blackhao0426@gmail.com>2026-08-29 12:26:11 -0500
committerYurenHao0426 <Blackhao0426@gmail.com>2026-08-29 12:26:17 -0500
commit903f77bbf11b20011abc70645b06ccc0f669bfdf (patch)
treeca4d27bfc51ee2e034f0b4eba5f914583490f6b5 /results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json
parent2b9caf80d9a1054ec585a03718fc37106f8c7aae (diff)
results: record raw KP traffic scaling collapse
Diffstat (limited to 'results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json')
-rw-r--r--results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json7904
1 files changed, 7904 insertions, 0 deletions
diff --git a/results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json b/results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json
new file mode 100644
index 0000000..c9e7960
--- /dev/null
+++ b/results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json
@@ -0,0 +1,7904 @@
+{
+ "architecture": {
+ "adaptive_apical_parameters": 1064960,
+ "adaptive_feedback_parameters": 848512,
+ "base_width": 16,
+ "blocks_per_stage": 9,
+ "bn_eps": 1e-05,
+ "bn_momentum": 0.1,
+ "depth": 56,
+ "family": "CIFAR 6n+2 ResNet, option-A shortcuts",
+ "fixed_feedback_parameters": 0,
+ "fixed_traffic_coefficients": 532480,
+ "forward_parameters": 853018,
+ "hidden_shapes": [
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 16,
+ 32,
+ 32
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 32,
+ 16,
+ 16
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ],
+ [
+ 64,
+ 8,
+ 8
+ ]
+ ],
+ "normalization": "batchnorm",
+ "predictor_parameters": 1064960,
+ "residual_scale": 1.0,
+ "vectorizer_mode": null,
+ "vectorizer_parameters": 0
+ },
+ "args": {
+ "a_scale": 1.0,
+ "a_warmup_steps": 0,
+ "alignment_probe": 32,
+ "apical_calibration_mode": "unit_targets",
+ "apical_seed": null,
+ "augment_train": 1,
+ "batch_size": 128,
+ "bn_eps": 1e-05,
+ "bn_momentum": 0.1,
+ "data_dir": "/home/yurenh2/sdrn/data",
+ "depth": 56,
+ "device": "cuda",
+ "epochs": 200,
+ "eta_A": 0.01,
+ "eta_P": 0.1,
+ "eval_every": 1,
+ "eval_split": "validation",
+ "learn_P": 1,
+ "loader_seed": 0,
+ "lr": 0.1,
+ "lr_gamma": 0.1,
+ "lr_milestones": "100,150",
+ "lr_schedule": "step",
+ "max_steps": 0,
+ "mirror_batch_size": 1,
+ "mirror_eta": 0.1,
+ "mirror_every": 16,
+ "mirror_noise_std": 1.0,
+ "mirror_seed": 3000,
+ "mirror_warmup_steps": 0,
+ "mode": "kp_traffic",
+ "momentum": 0.9,
+ "neutral_projection": 1,
+ "normalization": "batchnorm",
+ "nuisance_scale": 0.0,
+ "out": "/scratch/yurenh2/sdil-raw-kp-a6000-r1/results/kp_raw_traffic_scaling/r1/raw-kp-traffic4-r1-d56.json",
+ "output_lr": 0.1,
+ "pert_directions": 1,
+ "pert_every": 4,
+ "pert_sigma": 0.01,
+ "perturb_seed": 1000,
+ "predictor_every": 0,
+ "predictor_mode": "closed_form",
+ "predictor_warmup_steps": 1,
+ "residual_scale": null,
+ "seed": 0,
+ "split_seed": 2027,
+ "traffic_calibration_examples": 64,
+ "traffic_ratio": 4.0,
+ "traffic_rule": "raw",
+ "traffic_seed": 5000,
+ "train_limit": 0,
+ "use_residual": 1,
+ "val_examples": 5000,
+ "vectorizer_mode": "spatial_template",
+ "warmup_epochs": 5,
+ "weight_decay": 0.0001,
+ "weight_scale": 1.0,
+ "width": 16
+ },
+ "calibration_metric_space": "reciprocal_local_activity_products_with_mixed_apical_traffic",
+ "counters": {
+ "apical_warmup_examples": 0,
+ "calibration_event_examples": 0,
+ "causal_scalar_observations": 0,
+ "logical_batch_loss_queries": 0,
+ "mirror_conv_examples": 0,
+ "mirror_events": 0,
+ "mirror_readout_examples": 0,
+ "neutral_projection_examples": 9000000,
+ "ordinary_examples": 9000000,
+ "per_example_loss_terms": 0,
+ "perturbation_events": 0,
+ "perturbation_forward_examples": 0,
+ "predictor_update_examples": 64,
+ "predictor_warmup_examples": 0,
+ "traffic_audit_examples": 0,
+ "traffic_calibration_examples": 64
+ },
+ "diagnostics": {
+ "early_third_mean": NaN,
+ "feedback_forward_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "feedback_forward_norm_ratio": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "feedback_forward_relative_error": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "innovation_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "instruction_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "matched_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "max_norm_match_direction_error": NaN,
+ "max_norm_match_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "max_absolute_correction_slope": 0.0,
+ "max_absolute_post_projection_soma_slope": 0.0,
+ "max_absolute_pre_projection_soma_slope": 0.0,
+ "max_positive_post_projection_soma_slope": 0.0,
+ "min_post_projection_soma_slope": 0.0,
+ "observations": 32,
+ "post_projection_traffic_rms_ratio": NaN,
+ "pre_projection_traffic_rms_ratio": NaN
+ },
+ "normalization_state": "training_batch_stats_without_running_update",
+ "predictor_traffic_residual_rms_ratio": NaN,
+ "raw_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "teaching_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "traffic_instruction_rms_ratio": NaN,
+ "used_negative_gradient_cosine": [
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN,
+ NaN
+ ],
+ "wall_s": 0.1803145408630371
+ },
+ "epochs": [
+ {
+ "epoch": 1,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.02,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.25,
+ "maximum_absolute_post_projection_soma_slope": 0.0013689994812011719,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": 3.019082849412433e-08,
+ "maximum_pre_projection_traffic_rms_ratio": 0.004192359898066911,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.02,
+ "step": 352,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 2,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.04,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.04,
+ "step": 704,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 3,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.06000000000000001,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.06000000000000001,
+ "step": 1056,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 4,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.08,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.08,
+ "step": 1408,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 5,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 1760,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 6,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 2112,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 7,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 2464,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 8,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 2816,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 9,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 3168,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 10,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 3520,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 11,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 3872,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 12,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 4224,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 13,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 4576,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 14,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 4928,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 15,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 5280,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 16,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 5632,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 17,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 5984,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 18,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 6336,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 19,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 6688,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 20,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 7040,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 21,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 7392,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 22,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 7744,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 23,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 8096,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 24,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 8448,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 25,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 8800,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 26,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 9152,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 27,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 9504,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 28,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 9856,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 29,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 10208,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 30,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 10560,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 31,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 10912,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 32,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 11264,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 33,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 11616,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 34,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 11968,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 35,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 12320,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 36,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 12672,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 37,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 13024,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 38,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 13376,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 39,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 13728,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 40,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 14080,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 41,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 14432,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 42,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 14784,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 43,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 15136,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 44,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 15488,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 45,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 15840,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 46,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 16192,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 47,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 16544,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 48,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 16896,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 49,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 17248,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 50,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 17600,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 51,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 17952,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 52,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 18304,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 53,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 18656,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 54,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 19008,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 55,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 19360,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 56,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 19712,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 57,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 20064,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 58,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 20416,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 59,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 20768,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 60,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 21120,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 61,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 21472,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 62,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 21824,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 63,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 22176,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 64,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 22528,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 65,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 22880,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 66,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 23232,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 67,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 23584,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 68,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 23936,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 69,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 24288,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 70,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 24640,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 71,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 24992,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 72,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 25344,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 73,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 25696,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 74,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 26048,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 75,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 26400,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 76,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 26752,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 77,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 27104,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 78,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 27456,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 79,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 27808,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 80,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 28160,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 81,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 28512,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 82,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 28864,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 83,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 29216,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 84,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 29568,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 85,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 29920,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 86,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 30272,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 87,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 30624,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 88,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 30976,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 89,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 31328,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 90,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 31680,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 91,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 32032,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 92,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 32384,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 93,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 32736,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 94,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 33088,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 95,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 33440,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 96,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 33792,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 97,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 34144,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 98,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 34496,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 99,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 34848,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 100,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.1,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.1,
+ "step": 35200,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 101,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 35552,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 102,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 35904,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 103,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 36256,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 104,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 36608,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 105,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 36960,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 106,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 37312,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 107,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 37664,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 108,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 38016,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 109,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 38368,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 110,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 38720,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 111,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 39072,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 112,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 39424,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 113,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 39776,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 114,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 40128,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 115,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 40480,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 116,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 40832,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 117,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 41184,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 118,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 41536,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 119,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 41888,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 120,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 42240,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 121,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 42592,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 122,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 42944,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 123,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 43296,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 124,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 43648,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 125,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 44000,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 126,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 44352,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 127,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 44704,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 128,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 45056,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 129,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 45408,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 130,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 45760,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 131,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 46112,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 132,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 46464,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 133,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 46816,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 134,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 47168,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 135,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 47520,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 136,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 47872,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 137,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 48224,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 138,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 48576,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 139,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 48928,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 140,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 49280,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 141,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 49632,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 142,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 49984,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 143,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 50336,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 144,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 50688,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 145,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 51040,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 146,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 51392,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 147,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 51744,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 148,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 52096,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 149,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 52448,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 150,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.010000000000000002,
+ "step": 52800,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 151,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 53152,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 152,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 53504,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 153,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 53856,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 154,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 54208,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 155,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 54560,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 156,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 54912,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 157,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 55264,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 158,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 55616,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 159,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 55968,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 160,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 56320,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 161,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 56672,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 162,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 57024,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 163,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 57376,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 164,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 57728,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 165,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 58080,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 166,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 58432,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 167,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 58784,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 168,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 59136,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 169,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 59488,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 170,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 59840,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 171,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 60192,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 172,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 60544,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 173,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 60896,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 174,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 61248,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 175,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 61600,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 176,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 61952,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 177,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 62304,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 178,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 62656,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 179,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 63008,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 180,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 63360,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 181,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 63712,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 182,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 64064,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 183,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 64416,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 184,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 64768,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 185,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 65120,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 186,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 65472,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 187,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 65824,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 188,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 66176,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 189,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 66528,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 190,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 66880,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 191,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 67232,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 192,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 67584,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 193,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 67936,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 194,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 68288,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 195,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 68640,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 196,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 68992,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 197,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 69344,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 198,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 69696,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 199,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 70048,
+ "train_examples": 45000,
+ "train_loss": NaN
+ },
+ {
+ "epoch": 200,
+ "eval_accuracy": 0.1,
+ "eval_loss": NaN,
+ "eval_split": "validation",
+ "feedback_tracking": {
+ "max_feedback_forward_relative_error": NaN,
+ "mean_feedback_forward_cosine": NaN,
+ "mean_feedback_forward_relative_error": NaN,
+ "min_feedback_forward_cosine": NaN
+ },
+ "lr": 0.0010000000000000002,
+ "mixed_apical": {
+ "innovation_rms": NaN,
+ "instruction_rms": NaN,
+ "raw_apical_rms": NaN,
+ "teaching_rms": NaN,
+ "traffic_rms": NaN
+ },
+ "neutral_projection": {
+ "instruction_observations": 0,
+ "maximum_absolute_correction_slope": 0.0,
+ "maximum_absolute_post_projection_soma_slope": 0.0,
+ "maximum_observations": 128,
+ "maximum_post_projection_traffic_rms_ratio": NaN,
+ "maximum_pre_projection_traffic_rms_ratio": NaN,
+ "minimum_observations": 72
+ },
+ "output_lr": 0.0010000000000000002,
+ "step": 70400,
+ "train_examples": 45000,
+ "train_loss": NaN
+ }
+ ],
+ "evaluation_protocol": {
+ "test_evaluations": 0,
+ "test_used_for_selection": false,
+ "validation_evaluations": 201
+ },
+ "final": {
+ "accuracy": 0.1,
+ "epoch": 200,
+ "evaluation_split": "validation",
+ "finite": false,
+ "loss": NaN,
+ "step": 70400
+ },
+ "hardware": {
+ "cuda_device_name": "NVIDIA RTX A6000",
+ "cuda_visible_devices": "3",
+ "device": "cuda",
+ "device_total_memory_bytes": 51041271808,
+ "peak_memory_allocated_bytes": 3262279680,
+ "peak_memory_reserved_bytes": 5226102784,
+ "torch_version": "2.10.0+cu128"
+ },
+ "predictor_warmup": {
+ "closed_form_fit": {
+ "max_absolute_residual_soma_slope": 1.2161675044808362e-07,
+ "max_applied_stability_margin": 0.0,
+ "max_positive_residual_soma_slope": 1.2161675044808362e-07,
+ "min_residual_soma_slope": -8.734632928053543e-08,
+ "mse": 1.564258040580932e-17,
+ "observations": 64,
+ "residual_traffic_rms_ratio": 7.20529428002985e-08,
+ "stability_margin": 0.0
+ },
+ "examples": 64,
+ "instruction_present": false,
+ "mode": "closed_form",
+ "post_warmup_traffic_residual_rms_ratio": 7.20529428002985e-08,
+ "reuses_traffic_calibration_forward": true,
+ "steps": 1,
+ "task_loader_state_restored": true
+ },
+ "protocol_family": "oral_a_cifar_local_resnet_development",
+ "provenance": {
+ "git_commit": "2b9caf80d9a1054ec585a03718fc37106f8c7aae",
+ "git_tracked_dirty": false
+ },
+ "schema_version": 1,
+ "split": {
+ "cifar_source_files": [
+ {
+ "bytes": 31035704,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/data_batch_1",
+ "sha256": "54636561a3ce25bd3e19253c6b0d8538147b0ae398331ac4a2d86c6d987368cd"
+ },
+ {
+ "bytes": 31035320,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/data_batch_2",
+ "sha256": "766b2cef9fbc745cf056b3152224f7cf77163b330ea9a15f9392beb8b89bc5a8"
+ },
+ {
+ "bytes": 31035999,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/data_batch_3",
+ "sha256": "0f00d98ebfb30b3ec0ad19f9756dc2630b89003e10525f5e148445e82aa6a1f9"
+ },
+ {
+ "bytes": 31035696,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/data_batch_4",
+ "sha256": "3f7bb240661948b8f4d53e36ec720d8306f5668bd0071dcb4e6c947f78e9682b"
+ },
+ {
+ "bytes": 31035623,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/data_batch_5",
+ "sha256": "d91802434d8376bbaeeadf58a737e3a1b12ac839077e931237e0dcd43adcb154"
+ },
+ {
+ "bytes": 31035526,
+ "path": "/home/yurenh2/sdrn/data/cifar-10-batches-py/test_batch",
+ "sha256": "f53d8d457504f7cff4ea9e021afcf0e0ad8e24a91f3fc42091b8adef61157831"
+ }
+ ],
+ "dataset": "cifar10",
+ "evaluation_split": "validation",
+ "input_layout": "NCHW",
+ "input_shape": [
+ 3,
+ 32,
+ 32
+ ],
+ "loader_seed": 0,
+ "normalization_mean": [
+ 0.49140000343322754,
+ 0.4821999967098236,
+ 0.4465000033378601
+ ],
+ "normalization_std": [
+ 0.24699999392032623,
+ 0.2434999942779541,
+ 0.26159998774528503
+ ],
+ "split_from_training_only": true,
+ "split_seed": 2027,
+ "test_examples": 10000,
+ "train_examples": 45000,
+ "training_augmentation": "random_crop_32_padding_4_zero_then_horizontal_flip_p0.5",
+ "validation_class_counts": {
+ "0": 500,
+ "1": 500,
+ "2": 500,
+ "3": 500,
+ "4": 500,
+ "5": 500,
+ "6": 500,
+ "7": 500,
+ "8": 500,
+ "9": 500
+ },
+ "validation_examples": 5000,
+ "validation_index_sha256": "8328b206a97c420e49e54e3eca4abe3274c4756b084355784ea3fb8059e4515b"
+ },
+ "timing": {
+ "apical_warmup_wall_s": 0.0,
+ "evaluation_wall_s": 56.69630265235901,
+ "mirror_warmup_wall_s": 0.0,
+ "predictor_warmup_wall_s": 0.040871381759643555,
+ "timing_excludes_data_loading_hashing_and_model_construction": true,
+ "total_timed_wall_s": 8074.125160694122,
+ "train_wall_s": 8014.034039974213
+ },
+ "traffic_calibration": {
+ "data_source": "first unaugmented development-training examples",
+ "examples": 64,
+ "instruction_rms": [
+ 0.046661268919706345,
+ 0.03623805567622185,
+ 0.02191813662648201,
+ 0.024097830057144165,
+ 0.014865260571241379,
+ 0.017354615032672882,
+ 0.010909398086369038,
+ 0.01297324150800705,
+ 0.008544357493519783,
+ 0.010941592045128345,
+ 0.006431655492633581,
+ 0.007946132682263851,
+ 0.005391000770032406,
+ 0.007816258817911148,
+ 0.004525622818619013,
+ 0.0066126082092523575,
+ 0.003956055734306574,
+ 0.005918067414313555,
+ 0.003425528295338154,
+ 0.008428334258496761,
+ 0.005141484085470438,
+ 0.006968188565224409,
+ 0.004458846990019083,
+ 0.0059847780503332615,
+ 0.003961662296205759,
+ 0.005532864481210709,
+ 0.003566647879779339,
+ 0.004960492253303528,
+ 0.003204447217285633,
+ 0.004739514552056789,
+ 0.002828181255608797,
+ 0.004206330515444279,
+ 0.0025602977257221937,
+ 0.0038625835441052914,
+ 0.002320697996765375,
+ 0.003506189212203026,
+ 0.00211885292083025,
+ 0.00520055228844285,
+ 0.0034681258257478476,
+ 0.0048829335719347,
+ 0.0031613244209438562,
+ 0.004391728900372982,
+ 0.002885380294173956,
+ 0.003957326058298349,
+ 0.0026813724543899298,
+ 0.0036668810062110424,
+ 0.002520280424505472,
+ 0.003550357650965452,
+ 0.002374650677666068,
+ 0.0033130731899291277,
+ 0.00227394443936646,
+ 0.0031898694578558207,
+ 0.0022091541904956102,
+ 0.0028631724417209625,
+ 0.0022419714368879795
+ ],
+ "realized_traffic_instruction_rms_ratio": [
+ 4.0,
+ 4.0,
+ 3.999999761581421,
+ 4.000000476837158,
+ 4.000000476837158,
+ 4.0,
+ 3.999999761581421,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 4.000000476837158,
+ 4.000000476837158,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 4.000000476837158,
+ 4.0,
+ 3.999999761581421,
+ 4.0,
+ 3.999999761581421,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 3.999999523162842,
+ 4.000000476837158,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.000000476837158,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 4.0,
+ 3.999999761581421,
+ 4.000000476837158,
+ 4.0,
+ 4.0
+ ],
+ "target_ratio": 4.0,
+ "traffic_gain": [
+ 0.24343252182006836,
+ 0.195766419172287,
+ 0.07593677192926407,
+ 0.12502780556678772,
+ 0.039660874754190445,
+ 0.09477632492780685,
+ 0.025135835632681847,
+ 0.06823719292879105,
+ 0.01779446378350258,
+ 0.05998488515615463,
+ 0.012211058288812637,
+ 0.04119816794991493,
+ 0.009281118400394917,
+ 0.0425565205514431,
+ 0.00712451571598649,
+ 0.034161023795604706,
+ 0.005648850928992033,
+ 0.032030124217271805,
+ 0.004723988473415375,
+ 0.046521805226802826,
+ 0.009257137775421143,
+ 0.03639799728989601,
+ 0.007381213828921318,
+ 0.03129151463508606,
+ 0.006085643544793129,
+ 0.02907627448439598,
+ 0.0051673538982868195,
+ 0.026046551764011383,
+ 0.004462772980332375,
+ 0.025232573971152306,
+ 0.003709618002176285,
+ 0.02237042225897312,
+ 0.0031845064368098974,
+ 0.020631348714232445,
+ 0.0027702576480805874,
+ 0.01875687763094902,
+ 0.0024420637637376785,
+ 0.027893690392374992,
+ 0.005270204972475767,
+ 0.026072943583130836,
+ 0.004499452188611031,
+ 0.02368655987083912,
+ 0.003874595044180751,
+ 0.020804405212402344,
+ 0.003462383756414056,
+ 0.019228827208280563,
+ 0.0030815184582024813,
+ 0.018857430666685104,
+ 0.002791563980281353,
+ 0.017469387501478195,
+ 0.0025648120790719986,
+ 0.016879137605428696,
+ 0.002401104662567377,
+ 0.01507137157022953,
+ 0.0023584773298352957
+ ],
+ "unscaled_traffic_rms": [
+ 0.7667220234870911,
+ 0.7404345870018005,
+ 1.1545466184616089,
+ 0.7709590792655945,
+ 1.499236822128296,
+ 0.7324451804161072,
+ 1.7360708713531494,
+ 0.760479211807251,
+ 1.920677661895752,
+ 0.7296232581138611,
+ 2.106829881668091,
+ 0.7715035080909729,
+ 2.323427200317383,
+ 0.734670877456665,
+ 2.5408732891082764,
+ 0.7742869257926941,
+ 2.8013172149658203,
+ 0.7390626668930054,
+ 2.9005391597747803,
+ 0.7246781587600708,
+ 2.221630096435547,
+ 0.7657771706581116,
+ 2.4163217544555664,
+ 0.7650352716445923,
+ 2.6039397716522217,
+ 0.7611517906188965,
+ 2.760908603668213,
+ 0.7617887258529663,
+ 2.8721578121185303,
+ 0.751332700252533,
+ 3.0495660305023193,
+ 0.7521235942840576,
+ 3.215942859649658,
+ 0.7488765716552734,
+ 3.350876808166504,
+ 0.7477127313613892,
+ 3.4705939292907715,
+ 0.7457675337791443,
+ 2.632251262664795,
+ 0.7491188645362854,
+ 2.810408353805542,
+ 0.7416406273841858,
+ 2.9787683486938477,
+ 0.7608630657196045,
+ 3.0977184772491455,
+ 0.7627882957458496,
+ 3.2714786529541016,
+ 0.7530946731567383,
+ 3.4026098251342773,
+ 0.7586008906364441,
+ 3.5463719367980957,
+ 0.7559318542480469,
+ 3.680229902267456,
+ 0.759896993637085,
+ 3.8024048805236816
+ ],
+ "uses_validation_endpoint": false
+ },
+ "work": {
+ "apical_macs_per_example": 125043328,
+ "causal_scalar_observations": 0,
+ "components": {
+ "apical_projection_macs": 1125397954772992,
+ "apical_regression_macs": 0,
+ "bp_reverse_macs_estimate": 0,
+ "kp_reciprocal_correlation_macs": 1125389952000000,
+ "local_weight_correlation_macs": 1129371264000000,
+ "mirror_feedback_prediction_macs": 0,
+ "mirror_local_correlation_macs": 0,
+ "mirror_response_macs": 0,
+ "ordinary_forward_macs": 1129371264000000,
+ "perturbation_forward_macs": 0,
+ "warmup_clean_forward_macs": 8031084544
+ },
+ "definition": "multiply-accumulates in conv/linear maps; one local weight correlation equals one forward-weight MAC count; BP reverse is estimated as one weight-gradient plus one activation-gradient convolution per forward convolution; mixed-traffic/predictor elementwise arithmetic is reported as a conservative operation estimate separately and is not folded into MACs",
+ "elementwise_operations_estimate": 115016770519040,
+ "forward_macs_per_example": 125485696,
+ "logical_batch_loss_queries": 0,
+ "mirror_probe_examples": 0,
+ "mirror_readout_probe_examples": 0,
+ "neutral_projection_observations": 9000000,
+ "per_example_cross_entropy_terms": 0,
+ "total_clean_forward_examples": 9000064,
+ "total_forward_equivalent_examples": 9000064,
+ "total_macs_estimate": 4509538465857536
+ }
+}