{ "architecture": { "adaptive_apical_parameters": 376832, "adaptive_feedback_parameters": 267904, "base_width": 16, "blocks_per_stage": 3, "bn_eps": 1e-05, "bn_momentum": 0.1, "depth": 20, "family": "CIFAR 6n+2 ResNet, option-A shortcuts", "fixed_feedback_parameters": 0, "fixed_traffic_coefficients": 188416, "forward_parameters": 269722, "hidden_shapes": [ [ 16, 32, 32 ], [ 16, 32, 32 ], [ 16, 32, 32 ], [ 16, 32, 32 ], [ 16, 32, 32 ], [ 16, 32, 32 ], [ 16, 32, 32 ], [ 32, 16, 16 ], [ 32, 16, 16 ], [ 32, 16, 16 ], [ 32, 16, 16 ], [ 32, 16, 16 ], [ 32, 16, 16 ], [ 64, 8, 8 ], [ 64, 8, 8 ], [ 64, 8, 8 ], [ 64, 8, 8 ], [ 64, 8, 8 ], [ 64, 8, 8 ] ], "normalization": "batchnorm", "predictor_parameters": 376832, "residual_scale": 1.0, "vectorizer_mode": null, "vectorizer_parameters": 0 }, "args": { "a_scale": 1.0, "a_warmup_steps": 0, "alignment_probe": 32, "apical_calibration_mode": "unit_targets", "apical_seed": null, "augment_train": 1, "batch_size": 128, "bn_eps": 1e-05, "bn_momentum": 0.1, "data_dir": "/orion/u/oscarwan/scratch/sdil-data", "depth": 20, "device": "cuda", "epochs": 200, "eta_A": 0.01, "eta_P": 0.1, "eval_every": 1, "eval_split": "validation", "learn_P": 1, "loader_seed": 0, "lr": 0.1, "lr_gamma": 0.1, "lr_milestones": "100,150", "lr_schedule": "step", "max_steps": 0, "mirror_batch_size": 1, "mirror_eta": 0.1, "mirror_every": 16, "mirror_noise_std": 1.0, "mirror_seed": 3000, "mirror_warmup_steps": 0, "mode": "kp_traffic", "momentum": 0.9, "neutral_projection": 1, "normalization": "batchnorm", "nuisance_scale": 0.0, "out": "/orion/u/oscarwan/scratch/sdil-work/sdil-a6000-full-rerun/results/resnet_crossover/r2/resnet-r2-sdil-d20-lr0p1.json", "output_lr": 0.1, "pert_directions": 1, "pert_every": 4, "pert_sigma": 0.01, "perturb_seed": 1000, "predictor_every": 0, "predictor_mode": "closed_form", "predictor_warmup_steps": 1, "residual_scale": null, "seed": 0, "split_seed": 2027, "traffic_calibration_examples": 64, "traffic_ratio": 4.0, "traffic_rule": "innovation", "traffic_seed": 5000, "train_limit": 0, "use_residual": 1, "val_examples": 5000, "vectorizer_mode": "spatial_template", "warmup_epochs": 5, "weight_decay": 0.0001, "weight_scale": 1.0, "width": 16 }, "calibration_metric_space": "reciprocal_local_activity_products_with_mixed_apical_traffic", "counters": { "apical_warmup_examples": 0, "calibration_event_examples": 0, "causal_scalar_observations": 0, "logical_batch_loss_queries": 0, "mirror_conv_examples": 0, "mirror_events": 0, "mirror_readout_examples": 0, "neutral_projection_examples": 9000000, "ordinary_examples": 9000000, "per_example_loss_terms": 0, "perturbation_events": 0, "perturbation_forward_examples": 0, "predictor_update_examples": 64, "predictor_warmup_examples": 0, "traffic_audit_examples": 0, "traffic_calibration_examples": 64 }, "diagnostics": { "early_third_mean": 0.9992486238479614, "feedback_forward_cosine": [ 0.9996339678764343, 0.9996197819709778, 0.999623715877533, 0.9995846748352051, 0.9997047185897827, 0.9996135830879211, 0.9995279908180237, 0.9996839761734009, 0.9996345043182373, 0.999563455581665, 0.9996508359909058, 0.9994888305664062, 0.999567985534668, 0.9997429251670837, 0.9997261762619019, 0.9996747970581055, 0.9997008442878723, 0.9992879629135132, 0.9999708533287048 ], "feedback_forward_norm_ratio": [ 1.0003844499588013, 1.0015509128570557, 0.9996321797370911, 1.001647710800171, 0.9995453357696533, 1.0023027658462524, 0.9988731145858765, 1.0006657838821411, 0.999077558517456, 1.0016008615493774, 0.9999746084213257, 1.0018646717071533, 0.9991083145141602, 1.000430703163147, 1.0001863241195679, 1.0009725093841553, 1.0004057884216309, 1.0017213821411133, 1.0044785737991333 ], "feedback_forward_relative_error": [ 0.027061661705374718, 0.027639765292406082, 0.02743203565478325, 0.028893308714032173, 0.024302596226334572, 0.027923736721277237, 0.03072751872241497, 0.025158708915114403, 0.027041001245379448, 0.029615972191095352, 0.026425801217556, 0.03206216171383858, 0.029396697878837585, 0.02268228493630886, 0.023404264822602272, 0.025532469153404236, 0.02446761168539524, 0.037806157022714615, 0.00886303000152111 ], "innovation_negative_gradient_cosine": [ 0.9992955923080444, 0.9991967678070068, 0.9992392063140869, 0.9991347193717957, 0.9992673397064209, 0.9993581175804138, 0.9993082284927368, 0.9993443489074707, 0.9994051456451416, 0.9993393421173096, 0.9994563460350037, 0.9994194507598877, 0.9994933009147644, 0.9996087551116943, 0.9996581077575684, 0.9997082948684692, 0.9998230934143066, 0.999924898147583, 0.9078794717788696 ], "instruction_negative_gradient_cosine": [ 0.9992955923080444, 0.9991967678070068, 0.9992392063140869, 0.9991347789764404, 0.9992673397064209, 0.9993581175804138, 0.9993082284927368, 0.9993443489074707, 0.9994051456451416, 0.9993393421173096, 0.9994563460350037, 0.9994194507598877, 0.9994933009147644, 0.9996087551116943, 0.9996581077575684, 0.9997082948684692, 0.9998230934143066, 0.999924898147583, 0.9349699020385742 ], "matched_negative_gradient_cosine": [ 0.03966842591762543, 0.012892607599496841, 0.03667213395237923, 0.04239062964916229, 0.04645364731550217, 0.06657349318265915, 0.07031472027301788, 0.0461806021630764, 0.0483735054731369, 0.11813706159591675, 0.0720367431640625, 0.23040176928043365, 0.0929129347205162, 0.08425292372703552, 0.08489963412284851, 0.2519374489784241, 0.1920303851366043, 0.2691277265548706, 0.13027682900428772 ], "max_norm_match_direction_error": 1.7881393432617188e-07, "max_norm_match_relative_error": 1.754590499558617e-07, "mean_feedback_forward_cosine": 0.9996316621178075, "mean_feedback_forward_relative_error": 0.026654567569494247, "neutral_projection": { "instruction_observations": 0, "max_absolute_correction_slope": 0.03110409900546074, "max_absolute_post_projection_soma_slope": 5.2924469251536266e-09, "max_absolute_pre_projection_soma_slope": 0.03110409900546074, "max_positive_post_projection_soma_slope": 4.771845585338497e-09, "min_post_projection_soma_slope": -5.2924469251536266e-09, "observations": 32, "post_projection_traffic_rms_ratio": 2.4805662368076366e-08, "pre_projection_traffic_rms_ratio": 0.007601542191251489 }, "normalization_state": "training_batch_stats_without_running_update", "predictor_traffic_residual_rms_ratio": 0.007601542191206739, "raw_negative_gradient_cosine": [ 0.03966842591762543, 0.012892606668174267, 0.03667213395237923, 0.04239062964916229, 0.04645364731550217, 0.06657349318265915, 0.07031472027301788, 0.0461806021630764, 0.048373498022556305, 0.11813706904649734, 0.0720367506146431, 0.23040176928043365, 0.0929129347205162, 0.08425292372703552, 0.0848996490240097, 0.25193747878074646, 0.1920303851366043, 0.2691276967525482, 0.13027682900428772 ], "teaching_negative_gradient_cosine": [ 0.9992955923080444, 0.9991967678070068, 0.9992392063140869, 0.9991347193717957, 0.9992673397064209, 0.9993581175804138, 0.9993082284927368, 0.9993443489074707, 0.9994051456451416, 0.9993393421173096, 0.9994563460350037, 0.9994194507598877, 0.9994933009147644, 0.9996087551116943, 0.9996581077575684, 0.9997082948684692, 0.9998230934143066, 0.999924898147583, 0.9078794717788696 ], "traffic_instruction_rms_ratio": 9.3995664093872, "used_negative_gradient_cosine": [ 0.9992955923080444, 0.9991967678070068, 0.9992392063140869, 0.9991347193717957, 0.9992673397064209, 0.9993581175804138, 0.9993082284927368, 0.9993443489074707, 0.9994051456451416, 0.9993393421173096, 0.9994563460350037, 0.9994194507598877, 0.9994933009147644, 0.9996087551116943, 0.9996581077575684, 0.9997082948684692, 0.9998230934143066, 0.999924898147583, 0.9078794717788696 ], "wall_s": 0.10504412651062012 }, "epochs": [ { "epoch": 1, "eval_accuracy": 0.3116, "eval_loss": 2.02555947265625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.3959459066390991, "mean_feedback_forward_cosine": 0.12446963296909082, "mean_feedback_forward_relative_error": 1.3425679206848145, "min_feedback_forward_cosine": 0.03807289898395538 }, "lr": 0.02, "mixed_apical": { "innovation_rms": 0.004026297986185734, "instruction_rms": 0.004026297985703689, "raw_apical_rms": 0.018433059693736067, "teaching_rms": 0.004026297986185734, "traffic_rms": 0.01797717185451189 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104110181331635, "maximum_absolute_post_projection_soma_slope": 1.8376869803660156e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 3.029582466001542e-08, "maximum_pre_projection_traffic_rms_ratio": 0.006025940798164677, "minimum_observations": 72 }, "output_lr": 0.02, "step": 352, "train_examples": 45000, "train_loss": 1.9139111452526516 }, { "epoch": 2, "eval_accuracy": 0.4306, "eval_loss": 1.8821124755859375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.3497217893600464, "mean_feedback_forward_cosine": 0.28874401983461884, "mean_feedback_forward_relative_error": 1.2083154571683783, "min_feedback_forward_cosine": 0.11273814737796783 }, "lr": 0.04, "mixed_apical": { "innovation_rms": 0.005270128443391427, "instruction_rms": 0.005270128443363647, "raw_apical_rms": 0.020287175500285828, "teaching_rms": 0.005270128443391427, "traffic_rms": 0.019583521396373933 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.4794059310929697e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.947214936240712e-08, "maximum_pre_projection_traffic_rms_ratio": 0.006557262506205862, "minimum_observations": 72 }, "output_lr": 0.04, "step": 704, "train_examples": 45000, "train_loss": 1.5111413827260336 }, { "epoch": 3, "eval_accuracy": 0.5196, "eval_loss": 1.8604373779296874, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.298816442489624, "mean_feedback_forward_cosine": 0.4102881244922939, "mean_feedback_forward_relative_error": 1.0967007655846446, "min_feedback_forward_cosine": 0.18582221865653992 }, "lr": 0.06000000000000001, "mixed_apical": { "innovation_rms": 0.005695637091846514, "instruction_rms": 0.005695637093150145, "raw_apical_rms": 0.02234436190563027, "teaching_rms": 0.005695637091846514, "traffic_rms": 0.021599725418751093 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3064925141748063e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.8363789922639952e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008079684570298312, "minimum_observations": 72 }, "output_lr": 0.06000000000000001, "step": 1056, "train_examples": 45000, "train_loss": 1.1980859601550633 }, { "epoch": 4, "eval_accuracy": 0.6292, "eval_loss": 1.0531740112304688, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.2463593482971191, "mean_feedback_forward_cosine": 0.5076760571253928, "mean_feedback_forward_relative_error": 0.9999459856434872, "min_feedback_forward_cosine": 0.2567841410636902 }, "lr": 0.08, "mixed_apical": { "innovation_rms": 0.005602893273743301, "instruction_rms": 0.005602893273696883, "raw_apical_rms": 0.023992327474635113, "teaching_rms": 0.005602893273743301, "traffic_rms": 0.02332356349597622 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.384531866932548e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7928872981115507e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008067533370801183, "minimum_observations": 72 }, "output_lr": 0.08, "step": 1408, "train_examples": 45000, "train_loss": 1.002971761671702 }, { "epoch": 5, "eval_accuracy": 0.6908, "eval_loss": 0.9096707763671875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.186301827430725, "mean_feedback_forward_cosine": 0.5885937731516989, "mean_feedback_forward_relative_error": 0.9130983446773729, "min_feedback_forward_cosine": 0.3299712836742401 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0052571458855342305, "instruction_rms": 0.005257145887047622, "raw_apical_rms": 0.025175455443176575, "teaching_rms": 0.0052571458855342305, "traffic_rms": 0.02461522301585032 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104108318686485, "maximum_absolute_post_projection_soma_slope": 1.4709918616517825e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.762725017129495e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007898785010883138, "minimum_observations": 72 }, "output_lr": 0.1, "step": 1760, "train_examples": 45000, "train_loss": 0.8739679383595784 }, { "epoch": 6, "eval_accuracy": 0.6788, "eval_loss": 0.9818740600585938, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.137481927871704, "mean_feedback_forward_cosine": 0.6417811418834486, "mean_feedback_forward_relative_error": 0.8515592123332777, "min_feedback_forward_cosine": 0.3858734965324402 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00511800449876425, "instruction_rms": 0.005118004498437255, "raw_apical_rms": 0.026285692882644283, "teaching_rms": 0.00511800449876425, "traffic_rms": 0.025778497751821908 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.2827462647635457e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7474045133965685e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008272124776851554, "minimum_observations": 72 }, "output_lr": 0.1, "step": 2112, "train_examples": 45000, "train_loss": 0.7683374342070686 }, { "epoch": 7, "eval_accuracy": 0.697, "eval_loss": 0.8805564208984376, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.0916686058044434, "mean_feedback_forward_cosine": 0.6830935258614389, "mean_feedback_forward_relative_error": 0.8006800193535654, "min_feedback_forward_cosine": 0.4360256791114807 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005090637227480062, "instruction_rms": 0.005090637226330095, "raw_apical_rms": 0.02710135754344636, "teaching_rms": 0.005090637227480062, "traffic_rms": 0.026614705942795136 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.2188740683427568e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7337732104623406e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008402664048491541, "minimum_observations": 72 }, "output_lr": 0.1, "step": 2464, "train_examples": 45000, "train_loss": 0.700017037179735 }, { "epoch": 8, "eval_accuracy": 0.7582, "eval_loss": 0.7145669799804687, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.0521509647369385, "mean_feedback_forward_cosine": 0.7155027107188576, "mean_feedback_forward_relative_error": 0.7585068752891139, "min_feedback_forward_cosine": 0.4769858717918396 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005100889991883216, "instruction_rms": 0.005100889989612128, "raw_apical_rms": 0.02799491408125279, "teaching_rms": 0.005100889991883216, "traffic_rms": 0.02752234136034223 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2122367998301797e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7188394376933303e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008349236372860024, "minimum_observations": 72 }, "output_lr": 0.1, "step": 2816, "train_examples": 45000, "train_loss": 0.6431639823065863 }, { "epoch": 9, "eval_accuracy": 0.714, "eval_loss": 0.831437353515625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 1.01520574092865, "mean_feedback_forward_cosine": 0.7427803372081957, "mean_feedback_forward_relative_error": 0.7210724385161149, "min_feedback_forward_cosine": 0.5141153335571289 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005100730785606785, "instruction_rms": 0.00510073078782863, "raw_apical_rms": 0.028489280379951753, "teaching_rms": 0.005100730785606785, "traffic_rms": 0.028024566431863063 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1568369373549103e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7155556621068902e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008549445861177576, "minimum_observations": 72 }, "output_lr": 0.1, "step": 3168, "train_examples": 45000, "train_loss": 0.5943075577841864 }, { "epoch": 10, "eval_accuracy": 0.7462, "eval_loss": 0.8459345947265625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.9798910617828369, "mean_feedback_forward_cosine": 0.7666835596686915, "mean_feedback_forward_relative_error": 0.6867316757377825, "min_feedback_forward_cosine": 0.5473746061325073 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005082316784895747, "instruction_rms": 0.005082316785262091, "raw_apical_rms": 0.028900599778495628, "teaching_rms": 0.005082316784895747, "traffic_rms": 0.028445411560596746 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104106456041336, "maximum_absolute_post_projection_soma_slope": 1.2107207680855936e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7078874661949912e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008347870767561681, "minimum_observations": 72 }, "output_lr": 0.1, "step": 3520, "train_examples": 45000, "train_loss": 0.5634444468127356 }, { "epoch": 11, "eval_accuracy": 0.7894, "eval_loss": 0.6491141357421875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.9458162784576416, "mean_feedback_forward_cosine": 0.787112085442794, "mean_feedback_forward_relative_error": 0.6555717791381636, "min_feedback_forward_cosine": 0.5784483551979065 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005123974302786634, "instruction_rms": 0.005123974300594778, "raw_apical_rms": 0.029270407704884427, "teaching_rms": 0.005123974302786634, "traffic_rms": 0.028813281735924453 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1776799091478551e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.7015997192714634e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007876796654479682, "minimum_observations": 72 }, "output_lr": 0.1, "step": 3872, "train_examples": 45000, "train_loss": 0.5321417511728075 }, { "epoch": 12, "eval_accuracy": 0.7916, "eval_loss": 0.6628656616210937, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.9140507578849792, "mean_feedback_forward_cosine": 0.8051042274424904, "mean_feedback_forward_relative_error": 0.6269298242895227, "min_feedback_forward_cosine": 0.6064649820327759 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005089625208600715, "instruction_rms": 0.005089625207450145, "raw_apical_rms": 0.02950235115080955, "teaching_rms": 0.005089625208600715, "traffic_rms": 0.02905536991273402 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1587401260726438e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.697508297887163e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008881822530006531, "minimum_observations": 72 }, "output_lr": 0.1, "step": 4224, "train_examples": 45000, "train_loss": 0.5126900021764967 }, { "epoch": 13, "eval_accuracy": 0.7438, "eval_loss": 0.8314508178710938, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.8837882280349731, "mean_feedback_forward_cosine": 0.8213234888879877, "mean_feedback_forward_relative_error": 0.5999040070332979, "min_feedback_forward_cosine": 0.6320071220397949 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005123668963105766, "instruction_rms": 0.005123668963803649, "raw_apical_rms": 0.030016462374151044, "teaching_rms": 0.005123668963105766, "traffic_rms": 0.029570846120130275 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.243258118677204e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.69923774723968e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008417570457143489, "minimum_observations": 72 }, "output_lr": 0.1, "step": 4576, "train_examples": 45000, "train_loss": 0.4830100783560011 }, { "epoch": 14, "eval_accuracy": 0.8082, "eval_loss": 0.6025417114257813, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.854644775390625, "mean_feedback_forward_cosine": 0.8355686758693895, "mean_feedback_forward_relative_error": 0.5752676631274977, "min_feedback_forward_cosine": 0.6560328006744385 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005139756653881987, "instruction_rms": 0.005139756654406729, "raw_apical_rms": 0.03028349071583645, "teaching_rms": 0.005139756653881987, "traffic_rms": 0.029838919366939717 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3025974077152114e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.696470114009614e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008806346988294534, "minimum_observations": 72 }, "output_lr": 0.1, "step": 4928, "train_examples": 45000, "train_loss": 0.463170660188463 }, { "epoch": 15, "eval_accuracy": 0.805, "eval_loss": 0.6055401611328125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.8269039988517761, "mean_feedback_forward_cosine": 0.8486043779473555, "mean_feedback_forward_relative_error": 0.5517268729837317, "min_feedback_forward_cosine": 0.6777786016464233 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005103417485489563, "instruction_rms": 0.0051034174849611015, "raw_apical_rms": 0.03061214404180109, "teaching_rms": 0.005103417485489563, "traffic_rms": 0.030178261546094633 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4411319249063581e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6896146117949813e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008763286921123518, "minimum_observations": 72 }, "output_lr": 0.1, "step": 5280, "train_examples": 45000, "train_loss": 0.4528525505039427 }, { "epoch": 16, "eval_accuracy": 0.7672, "eval_loss": 0.7340782592773437, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.7998066544532776, "mean_feedback_forward_cosine": 0.8603590287660298, "mean_feedback_forward_relative_error": 0.5296951375509563, "min_feedback_forward_cosine": 0.6985958814620972 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005163668726531768, "instruction_rms": 0.005163668725697001, "raw_apical_rms": 0.030868834889039496, "teaching_rms": 0.005163668726531768, "traffic_rms": 0.030428273299187767 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2748145650220977e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6880693308318265e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009315669449123565, "minimum_observations": 72 }, "output_lr": 0.1, "step": 5632, "train_examples": 45000, "train_loss": 0.43222274622917173 }, { "epoch": 17, "eval_accuracy": 0.805, "eval_loss": 0.6171972778320313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.7732645273208618, "mean_feedback_forward_cosine": 0.8710650958512959, "mean_feedback_forward_relative_error": 0.5087922160562716, "min_feedback_forward_cosine": 0.7182590961456299 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005167402571857455, "instruction_rms": 0.005167402572632576, "raw_apical_rms": 0.03102051479275261, "teaching_rms": 0.005167402571857455, "traffic_rms": 0.03058101220474407 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1738018557139185e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.682641138467952e-08, "maximum_pre_projection_traffic_rms_ratio": 0.0090117500951202, "minimum_observations": 72 }, "output_lr": 0.1, "step": 5984, "train_examples": 45000, "train_loss": 0.4198982719315423 }, { "epoch": 18, "eval_accuracy": 0.8326, "eval_loss": 0.5000441101074219, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.7474690675735474, "mean_feedback_forward_cosine": 0.8805968604589763, "mean_feedback_forward_relative_error": 0.48924355130446584, "min_feedback_forward_cosine": 0.7365822196006775 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005130215386217267, "instruction_rms": 0.00513021538634713, "raw_apical_rms": 0.03141726497064013, "teaching_rms": 0.005130215386217267, "traffic_rms": 0.0309897016667005 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104104593396187, "maximum_absolute_post_projection_soma_slope": 1.1615486350535775e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6820495615530207e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009317042634727535, "minimum_observations": 72 }, "output_lr": 0.1, "step": 6336, "train_examples": 45000, "train_loss": 0.407132633696662 }, { "epoch": 19, "eval_accuracy": 0.827, "eval_loss": 0.5370485595703125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.7219812273979187, "mean_feedback_forward_cosine": 0.8894854093852796, "mean_feedback_forward_relative_error": 0.4705220602060619, "min_feedback_forward_cosine": 0.7542740106582642 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005203601837145817, "instruction_rms": 0.00520360183613507, "raw_apical_rms": 0.031504752858528745, "teaching_rms": 0.005203601837145817, "traffic_rms": 0.031065647092155167 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.0613388390368073e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6718240273237736e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009022047554874449, "minimum_observations": 72 }, "output_lr": 0.1, "step": 6688, "train_examples": 45000, "train_loss": 0.39371106230417885 }, { "epoch": 20, "eval_accuracy": 0.8186, "eval_loss": 0.5529235717773437, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.697158694267273, "mean_feedback_forward_cosine": 0.8974085512914156, "mean_feedback_forward_relative_error": 0.45305699972729935, "min_feedback_forward_cosine": 0.7705336809158325 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005105721991124259, "instruction_rms": 0.005105721989551596, "raw_apical_rms": 0.03167865650987401, "teaching_rms": 0.005105721991124259, "traffic_rms": 0.03125853040121373 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.0572734687741558e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.685083141653272e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008546781791054408, "minimum_observations": 72 }, "output_lr": 0.1, "step": 7040, "train_examples": 45000, "train_loss": 0.3791846862051222 }, { "epoch": 21, "eval_accuracy": 0.8418, "eval_loss": 0.5103697387695313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.6728779077529907, "mean_feedback_forward_cosine": 0.9049001775289837, "mean_feedback_forward_relative_error": 0.43597892554182754, "min_feedback_forward_cosine": 0.7860504984855652 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005157035474318466, "instruction_rms": 0.00515703547400123, "raw_apical_rms": 0.032001719221733, "teaching_rms": 0.005157035474318466, "traffic_rms": 0.03157677551437884 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4813031690152911e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6796041782521214e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008514171408789961, "minimum_observations": 72 }, "output_lr": 0.1, "step": 7392, "train_examples": 45000, "train_loss": 0.37004463691711426 }, { "epoch": 22, "eval_accuracy": 0.832, "eval_loss": 0.5088022521972656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.6498216986656189, "mean_feedback_forward_cosine": 0.9116312077170924, "mean_feedback_forward_relative_error": 0.4200763890617772, "min_feedback_forward_cosine": 0.8003801703453064 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005106973395853267, "instruction_rms": 0.005106973397976795, "raw_apical_rms": 0.03216938340004663, "teaching_rms": 0.005106973395853267, "traffic_rms": 0.0317553491245528 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.1584300629863264e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6823495916847997e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008189136306340775, "minimum_observations": 72 }, "output_lr": 0.1, "step": 7744, "train_examples": 45000, "train_loss": 0.3618061388068729 }, { "epoch": 23, "eval_accuracy": 0.8436, "eval_loss": 0.4814773193359375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.6265225410461426, "mean_feedback_forward_cosine": 0.9179497612150092, "mean_feedback_forward_relative_error": 0.4045995630716023, "min_feedback_forward_cosine": 0.8143157958984375 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005055386002004759, "instruction_rms": 0.005055386002356951, "raw_apical_rms": 0.0322901928117579, "teaching_rms": 0.005055386002004759, "traffic_rms": 0.03188634064501978 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.0838371977683892e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6741981811622218e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00858211427408929, "minimum_observations": 72 }, "output_lr": 0.1, "step": 8096, "train_examples": 45000, "train_loss": 0.35613183804617987 }, { "epoch": 24, "eval_accuracy": 0.8344, "eval_loss": 0.51261796875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.6042298078536987, "mean_feedback_forward_cosine": 0.9237859217744124, "mean_feedback_forward_relative_error": 0.3897753475528014, "min_feedback_forward_cosine": 0.8270023465156555 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005026311796011831, "instruction_rms": 0.005026311794119769, "raw_apical_rms": 0.03239631130747826, "teaching_rms": 0.005026311796011831, "traffic_rms": 0.031997764570577646 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.115325076739282e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6719706724083858e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008635285323910395, "minimum_observations": 72 }, "output_lr": 0.1, "step": 8448, "train_examples": 45000, "train_loss": 0.3461827133178711 }, { "epoch": 25, "eval_accuracy": 0.8376, "eval_loss": 0.4821809814453125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.5829207301139832, "mean_feedback_forward_cosine": 0.9291425284586454, "mean_feedback_forward_relative_error": 0.37564187300832647, "min_feedback_forward_cosine": 0.8387241959571838 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005042792125698084, "instruction_rms": 0.005042792126893753, "raw_apical_rms": 0.03245913087995026, "teaching_rms": 0.005042792125698084, "traffic_rms": 0.03205849323489724 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.2731623755257715e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6674630115957838e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00855959767109689, "minimum_observations": 72 }, "output_lr": 0.1, "step": 8800, "train_examples": 45000, "train_loss": 0.3370492530769772 }, { "epoch": 26, "eval_accuracy": 0.8434, "eval_loss": 0.495537744140625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.5627683997154236, "mean_feedback_forward_cosine": 0.9340524171528063, "mean_feedback_forward_relative_error": 0.3622163777288638, "min_feedback_forward_cosine": 0.8494534492492676 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0049591596564131655, "instruction_rms": 0.004959159657579335, "raw_apical_rms": 0.03265736445835238, "teaching_rms": 0.0049591596564131655, "traffic_rms": 0.03227297794244435 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4674928827673739e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6686001064386828e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008467157723614333, "minimum_observations": 72 }, "output_lr": 0.1, "step": 9152, "train_examples": 45000, "train_loss": 0.3300551345931159 }, { "epoch": 27, "eval_accuracy": 0.8342, "eval_loss": 0.5357415649414062, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.5433613657951355, "mean_feedback_forward_cosine": 0.9385507389118797, "mean_feedback_forward_relative_error": 0.3495171783786071, "min_feedback_forward_cosine": 0.8595328330993652 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0049489392695670105, "instruction_rms": 0.004948939268289771, "raw_apical_rms": 0.03277365859859984, "teaching_rms": 0.0049489392695670105, "traffic_rms": 0.03239129424735014 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.031104102730751038, "maximum_absolute_post_projection_soma_slope": 1.1465401072996428e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6669398061146425e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008833973657661845, "minimum_observations": 72 }, "output_lr": 0.1, "step": 9504, "train_examples": 45000, "train_loss": 0.32522023562060465 }, { "epoch": 28, "eval_accuracy": 0.8584, "eval_loss": 0.439326318359375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.5248848795890808, "mean_feedback_forward_cosine": 0.9427224648626227, "mean_feedback_forward_relative_error": 0.33729491735759537, "min_feedback_forward_cosine": 0.8687142729759216 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.005033935666566265, "instruction_rms": 0.005033935664838083, "raw_apical_rms": 0.03299414083397847, "teaching_rms": 0.005033935666566265, "traffic_rms": 0.032601410542060845 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3903027173967075e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6688990737640255e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00887849304205244, "minimum_observations": 72 }, "output_lr": 0.1, "step": 9856, "train_examples": 45000, "train_loss": 0.3156820275094774 }, { "epoch": 29, "eval_accuracy": 0.8448, "eval_loss": 0.4970781555175781, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.5062661170959473, "mean_feedback_forward_cosine": 0.9466551416798642, "mean_feedback_forward_relative_error": 0.3253671848460248, "min_feedback_forward_cosine": 0.8777074813842773 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004954867700972754, "instruction_rms": 0.004954867702669111, "raw_apical_rms": 0.03305198524729274, "teaching_rms": 0.004954867700972754, "traffic_rms": 0.032672122765333926 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.325884468883487e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.657915232911312e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008695523989195557, "minimum_observations": 72 }, "output_lr": 0.1, "step": 10208, "train_examples": 45000, "train_loss": 0.31194691899087695 }, { "epoch": 30, "eval_accuracy": 0.858, "eval_loss": 0.451676953125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.4891993999481201, "mean_feedback_forward_cosine": 0.9501831343299464, "mean_feedback_forward_relative_error": 0.31429174542427063, "min_feedback_forward_cosine": 0.8856332898139954 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004896729235509657, "instruction_rms": 0.00489672923643095, "raw_apical_rms": 0.033082976683124876, "teaching_rms": 0.004896729235509657, "traffic_rms": 0.0327127175154366 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1145472988971505e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6612049666700516e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009022131846671251, "minimum_observations": 72 }, "output_lr": 0.1, "step": 10560, "train_examples": 45000, "train_loss": 0.30540858267678156 }, { "epoch": 31, "eval_accuracy": 0.8392, "eval_loss": 0.5462397277832032, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.4719200134277344, "mean_feedback_forward_cosine": 0.9535760408953616, "mean_feedback_forward_relative_error": 0.3032335952708596, "min_feedback_forward_cosine": 0.8934358358383179 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004958124178690693, "instruction_rms": 0.004958124178351577, "raw_apical_rms": 0.033261925680794766, "teaching_rms": 0.004958124178690693, "traffic_rms": 0.03288311390801063 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1543311195794104e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6575105475981898e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008333529629313366, "minimum_observations": 72 }, "output_lr": 0.1, "step": 10912, "train_examples": 45000, "train_loss": 0.30266087454160057 }, { "epoch": 32, "eval_accuracy": 0.8036, "eval_loss": 0.682837109375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.45478224754333496, "mean_feedback_forward_cosine": 0.956767483761436, "mean_feedback_forward_relative_error": 0.29247854414739105, "min_feedback_forward_cosine": 0.9008991718292236 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004953896585750713, "instruction_rms": 0.0049538965852565925, "raw_apical_rms": 0.033257915393122, "teaching_rms": 0.004953896585750713, "traffic_rms": 0.03288020627538047 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1645643560598273e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6531492453302036e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008216337933057904, "minimum_observations": 72 }, "output_lr": 0.1, "step": 11264, "train_examples": 45000, "train_loss": 0.29637968017260236 }, { "epoch": 33, "eval_accuracy": 0.8454, "eval_loss": 0.49532133178710935, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.43830615282058716, "mean_feedback_forward_cosine": 0.9597060868614599, "mean_feedback_forward_relative_error": 0.2823241635372764, "min_feedback_forward_cosine": 0.907834529876709 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004970880337995713, "instruction_rms": 0.004970880337158342, "raw_apical_rms": 0.033359007890836304, "teaching_rms": 0.004970880337995713, "traffic_rms": 0.032979909608127016 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2482241018574314e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6543463971984505e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008041048452023991, "minimum_observations": 72 }, "output_lr": 0.1, "step": 11616, "train_examples": 45000, "train_loss": 0.294988309123781 }, { "epoch": 34, "eval_accuracy": 0.8534, "eval_loss": 0.4693566711425781, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.4227277338504791, "mean_feedback_forward_cosine": 0.9624063247128537, "mean_feedback_forward_relative_error": 0.2726022440351938, "min_feedback_forward_cosine": 0.9141800999641418 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004892167475285149, "instruction_rms": 0.004892167475637795, "raw_apical_rms": 0.03358519006547927, "teaching_rms": 0.004892167475285149, "traffic_rms": 0.03321982884891977 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1676708489005705e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.653744592060938e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007941698955564375, "minimum_observations": 72 }, "output_lr": 0.1, "step": 11968, "train_examples": 45000, "train_loss": 0.29385936484071945 }, { "epoch": 35, "eval_accuracy": 0.8324, "eval_loss": 0.5749091674804687, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.40767407417297363, "mean_feedback_forward_cosine": 0.9649951959911146, "mean_feedback_forward_relative_error": 0.262962150338449, "min_feedback_forward_cosine": 0.9200702905654907 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004980105439659693, "instruction_rms": 0.0049801054402052606, "raw_apical_rms": 0.03347855324387941, "teaching_rms": 0.004980105439659693, "traffic_rms": 0.03309860209702309 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4705655360103265e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6504644458464934e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007713812389435235, "minimum_observations": 72 }, "output_lr": 0.1, "step": 12320, "train_examples": 45000, "train_loss": 0.28374992145167455 }, { "epoch": 36, "eval_accuracy": 0.8426, "eval_loss": 0.4943857971191406, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.39344385266304016, "mean_feedback_forward_cosine": 0.9673068209698326, "mean_feedback_forward_relative_error": 0.25407097998418304, "min_feedback_forward_cosine": 0.9254612922668457 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00480167981515975, "instruction_rms": 0.004801679816594659, "raw_apical_rms": 0.0337876464262403, "teaching_rms": 0.00480167981515975, "traffic_rms": 0.03343744331605359 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.18527738734997e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6540505792612133e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008233388511928756, "minimum_observations": 72 }, "output_lr": 0.1, "step": 12672, "train_examples": 45000, "train_loss": 0.27896705027686225 }, { "epoch": 37, "eval_accuracy": 0.8496, "eval_loss": 0.475590234375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.3787844777107239, "mean_feedback_forward_cosine": 0.9695587503282648, "mean_feedback_forward_relative_error": 0.24504558938114265, "min_feedback_forward_cosine": 0.9308475255966187 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004897628023750723, "instruction_rms": 0.004897628022957946, "raw_apical_rms": 0.03391378027919636, "teaching_rms": 0.004897628023750723, "traffic_rms": 0.03355177070229845 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4692020933182448e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.652624532061659e-08, "maximum_pre_projection_traffic_rms_ratio": 0.0080768554028717, "minimum_observations": 72 }, "output_lr": 0.1, "step": 13024, "train_examples": 45000, "train_loss": 0.28317848139074114 }, { "epoch": 38, "eval_accuracy": 0.8388, "eval_loss": 0.5251111755371094, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.36561089754104614, "mean_feedback_forward_cosine": 0.9715913094972309, "mean_feedback_forward_relative_error": 0.23662489613420085, "min_feedback_forward_cosine": 0.9354627132415771 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004867969835435969, "instruction_rms": 0.004867969835411105, "raw_apical_rms": 0.034011534417579974, "teaching_rms": 0.004867969835435969, "traffic_rms": 0.03365475892133878 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4360414191116888e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.640010561246279e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007765667090728688, "minimum_observations": 72 }, "output_lr": 0.1, "step": 13376, "train_examples": 45000, "train_loss": 0.2726616321086884 }, { "epoch": 39, "eval_accuracy": 0.8516, "eval_loss": 0.5048835876464843, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.35223522782325745, "mean_feedback_forward_cosine": 0.9735078090115598, "mean_feedback_forward_relative_error": 0.22845008381103216, "min_feedback_forward_cosine": 0.9399992823600769 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004801664601956974, "instruction_rms": 0.004801664602546571, "raw_apical_rms": 0.03404760170530794, "teaching_rms": 0.004801664601956974, "traffic_rms": 0.033700256476151186 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.088730616771727e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6503538103055278e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00793716446790211, "minimum_observations": 72 }, "output_lr": 0.1, "step": 13728, "train_examples": 45000, "train_loss": 0.27212047130266825 }, { "epoch": 40, "eval_accuracy": 0.8526, "eval_loss": 0.4644252502441406, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.33981913328170776, "mean_feedback_forward_cosine": 0.9752821106659738, "mean_feedback_forward_relative_error": 0.22056759305690465, "min_feedback_forward_cosine": 0.9440567493438721 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004814310388714407, "instruction_rms": 0.004814310390229436, "raw_apical_rms": 0.03398011142037965, "teaching_rms": 0.004814310388714407, "traffic_rms": 0.03363070354682049 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4484050403495985e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6436851105300998e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008074874997465701, "minimum_observations": 72 }, "output_lr": 0.1, "step": 14080, "train_examples": 45000, "train_loss": 0.26740257726775274 }, { "epoch": 41, "eval_accuracy": 0.8676, "eval_loss": 0.4324529357910156, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.32735109329223633, "mean_feedback_forward_cosine": 0.976964185112401, "mean_feedback_forward_relative_error": 0.21286306843945854, "min_feedback_forward_cosine": 0.9480441212654114 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004837030249174624, "instruction_rms": 0.004837030249051573, "raw_apical_rms": 0.03398783325450356, "teaching_rms": 0.004837030249174624, "traffic_rms": 0.033634786648000445 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1495266960537265e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6450261607396043e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008407791255391525, "minimum_observations": 72 }, "output_lr": 0.1, "step": 14432, "train_examples": 45000, "train_loss": 0.26583909475538464 }, { "epoch": 42, "eval_accuracy": 0.8476, "eval_loss": 0.5370885559082031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.3157062828540802, "mean_feedback_forward_cosine": 0.978500065050627, "mean_feedback_forward_relative_error": 0.20558425548829531, "min_feedback_forward_cosine": 0.9516211748123169 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004794390846475768, "instruction_rms": 0.004794390848540248, "raw_apical_rms": 0.03408740414116479, "teaching_rms": 0.004794390846475768, "traffic_rms": 0.033739975034218224 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.380817327145678e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.641002205330793e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008418045090464961, "minimum_observations": 72 }, "output_lr": 0.1, "step": 14784, "train_examples": 45000, "train_loss": 0.2626739225387573 }, { "epoch": 43, "eval_accuracy": 0.8474, "eval_loss": 0.5109385070800782, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.304364949464798, "mean_feedback_forward_cosine": 0.9799450290830511, "mean_feedback_forward_relative_error": 0.19850653723666542, "min_feedback_forward_cosine": 0.9549909234046936 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004773650322553887, "instruction_rms": 0.004773650322350811, "raw_apical_rms": 0.03410092191690993, "teaching_rms": 0.004773650322553887, "traffic_rms": 0.03375879169793919 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2696138362855436e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.646613554126838e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008801516921465368, "minimum_observations": 72 }, "output_lr": 0.1, "step": 15136, "train_examples": 45000, "train_loss": 0.2619066998057895 }, { "epoch": 44, "eval_accuracy": 0.8382, "eval_loss": 0.5117140441894531, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.29309210181236267, "mean_feedback_forward_cosine": 0.9813267180794164, "mean_feedback_forward_relative_error": 0.1915239977993463, "min_feedback_forward_cosine": 0.9582096338272095 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0048636472342842105, "instruction_rms": 0.0048636472349773505, "raw_apical_rms": 0.03406931260972435, "teaching_rms": 0.0048636472342842105, "traffic_rms": 0.03371260529755212 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.663171822485765e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.641406773724961e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008529031631681387, "minimum_observations": 72 }, "output_lr": 0.1, "step": 15488, "train_examples": 45000, "train_loss": 0.258253004556232 }, { "epoch": 45, "eval_accuracy": 0.8524, "eval_loss": 0.49885089111328124, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.28267934918403625, "mean_feedback_forward_cosine": 0.9825521017375746, "mean_feedback_forward_relative_error": 0.18504575914458224, "min_feedback_forward_cosine": 0.9610792398452759 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004776449581523731, "instruction_rms": 0.004776449580832663, "raw_apical_rms": 0.03405220258513439, "teaching_rms": 0.004776449581523731, "traffic_rms": 0.03370789796385943 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1919964570950015e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.646861215258964e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009121332944048951, "minimum_observations": 72 }, "output_lr": 0.1, "step": 15840, "train_examples": 45000, "train_loss": 0.25226737350887724 }, { "epoch": 46, "eval_accuracy": 0.8322, "eval_loss": 0.5687988708496093, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.27236035466194153, "mean_feedback_forward_cosine": 0.9837380020241988, "mean_feedback_forward_relative_error": 0.1786251789645145, "min_feedback_forward_cosine": 0.9638214111328125 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004811620708506466, "instruction_rms": 0.004811620707522746, "raw_apical_rms": 0.03409326012300677, "teaching_rms": 0.004811620708506466, "traffic_rms": 0.033744104574039396 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3385352382044857e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6453304569253207e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008623667473082434, "minimum_observations": 72 }, "output_lr": 0.1, "step": 16192, "train_examples": 45000, "train_loss": 0.2542002528270086 }, { "epoch": 47, "eval_accuracy": 0.8648, "eval_loss": 0.4691862121582031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.2622673809528351, "mean_feedback_forward_cosine": 0.9848273239637676, "mean_feedback_forward_relative_error": 0.17249753718313418, "min_feedback_forward_cosine": 0.966410756111145 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0047637483264667815, "instruction_rms": 0.00476374832466967, "raw_apical_rms": 0.03431797937572261, "teaching_rms": 0.0047637483264667815, "traffic_rms": 0.033978842904995504 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2311806685261217e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.647349410140757e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008973244018344448, "minimum_observations": 72 }, "output_lr": 0.1, "step": 16544, "train_examples": 45000, "train_loss": 0.2472731151368883 }, { "epoch": 48, "eval_accuracy": 0.8774, "eval_loss": 0.390655712890625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.25277069211006165, "mean_feedback_forward_cosine": 0.9858405025381791, "mean_feedback_forward_relative_error": 0.16660764774209574, "min_feedback_forward_cosine": 0.968781590461731 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004734057300343864, "instruction_rms": 0.004734057300560648, "raw_apical_rms": 0.034416352698988704, "teaching_rms": 0.004734057300343864, "traffic_rms": 0.034082861947264044 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5418537557820855e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6381597280930896e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008873849990073814, "minimum_observations": 72 }, "output_lr": 0.1, "step": 16896, "train_examples": 45000, "train_loss": 0.24886706942982142 }, { "epoch": 49, "eval_accuracy": 0.8566, "eval_loss": 0.4763729858398438, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.24390378594398499, "mean_feedback_forward_cosine": 0.9867772993288542, "mean_feedback_forward_relative_error": 0.1609509493175306, "min_feedback_forward_cosine": 0.9709120392799377 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00472433885555469, "instruction_rms": 0.0047243388555071745, "raw_apical_rms": 0.034407930029486083, "teaching_rms": 0.00472433885555469, "traffic_rms": 0.03407515877199275 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.366304402949936e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6450807803613235e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008432729201866343, "minimum_observations": 72 }, "output_lr": 0.1, "step": 17248, "train_examples": 45000, "train_loss": 0.24381286273797353 }, { "epoch": 50, "eval_accuracy": 0.8546, "eval_loss": 0.5009172668457031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.23519784212112427, "mean_feedback_forward_cosine": 0.9876453939237093, "mean_feedback_forward_relative_error": 0.15553969811452062, "min_feedback_forward_cosine": 0.9729282259941101 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004606681932301185, "instruction_rms": 0.0046066819324219925, "raw_apical_rms": 0.03445817750563184, "teaching_rms": 0.004606681932301185, "traffic_rms": 0.034141882132894624 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3151639777220225e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6364552935181166e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008785256886105718, "minimum_observations": 72 }, "output_lr": 0.1, "step": 17600, "train_examples": 45000, "train_loss": 0.24616385930114323 }, { "epoch": 51, "eval_accuracy": 0.84, "eval_loss": 0.5515082946777343, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.2269156277179718, "mean_feedback_forward_cosine": 0.988458187956559, "mean_feedback_forward_relative_error": 0.15030134508484289, "min_feedback_forward_cosine": 0.9747790098190308 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0046441777956041635, "instruction_rms": 0.004644177795562959, "raw_apical_rms": 0.03444990691445392, "teaching_rms": 0.0046441777956041635, "traffic_rms": 0.034127614922136666 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.191775833575548e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.634738683197308e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008759819974824733, "minimum_observations": 72 }, "output_lr": 0.1, "step": 17952, "train_examples": 45000, "train_loss": 0.23702717757754857 }, { "epoch": 52, "eval_accuracy": 0.8618, "eval_loss": 0.4465389404296875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.21880142390727997, "mean_feedback_forward_cosine": 0.9892266361336959, "mean_feedback_forward_relative_error": 0.1451731159498817, "min_feedback_forward_cosine": 0.9765316843986511 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004629176862530896, "instruction_rms": 0.004629176863975987, "raw_apical_rms": 0.034563132246923416, "teaching_rms": 0.004629176862530896, "traffic_rms": 0.034245299133160385 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4713018359202579e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6315995941463887e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008599320273287768, "minimum_observations": 72 }, "output_lr": 0.1, "step": 18304, "train_examples": 45000, "train_loss": 0.2346235758781433 }, { "epoch": 53, "eval_accuracy": 0.8478, "eval_loss": 0.5581020751953125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.21077044308185577, "mean_feedback_forward_cosine": 0.9899541767019975, "mean_feedback_forward_relative_error": 0.14016883134057648, "min_feedback_forward_cosine": 0.9782070517539978 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004693637465156337, "instruction_rms": 0.0046936374643177506, "raw_apical_rms": 0.03475809665475123, "teaching_rms": 0.004693637465156337, "traffic_rms": 0.03443199783267906 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409714281559, "maximum_absolute_post_projection_soma_slope": 1.0264071370613692e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6348604158506463e-08, "maximum_pre_projection_traffic_rms_ratio": 0.007993278147103374, "minimum_observations": 72 }, "output_lr": 0.1, "step": 18656, "train_examples": 45000, "train_loss": 0.23640003298123677 }, { "epoch": 54, "eval_accuracy": 0.8128, "eval_loss": 0.6650457153320313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.2032177746295929, "mean_feedback_forward_cosine": 0.9906056209614402, "mean_feedback_forward_relative_error": 0.13552678729358472, "min_feedback_forward_cosine": 0.9797242879867554 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004569560428927146, "instruction_rms": 0.004569560428360455, "raw_apical_rms": 0.03459364877157499, "teaching_rms": 0.004569560428927146, "traffic_rms": 0.03428311090995729 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.284697415115943e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6305371842757283e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008608573884396474, "minimum_observations": 72 }, "output_lr": 0.1, "step": 19008, "train_examples": 45000, "train_loss": 0.2298361652188831 }, { "epoch": 55, "eval_accuracy": 0.8632, "eval_loss": 0.47038958129882813, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.1957596242427826, "mean_feedback_forward_cosine": 0.9912525101711875, "mean_feedback_forward_relative_error": 0.13075828414998555, "min_feedback_forward_cosine": 0.9811676740646362 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0046634500385850965, "instruction_rms": 0.004663450037787709, "raw_apical_rms": 0.03473260594777723, "teaching_rms": 0.0046634500385850965, "traffic_rms": 0.03440977488178481 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1937872912426428e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6346369070560357e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00887763029480918, "minimum_observations": 72 }, "output_lr": 0.1, "step": 19360, "train_examples": 45000, "train_loss": 0.23555502649413215 }, { "epoch": 56, "eval_accuracy": 0.8548, "eval_loss": 0.47070689086914064, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.18890292942523956, "mean_feedback_forward_cosine": 0.9918342389558491, "mean_feedback_forward_relative_error": 0.12631950586249954, "min_feedback_forward_cosine": 0.9824573397636414 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00462494777569615, "instruction_rms": 0.0046249477761719626, "raw_apical_rms": 0.03483555329347786, "teaching_rms": 0.00462494777569615, "traffic_rms": 0.034519437051945545 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5332638270137977e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6341594016900744e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008304118629929533, "minimum_observations": 72 }, "output_lr": 0.1, "step": 19712, "train_examples": 45000, "train_loss": 0.23004417071607378 }, { "epoch": 57, "eval_accuracy": 0.8586, "eval_loss": 0.46194222412109376, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.18201766908168793, "mean_feedback_forward_cosine": 0.9923800041801051, "mean_feedback_forward_relative_error": 0.12201094215637759, "min_feedback_forward_cosine": 0.9837061166763306 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004623286000372373, "instruction_rms": 0.004623285999568594, "raw_apical_rms": 0.0347715408729308, "teaching_rms": 0.004623286000372373, "traffic_rms": 0.03445529255125391 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4529461189738413e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6349651030211643e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008987323391636841, "minimum_observations": 72 }, "output_lr": 0.1, "step": 20064, "train_examples": 45000, "train_loss": 0.23447738461494447 }, { "epoch": 58, "eval_accuracy": 0.8776, "eval_loss": 0.39425791625976564, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.17561373114585876, "mean_feedback_forward_cosine": 0.9928765798869886, "mean_feedback_forward_relative_error": 0.11794576519413998, "min_feedback_forward_cosine": 0.9848186373710632 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004489613265887848, "instruction_rms": 0.004489613266076248, "raw_apical_rms": 0.03469464289829862, "teaching_rms": 0.004489613265887848, "traffic_rms": 0.03439626084777562 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0672150274615433e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6355677912489722e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009090677963991408, "minimum_observations": 72 }, "output_lr": 0.1, "step": 20416, "train_examples": 45000, "train_loss": 0.22616133080588446 }, { "epoch": 59, "eval_accuracy": 0.8214, "eval_loss": 0.6318106689453125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.16960246860980988, "mean_feedback_forward_cosine": 0.9933565196238066, "mean_feedback_forward_relative_error": 0.11387859382911732, "min_feedback_forward_cosine": 0.9858263731002808 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00457532860681517, "instruction_rms": 0.004575328606559777, "raw_apical_rms": 0.03477156502703751, "teaching_rms": 0.00457532860681517, "traffic_rms": 0.03446172136504439 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3520507380349045e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6335615320188663e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009238969431445714, "minimum_observations": 72 }, "output_lr": 0.1, "step": 20768, "train_examples": 45000, "train_loss": 0.22260379991266463 }, { "epoch": 60, "eval_accuracy": 0.878, "eval_loss": 0.4137625183105469, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.16372554004192352, "mean_feedback_forward_cosine": 0.9937896226581774, "mean_feedback_forward_relative_error": 0.11009067689117633, "min_feedback_forward_cosine": 0.9867862462997437 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004529203460647302, "instruction_rms": 0.004529203459621877, "raw_apical_rms": 0.03463304539482143, "teaching_rms": 0.004529203460647302, "traffic_rms": 0.034327751484534805 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4452857577396117e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.633967674301304e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009334968467973907, "minimum_observations": 72 }, "output_lr": 0.1, "step": 21120, "train_examples": 45000, "train_loss": 0.22208338684505888 }, { "epoch": 61, "eval_accuracy": 0.8534, "eval_loss": 0.516475, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.1577123999595642, "mean_feedback_forward_cosine": 0.9942108737794977, "mean_feedback_forward_relative_error": 0.1062790857333886, "min_feedback_forward_cosine": 0.9877330660820007 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004550236786852152, "instruction_rms": 0.004550236786631306, "raw_apical_rms": 0.034765179154599105, "teaching_rms": 0.004550236786852152, "traffic_rms": 0.03445819330376294 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1467695237854514e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.631810116574943e-08, "maximum_pre_projection_traffic_rms_ratio": 0.010080600596530591, "minimum_observations": 72 }, "output_lr": 0.1, "step": 21472, "train_examples": 45000, "train_loss": 0.22619280171129438 }, { "epoch": 62, "eval_accuracy": 0.8586, "eval_loss": 0.442544677734375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.15221844613552094, "mean_feedback_forward_cosine": 0.9945927325047945, "mean_feedback_forward_relative_error": 0.10269431064003393, "min_feedback_forward_cosine": 0.9885700941085815 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004521705374212668, "instruction_rms": 0.004521705374268841, "raw_apical_rms": 0.034761470487341545, "teaching_rms": 0.004521705374212668, "traffic_rms": 0.034458362299596604 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2999428200544116e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.632537082100106e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00985824219365451, "minimum_observations": 72 }, "output_lr": 0.1, "step": 21824, "train_examples": 45000, "train_loss": 0.21663891365263196 }, { "epoch": 63, "eval_accuracy": 0.855, "eval_loss": 0.47691630249023437, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.14677031338214874, "mean_feedback_forward_cosine": 0.9949565529823303, "mean_feedback_forward_relative_error": 0.09916972682664268, "min_feedback_forward_cosine": 0.9893686771392822 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00454800645576982, "instruction_rms": 0.0045480064540945105, "raw_apical_rms": 0.034746996973843966, "teaching_rms": 0.00454800645576982, "traffic_rms": 0.034440261084225494 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.231772195353642e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6402821822006248e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009285121608502507, "minimum_observations": 72 }, "output_lr": 0.1, "step": 22176, "train_examples": 45000, "train_loss": 0.2174586017343733 }, { "epoch": 64, "eval_accuracy": 0.8486, "eval_loss": 0.5087167785644531, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.14159931242465973, "mean_feedback_forward_cosine": 0.995289661382374, "mean_feedback_forward_relative_error": 0.09583163555515439, "min_feedback_forward_cosine": 0.9900988340377808 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004509878056473776, "instruction_rms": 0.004509878057411221, "raw_apical_rms": 0.03485475855180221, "teaching_rms": 0.004509878056473776, "traffic_rms": 0.03455458867414804 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4009420290506114e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6325254003801997e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009322428344413306, "minimum_observations": 72 }, "output_lr": 0.1, "step": 22528, "train_examples": 45000, "train_loss": 0.21440663772159152 }, { "epoch": 65, "eval_accuracy": 0.8446, "eval_loss": 0.519659423828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.1363605558872223, "mean_feedback_forward_cosine": 0.9956220764862863, "mean_feedback_forward_relative_error": 0.09237666682977426, "min_feedback_forward_cosine": 0.9908114075660706 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0046595919890802945, "instruction_rms": 0.00465959199033466, "raw_apical_rms": 0.034852558301645464, "teaching_rms": 0.0046595919890802945, "traffic_rms": 0.03453176629947474 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3025884371131724e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.636034339162178e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00948175308698507, "minimum_observations": 72 }, "output_lr": 0.1, "step": 22880, "train_examples": 45000, "train_loss": 0.22187283344003889 }, { "epoch": 66, "eval_accuracy": 0.8292, "eval_loss": 0.5881011901855469, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.13144823908805847, "mean_feedback_forward_cosine": 0.9959171947680021, "mean_feedback_forward_relative_error": 0.08920571855024288, "min_feedback_forward_cosine": 0.9914578199386597 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00458447076552368, "instruction_rms": 0.004584470763683925, "raw_apical_rms": 0.03497863145534947, "teaching_rms": 0.00458447076552368, "traffic_rms": 0.03467038425593533 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.143722805352354e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.635584598929081e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009966187537097727, "minimum_observations": 72 }, "output_lr": 0.1, "step": 23232, "train_examples": 45000, "train_loss": 0.216731480439504 }, { "epoch": 67, "eval_accuracy": 0.8674, "eval_loss": 0.4599829772949219, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.12657660245895386, "mean_feedback_forward_cosine": 0.9961990149397599, "mean_feedback_forward_relative_error": 0.0860732936937558, "min_feedback_forward_cosine": 0.9920773506164551 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004627145895933496, "instruction_rms": 0.0046271458963005685, "raw_apical_rms": 0.035152856415883046, "teaching_rms": 0.004627145895933496, "traffic_rms": 0.03483804983062403 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2837901408602193e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6286313526223627e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009312316831906867, "minimum_observations": 72 }, "output_lr": 0.1, "step": 23584, "train_examples": 45000, "train_loss": 0.2194969289912118 }, { "epoch": 68, "eval_accuracy": 0.8786, "eval_loss": 0.39053208618164065, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.12211810797452927, "mean_feedback_forward_cosine": 0.9964460071764494, "mean_feedback_forward_relative_error": 0.08322563669399212, "min_feedback_forward_cosine": 0.992622435092926 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004448222060488421, "instruction_rms": 0.004448222060096612, "raw_apical_rms": 0.03514675221017867, "teaching_rms": 0.004448222060488421, "traffic_rms": 0.03485672297521746 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.155842621614056e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.626279994344699e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00924205510891637, "minimum_observations": 72 }, "output_lr": 0.1, "step": 23936, "train_examples": 45000, "train_loss": 0.2129067963335249 }, { "epoch": 69, "eval_accuracy": 0.8682, "eval_loss": 0.45594747314453127, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.11784830689430237, "mean_feedback_forward_cosine": 0.9966843002720883, "mean_feedback_forward_relative_error": 0.08037736404098962, "min_feedback_forward_cosine": 0.993126392364502 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004486322136916355, "instruction_rms": 0.0044863221378644074, "raw_apical_rms": 0.03523522815799778, "teaching_rms": 0.004486322136916355, "traffic_rms": 0.03494151811448261 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2787289449534e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6302305539835843e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009635511186971873, "minimum_observations": 72 }, "output_lr": 0.1, "step": 24288, "train_examples": 45000, "train_loss": 0.2087914967695872 }, { "epoch": 70, "eval_accuracy": 0.8676, "eval_loss": 0.46101365966796876, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.11344674974679947, "mean_feedback_forward_cosine": 0.9969156855031064, "mean_feedback_forward_relative_error": 0.0775245220253342, "min_feedback_forward_cosine": 0.9936275482177734 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0045926297245273235, "instruction_rms": 0.004592629725361557, "raw_apical_rms": 0.03517295844474793, "teaching_rms": 0.0045926297245273235, "traffic_rms": 0.034864906325467265 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3895605555092061e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6306149491126397e-08, "maximum_pre_projection_traffic_rms_ratio": 0.010313904601028254, "minimum_observations": 72 }, "output_lr": 0.1, "step": 24640, "train_examples": 45000, "train_loss": 0.21919610788292354 }, { "epoch": 71, "eval_accuracy": 0.8624, "eval_loss": 0.4905334533691406, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.10946271568536758, "mean_feedback_forward_cosine": 0.9971191381153307, "mean_feedback_forward_relative_error": 0.07491065189242363, "min_feedback_forward_cosine": 0.9940650463104248 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004505364726091503, "instruction_rms": 0.004505364726523862, "raw_apical_rms": 0.035162062356154516, "teaching_rms": 0.004505364726091503, "traffic_rms": 0.03486381904572826 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.506950475516078e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6337605717311066e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009701712553423126, "minimum_observations": 72 }, "output_lr": 0.1, "step": 24992, "train_examples": 45000, "train_loss": 0.2061603936460283 }, { "epoch": 72, "eval_accuracy": 0.864, "eval_loss": 0.45937369384765625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.10553739964962006, "mean_feedback_forward_cosine": 0.9973140986342179, "mean_feedback_forward_relative_error": 0.07233009212895443, "min_feedback_forward_cosine": 0.9944818019866943 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004501120009738082, "instruction_rms": 0.0045011200098905866, "raw_apical_rms": 0.03523203479675473, "teaching_rms": 0.004501120009738082, "traffic_rms": 0.03493577899487651 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2663494253217777e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6291002096393187e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009789404177086205, "minimum_observations": 72 }, "output_lr": 0.1, "step": 25344, "train_examples": 45000, "train_loss": 0.20920034455723233 }, { "epoch": 73, "eval_accuracy": 0.8586, "eval_loss": 0.49533743286132814, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.10173561424016953, "mean_feedback_forward_cosine": 0.9974929408023232, "mean_feedback_forward_relative_error": 0.0698717755118483, "min_feedback_forward_cosine": 0.9948709607124329 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004452159829408188, "instruction_rms": 0.004452159830043112, "raw_apical_rms": 0.03521120323014893, "teaching_rms": 0.004452159829408188, "traffic_rms": 0.03492161503984042 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1709801128745312e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6294496252774047e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009982753524995102, "minimum_observations": 72 }, "output_lr": 0.1, "step": 25696, "train_examples": 45000, "train_loss": 0.20618399731847975 }, { "epoch": 74, "eval_accuracy": 0.8566, "eval_loss": 0.4973161560058594, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.09814338386058807, "mean_feedback_forward_cosine": 0.9976599059606853, "mean_feedback_forward_relative_error": 0.06750352210120152, "min_feedback_forward_cosine": 0.9952248334884644 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0044704650968832435, "instruction_rms": 0.004470465096845052, "raw_apical_rms": 0.03531770239480634, "teaching_rms": 0.0044704650968832435, "traffic_rms": 0.03502581041891627 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3497415629615261e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.628883202448988e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008991144034400933, "minimum_observations": 72 }, "output_lr": 0.1, "step": 26048, "train_examples": 45000, "train_loss": 0.2070677791595459 }, { "epoch": 75, "eval_accuracy": 0.8658, "eval_loss": 0.44002984008789064, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.09478152543306351, "mean_feedback_forward_cosine": 0.9978180370832744, "mean_feedback_forward_relative_error": 0.06517410856720648, "min_feedback_forward_cosine": 0.9955450296401978 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00454264692216653, "instruction_rms": 0.004542646922724606, "raw_apical_rms": 0.03538495497628492, "teaching_rms": 0.00454264692216653, "traffic_rms": 0.03508444157413726 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2500177781760158e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6245408513228918e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008954280103157295, "minimum_observations": 72 }, "output_lr": 0.1, "step": 26400, "train_examples": 45000, "train_loss": 0.20586039009624058 }, { "epoch": 76, "eval_accuracy": 0.8618, "eval_loss": 0.5047085205078125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.09143461287021637, "mean_feedback_forward_cosine": 0.9979652668300428, "mean_feedback_forward_relative_error": 0.06293161380055703, "min_feedback_forward_cosine": 0.9958520531654358 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004514038875925267, "instruction_rms": 0.004514038875881944, "raw_apical_rms": 0.03532667619049348, "teaching_rms": 0.004514038875925267, "traffic_rms": 0.035028996401786416 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2083551048647223e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.627984139976097e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008699853703649804, "minimum_observations": 72 }, "output_lr": 0.1, "step": 26752, "train_examples": 45000, "train_loss": 0.2045543732325236 }, { "epoch": 77, "eval_accuracy": 0.8472, "eval_loss": 0.5431947448730469, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.08820625394582748, "mean_feedback_forward_cosine": 0.9981047416988172, "mean_feedback_forward_relative_error": 0.06073338058041899, "min_feedback_forward_cosine": 0.9961393475532532 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004488939879508441, "instruction_rms": 0.004488939879789814, "raw_apical_rms": 0.03538401410533833, "teaching_rms": 0.004488939879508441, "traffic_rms": 0.035089421880606736 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0987145415697341e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.626817068303352e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008779103060851395, "minimum_observations": 72 }, "output_lr": 0.1, "step": 27104, "train_examples": 45000, "train_loss": 0.20401948824723562 }, { "epoch": 78, "eval_accuracy": 0.883, "eval_loss": 0.37970450439453124, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.08497180044651031, "mean_feedback_forward_cosine": 0.9982345982601768, "mean_feedback_forward_relative_error": 0.05861183295124456, "min_feedback_forward_cosine": 0.9964160323143005 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004555921653594509, "instruction_rms": 0.004555921654625884, "raw_apical_rms": 0.03546975936725454, "teaching_rms": 0.004555921653594509, "traffic_rms": 0.035167905450692066 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0623000257226067e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.621434190911347e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008460152146069481, "minimum_observations": 72 }, "output_lr": 0.1, "step": 27456, "train_examples": 45000, "train_loss": 0.20838114698727925 }, { "epoch": 79, "eval_accuracy": 0.8716, "eval_loss": 0.4349828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.08195152133703232, "mean_feedback_forward_cosine": 0.9983531424873754, "mean_feedback_forward_relative_error": 0.056606653293496685, "min_feedback_forward_cosine": 0.996665358543396 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004485157069579081, "instruction_rms": 0.004485157070267351, "raw_apical_rms": 0.035540728599918, "teaching_rms": 0.004485157069579081, "traffic_rms": 0.035248704333594415 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2393795323362156e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6170983902311632e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008678463501860812, "minimum_observations": 72 }, "output_lr": 0.1, "step": 27808, "train_examples": 45000, "train_loss": 0.20069760993321736 }, { "epoch": 80, "eval_accuracy": 0.8722, "eval_loss": 0.4430991516113281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.07911452651023865, "mean_feedback_forward_cosine": 0.9984633263788725, "mean_feedback_forward_relative_error": 0.05467654764652252, "min_feedback_forward_cosine": 0.9968912601470947 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0045079332396336476, "instruction_rms": 0.004507933238804002, "raw_apical_rms": 0.035578414364218054, "teaching_rms": 0.0045079332396336476, "traffic_rms": 0.035283345328562615 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2718983199988543e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.626559093991407e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009245253864448234, "minimum_observations": 72 }, "output_lr": 0.1, "step": 28160, "train_examples": 45000, "train_loss": 0.19840980619854398 }, { "epoch": 81, "eval_accuracy": 0.8716, "eval_loss": 0.4429517333984375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.07626857608556747, "mean_feedback_forward_cosine": 0.9985685662219399, "mean_feedback_forward_relative_error": 0.05277032405138016, "min_feedback_forward_cosine": 0.9971103668212891 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0044664374004133875, "instruction_rms": 0.004466437399506244, "raw_apical_rms": 0.035601181321927945, "teaching_rms": 0.0044664374004133875, "traffic_rms": 0.03531270643760204 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5420379639863313e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6280340575991765e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009392048812378368, "minimum_observations": 72 }, "output_lr": 0.1, "step": 28512, "train_examples": 45000, "train_loss": 0.20652776799466874 }, { "epoch": 82, "eval_accuracy": 0.8596, "eval_loss": 0.4637076110839844, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.07356619089841843, "mean_feedback_forward_cosine": 0.9986630929143805, "mean_feedback_forward_relative_error": 0.051000150410752544, "min_feedback_forward_cosine": 0.9973108172416687 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004467663117046105, "instruction_rms": 0.004467663119095558, "raw_apical_rms": 0.035543474657197496, "teaching_rms": 0.004467663117046105, "traffic_rms": 0.035254164064680245 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.5173352352348957e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.634132948920163e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009524069379349749, "minimum_observations": 72 }, "output_lr": 0.1, "step": 28864, "train_examples": 45000, "train_loss": 0.2017500485473209 }, { "epoch": 83, "eval_accuracy": 0.8726, "eval_loss": 0.44147421875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0709899514913559, "mean_feedback_forward_cosine": 0.998748707143884, "mean_feedback_forward_relative_error": 0.04933068960120803, "min_feedback_forward_cosine": 0.9974950551986694 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004331244755192192, "instruction_rms": 0.004331244754318333, "raw_apical_rms": 0.0354581014473686, "teaching_rms": 0.004331244755192192, "traffic_rms": 0.03518428792538795 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1918544373656914e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.628112758512951e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009194250770854862, "minimum_observations": 72 }, "output_lr": 0.1, "step": 29216, "train_examples": 45000, "train_loss": 0.19447883835368687 }, { "epoch": 84, "eval_accuracy": 0.8432, "eval_loss": 0.5976843139648438, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.06832236796617508, "mean_feedback_forward_cosine": 0.9988360875531247, "mean_feedback_forward_relative_error": 0.04757653666954292, "min_feedback_forward_cosine": 0.9976797103881836 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00449569913828046, "instruction_rms": 0.004495699139872506, "raw_apical_rms": 0.03560047481926671, "teaching_rms": 0.00449569913828046, "traffic_rms": 0.03530655605531118 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3855610880852964e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6254458653860938e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009227602195459218, "minimum_observations": 72 }, "output_lr": 0.1, "step": 29568, "train_examples": 45000, "train_loss": 0.1982009590122435 }, { "epoch": 85, "eval_accuracy": 0.8714, "eval_loss": 0.4689421752929688, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0658072829246521, "mean_feedback_forward_cosine": 0.9989171059508073, "mean_feedback_forward_relative_error": 0.04589343374889148, "min_feedback_forward_cosine": 0.9978466033935547 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004473240100555046, "instruction_rms": 0.004473240100649002, "raw_apical_rms": 0.03558570370130643, "teaching_rms": 0.004473240100555046, "traffic_rms": 0.0352969631953337 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3908000084938976e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6322337465210142e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009480140194466701, "minimum_observations": 72 }, "output_lr": 0.1, "step": 29920, "train_examples": 45000, "train_loss": 0.1995692233191596 }, { "epoch": 86, "eval_accuracy": 0.8788, "eval_loss": 0.4291405334472656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0634622797369957, "mean_feedback_forward_cosine": 0.9989897796982213, "mean_feedback_forward_relative_error": 0.04432482478257857, "min_feedback_forward_cosine": 0.99799644947052 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004403505153147693, "instruction_rms": 0.004403505154678212, "raw_apical_rms": 0.0357053535971535, "teaching_rms": 0.004403505153147693, "traffic_rms": 0.03542529013894475 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2386266234898358e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6296237913063535e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009443209257356585, "minimum_observations": 72 }, "output_lr": 0.1, "step": 30272, "train_examples": 45000, "train_loss": 0.19470010391871134 }, { "epoch": 87, "eval_accuracy": 0.871, "eval_loss": 0.45971768188476564, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.06109802424907684, "mean_feedback_forward_cosine": 0.9990601978803936, "mean_feedback_forward_relative_error": 0.042754401893992176, "min_feedback_forward_cosine": 0.9981423616409302 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004557896740936863, "instruction_rms": 0.004557896740819575, "raw_apical_rms": 0.035865302055868825, "teaching_rms": 0.004557896740936863, "traffic_rms": 0.03556687724452723 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2751142364209045e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.623585945807858e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009776126863082948, "minimum_observations": 72 }, "output_lr": 0.1, "step": 30624, "train_examples": 45000, "train_loss": 0.20030388827853732 }, { "epoch": 88, "eval_accuracy": 0.8744, "eval_loss": 0.4562751953125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.05893165245652199, "mean_feedback_forward_cosine": 0.9991234195859808, "mean_feedback_forward_relative_error": 0.041289182379841805, "min_feedback_forward_cosine": 0.9982715845108032 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004438131279854983, "instruction_rms": 0.004438131278594169, "raw_apical_rms": 0.03587695328197024, "teaching_rms": 0.004438131279854983, "traffic_rms": 0.03559322356496659 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2551897299317716e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6242038664289318e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009567203178508883, "minimum_observations": 72 }, "output_lr": 0.1, "step": 30976, "train_examples": 45000, "train_loss": 0.19772963500552707 }, { "epoch": 89, "eval_accuracy": 0.8818, "eval_loss": 0.393742041015625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.056795962154865265, "mean_feedback_forward_cosine": 0.9991841222110548, "mean_feedback_forward_relative_error": 0.039833312167933115, "min_feedback_forward_cosine": 0.9983944296836853 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004542999277200115, "instruction_rms": 0.004542999277433244, "raw_apical_rms": 0.035812734370255755, "teaching_rms": 0.004542999277200115, "traffic_rms": 0.03551498619129561 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.105207303453426e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6283390844837256e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009153033826681829, "minimum_observations": 72 }, "output_lr": 0.1, "step": 31328, "train_examples": 45000, "train_loss": 0.19744758405950336 }, { "epoch": 90, "eval_accuracy": 0.827, "eval_loss": 0.6168673828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.05481269583106041, "mean_feedback_forward_cosine": 0.9992394321843198, "mean_feedback_forward_relative_error": 0.03845428224456938, "min_feedback_forward_cosine": 0.9985045194625854 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.00444154358005188, "instruction_rms": 0.004441543578801351, "raw_apical_rms": 0.036016278584755784, "teaching_rms": 0.00444154358005188, "traffic_rms": 0.03573315054412186 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1648157105526025e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6269239789906622e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009388308772157275, "minimum_observations": 72 }, "output_lr": 0.1, "step": 31680, "train_examples": 45000, "train_loss": 0.19283736647499933 }, { "epoch": 91, "eval_accuracy": 0.8776, "eval_loss": 0.4221093078613281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.05281934514641762, "mean_feedback_forward_cosine": 0.9992917525140863, "mean_feedback_forward_relative_error": 0.03710895972816568, "min_feedback_forward_cosine": 0.9986110925674438 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004461205840806688, "instruction_rms": 0.004461205837663978, "raw_apical_rms": 0.036108889058203204, "teaching_rms": 0.004461205840806688, "traffic_rms": 0.03582470494409129 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5864106472918138e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6244549495347382e-08, "maximum_pre_projection_traffic_rms_ratio": 0.008758704244552483, "minimum_observations": 72 }, "output_lr": 0.1, "step": 32032, "train_examples": 45000, "train_loss": 0.20179404377937316 }, { "epoch": 92, "eval_accuracy": 0.8498, "eval_loss": 0.5488065246582031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.050882983952760696, "mean_feedback_forward_cosine": 0.9993401922677693, "mean_feedback_forward_relative_error": 0.0358158204900591, "min_feedback_forward_cosine": 0.9987108707427979 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004385742457702917, "instruction_rms": 0.0043857424557278875, "raw_apical_rms": 0.0361424568017549, "teaching_rms": 0.004385742457702917, "traffic_rms": 0.03586691782618966 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4615670451689766e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618869183946591e-08, "maximum_pre_projection_traffic_rms_ratio": 0.01006033014347003, "minimum_observations": 72 }, "output_lr": 0.1, "step": 32384, "train_examples": 45000, "train_loss": 0.19619109466340806 }, { "epoch": 93, "eval_accuracy": 0.874, "eval_loss": 0.41386087646484376, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.04907582700252533, "mean_feedback_forward_cosine": 0.9993855263057508, "mean_feedback_forward_relative_error": 0.034564472636894175, "min_feedback_forward_cosine": 0.9988006949424744 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004464036627903883, "instruction_rms": 0.0044640366265155, "raw_apical_rms": 0.03607449473952833, "teaching_rms": 0.004464036627903883, "traffic_rms": 0.03578905939075563 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4828236416519758e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6186613133143958e-08, "maximum_pre_projection_traffic_rms_ratio": 0.01023274823824256, "minimum_observations": 72 }, "output_lr": 0.1, "step": 32736, "train_examples": 45000, "train_loss": 0.19600322678618962 }, { "epoch": 94, "eval_accuracy": 0.8606, "eval_loss": 0.4576331787109375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.04737013205885887, "mean_feedback_forward_cosine": 0.999426145302622, "mean_feedback_forward_relative_error": 0.03339990821519965, "min_feedback_forward_cosine": 0.9988824725151062 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004339615684676995, "instruction_rms": 0.00433961568607273, "raw_apical_rms": 0.036070355140655756, "teaching_rms": 0.004339615684676995, "traffic_rms": 0.03580020923633968 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4304748496840602e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.620125759649221e-08, "maximum_pre_projection_traffic_rms_ratio": 0.010584376748177247, "minimum_observations": 72 }, "output_lr": 0.1, "step": 33088, "train_examples": 45000, "train_loss": 0.19169836284187106 }, { "epoch": 95, "eval_accuracy": 0.8596, "eval_loss": 0.4559836181640625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.04570562392473221, "mean_feedback_forward_cosine": 0.9994649761601498, "mean_feedback_forward_relative_error": 0.03224945597742733, "min_feedback_forward_cosine": 0.9989596605300903 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004355237541317184, "instruction_rms": 0.004355237540550336, "raw_apical_rms": 0.03623222569830089, "teaching_rms": 0.004355237541317184, "traffic_rms": 0.03596110031917357 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1994017334870932e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6230141946270165e-08, "maximum_pre_projection_traffic_rms_ratio": 0.010526418873724519, "minimum_observations": 72 }, "output_lr": 0.1, "step": 33440, "train_examples": 45000, "train_loss": 0.19197891221576266 }, { "epoch": 96, "eval_accuracy": 0.8804, "eval_loss": 0.3978798095703125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0440932996571064, "mean_feedback_forward_cosine": 0.9995005256251285, "mean_feedback_forward_relative_error": 0.031160078109487108, "min_feedback_forward_cosine": 0.999031662940979 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004347173773633163, "instruction_rms": 0.004347173773565615, "raw_apical_rms": 0.036085388551255995, "teaching_rms": 0.004347173773633163, "traffic_rms": 0.03581637326586409 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.4107484069825205e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6188052547790338e-08, "maximum_pre_projection_traffic_rms_ratio": 0.0105355196707146, "minimum_observations": 72 }, "output_lr": 0.1, "step": 33792, "train_examples": 45000, "train_loss": 0.18896560633977255 }, { "epoch": 97, "eval_accuracy": 0.8696, "eval_loss": 0.45746707153320315, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.04250432923436165, "mean_feedback_forward_cosine": 0.9995339355970684, "mean_feedback_forward_relative_error": 0.030100022442638874, "min_feedback_forward_cosine": 0.9991000294685364 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004316854733873792, "instruction_rms": 0.004316854732836267, "raw_apical_rms": 0.03606182770129689, "teaching_rms": 0.004316854733873792, "traffic_rms": 0.0357937525580078 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.537128291317913e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619020163322017e-08, "maximum_pre_projection_traffic_rms_ratio": 0.010392886427435362, "minimum_observations": 72 }, "output_lr": 0.1, "step": 34144, "train_examples": 45000, "train_loss": 0.18978721633487278 }, { "epoch": 98, "eval_accuracy": 0.8804, "eval_loss": 0.41344547729492187, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.040988631546497345, "mean_feedback_forward_cosine": 0.9995653001885665, "mean_feedback_forward_relative_error": 0.029067374030618293, "min_feedback_forward_cosine": 0.9991629123687744 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004360429312977475, "instruction_rms": 0.00436042931312973, "raw_apical_rms": 0.03617032916319902, "teaching_rms": 0.004360429312977475, "traffic_rms": 0.03589993955470201 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5491643523546372e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.623243888849237e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009429446372638756, "minimum_observations": 72 }, "output_lr": 0.1, "step": 34496, "train_examples": 45000, "train_loss": 0.19110920924080743 }, { "epoch": 99, "eval_accuracy": 0.8758, "eval_loss": 0.42149432373046875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03946814313530922, "mean_feedback_forward_cosine": 0.999595748750787, "mean_feedback_forward_relative_error": 0.028032965467948662, "min_feedback_forward_cosine": 0.9992236495018005 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.0043877109872414895, "instruction_rms": 0.004387710985843983, "raw_apical_rms": 0.036154608328167366, "teaching_rms": 0.0043877109872414895, "traffic_rms": 0.03587890615478651 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3658580044761948e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6144190739499514e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009637188461033713, "minimum_observations": 72 }, "output_lr": 0.1, "step": 34848, "train_examples": 45000, "train_loss": 0.19423515079286363 }, { "epoch": 100, "eval_accuracy": 0.8842, "eval_loss": 0.42995159912109376, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03813067451119423, "mean_feedback_forward_cosine": 0.9996227182840046, "mean_feedback_forward_relative_error": 0.027078961463351, "min_feedback_forward_cosine": 0.9992754459381104 }, "lr": 0.1, "mixed_apical": { "innovation_rms": 0.004330861420460429, "instruction_rms": 0.004330861419590931, "raw_apical_rms": 0.03606853535647668, "teaching_rms": 0.004330861420460429, "traffic_rms": 0.03579993205263799 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1662693033542837e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6230222065213373e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00962217048547801, "minimum_observations": 72 }, "output_lr": 0.1, "step": 35200, "train_examples": 45000, "train_loss": 0.1828259764790535 }, { "epoch": 101, "eval_accuracy": 0.9084, "eval_loss": 0.3259307800292969, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0381181500852108, "mean_feedback_forward_cosine": 0.9996229786621896, "mean_feedback_forward_relative_error": 0.027065618993028215, "min_feedback_forward_cosine": 0.9992759227752686 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0033472765188487965, "instruction_rms": 0.003347276517472718, "raw_apical_rms": 0.03601295671222831, "teaching_rms": 0.0033472765188487965, "traffic_rms": 0.035850149572585595 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4773395839995374e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.614194736853349e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009414729635947462, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 35552, "train_examples": 45000, "train_loss": 0.11904574631386333 }, { "epoch": 102, "eval_accuracy": 0.9092, "eval_loss": 0.3211487365722656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0381116084754467, "mean_feedback_forward_cosine": 0.9996231825728166, "mean_feedback_forward_relative_error": 0.027055564385495688, "min_feedback_forward_cosine": 0.9992762207984924 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002990484514874979, "instruction_rms": 0.0029904845151677907, "raw_apical_rms": 0.035986723455086835, "teaching_rms": 0.002990484514874979, "traffic_rms": 0.03585656063547647 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409714281559, "maximum_absolute_post_projection_soma_slope": 1.3441757928944753e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6108888812942435e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009440852111375898, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 35904, "train_examples": 45000, "train_loss": 0.08980239703655243 }, { "epoch": 103, "eval_accuracy": 0.909, "eval_loss": 0.3183172668457031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03810526058077812, "mean_feedback_forward_cosine": 0.9996233362900583, "mean_feedback_forward_relative_error": 0.027046052837058118, "min_feedback_forward_cosine": 0.9992765188217163 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0029293037461553487, "instruction_rms": 0.0029293037476591168, "raw_apical_rms": 0.035936192474489675, "teaching_rms": 0.0029293037461553487, "traffic_rms": 0.035808943485872206 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4824728111761942e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6105168969895138e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009491064437173787, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 36256, "train_examples": 45000, "train_loss": 0.0815545727610588 }, { "epoch": 104, "eval_accuracy": 0.9118, "eval_loss": 0.311673388671875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0380992516875267, "mean_feedback_forward_cosine": 0.9996235088298195, "mean_feedback_forward_relative_error": 0.027036949305942182, "min_feedback_forward_cosine": 0.9992767572402954 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002896674103148192, "instruction_rms": 0.0028966741026558423, "raw_apical_rms": 0.035942960685461434, "teaching_rms": 0.002896674103148192, "traffic_rms": 0.03581913271956188 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4247645729881242e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6097947301262527e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00951281183298253, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 36608, "train_examples": 45000, "train_loss": 0.07392787510024176 }, { "epoch": 105, "eval_accuracy": 0.9098, "eval_loss": 0.32584077758789065, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03809328004717827, "mean_feedback_forward_cosine": 0.9996236782324942, "mean_feedback_forward_relative_error": 0.027028057234067666, "min_feedback_forward_cosine": 0.9992769360542297 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002982486869296268, "instruction_rms": 0.0029824868702288607, "raw_apical_rms": 0.03592376979909807, "teaching_rms": 0.002982486869296268, "traffic_rms": 0.035791721196680615 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409714281559, "maximum_absolute_post_projection_soma_slope": 1.272930028051178e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6149943162567607e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009557600262048776, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 36960, "train_examples": 45000, "train_loss": 0.07141380354563395 }, { "epoch": 106, "eval_accuracy": 0.913, "eval_loss": 0.32148916625976565, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038087308406829834, "mean_feedback_forward_cosine": 0.9996238162643031, "mean_feedback_forward_relative_error": 0.027019406717858817, "min_feedback_forward_cosine": 0.9992771148681641 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0029289830002966963, "instruction_rms": 0.0029289830017090136, "raw_apical_rms": 0.035914032439172634, "teaching_rms": 0.0029289830002966963, "traffic_rms": 0.035786792806693675 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409714281559, "maximum_absolute_post_projection_soma_slope": 1.2585185338309657e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6155209415759927e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009643434889365563, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 37312, "train_examples": 45000, "train_loss": 0.06653599984910753 }, { "epoch": 107, "eval_accuracy": 0.9122, "eval_loss": 0.32478743896484374, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03808138519525528, "mean_feedback_forward_cosine": 0.9996239856669777, "mean_feedback_forward_relative_error": 0.02701078198458019, "min_feedback_forward_cosine": 0.9992773532867432 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028665601539593255, "instruction_rms": 0.0028665601528412975, "raw_apical_rms": 0.03588042390045279, "teaching_rms": 0.0028665601539593255, "traffic_rms": 0.035756650487861315 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3040343027626022e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.612231057199634e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009576412071197617, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 37664, "train_examples": 45000, "train_loss": 0.06255504687362247 }, { "epoch": 108, "eval_accuracy": 0.9122, "eval_loss": 0.328871923828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038075514137744904, "mean_feedback_forward_cosine": 0.9996241268358732, "mean_feedback_forward_relative_error": 0.02700227861733813, "min_feedback_forward_cosine": 0.9992775917053223 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028695633932737264, "instruction_rms": 0.0028695633942765666, "raw_apical_rms": 0.035890662211287484, "teaching_rms": 0.0028695633932737264, "traffic_rms": 0.035766018499236475 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1649767373000941e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6136342007962996e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00968816035848221, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 38016, "train_examples": 45000, "train_loss": 0.0597408724811342 }, { "epoch": 109, "eval_accuracy": 0.914, "eval_loss": 0.33251861572265623, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03806949779391289, "mean_feedback_forward_cosine": 0.9996242868272882, "mean_feedback_forward_relative_error": 0.026993888087178532, "min_feedback_forward_cosine": 0.9992778301239014 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028985146835832764, "instruction_rms": 0.002898514684873951, "raw_apical_rms": 0.0358777356892019, "teaching_rms": 0.0028985146835832764, "traffic_rms": 0.0357524569798364 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2582765052115974e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.610909395309814e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009558368229309566, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 38368, "train_examples": 45000, "train_loss": 0.058068850870927176 }, { "epoch": 110, "eval_accuracy": 0.9128, "eval_loss": 0.33395889892578123, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038063690066337585, "mean_feedback_forward_cosine": 0.999624468778309, "mean_feedback_forward_relative_error": 0.02698576935615979, "min_feedback_forward_cosine": 0.9992780685424805 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028696458178227983, "instruction_rms": 0.002869645817842472, "raw_apical_rms": 0.03585184658767721, "teaching_rms": 0.0028696458178227983, "traffic_rms": 0.035726987625552924 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4731561748249078e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6158843093443453e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009566121352255097, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 38720, "train_examples": 45000, "train_loss": 0.054469241478708054 }, { "epoch": 111, "eval_accuracy": 0.9138, "eval_loss": 0.33631309814453125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03805793449282646, "mean_feedback_forward_cosine": 0.9996246475922433, "mean_feedback_forward_relative_error": 0.026977706896631343, "min_feedback_forward_cosine": 0.9992783069610596 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028511713941757337, "instruction_rms": 0.0028511713934999392, "raw_apical_rms": 0.03585176552770924, "teaching_rms": 0.0028511713941757337, "traffic_rms": 0.035727985689006425 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2175729757757381e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6156636693558254e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009671452186644064, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 39072, "train_examples": 45000, "train_loss": 0.05229350429375967 }, { "epoch": 112, "eval_accuracy": 0.9154, "eval_loss": 0.33809072265625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038052406162023544, "mean_feedback_forward_cosine": 0.9996248044465718, "mean_feedback_forward_relative_error": 0.02696984668115252, "min_feedback_forward_cosine": 0.9992785453796387 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028222139723085853, "instruction_rms": 0.002822213971199403, "raw_apical_rms": 0.035873038034578815, "teaching_rms": 0.0028222139723085853, "traffic_rms": 0.03575171930431188 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.392575832426246e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6145431346167743e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009570548191714557, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 39424, "train_examples": 45000, "train_loss": 0.05088527640766568 }, { "epoch": 113, "eval_accuracy": 0.9102, "eval_loss": 0.34676420288085935, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038046613335609436, "mean_feedback_forward_cosine": 0.999624933067121, "mean_feedback_forward_relative_error": 0.026961923969027243, "min_feedback_forward_cosine": 0.9992787837982178 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002842311355588269, "instruction_rms": 0.0028423113554333825, "raw_apical_rms": 0.03587723687063692, "teaching_rms": 0.002842311355588269, "traffic_rms": 0.03575509434187239 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4686383664752611e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6144555520498742e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009498977853440015, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 39776, "train_examples": 45000, "train_loss": 0.04946711292134391 }, { "epoch": 114, "eval_accuracy": 0.9122, "eval_loss": 0.34561643676757814, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03804095461964607, "mean_feedback_forward_cosine": 0.9996250961956225, "mean_feedback_forward_relative_error": 0.026953961700201035, "min_feedback_forward_cosine": 0.9992790222167969 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002797731487760313, "instruction_rms": 0.0027977314877417453, "raw_apical_rms": 0.035867336452967774, "teaching_rms": 0.002797731487760313, "traffic_rms": 0.03574732062936145 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2948744299023929e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6190549016728118e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009511829493815006, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 40128, "train_examples": 45000, "train_loss": 0.04669660123321745 }, { "epoch": 115, "eval_accuracy": 0.9104, "eval_loss": 0.3552204650878906, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03803538531064987, "mean_feedback_forward_cosine": 0.9996252342274314, "mean_feedback_forward_relative_error": 0.026946195597319228, "min_feedback_forward_cosine": 0.999279260635376 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002781539789875912, "instruction_rms": 0.002781539789402498, "raw_apical_rms": 0.03583110792841806, "teaching_rms": 0.002781539789875912, "traffic_rms": 0.03571137774542888 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2482407996117217e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6190075102145886e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009584501072354873, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 40480, "train_examples": 45000, "train_loss": 0.043811548323763744 }, { "epoch": 116, "eval_accuracy": 0.913, "eval_loss": 0.34888399658203123, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03802938014268875, "mean_feedback_forward_cosine": 0.9996254004930195, "mean_feedback_forward_relative_error": 0.026938311069419508, "min_feedback_forward_cosine": 0.9992794990539551 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027589384972830176, "instruction_rms": 0.002758938498364458, "raw_apical_rms": 0.035822512187125864, "teaching_rms": 0.0027589384972830176, "traffic_rms": 0.0357032934364985 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4204090348357568e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6174936257567725e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00952099290605394, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 40832, "train_examples": 45000, "train_loss": 0.04321008748345905 }, { "epoch": 117, "eval_accuracy": 0.9116, "eval_loss": 0.351063623046875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03802365064620972, "mean_feedback_forward_cosine": 0.9996255730327807, "mean_feedback_forward_relative_error": 0.026930446785531546, "min_feedback_forward_cosine": 0.9992796778678894 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028121380910417835, "instruction_rms": 0.0028121380914258374, "raw_apical_rms": 0.03584902275998271, "teaching_rms": 0.0028121380910417835, "traffic_rms": 0.035727811590774095 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1390384635490136e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.615851491866325e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00953851163872493, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 41184, "train_examples": 45000, "train_loss": 0.041723162909348806 }, { "epoch": 118, "eval_accuracy": 0.9116, "eval_loss": 0.3595480163574219, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03801767900586128, "mean_feedback_forward_cosine": 0.9996257110645896, "mean_feedback_forward_relative_error": 0.026922483977518584, "min_feedback_forward_cosine": 0.999279797077179 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0028066320925657522, "instruction_rms": 0.0028066320926862657, "raw_apical_rms": 0.03583823213845065, "teaching_rms": 0.0028066320925657522, "traffic_rms": 0.035717416974547646 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1584762482641509e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6138026794508964e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009567498567318766, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 41536, "train_examples": 45000, "train_loss": 0.04121919312477112 }, { "epoch": 119, "eval_accuracy": 0.9116, "eval_loss": 0.36063224487304685, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038011953234672546, "mean_feedback_forward_cosine": 0.9996258741930911, "mean_feedback_forward_relative_error": 0.026914845318778566, "min_feedback_forward_cosine": 0.9992802143096924 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002766894998886884, "instruction_rms": 0.0027668949982804733, "raw_apical_rms": 0.035822942272094475, "teaching_rms": 0.002766894998886884, "traffic_rms": 0.035703425144166405 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1590560511365311e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6143377507427477e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009596634022104129, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 41888, "train_examples": 45000, "train_loss": 0.03897833952241474 }, { "epoch": 120, "eval_accuracy": 0.9122, "eval_loss": 0.36014967651367186, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.038005948066711426, "mean_feedback_forward_cosine": 0.9996260937891508, "mean_feedback_forward_relative_error": 0.02690696235942213, "min_feedback_forward_cosine": 0.9992803931236267 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002761162125425492, "instruction_rms": 0.0027611621253415103, "raw_apical_rms": 0.03583332192186645, "teaching_rms": 0.002761162125425492, "traffic_rms": 0.035714112015139084 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.258372517298767e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6169752667974602e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009646114910546006, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 42240, "train_examples": 45000, "train_loss": 0.038807947030994626 }, { "epoch": 121, "eval_accuracy": 0.912, "eval_loss": 0.368635986328125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03799998760223389, "mean_feedback_forward_cosine": 0.9996262255467867, "mean_feedback_forward_relative_error": 0.026899256302337898, "min_feedback_forward_cosine": 0.9992806911468506 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.00275476982346384, "instruction_rms": 0.002754769822896326, "raw_apical_rms": 0.03580108555403456, "teaching_rms": 0.00275476982346384, "traffic_rms": 0.03568257318023869 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.500537294418791e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6158118961452318e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009732036852036902, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 42592, "train_examples": 45000, "train_loss": 0.03859740868144565 }, { "epoch": 122, "eval_accuracy": 0.9112, "eval_loss": 0.375572607421875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03799373283982277, "mean_feedback_forward_cosine": 0.9996264106348941, "mean_feedback_forward_relative_error": 0.026891536863618774, "min_feedback_forward_cosine": 0.9992808699607849 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027601279683554577, "instruction_rms": 0.002760127970405934, "raw_apical_rms": 0.03581597123058649, "teaching_rms": 0.0027601279683554577, "traffic_rms": 0.03569536676631768 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3610550908538244e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.616823077868045e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00965707582365918, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 42944, "train_examples": 45000, "train_loss": 0.03734560879071554 }, { "epoch": 123, "eval_accuracy": 0.9096, "eval_loss": 0.3836206359863281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03798767551779747, "mean_feedback_forward_cosine": 0.9996265298441837, "mean_feedback_forward_relative_error": 0.02688379639661626, "min_feedback_forward_cosine": 0.9992810487747192 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026655376026348985, "instruction_rms": 0.0026655376010316545, "raw_apical_rms": 0.03579517670364923, "teaching_rms": 0.0026655376026348985, "traffic_rms": 0.035683251075829196 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.6414423598121175e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6190680857384163e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00963298712955783, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 43296, "train_examples": 45000, "train_loss": 0.03550222207605839 }, { "epoch": 124, "eval_accuracy": 0.9124, "eval_loss": 0.3698329162597656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03798159584403038, "mean_feedback_forward_cosine": 0.9996267400289837, "mean_feedback_forward_relative_error": 0.02687601612782792, "min_feedback_forward_cosine": 0.9992812871932983 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027511484741651825, "instruction_rms": 0.0027511484752177208, "raw_apical_rms": 0.03577062803804927, "teaching_rms": 0.0027511484741651825, "traffic_rms": 0.03565009219861281 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.120090598050183e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.616681270428917e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009707561803276307, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 43648, "train_examples": 45000, "train_loss": 0.03580282854802078 }, { "epoch": 125, "eval_accuracy": 0.9114, "eval_loss": 0.3712406555175781, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03797522932291031, "mean_feedback_forward_cosine": 0.9996268937462255, "mean_feedback_forward_relative_error": 0.026868038369636787, "min_feedback_forward_cosine": 0.9992815852165222 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027907677721793023, "instruction_rms": 0.002790767771911957, "raw_apical_rms": 0.03577578432471849, "teaching_rms": 0.0027907677721793023, "traffic_rms": 0.035652179953717646 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.379840330884008e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.614495218653508e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009818036049193164, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 44000, "train_examples": 45000, "train_loss": 0.036065083287821875 }, { "epoch": 126, "eval_accuracy": 0.913, "eval_loss": 0.37410505981445313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037968847900629044, "mean_feedback_forward_cosine": 0.9996270411892941, "mean_feedback_forward_relative_error": 0.026860256336237256, "min_feedback_forward_cosine": 0.9992817044258118 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027855026442477598, "instruction_rms": 0.0027855026440891987, "raw_apical_rms": 0.03578097218964767, "teaching_rms": 0.0027855026442477598, "traffic_rms": 0.03565767145537793 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.147241590615522e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6161130612054242e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009674539963637395, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 44352, "train_examples": 45000, "train_loss": 0.03503612222803964 }, { "epoch": 127, "eval_accuracy": 0.9104, "eval_loss": 0.38507326049804685, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03796249255537987, "mean_feedback_forward_cosine": 0.9996272356886613, "mean_feedback_forward_relative_error": 0.026852291273443324, "min_feedback_forward_cosine": 0.9992821216583252 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026975618837138983, "instruction_rms": 0.002697561883383782, "raw_apical_rms": 0.03579064949846312, "teaching_rms": 0.0026975618837138983, "traffic_rms": 0.03567367917199365 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3141908006275571e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618431664614786e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009527002395862164, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 44704, "train_examples": 45000, "train_loss": 0.03341853344672256 }, { "epoch": 128, "eval_accuracy": 0.911, "eval_loss": 0.3920139404296875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03795585036277771, "mean_feedback_forward_cosine": 0.9996274207767687, "mean_feedback_forward_relative_error": 0.026844228862931852, "min_feedback_forward_cosine": 0.9992824196815491 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002750541218062686, "instruction_rms": 0.0027505412191790746, "raw_apical_rms": 0.03576918976281961, "teaching_rms": 0.002750541218062686, "traffic_rms": 0.0356481807025341 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2473168276017077e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6218493188187658e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009663760274781231, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 45056, "train_examples": 45000, "train_loss": 0.03287169239719709 }, { "epoch": 129, "eval_accuracy": 0.9134, "eval_loss": 0.38938822021484376, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037949901074171066, "mean_feedback_forward_cosine": 0.9996275870423568, "mean_feedback_forward_relative_error": 0.02683663461357355, "min_feedback_forward_cosine": 0.9992826581001282 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026238850680548745, "instruction_rms": 0.0026238850678266677, "raw_apical_rms": 0.035746906829503516, "teaching_rms": 0.0026238850680548745, "traffic_rms": 0.035636102017194186 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0733844924004643e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6188728554294605e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009614808397064061, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 45408, "train_examples": 45000, "train_loss": 0.03094183478222953 }, { "epoch": 130, "eval_accuracy": 0.9134, "eval_loss": 0.3928030151367187, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03794398903846741, "mean_feedback_forward_cosine": 0.9996277627192045, "mean_feedback_forward_relative_error": 0.02682895414335163, "min_feedback_forward_cosine": 0.9992827773094177 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002622710879992411, "instruction_rms": 0.002622710880762901, "raw_apical_rms": 0.035731069218762186, "teaching_rms": 0.002622710879992411, "traffic_rms": 0.03561991443288764 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2849611152887519e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6121007907933642e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009830500001566147, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 45760, "train_examples": 45000, "train_loss": 0.029354358004861407 }, { "epoch": 131, "eval_accuracy": 0.9114, "eval_loss": 0.38648424072265625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03793803229928017, "mean_feedback_forward_cosine": 0.9996279195735329, "mean_feedback_forward_relative_error": 0.026821194118575045, "min_feedback_forward_cosine": 0.9992830157279968 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025914732781347487, "instruction_rms": 0.0025914732781897134, "raw_apical_rms": 0.0357203964741929, "teaching_rms": 0.0025914732781347487, "traffic_rms": 0.03561015827148135 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2277120653436668e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6177991820475174e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009724882261981085, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 46112, "train_examples": 45000, "train_loss": 0.028900067031052377 }, { "epoch": 132, "eval_accuracy": 0.9106, "eval_loss": 0.3918890930175781, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03793131932616234, "mean_feedback_forward_cosine": 0.9996280921132941, "mean_feedback_forward_relative_error": 0.02681309494533037, "min_feedback_forward_cosine": 0.9992832541465759 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026975961361970055, "instruction_rms": 0.002697596135337974, "raw_apical_rms": 0.035710380517198305, "teaching_rms": 0.0026975961361970055, "traffic_rms": 0.035592226690178135 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2983555564005655e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.622333585292056e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009668498919770402, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 46464, "train_examples": 45000, "train_loss": 0.030538018282088967 }, { "epoch": 133, "eval_accuracy": 0.9104, "eval_loss": 0.39623680419921875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037924885749816895, "mean_feedback_forward_cosine": 0.9996282458305359, "mean_feedback_forward_relative_error": 0.02680520125125584, "min_feedback_forward_cosine": 0.999283492565155 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002635780184050218, "instruction_rms": 0.0026357801832153664, "raw_apical_rms": 0.03569409748753582, "teaching_rms": 0.002635780184050218, "traffic_rms": 0.03557964049918153 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3676385357541676e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.615643645286502e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009754141415901071, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 46816, "train_examples": 45000, "train_loss": 0.029081654803454877 }, { "epoch": 134, "eval_accuracy": 0.9108, "eval_loss": 0.3895315185546875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037918198853731155, "mean_feedback_forward_cosine": 0.999628462289509, "mean_feedback_forward_relative_error": 0.02679695581134997, "min_feedback_forward_cosine": 0.9992837905883789 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002742187509968168, "instruction_rms": 0.0027421875111034097, "raw_apical_rms": 0.03572439865144619, "teaching_rms": 0.002742187509968168, "traffic_rms": 0.03560007387385542 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3136595811147345e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6202907495852204e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009760525172780596, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 47168, "train_examples": 45000, "train_loss": 0.028779723361465667 }, { "epoch": 135, "eval_accuracy": 0.9106, "eval_loss": 0.3926762451171875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037911418825387955, "mean_feedback_forward_cosine": 0.9996286379663568, "mean_feedback_forward_relative_error": 0.026788822914424696, "min_feedback_forward_cosine": 0.9992839097976685 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026868494036395157, "instruction_rms": 0.002686849404910164, "raw_apical_rms": 0.03569168232715309, "teaching_rms": 0.0026868494036395157, "traffic_rms": 0.03557283692593126 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3787125219266727e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6191191160133836e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00979281848443928, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 47520, "train_examples": 45000, "train_loss": 0.02846326970325576 }, { "epoch": 136, "eval_accuracy": 0.9084, "eval_loss": 0.40878616943359375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03790559247136116, "mean_feedback_forward_cosine": 0.999628832465724, "mean_feedback_forward_relative_error": 0.026781202195898482, "min_feedback_forward_cosine": 0.9992842674255371 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025450656243850523, "instruction_rms": 0.002545065624684874, "raw_apical_rms": 0.03566917022717624, "teaching_rms": 0.0025450656243850523, "traffic_rms": 0.0355617712433612 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2010985095400883e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6177253169118073e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009744248196663233, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 47872, "train_examples": 45000, "train_loss": 0.025685858269201386 }, { "epoch": 137, "eval_accuracy": 0.9128, "eval_loss": 0.3987355712890625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03789890930056572, "mean_feedback_forward_cosine": 0.9996290363763508, "mean_feedback_forward_relative_error": 0.026773277278009214, "min_feedback_forward_cosine": 0.999284565448761 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026180515333599323, "instruction_rms": 0.0026180515335020634, "raw_apical_rms": 0.03570993695445157, "teaching_rms": 0.0026180515333599323, "traffic_rms": 0.03559666524284681 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.597332932590234e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6204578252730795e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009646679881658194, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 48224, "train_examples": 45000, "train_loss": 0.027844087640444437 }, { "epoch": 138, "eval_accuracy": 0.9102, "eval_loss": 0.4109247741699219, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03789233788847923, "mean_feedback_forward_cosine": 0.9996291806823329, "mean_feedback_forward_relative_error": 0.026765429463825728, "min_feedback_forward_cosine": 0.9992847442626953 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002638664010063119, "instruction_rms": 0.0026386640096644647, "raw_apical_rms": 0.03566768918823276, "teaching_rms": 0.002638664010063119, "traffic_rms": 0.03555359236882088 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2113433811578034e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.623062258955324e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00976945290872928, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 48576, "train_examples": 45000, "train_loss": 0.026772137907644114 }, { "epoch": 139, "eval_accuracy": 0.9144, "eval_loss": 0.40518236694335935, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03788561001420021, "mean_feedback_forward_cosine": 0.9996293783187866, "mean_feedback_forward_relative_error": 0.026757078539384038, "min_feedback_forward_cosine": 0.999285101890564 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002612001682187245, "instruction_rms": 0.0026120016827994065, "raw_apical_rms": 0.03565216126697786, "teaching_rms": 0.002612001682187245, "traffic_rms": 0.035537428261166085 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1465832727708403e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6258578957992902e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009644668044545194, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 48928, "train_examples": 45000, "train_loss": 0.02580999892420239 }, { "epoch": 140, "eval_accuracy": 0.9104, "eval_loss": 0.411278125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03787907212972641, "mean_feedback_forward_cosine": 0.9996295696810672, "mean_feedback_forward_relative_error": 0.026749126613140106, "min_feedback_forward_cosine": 0.9992852210998535 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002611693291988267, "instruction_rms": 0.002611693292765891, "raw_apical_rms": 0.035591762399835865, "teaching_rms": 0.002611693291988267, "traffic_rms": 0.03547938614446786 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2840193797103439e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6246608171250558e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009743369749401539, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 49280, "train_examples": 45000, "train_loss": 0.025524346191353266 }, { "epoch": 141, "eval_accuracy": 0.9106, "eval_loss": 0.4062041748046875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03787163272500038, "mean_feedback_forward_cosine": 0.9996297767287806, "mean_feedback_forward_relative_error": 0.026740355907302154, "min_feedback_forward_cosine": 0.9992855787277222 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0027070270794916193, "instruction_rms": 0.0027070270797813255, "raw_apical_rms": 0.03563609802435912, "teaching_rms": 0.0027070270794916193, "traffic_rms": 0.035511611640737885 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4507527623663918e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6223096926328764e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009729349519671793, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 49632, "train_examples": 45000, "train_loss": 0.027296853695147567 }, { "epoch": 142, "eval_accuracy": 0.9118, "eval_loss": 0.41186312255859375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037864819169044495, "mean_feedback_forward_cosine": 0.9996299618168881, "mean_feedback_forward_relative_error": 0.026732132868155054, "min_feedback_forward_cosine": 0.9992859363555908 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025778124945542435, "instruction_rms": 0.0025778124941378392, "raw_apical_rms": 0.03561647943645186, "teaching_rms": 0.0025778124945542435, "traffic_rms": 0.035505854937505556 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2427866735720272e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6168315613522945e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00971278371826236, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 49984, "train_examples": 45000, "train_loss": 0.02511273897687594 }, { "epoch": 143, "eval_accuracy": 0.9106, "eval_loss": 0.4166827209472656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03785836696624756, "mean_feedback_forward_cosine": 0.999630143767909, "mean_feedback_forward_relative_error": 0.02672435906960776, "min_feedback_forward_cosine": 0.9992861151695251 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0024070126294162093, "instruction_rms": 0.0024070126293388137, "raw_apical_rms": 0.03559019898416294, "teaching_rms": 0.0024070126294162093, "traffic_rms": 0.03549209008796763 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2012990602272566e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618936282268463e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009764600853767324, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 50336, "train_examples": 45000, "train_loss": 0.022995042044586606 }, { "epoch": 144, "eval_accuracy": 0.9126, "eval_loss": 0.41340057373046873, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03785092383623123, "mean_feedback_forward_cosine": 0.9996303508156225, "mean_feedback_forward_relative_error": 0.026715706151567008, "min_feedback_forward_cosine": 0.999286413192749 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0026267032270786655, "instruction_rms": 0.0026267032265151757, "raw_apical_rms": 0.03561348328808878, "teaching_rms": 0.0026267032270786655, "traffic_rms": 0.03549544675313446 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4057949471180109e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6210168806989145e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009787132839748691, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 50688, "train_examples": 45000, "train_loss": 0.024796697247690624 }, { "epoch": 145, "eval_accuracy": 0.9126, "eval_loss": 0.407359423828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03784457966685295, "mean_feedback_forward_cosine": 0.9996305139441239, "mean_feedback_forward_relative_error": 0.0267080179856796, "min_feedback_forward_cosine": 0.9992866516113281 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002411227822155689, "instruction_rms": 0.002411227823475597, "raw_apical_rms": 0.03559807514429829, "teaching_rms": 0.002411227822155689, "traffic_rms": 0.0354983777965054 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0809019457269642e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.620617980156489e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00980182348454157, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 51040, "train_examples": 45000, "train_loss": 0.022539040789835985 }, { "epoch": 146, "eval_accuracy": 0.91, "eval_loss": 0.42620809326171877, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03783755376935005, "mean_feedback_forward_cosine": 0.9996307115805777, "mean_feedback_forward_relative_error": 0.026699521137695564, "min_feedback_forward_cosine": 0.9992868900299072 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.002565811242517235, "instruction_rms": 0.002565811242643303, "raw_apical_rms": 0.035587567868722365, "teaching_rms": 0.002565811242517235, "traffic_rms": 0.03547522987971678 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4903037026670063e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6225682665495397e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009706511222796843, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 51392, "train_examples": 45000, "train_loss": 0.023578642381893264 }, { "epoch": 147, "eval_accuracy": 0.911, "eval_loss": 0.42503335571289064, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03783031553030014, "mean_feedback_forward_cosine": 0.999630940587897, "mean_feedback_forward_relative_error": 0.026690693670197538, "min_feedback_forward_cosine": 0.9992870688438416 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025885059522246312, "instruction_rms": 0.0025885059535557015, "raw_apical_rms": 0.03555838610924396, "teaching_rms": 0.0025885059522246312, "traffic_rms": 0.035442078172238385 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2002680627176687e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6267581202852138e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00985412452162739, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 51744, "train_examples": 45000, "train_loss": 0.023740731816159353 }, { "epoch": 148, "eval_accuracy": 0.9122, "eval_loss": 0.4174243408203125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03782280161976814, "mean_feedback_forward_cosine": 0.9996311382243508, "mean_feedback_forward_relative_error": 0.026681908847470032, "min_feedback_forward_cosine": 0.9992873668670654 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025628457988248884, "instruction_rms": 0.0025628457987137013, "raw_apical_rms": 0.03553239426766158, "teaching_rms": 0.0025628457988248884, "traffic_rms": 0.03542038082092827 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2999201715047093e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6248284634245207e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009733664121826479, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 52096, "train_examples": 45000, "train_loss": 0.023489599435859255 }, { "epoch": 149, "eval_accuracy": 0.915, "eval_loss": 0.42041235961914064, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037815794348716736, "mean_feedback_forward_cosine": 0.9996313515462374, "mean_feedback_forward_relative_error": 0.02667347900569439, "min_feedback_forward_cosine": 0.9992876052856445 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.00253459505010071, "instruction_rms": 0.0025345950500882826, "raw_apical_rms": 0.03551564592976059, "teaching_rms": 0.00253459505010071, "traffic_rms": 0.035407345219106684 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2784917124974982e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6207162199078193e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009688193952499912, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 52448, "train_examples": 45000, "train_loss": 0.022620651949776544 }, { "epoch": 150, "eval_accuracy": 0.9104, "eval_loss": 0.42439256591796876, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780863806605339, "mean_feedback_forward_cosine": 0.9996315397714314, "mean_feedback_forward_relative_error": 0.026664931229070613, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.010000000000000002, "mixed_apical": { "innovation_rms": 0.0025151916352342905, "instruction_rms": 0.002515191635826509, "raw_apical_rms": 0.03552600170105816, "teaching_rms": 0.0025151916352342905, "traffic_rms": 0.03541416019616737 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3124211939441466e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618080090131379e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009837820810131428, "minimum_observations": 72 }, "output_lr": 0.010000000000000002, "step": 52800, "train_examples": 45000, "train_loss": 0.022285571916566955 }, { "epoch": 151, "eval_accuracy": 0.9112, "eval_loss": 0.4160915588378906, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780853748321533, "mean_feedback_forward_cosine": 0.9996315460456046, "mean_feedback_forward_relative_error": 0.0266646696254611, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0023690394798630107, "instruction_rms": 0.002369039479136609, "raw_apical_rms": 0.035500359686107825, "teaching_rms": 0.0023690394798630107, "traffic_rms": 0.03540311715202738 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3979216006987372e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6147353264949156e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009950262225916816, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 53152, "train_examples": 45000, "train_loss": 0.020033901221967406 }, { "epoch": 152, "eval_accuracy": 0.915, "eval_loss": 0.412415478515625, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780847415328026, "mean_feedback_forward_cosine": 0.999631542908518, "mean_feedback_forward_relative_error": 0.026664435765460917, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002363181180109337, "instruction_rms": 0.0023631811816877146, "raw_apical_rms": 0.03550671226071755, "teaching_rms": 0.002363181180109337, "traffic_rms": 0.03540743308969674 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3078425453727505e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6143342377322934e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009923390440856971, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 53504, "train_examples": 45000, "train_loss": 0.01982582550181283 }, { "epoch": 153, "eval_accuracy": 0.914, "eval_loss": 0.4219018493652344, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780841827392578, "mean_feedback_forward_cosine": 0.9996315711422971, "mean_feedback_forward_relative_error": 0.02666421739482566, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0022168579681471966, "instruction_rms": 0.0022168579682489828, "raw_apical_rms": 0.03549892093773543, "teaching_rms": 0.0022168579681471966, "traffic_rms": 0.03540893340906787 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1699555102495651e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6155479768674653e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00991793256075795, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 53856, "train_examples": 45000, "train_loss": 0.018583940839767457 }, { "epoch": 154, "eval_accuracy": 0.9154, "eval_loss": 0.4142001647949219, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037808362394571304, "mean_feedback_forward_cosine": 0.9996315585939508, "mean_feedback_forward_relative_error": 0.026664001033886484, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0022208326704436345, "instruction_rms": 0.0022208326696203434, "raw_apical_rms": 0.0354993800874489, "teaching_rms": 0.0022208326704436345, "traffic_rms": 0.03541088335135728 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.174215213950447e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6138077736505478e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009778174847088088, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 54208, "train_examples": 45000, "train_loss": 0.018304667066037655 }, { "epoch": 155, "eval_accuracy": 0.9126, "eval_loss": 0.41529046630859373, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780830651521683, "mean_feedback_forward_cosine": 0.9996315648681239, "mean_feedback_forward_relative_error": 0.02666377888894395, "min_feedback_forward_cosine": 0.9992879033088684 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020940083723578317, "instruction_rms": 0.00209400837211589, "raw_apical_rms": 0.03549419842454183, "teaching_rms": 0.0020940083723578317, "traffic_rms": 0.03541537284997737 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3867719417248736e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.615518187018473e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009840861291704164, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 54560, "train_examples": 45000, "train_loss": 0.017229355897671647 }, { "epoch": 156, "eval_accuracy": 0.9158, "eval_loss": 0.4150919738769531, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037808261811733246, "mean_feedback_forward_cosine": 0.9996315617310373, "mean_feedback_forward_relative_error": 0.02666356625329507, "min_feedback_forward_cosine": 0.9992879033088684 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020718280070672877, "instruction_rms": 0.0020718280072837747, "raw_apical_rms": 0.03549177889857754, "teaching_rms": 0.0020718280070672877, "traffic_rms": 0.03541395171582714 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1908183772391112e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.616108327523135e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009694605252590052, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 54912, "train_examples": 45000, "train_loss": 0.016535244550307592 }, { "epoch": 157, "eval_accuracy": 0.9124, "eval_loss": 0.4139591613769531, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780820965766907, "mean_feedback_forward_cosine": 0.9996315585939508, "mean_feedback_forward_relative_error": 0.026663346510184437, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0021928518226127106, "instruction_rms": 0.002192851823067784, "raw_apical_rms": 0.03550177907923658, "teaching_rms": 0.0021928518226127106, "traffic_rms": 0.03541410326784334 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4171884110680821e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618542717085575e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009729103278611475, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 55264, "train_examples": 45000, "train_loss": 0.017914864792426426 }, { "epoch": 158, "eval_accuracy": 0.9136, "eval_loss": 0.4135891052246094, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780815750360489, "mean_feedback_forward_cosine": 0.9996315366343448, "mean_feedback_forward_relative_error": 0.026663127208226604, "min_feedback_forward_cosine": 0.9992879033088684 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002134958372463622, "instruction_rms": 0.0021349583719595688, "raw_apical_rms": 0.03549795898305622, "teaching_rms": 0.002134958372463622, "traffic_rms": 0.03541718881392205 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2411835115244685e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618284934513545e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009742366157895569, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 55616, "train_examples": 45000, "train_loss": 0.01753395065723194 }, { "epoch": 159, "eval_accuracy": 0.9156, "eval_loss": 0.41060625610351564, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780810534954071, "mean_feedback_forward_cosine": 0.9996315680052105, "mean_feedback_forward_relative_error": 0.026662918150817092, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0021345640691926306, "instruction_rms": 0.0021345640694966726, "raw_apical_rms": 0.03549960982866271, "teaching_rms": 0.0021345640691926306, "traffic_rms": 0.035419135821711384 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3708177704074842e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.621017741400353e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009681370527874348, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 55968, "train_examples": 45000, "train_loss": 0.016990253758927185 }, { "epoch": 160, "eval_accuracy": 0.9152, "eval_loss": 0.413508935546875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037808045744895935, "mean_feedback_forward_cosine": 0.9996315523197776, "mean_feedback_forward_relative_error": 0.026662708848322694, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002075748873974312, "instruction_rms": 0.002075748873711616, "raw_apical_rms": 0.035495948403698525, "teaching_rms": 0.002075748873974312, "traffic_rms": 0.03541909665314382 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2328693621554976e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.623219162921405e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009798775898307792, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 56320, "train_examples": 45000, "train_loss": 0.016840938025050694 }, { "epoch": 161, "eval_accuracy": 0.915, "eval_loss": 0.4121825561523437, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780798986554146, "mean_feedback_forward_cosine": 0.9996315774164701, "mean_feedback_forward_relative_error": 0.02666250243782997, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002121357037740998, "instruction_rms": 0.0021213570378834324, "raw_apical_rms": 0.03550143453081703, "teaching_rms": 0.002121357037740998, "traffic_rms": 0.035419878280186855 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2869592502795513e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.617544037746847e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009704877673677476, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 56672, "train_examples": 45000, "train_loss": 0.016971301689743996 }, { "epoch": 162, "eval_accuracy": 0.9142, "eval_loss": 0.41635877685546874, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780794143676758, "mean_feedback_forward_cosine": 0.9996315554568642, "mean_feedback_forward_relative_error": 0.026662287743468033, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001991115441323907, "instruction_rms": 0.001991115442340531, "raw_apical_rms": 0.035491182938576275, "teaching_rms": 0.001991115441323907, "traffic_rms": 0.035420416209033016 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3590495839821415e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619519543498664e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009655481431774027, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 57024, "train_examples": 45000, "train_loss": 0.015489534443534082 }, { "epoch": 163, "eval_accuracy": 0.9138, "eval_loss": 0.4135448547363281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0378078892827034, "mean_feedback_forward_cosine": 0.9996315774164701, "mean_feedback_forward_relative_error": 0.02666207834293968, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020567535253763576, "instruction_rms": 0.0020567535255817935, "raw_apical_rms": 0.035494462825656777, "teaching_rms": 0.0020567535253763576, "traffic_rms": 0.03541904425544074 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2687332962002529e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6184658532040568e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009708826992103438, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 57376, "train_examples": 45000, "train_loss": 0.016186376640366183 }, { "epoch": 164, "eval_accuracy": 0.9144, "eval_loss": 0.415368798828125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780784085392952, "mean_feedback_forward_cosine": 0.999631593101903, "mean_feedback_forward_relative_error": 0.026661876294957965, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019375142163203856, "instruction_rms": 0.0019375142165507645, "raw_apical_rms": 0.035487892708861685, "teaching_rms": 0.0019375142163203856, "traffic_rms": 0.03541944844315403 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.291764029076603e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.61590983006741e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009717712448308678, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 57728, "train_examples": 45000, "train_loss": 0.015254196861386298 }, { "epoch": 165, "eval_accuracy": 0.9132, "eval_loss": 0.4172639404296875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780778497457504, "mean_feedback_forward_cosine": 0.9996315742793837, "mean_feedback_forward_relative_error": 0.026661668364938936, "min_feedback_forward_cosine": 0.9992879033088684 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020433014823095573, "instruction_rms": 0.0020433014818764506, "raw_apical_rms": 0.03549243381270347, "teaching_rms": 0.0020433014823095573, "traffic_rms": 0.03541736025860466 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2993341513833911e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6160578069739604e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009716151742027465, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 58080, "train_examples": 45000, "train_loss": 0.01599680534899235 }, { "epoch": 166, "eval_accuracy": 0.9134, "eval_loss": 0.41902383422851563, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780774399638176, "mean_feedback_forward_cosine": 0.9996315617310373, "mean_feedback_forward_relative_error": 0.02666145984671618, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019939385671762506, "instruction_rms": 0.001993938567715279, "raw_apical_rms": 0.03548806314820587, "teaching_rms": 0.0019939385671762506, "traffic_rms": 0.03541724515608608 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.471319333035126e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618911496952291e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00968140701438848, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 58432, "train_examples": 45000, "train_loss": 0.015350342567927307 }, { "epoch": 167, "eval_accuracy": 0.9138, "eval_loss": 0.42023292236328125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780769556760788, "mean_feedback_forward_cosine": 0.9996315805535567, "mean_feedback_forward_relative_error": 0.02666125147554435, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020467549993294968, "instruction_rms": 0.00204675499844481, "raw_apical_rms": 0.03549362319880884, "teaching_rms": 0.0020467549993294968, "traffic_rms": 0.03541744547909088 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3256748587764378e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6198538364641417e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009709477833559205, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 58784, "train_examples": 45000, "train_loss": 0.016373495394074254 }, { "epoch": 168, "eval_accuracy": 0.9124, "eval_loss": 0.41826709594726563, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037807647138834, "mean_feedback_forward_cosine": 0.9996316056502493, "mean_feedback_forward_relative_error": 0.026661050898071966, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001984984467698352, "instruction_rms": 0.0019849844670150416, "raw_apical_rms": 0.03549006263098476, "teaching_rms": 0.001984984467698352, "traffic_rms": 0.03541851113385414 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2651434566635089e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6169507411084307e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009769807110601119, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 59136, "train_examples": 45000, "train_loss": 0.015453135259283914 }, { "epoch": 169, "eval_accuracy": 0.9138, "eval_loss": 0.4206541809082031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780760243535042, "mean_feedback_forward_cosine": 0.9996315899648165, "mean_feedback_forward_relative_error": 0.026660842232798274, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.00202351260849575, "instruction_rms": 0.002023512608972183, "raw_apical_rms": 0.03549055191927649, "teaching_rms": 0.00202351260849575, "traffic_rms": 0.03541667822482855 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.0796592952999617e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6186895543251947e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009821765196698794, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 59488, "train_examples": 45000, "train_loss": 0.015848362532920306 }, { "epoch": 170, "eval_accuracy": 0.914, "eval_loss": 0.41541182861328124, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780755773186684, "mean_feedback_forward_cosine": 0.9996315962389896, "mean_feedback_forward_relative_error": 0.02666063675362813, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001959811377964408, "instruction_rms": 0.0019598113775032918, "raw_apical_rms": 0.035483915716881025, "teaching_rms": 0.001959811377964408, "traffic_rms": 0.035415321778480946 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3844236868010285e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.615777851086534e-08, "maximum_pre_projection_traffic_rms_ratio": 0.0097210159161736, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 59840, "train_examples": 45000, "train_loss": 0.014944665809389617 }, { "epoch": 171, "eval_accuracy": 0.914, "eval_loss": 0.4189151428222656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780750930309296, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.026660423578792496, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020314639544911626, "instruction_rms": 0.002031463954675679, "raw_apical_rms": 0.03549389696505197, "teaching_rms": 0.0020314639544911626, "traffic_rms": 0.0354194518350967 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3361433737202333e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6189122268711468e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009821385755846523, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 60192, "train_examples": 45000, "train_loss": 0.01616706893179152 }, { "epoch": 172, "eval_accuracy": 0.9142, "eval_loss": 0.41772709350585935, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780745342373848, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.02666021461941694, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020211037602693247, "instruction_rms": 0.0020211037607435027, "raw_apical_rms": 0.03549044453860664, "teaching_rms": 0.0020211037602693247, "traffic_rms": 0.03541693276093822 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.447212927274677e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6164672638921847e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009711404564543315, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 60544, "train_examples": 45000, "train_loss": 0.015749647364185916 }, { "epoch": 173, "eval_accuracy": 0.9138, "eval_loss": 0.42026092529296877, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0378074124455452, "mean_feedback_forward_cosine": 0.9996316181985956, "mean_feedback_forward_relative_error": 0.026660006640380936, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020449684581992575, "instruction_rms": 0.0020449684588546573, "raw_apical_rms": 0.03549233281750145, "teaching_rms": 0.0020449684581992575, "traffic_rms": 0.0354157516906314 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2915743141661551e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6188593762277255e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009791714520651178, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 60896, "train_examples": 45000, "train_loss": 0.01570732250975238 }, { "epoch": 174, "eval_accuracy": 0.913, "eval_loss": 0.41367199096679685, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037807367742061615, "mean_feedback_forward_cosine": 0.9996316213356821, "mean_feedback_forward_relative_error": 0.026659800229888213, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001886148273150442, "instruction_rms": 0.0018861482728113074, "raw_apical_rms": 0.03548341077420893, "teaching_rms": 0.001886148273150442, "traffic_rms": 0.03541795860143163 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2818100358913398e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619612116302527e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009807925893813902, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 61248, "train_examples": 45000, "train_loss": 0.014504380411075221 }, { "epoch": 175, "eval_accuracy": 0.9138, "eval_loss": 0.42116400146484373, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037807315587997437, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.02665959636827833, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001891071507064046, "instruction_rms": 0.0018910715072027106, "raw_apical_rms": 0.03548437812515092, "teaching_rms": 0.001891071507064046, "traffic_rms": 0.03541960000244503 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4794984792843024e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6202480277822806e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009742782585969964, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 61600, "train_examples": 45000, "train_loss": 0.014262648306621446 }, { "epoch": 176, "eval_accuracy": 0.9146, "eval_loss": 0.41923724975585935, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780727460980415, "mean_feedback_forward_cosine": 0.9996316025131627, "mean_feedback_forward_relative_error": 0.026659388095140457, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001960660959632219, "instruction_rms": 0.0019606609598975095, "raw_apical_rms": 0.03548896812625248, "teaching_rms": 0.001960660959632219, "traffic_rms": 0.035419966616758204 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.383726022652354e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6176810175820067e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009748636295267578, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 61952, "train_examples": 45000, "train_loss": 0.014850295876794392 }, { "epoch": 177, "eval_accuracy": 0.9146, "eval_loss": 0.42256874389648436, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037807222455739975, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.026659192125263968, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018412803620673794, "instruction_rms": 0.0018412803619506646, "raw_apical_rms": 0.035484063996722395, "teaching_rms": 0.0018412803620673794, "traffic_rms": 0.03542176508889632 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4235107315130335e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6168921716787525e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009706403903176812, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 62304, "train_examples": 45000, "train_loss": 0.013851795967751079 }, { "epoch": 178, "eval_accuracy": 0.9146, "eval_loss": 0.42203513793945313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780717775225639, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.026658983509007254, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001962376031336217, "instruction_rms": 0.001962376031402494, "raw_apical_rms": 0.035488060418281044, "teaching_rms": 0.001962376031336217, "traffic_rms": 0.035417335802325374 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2479540068000006e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619737439999005e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00975698656244246, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 62656, "train_examples": 45000, "train_loss": 0.01524298331340154 }, { "epoch": 179, "eval_accuracy": 0.9148, "eval_loss": 0.41612083740234374, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037807125598192215, "mean_feedback_forward_cosine": 0.999631615061509, "mean_feedback_forward_relative_error": 0.026658773275190277, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002171803203326694, "instruction_rms": 0.002171803203451999, "raw_apical_rms": 0.03549754966817121, "teaching_rms": 0.002171803203326694, "traffic_rms": 0.03541387145940637 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3130986076248519e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6186041789509365e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009808782243198215, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 63008, "train_examples": 45000, "train_loss": 0.016495510240230295 }, { "epoch": 180, "eval_accuracy": 0.9144, "eval_loss": 0.4196902770996094, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780708089470863, "mean_feedback_forward_cosine": 0.9996316087873358, "mean_feedback_forward_relative_error": 0.026658564217780765, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018914864539903626, "instruction_rms": 0.0018914864538349249, "raw_apical_rms": 0.035480294072998284, "teaching_rms": 0.0018914864539903626, "traffic_rms": 0.035413231681480466 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3206939541987595e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6179269646261458e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009765187053182557, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 63360, "train_examples": 45000, "train_loss": 0.014542664614982076 }, { "epoch": 181, "eval_accuracy": 0.9144, "eval_loss": 0.41798706665039065, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780703619122505, "mean_feedback_forward_cosine": 0.9996316307469418, "mean_feedback_forward_relative_error": 0.026658367659700543, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019398865705368001, "instruction_rms": 0.0019398865698302828, "raw_apical_rms": 0.03548393447367662, "teaching_rms": 0.0019398865705368001, "traffic_rms": 0.035415769575345556 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.1239237096560828e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6171983030625008e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009820256248368584, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 63712, "train_examples": 45000, "train_loss": 0.014637808668613434 }, { "epoch": 182, "eval_accuracy": 0.9142, "eval_loss": 0.42433768920898435, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806980311870575, "mean_feedback_forward_cosine": 0.9996316244727687, "mean_feedback_forward_relative_error": 0.026658172621146628, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019189778150392788, "instruction_rms": 0.0019189778147332775, "raw_apical_rms": 0.03548243117479171, "teaching_rms": 0.0019189778150392788, "traffic_rms": 0.03541347583140527 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.5036496492371043e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6171335935078734e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009778777356824414, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 64064, "train_examples": 45000, "train_loss": 0.015194662693805166 }, { "epoch": 183, "eval_accuracy": 0.9132, "eval_loss": 0.42002318115234377, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0378069207072258, "mean_feedback_forward_cosine": 0.9996316087873358, "mean_feedback_forward_relative_error": 0.02665796532834831, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020331055821016237, "instruction_rms": 0.0020331055826984887, "raw_apical_rms": 0.03548177099625021, "teaching_rms": 0.0020331055821016237, "traffic_rms": 0.03540610143311877 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.3314930491503674e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6171520037725326e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009748853273521037, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 64416, "train_examples": 45000, "train_loss": 0.015491151970624924 }, { "epoch": 184, "eval_accuracy": 0.9136, "eval_loss": 0.4230053771972656, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780688717961311, "mean_feedback_forward_cosine": 0.9996316213356821, "mean_feedback_forward_relative_error": 0.02665776131968749, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018688744556348029, "instruction_rms": 0.0018688744559231128, "raw_apical_rms": 0.03547066975577514, "teaching_rms": 0.0018688744556348029, "traffic_rms": 0.03540849608681272 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2078251288016872e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6177227780445252e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00972546943895346, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 64768, "train_examples": 45000, "train_loss": 0.013875001421405209 }, { "epoch": 185, "eval_accuracy": 0.9142, "eval_loss": 0.4274574951171875, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780684992671013, "mean_feedback_forward_cosine": 0.9996316370211149, "mean_feedback_forward_relative_error": 0.026657556477738053, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018596682569046118, "instruction_rms": 0.0018596682571716025, "raw_apical_rms": 0.03547805138678572, "teaching_rms": 0.0018596682569046118, "traffic_rms": 0.035413795228133545 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2427649132007446e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619894433203317e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009703887064664369, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 65120, "train_examples": 45000, "train_loss": 0.014032311059700119 }, { "epoch": 186, "eval_accuracy": 0.9132, "eval_loss": 0.42395435791015623, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806812673807144, "mean_feedback_forward_cosine": 0.9996316307469418, "mean_feedback_forward_relative_error": 0.02665735756684291, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018347543847815131, "instruction_rms": 0.001834754385007048, "raw_apical_rms": 0.03546985095177895, "teaching_rms": 0.0018347543847815131, "traffic_rms": 0.03540835359612842 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4097837564008842e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6180625176744536e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009759561785606016, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 65472, "train_examples": 45000, "train_loss": 0.013660452849997414 }, { "epoch": 187, "eval_accuracy": 0.914, "eval_loss": 0.42424832153320313, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780675679445267, "mean_feedback_forward_cosine": 0.9996316244727687, "mean_feedback_forward_relative_error": 0.026657164488968096, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.002006498395177536, "instruction_rms": 0.0020064983952284275, "raw_apical_rms": 0.03548441304733765, "teaching_rms": 0.002006498395177536, "traffic_rms": 0.03540871518407568 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3115205810265707e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6189264360511836e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009766192089174008, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 65824, "train_examples": 45000, "train_loss": 0.015087417976723777 }, { "epoch": 188, "eval_accuracy": 0.913, "eval_loss": 0.4244384094238281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780670836567879, "mean_feedback_forward_cosine": 0.9996316213356821, "mean_feedback_forward_relative_error": 0.026656959696035636, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019518414181727644, "instruction_rms": 0.00195184141939903, "raw_apical_rms": 0.0354842783765005, "teaching_rms": 0.0019518414181727644, "traffic_rms": 0.03541406576694399 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2689654660391625e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6187451529159547e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00966205666092081, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 66176, "train_examples": 45000, "train_loss": 0.014488841858175066 }, { "epoch": 189, "eval_accuracy": 0.9128, "eval_loss": 0.42518949584960936, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780665621161461, "mean_feedback_forward_cosine": 0.9996316401582015, "mean_feedback_forward_relative_error": 0.026656765343719406, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019539568888954336, "instruction_rms": 0.0019539568878578707, "raw_apical_rms": 0.03548744358893964, "teaching_rms": 0.0019539568888954336, "traffic_rms": 0.03541403026304128 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3715903968147813e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6187100559918243e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009720175671811639, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 66528, "train_examples": 45000, "train_loss": 0.015103299892942111 }, { "epoch": 190, "eval_accuracy": 0.912, "eval_loss": 0.4249855224609375, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806615233421326, "mean_feedback_forward_cosine": 0.9996316338840284, "mean_feedback_forward_relative_error": 0.026656565746586574, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019031509788945931, "instruction_rms": 0.001903150978429193, "raw_apical_rms": 0.03548138778264967, "teaching_rms": 0.0019031509788945931, "traffic_rms": 0.03541441407733898 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.3956911182333442e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6212568066008135e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009812432448323301, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 66880, "train_examples": 45000, "train_loss": 0.014304727699855963 }, { "epoch": 191, "eval_accuracy": 0.913, "eval_loss": 0.4252706420898438, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780658170580864, "mean_feedback_forward_cosine": 0.9996316558436343, "mean_feedback_forward_relative_error": 0.026656368796370532, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018229452660776897, "instruction_rms": 0.0018229452649682286, "raw_apical_rms": 0.035472715103697164, "teaching_rms": 0.0018229452660776897, "traffic_rms": 0.03541313239646838 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4061011910371235e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6228162384022934e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009659836963272264, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 67232, "train_examples": 45000, "train_loss": 0.013309210489193599 }, { "epoch": 192, "eval_accuracy": 0.9136, "eval_loss": 0.4258235900878906, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780653327703476, "mean_feedback_forward_cosine": 0.9996316558436343, "mean_feedback_forward_relative_error": 0.026656166650354862, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0018731226617284761, "instruction_rms": 0.0018731226609877986, "raw_apical_rms": 0.03547900176202172, "teaching_rms": 0.0018731226617284761, "traffic_rms": 0.03541178669681627 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4582523633066558e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619988173584462e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009646573340541543, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 67584, "train_examples": 45000, "train_loss": 0.013877916736486886 }, { "epoch": 193, "eval_accuracy": 0.9122, "eval_loss": 0.4229419250488281, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780648484826088, "mean_feedback_forward_cosine": 0.9996316370211149, "mean_feedback_forward_relative_error": 0.026655971023597215, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019435254211202456, "instruction_rms": 0.0019435254209826719, "raw_apical_rms": 0.035481766034522494, "teaching_rms": 0.0019435254211202456, "traffic_rms": 0.03541070988285963 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4557861582886744e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6205606463700388e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00970974169740098, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 67936, "train_examples": 45000, "train_loss": 0.01430190967188941 }, { "epoch": 194, "eval_accuracy": 0.9126, "eval_loss": 0.4232492980957031, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.0378064326941967, "mean_feedback_forward_cosine": 0.9996316464323747, "mean_feedback_forward_relative_error": 0.026655769269717366, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020056041251614136, "instruction_rms": 0.002005604125471447, "raw_apical_rms": 0.03548394231694213, "teaching_rms": 0.0020056041251614136, "traffic_rms": 0.03540891461726112 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2684434835819047e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.618433978649905e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009615365573339791, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 68288, "train_examples": 45000, "train_loss": 0.014883263099855847 }, { "epoch": 195, "eval_accuracy": 0.9136, "eval_loss": 0.42721522216796876, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806395441293716, "mean_feedback_forward_cosine": 0.9996316527065477, "mean_feedback_forward_relative_error": 0.0266555695255336, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.00193867040984838, "instruction_rms": 0.0019386704093032282, "raw_apical_rms": 0.03547711030343143, "teaching_rms": 0.00193867040984838, "traffic_rms": 0.03540596497952997 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.2688057715593004e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.619342135782023e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009858859734747524, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 68640, "train_examples": 45000, "train_loss": 0.014291609461274411 }, { "epoch": 196, "eval_accuracy": 0.9138, "eval_loss": 0.42337653198242187, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780634328722954, "mean_feedback_forward_cosine": 0.9996316589807209, "mean_feedback_forward_relative_error": 0.026655367134433044, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0020019146099371065, "instruction_rms": 0.002001914610000151, "raw_apical_rms": 0.03547915490680592, "teaching_rms": 0.0020019146099371065, "traffic_rms": 0.035404544313311116 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.4446251306310387e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.622310184832768e-08, "maximum_pre_projection_traffic_rms_ratio": 0.00974169248560291, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 68992, "train_examples": 45000, "train_loss": 0.015002086046669218 }, { "epoch": 197, "eval_accuracy": 0.9132, "eval_loss": 0.42314592895507813, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780629485845566, "mean_feedback_forward_cosine": 0.9996316558436343, "mean_feedback_forward_relative_error": 0.02665516979208118, "min_feedback_forward_cosine": 0.999288022518158 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019091024603237609, "instruction_rms": 0.0019091024594505403, "raw_apical_rms": 0.03546936178603817, "teaching_rms": 0.0019091024603237609, "traffic_rms": 0.03540039946082456 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.174481578658515e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.61961026386494e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009675740384794889, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 69344, "train_examples": 45000, "train_loss": 0.014087256733576456 }, { "epoch": 198, "eval_accuracy": 0.9138, "eval_loss": 0.4227126831054687, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.03780624642968178, "mean_feedback_forward_cosine": 0.9996316621178075, "mean_feedback_forward_relative_error": 0.026654975586815885, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019059753502149801, "instruction_rms": 0.0019059753496980464, "raw_apical_rms": 0.035465963658777015, "teaching_rms": 0.0019059753502149801, "traffic_rms": 0.03539591078722619 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.2380260372424345e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6286669231052677e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009671483722060802, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 69696, "train_examples": 45000, "train_loss": 0.01432547069489956 }, { "epoch": 199, "eval_accuracy": 0.9114, "eval_loss": 0.4212016235351563, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806201726198196, "mean_feedback_forward_cosine": 0.9996316621178075, "mean_feedback_forward_relative_error": 0.02665476863713641, "min_feedback_forward_cosine": 0.9992880821228027 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.0019068836071506673, "instruction_rms": 0.0019068836076270475, "raw_apical_rms": 0.03546137798021448, "teaching_rms": 0.0019068836071506673, "traffic_rms": 0.035395210269209734 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110409900546074, "maximum_absolute_post_projection_soma_slope": 1.6277230230343775e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6185724249417297e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009620592725691523, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 70048, "train_examples": 45000, "train_loss": 0.013825085100448794 }, { "epoch": 200, "eval_accuracy": 0.9132, "eval_loss": 0.4233872314453125, "eval_split": "validation", "feedback_tracking": { "max_feedback_forward_relative_error": 0.037806157022714615, "mean_feedback_forward_cosine": 0.9996316621178075, "mean_feedback_forward_relative_error": 0.026654567569494247, "min_feedback_forward_cosine": 0.9992879629135132 }, "lr": 0.0010000000000000002, "mixed_apical": { "innovation_rms": 0.001971850176861854, "instruction_rms": 0.0019718501772984765, "raw_apical_rms": 0.035469325266448755, "teaching_rms": 0.001971850176861854, "traffic_rms": 0.03539758458336501 }, "neutral_projection": { "instruction_observations": 0, "maximum_absolute_correction_slope": 0.03110410086810589, "maximum_absolute_post_projection_soma_slope": 1.1857881787591396e-08, "maximum_observations": 128, "maximum_post_projection_traffic_rms_ratio": 2.6222237096517437e-08, "maximum_pre_projection_traffic_rms_ratio": 0.009666236036098026, "minimum_observations": 72 }, "output_lr": 0.0010000000000000002, "step": 70400, "train_examples": 45000, "train_loss": 0.014849238505380022 } ], "evaluation_protocol": { "test_evaluations": 0, "test_used_for_selection": false, "validation_evaluations": 201 }, "final": { "accuracy": 0.9132, "epoch": 200, "evaluation_split": "validation", "finite": true, "loss": 0.4233872314453125, "step": 70400 }, "hardware": { "cuda_device_name": "NVIDIA RTX A6000", "cuda_visible_devices": "0", "device": "cuda", "device_total_memory_bytes": 50896568320, "peak_memory_allocated_bytes": 2013018112, "peak_memory_reserved_bytes": 2774532096, "torch_version": "2.3.1+cu118" }, "predictor_warmup": { "closed_form_fit": { "max_absolute_residual_soma_slope": 1.6958033199898637e-08, "max_applied_stability_margin": 0.0, "max_positive_residual_soma_slope": 1.6958033199898637e-08, "min_residual_soma_slope": -1.5074077097665395e-08, "mse": 1.4716528582992302e-18, "observations": 64, "residual_traffic_rms_ratio": 7.197853883807226e-08, "stability_margin": 0.0 }, "examples": 64, "instruction_present": false, "mode": "closed_form", "post_warmup_traffic_residual_rms_ratio": 7.197853883807226e-08, "reuses_traffic_calibration_forward": true, "steps": 1, "task_loader_state_restored": true }, "protocol_family": "oral_a_cifar_local_resnet_development", "provenance": { "git_commit": "f55872beaee658ff76ac15fd421b73017820c320", "git_tracked_dirty": false }, "schema_version": 1, "split": { "cifar_source_files": [ { "bytes": 31035704, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/data_batch_1", "sha256": "54636561a3ce25bd3e19253c6b0d8538147b0ae398331ac4a2d86c6d987368cd" }, { "bytes": 31035320, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/data_batch_2", "sha256": "766b2cef9fbc745cf056b3152224f7cf77163b330ea9a15f9392beb8b89bc5a8" }, { "bytes": 31035999, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/data_batch_3", "sha256": "0f00d98ebfb30b3ec0ad19f9756dc2630b89003e10525f5e148445e82aa6a1f9" }, { "bytes": 31035696, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/data_batch_4", "sha256": "3f7bb240661948b8f4d53e36ec720d8306f5668bd0071dcb4e6c947f78e9682b" }, { "bytes": 31035623, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/data_batch_5", "sha256": "d91802434d8376bbaeeadf58a737e3a1b12ac839077e931237e0dcd43adcb154" }, { "bytes": 31035526, "path": "/orion/u/oscarwan/scratch/sdil-data/cifar-10-batches-py/test_batch", "sha256": "f53d8d457504f7cff4ea9e021afcf0e0ad8e24a91f3fc42091b8adef61157831" } ], "dataset": "cifar10", "evaluation_split": "validation", "input_layout": "NCHW", "input_shape": [ 3, 32, 32 ], "loader_seed": 0, "normalization_mean": [ 0.49140000343322754, 0.4821999967098236, 0.4465000033378601 ], "normalization_std": [ 0.24699999392032623, 0.2434999942779541, 0.26159998774528503 ], "split_from_training_only": true, "split_seed": 2027, "test_examples": 10000, "train_examples": 45000, "training_augmentation": "random_crop_32_padding_4_zero_then_horizontal_flip_p0.5", "validation_class_counts": { "0": 500, "1": 500, "2": 500, "3": 500, "4": 500, "5": 500, "6": 500, "7": 500, "8": 500, "9": 500 }, "validation_examples": 5000, "validation_index_sha256": "8328b206a97c420e49e54e3eca4abe3274c4756b084355784ea3fb8059e4515b" }, "timing": { "apical_warmup_wall_s": 0.0, "evaluation_wall_s": 21.13534927368164, "mirror_warmup_wall_s": 0.0, "predictor_warmup_wall_s": 0.024861574172973633, "timing_excludes_data_loading_hashing_and_model_construction": true, "total_timed_wall_s": 3003.0224483013153, "train_wall_s": 2980.52508187294 }, "traffic_calibration": { "data_source": "first unaugmented development-training examples", "examples": 64, "instruction_rms": [ 0.008468643762171268, 0.006615260150283575, 0.003986957482993603, 0.004385664593428373, 0.0027129307854920626, 0.0031575150787830353, 0.002003862289711833, 0.0037573478184640408, 0.0027080816216766834, 0.0030197801534086466, 0.0020560885313898325, 0.0023898854851722717, 0.0016841775504872203, 0.0034015050623565912, 0.0025495023000985384, 0.003054187633097172, 0.0020917924121022224, 0.002605562563985586, 0.001891607535071671 ], "realized_traffic_instruction_rms_ratio": [ 4.000000476837158, 4.0, 4.0, 4.0, 4.0, 4.000000476837158, 4.000000476837158, 4.0, 4.0, 4.000000476837158, 4.0, 4.0, 4.000000476837158, 4.0, 3.999999523162842, 4.000000476837158, 4.0, 4.0, 4.000000476837158 ], "target_ratio": 4.0, "traffic_gain": [ 0.04418104141950607, 0.03573717549443245, 0.013813067227602005, 0.022754332050681114, 0.00723816454410553, 0.01724369451403618, 0.004617006052285433, 0.020357992500066757, 0.007312532514333725, 0.01600862480700016, 0.004682047292590141, 0.012491599656641483, 0.00330126890912652, 0.017684802412986755, 0.006067128852009773, 0.016301598399877548, 0.004425332881510258, 0.013932524248957634, 0.0035721727181226015 ], "unscaled_traffic_rms": [ 0.7667219638824463, 0.7404345870018005, 1.1545466184616089, 0.7709590792655945, 1.499236822128296, 0.7324451804161072, 1.7360707521438599, 0.7382550835609436, 1.4813371896743774, 0.7545382976531982, 1.7565721273422241, 0.765277624130249, 2.040642738342285, 0.7693622708320618, 1.6808624267578125, 0.7494204044342041, 1.890743613243103, 0.7480518221855164, 2.118159055709839 ], "uses_validation_endpoint": false }, "work": { "apical_macs_per_example": 40108672, "causal_scalar_observations": 0, "components": { "apical_projection_macs": 360980614955008, "apical_regression_macs": 0, "bp_reverse_macs_estimate": 0, "kp_reciprocal_correlation_macs": 360978048000000, "local_weight_correlation_macs": 364959360000000, "mirror_feedback_prediction_macs": 0, "mirror_local_correlation_macs": 0, "mirror_response_macs": 0, "ordinary_forward_macs": 364959360000000, "perturbation_forward_macs": 0, "warmup_clean_forward_macs": 2595266560 }, "definition": "multiply-accumulates in conv/linear maps; one local weight correlation equals one forward-weight MAC count; BP reverse is estimated as one weight-gradient plus one activation-gradient convolution per forward convolution; mixed-traffic/predictor elementwise arithmetic is reported as a conservative operation estimate separately and is not folded into MACs", "elementwise_operations_estimate": 40698241875968, "forward_macs_per_example": 40551040, "logical_batch_loss_queries": 0, "mirror_probe_examples": 0, "mirror_readout_probe_examples": 0, "neutral_projection_observations": 9000000, "per_example_cross_entropy_terms": 0, "total_clean_forward_examples": 9000064, "total_forward_equivalent_examples": 9000064, "total_macs_estimate": 1451879978221568 } }