{"id":"W4399202112","doi":"10.1371/journal.pcbi.1011145","title":"How well do models of visual cortex generalize to out of distribution samples?","year":2024,"lang":"en","type":"article","venue":"PLoS Computational Biology","topic":"Neural dynamics and brain function","field":"Neuroscience","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada; Compute Canada","keywords":"Artificial intelligence; Computer science; Visual cortex; Generalization; Artificial neural network; Cognitive neuroscience of visual object recognition; Robustness (evolution); Machine learning; Stimulus (psychology); Pattern recognition (psychology); Neuroscience; Object (grammar); Psychology; Biology; Cognitive psychology; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00005762654,0.00008755299,0.0001538589,0.0000814766,0.00003201214,0.00002528041,0.00009647085,0.00005268614,0.00002061482],"category_scores_gemma":[0.0001089225,0.00007468763,0.00006009191,0.0001975555,0.00008579784,0.00007957508,0.00005675258,0.0000632943,0.00001678835],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002591306,"about_ca_system_score_gemma":0.00003693272,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000006595305,"about_ca_topic_score_gemma":0.000001691939,"domain_scores_codex":[0.9991648,0.00007557667,0.0001990429,0.0002965321,0.0001404281,0.0001235817],"domain_scores_gemma":[0.9993714,0.0003700438,0.00006682856,0.00006507082,0.00008604561,0.00004062869],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000407035,0.00008880322,0.0001341517,0.00004062677,0.00001380097,0.000002095834,0.00004112664,0.02366784,0.7652336,0.2086422,0.0003309769,0.00176404],"study_design_scores_gemma":[0.0001751058,0.0005050591,0.001331834,0.00003148079,0.00001632187,0.000007537082,0.000008906091,0.8459327,0.05144209,0.09871997,0.001692075,0.000136901],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8016742,0.00003270769,0.195998,0.0009031812,0.0004760881,0.0001551283,0.0006102967,0.00003904436,0.0001113574],"genre_scores_gemma":[0.998675,0.000009310838,0.0006208613,0.0002116949,0.00006651042,0.000008140468,0.0003028036,0.000007716184,0.00009796386],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8222649,"threshold_uncertainty_score":0.3045673,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05793667048320408,"score_gpt":0.2971334464871979,"score_spread":0.2391967760039938,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}