{"id":"W4289937451","doi":"10.21203/rs.3.rs-1882716/v1","title":"Bias Reduction in Representation of Histopathology Images Using Deep Feature Selection","year":2022,"lang":"en","type":"preprint","venue":"Research Square","topic":"AI in cancer detection","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; Ontario Tech University","funders":"","keywords":"Computer science; Artificial intelligence; Generalization; Pattern recognition (psychology); Selection bias; Feature extraction; Feature selection; Feature (linguistics); Representation (politics); Data mining; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001130949,0.0006124055,0.0005486764,0.0008370071,0.0001976337,0.0005404168,0.0006040006,0.0004660422,0.0006184157],"category_scores_gemma":[0.002042609,0.0001909229,0.00062349,0.000638801,0.0002609106,0.0005575925,0.0007031149,0.0005539596,0.0002042193],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004717993,"about_ca_system_score_gemma":0.0006666397,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002722039,"about_ca_topic_score_gemma":0.002753876,"domain_scores_codex":[0.9995639,0.00009644674,0.00003274249,0.00009122986,0.0001365266,0.00007914306],"domain_scores_gemma":[0.9992985,0.0002112676,0.0001146886,0.0001075195,0.0002425766,0.00002545389],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003559114,0.0001683212,0.01025985,0.0001031411,0.0001513774,0.0002256691,0.0001048476,0.3035014,0.07070725,0.00190234,0.002771621,0.6097482],"study_design_scores_gemma":[0.000006724276,0.00004873289,0.00215011,0.00000642842,0.00001683362,0.00004215908,0.00001433784,0.9813346,0.01525928,0.0007411337,0.0003720323,0.000007727578],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.251464,0.0004332008,0.7454006,0.0002748687,0.00006237309,0.00007935867,0.0001841174,0.001294955,0.0008065106],"genre_scores_gemma":[0.8798719,0.0001326003,0.1183355,0.00011055,0.00002978162,0.00005742584,0.0003994117,0.00005646171,0.00100642],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002722039,"threshold_uncertainty_score":0.005981147,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1385631995075036,"score_gpt":0.437929365569947,"score_spread":0.2993661660624434,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}