{"id":"W4390519133","doi":"10.21203/rs.3.rs-3800842/v1","title":"Synthetic data reliably reproduces brain tumor primary research data","year":2024,"lang":"en","type":"preprint","venue":"Research Square","topic":"Glioma Diagnosis and Treatment","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"McGill University Health Centre; McGill University","keywords":"Context (archaeology); Synthetic data; Computer science; Reliability (semiconductor); Confidentiality; Similarity (geometry); Data mining; Medicine; Data science; Artificial intelligence; Machine learning; Biology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01813551,0.00070678,0.0006002832,0.002317085,0.0004735527,0.002467037,0.001333566,0.001177395,0.002180114],"category_scores_gemma":[0.0795409,0.0003515165,0.001380702,0.002551298,0.001175136,0.00114863,0.00155391,0.00103188,0.0008718955],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001297731,"about_ca_system_score_gemma":0.0019183,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003520194,"about_ca_topic_score_gemma":0.002932493,"domain_scores_codex":[0.9916691,0.005153667,0.0008105016,0.001259692,0.0009041203,0.0002029679],"domain_scores_gemma":[0.9259766,0.05264334,0.003830469,0.01093023,0.005959034,0.0006603382],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00305261,0.0009175122,0.2015698,0.002582388,0.001332696,0.001122699,0.00126641,0.5960303,0.006576722,0.02029206,0.03701381,0.128243],"study_design_scores_gemma":[0.0004381006,0.001104166,0.05546057,0.0008157787,0.0004349227,0.001315758,0.001360043,0.8033539,0.01148767,0.06421604,0.05980559,0.0002074171],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6408395,0.003530044,0.2471772,0.005023946,0.001252716,0.00151884,0.0886798,0.002272576,0.009705428],"genre_scores_gemma":[0.8460832,0.0007563368,0.08433815,0.0006415193,0.0001745369,0.001052832,0.06584477,0.000154416,0.0009543526],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9818645,"threshold_uncertainty_score":0.09591085,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3068039846815974,"score_gpt":0.5055125862142779,"score_spread":0.1987086015326804,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}