{"id":"W4386528130","doi":"10.5281/zenodo.8322584","title":"Tracing data: A survey investigating disciplinary differences in data citation","year":2023,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; University of Ottawa","funders":"","keywords":"Citation; Tracing; Discipline; Computer science; Survey data collection; Data science; Library science; Statistics; Programming language; Sociology; Mathematics; Social science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.04061208,0.0001989971,0.0007455816,0.01399847,0.001276365,0.003363101,0.0009335828,0.001037262,0.001377915],"category_scores_gemma":[0.1644937,0.000381263,0.0005371768,0.02717948,0.001392171,0.004640168,0.002701663,0.0008611042,0.0005831834],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001666629,"about_ca_system_score_gemma":0.002394,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003203916,"about_ca_topic_score_gemma":0.003723024,"domain_scores_codex":[0.967993,0.01374697,0.006847454,0.00251999,0.007812279,0.001080295],"domain_scores_gemma":[0.6673912,0.2306551,0.05250983,0.01144117,0.03297007,0.005032633],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00009441331,0.0000870851,0.8748417,0.001110875,0.000135509,0.0001427765,0.03854747,0.0001395337,0.0007218668,0.001398338,0.002006095,0.0807743],"study_design_scores_gemma":[0.00001856554,0.0001964397,0.8697653,0.001135823,0.0001044774,0.0009533075,0.08829784,0.0007889379,0.0009689233,0.002205704,0.03547542,0.00008922313],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9865655,0.004165524,0.002180138,0.001802482,0.00002915447,0.00008201878,0.001651373,0.00003254511,0.003491164],"genre_scores_gemma":[0.990541,0.004104063,0.002336619,0.0004733533,0.00004274218,0.0001602177,0.001516339,0.00004052375,0.0007850644],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9860016,"threshold_uncertainty_score":0.2147798,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6841979718495724,"score_gpt":0.4488876378466068,"score_spread":0.2353103340029656,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}