{"id":"W7019783098","doi":"","title":"Identifying and evaluating access-limited data sources in Canada: Recommendations for improving data discovery","year":2022,"lang":"en","type":"other","venue":"OSF Preprints (OSF Preprints)","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"","funders":"","keywords":"Data collection; Identification (biology); Knowledge extraction; Data quality; Key (lock)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.04787754,0.001596769,0.002009826,0.0246135,0.009953235,0.02464667,0.008781296,0.002887242,0.02347741],"category_scores_gemma":[0.3046411,0.00118392,0.002027215,0.03703349,0.005131211,0.01355661,0.008743343,0.003450053,0.006320396],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.08416384,"about_ca_system_score_gemma":0.3930793,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.9892536,"about_ca_topic_score_gemma":0.9891823,"domain_scores_codex":[0.9699507,0.005401245,0.004315819,0.002622892,0.01317175,0.004537538],"domain_scores_gemma":[0.6503274,0.0872721,0.01512106,0.02293686,0.2054083,0.01893429],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000451327,0.0002768801,0.1740539,0.00241467,0.000285845,0.0004025498,0.005385066,0.004686571,0.001707897,0.03718941,0.5475824,0.2255635],"study_design_scores_gemma":[0.0004726692,0.00008624634,0.17438,0.009775643,0.0007698945,0.000313589,0.03803829,0.03267719,0.01244491,0.06751431,0.6627727,0.0007546205],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"methods","genre_scores_codex":[0.09414097,0.01166667,0.1084173,0.2630166,0.001761112,0.008077249,0.3218081,0.01352965,0.1775824],"genre_scores_gemma":[0.2936968,0.01019978,0.4676868,0.01481005,0.0003338468,0.002786642,0.1541749,0.003502174,0.05280896],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9912187,"threshold_uncertainty_score":0.6106543,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1404870723661932,"score_gpt":0.3750732874810861,"score_spread":0.2345862151148929,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}