{"id":"W2096573823","doi":"10.5194/we-10-23-2010","title":"Judging the quality of our research: a self-assessment test","year":2010,"lang":"en","type":"article","venue":"Web Ecology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"York University; Queen's University","funders":"National Science Foundation","keywords":"Test (biology); Quality (philosophy); Psychology; Biology; Ecology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":["metaresearch","insufficient_payload"],"category_scores_codex":[0.3531699,0.0001164962,0.001749318,0.0002692651,0.0002408339,0.0002145085,0.002183431,0.0001024075,0.00590907],"category_scores_gemma":[0.07204071,0.00004561935,0.0006485133,0.001070646,0.00009636059,0.00006697652,0.0003168454,0.0005020331,0.002215046],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002825371,"about_ca_system_score_gemma":0.0003483438,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003085393,"about_ca_topic_score_gemma":0.00204266,"domain_scores_codex":[0.9646301,0.02340099,0.006558287,0.0007192809,0.004289977,0.0004014162],"domain_scores_gemma":[0.954983,0.03408542,0.003499689,0.005068567,0.002231205,0.0001321169],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000001726105,0.0001969218,0.8718024,0.00002662136,0.0001018645,0.000002356607,0.000432243,0.000004521664,0.00711258,0.03145581,0.08625551,0.002607465],"study_design_scores_gemma":[0.0001635686,0.00007001726,0.8585858,0.000002948017,0.00004776387,0.000007067244,0.002252745,0.003810267,0.00005309505,0.01354618,0.1213831,0.00007744121],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9632021,0.00002832493,0.0001538585,0.01052013,0.0005649378,0.000537623,0.000007482307,0.000004975594,0.02498054],"genre_scores_gemma":[0.9932909,0.000005446575,0.00360817,0.0002094142,0.000103414,0.00005544944,6.601384e-7,0.000004654986,0.002721893],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2811292,"threshold_uncertainty_score":0.9985619,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8565971464854185,"score_gpt":0.6560180743454863,"score_spread":0.2005790721399322,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}