{"id":"W3210268695","doi":"10.1136/oem-2021-epi.361","title":"RF-4 Inter-rater reliability of occupational exposure assessment in a case-control study","year":2021,"lang":"en","type":"article","venue":"","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre Hospitalier de l’Université de Montréal","funders":"","keywords":"Concordance; Checklist; Cohen's kappa; Coding (social sciences); Statistic; Inter-rater reliability; Population; Reliability (semiconductor); Statistics; Applied psychology; Medicine; Computer science; Psychology; Environmental health; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01134145,0.0001492103,0.0004259869,0.0001517112,0.0000654305,0.0001235942,0.00037535,0.00006225322,0.005835085],"category_scores_gemma":[0.002791777,0.00009870419,0.0001462469,0.000677829,0.00006728837,0.0002662268,0.0001607151,0.0002102314,0.00004240967],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000123008,"about_ca_system_score_gemma":0.0003013248,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001889012,"about_ca_topic_score_gemma":0.0024891,"domain_scores_codex":[0.9946785,0.001016213,0.001482896,0.0006841139,0.001926086,0.0002122018],"domain_scores_gemma":[0.9960924,0.00148518,0.0002039858,0.001016196,0.001128444,0.00007380145],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00008470369,0.001928534,0.9907882,0.000007302253,0.00001691117,0.0002085885,0.0006325505,0.0008097134,0.0005955381,0.000120927,0.0005658609,0.004241162],"study_design_scores_gemma":[0.001652277,0.0003784329,0.9837675,0.00001392217,0.00001600975,0.00002141078,0.00903772,0.001034415,0.0004905713,0.003056856,0.0004091141,0.0001217655],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9858213,0.00002245468,0.009622331,0.001063112,0.0003299336,0.000629264,0.00003019948,0.00001192053,0.002469494],"genre_scores_gemma":[0.9973767,9.468433e-7,0.001538074,0.0002205631,0.00002943281,0.00005433907,0.00000173477,0.000004069489,0.0007740726],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01155548,"threshold_uncertainty_score":0.9950737,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1460119491268043,"score_gpt":0.4238998104811826,"score_spread":0.2778878613543783,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}