{"id":"W4404490802","doi":"10.1371/journal.pone.0312255","title":"Test-retest reliability of behavioral and computational measures of advice taking under volatility","year":2024,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Mental Health Research Topics","field":"Psychology","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; Centre for Addiction and Mental Health","funders":"Canadian Institutes of Health Research; Krembil Foundation; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"Reliability (semiconductor); Face validity; Psychology; Variance (accounting); Computer science; Statistics; Econometrics; Audiology; Psychometrics; Clinical psychology; Medicine; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005601189,0.00006926431,0.0001862719,0.000066018,0.00003183419,0.000008101609,0.00007993131,0.00006626898,0.0005796152],"category_scores_gemma":[0.0001792789,0.00006684299,0.00002548282,0.0001562785,0.0001838414,0.00005813059,0.00005047098,0.0002054674,0.00001180744],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005683135,"about_ca_system_score_gemma":0.00007789147,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000692815,"about_ca_topic_score_gemma":0.00006460534,"domain_scores_codex":[0.9987299,0.000132446,0.000318418,0.000226045,0.0004315299,0.0001616508],"domain_scores_gemma":[0.9987551,0.0007177172,0.00007418091,0.0002004782,0.0001764939,0.00007606031],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001440925,0.004912437,0.9702352,0.003180033,0.0001199897,0.00000863482,0.002490181,0.0000162634,0.006808992,0.003409968,0.0002323067,0.008441896],"study_design_scores_gemma":[0.0003511547,0.0005073703,0.9835568,0.0003441343,0.00006861851,0.000002307362,0.0002233696,0.007719941,0.00147011,0.005632965,0.00003713384,0.00008606676],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9967062,0.0006582006,0.00009335513,0.000341557,0.0000517378,0.0002983557,0.00009833284,0.00004130762,0.001710995],"genre_scores_gemma":[0.9962667,0.000005445923,0.003391848,0.00002734377,0.00002912357,0.00001766911,0.00001195693,0.000009819722,0.0002401415],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01332162,"threshold_uncertainty_score":0.6346381,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2645327259988596,"score_gpt":0.4378623728171659,"score_spread":0.1733296468183064,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}