{"id":"W4402888402","doi":"10.2196/60678","title":"Evaluating the Influence of Role-Playing Prompts on ChatGPT’s Misinformation Detection Accuracy: Quantitative Study","year":2024,"lang":"en","type":"article","venue":"JMIR Infodemiology","topic":"Misinformation and Its Impacts","field":"Social Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Misinformation; Disinformation; Psychology; Social media; Social psychology; Identity (music); Social identity theory; Applied psychology; Political science; Computer science; Computer security; Social group","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01586297,0.0008782148,0.0008576224,0.001296729,0.0007989602,0.00206637,0.0009918673,0.001124834,0.002187744],"category_scores_gemma":[0.1850002,0.0004058645,0.0006465427,0.0007014922,0.0008829748,0.002515571,0.00143291,0.001745928,0.001485348],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008640663,"about_ca_system_score_gemma":0.0009093878,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001952072,"about_ca_topic_score_gemma":0.001935144,"domain_scores_codex":[0.9853495,0.009430579,0.00129443,0.001499723,0.001865914,0.0005599118],"domain_scores_gemma":[0.6603367,0.2883287,0.02216315,0.008171833,0.01764344,0.003356182],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.006842603,0.004527028,0.7215959,0.003703778,0.0005379407,0.0009037646,0.06356372,0.005018744,0.01904014,0.0007209764,0.006143126,0.1674022],"study_design_scores_gemma":[0.0004519732,0.01228445,0.8272684,0.001246212,0.001055368,0.001189371,0.03928056,0.07607588,0.02650519,0.00227444,0.01170688,0.0006613341],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9940522,0.0001485439,0.002729892,0.0001572321,0.00004023287,0.0005484002,0.0007778454,0.0003127755,0.001232767],"genre_scores_gemma":[0.9892958,0.0001438525,0.007163594,0.0002405542,0.00006618402,0.0009967505,0.001036102,0.00008738516,0.000969918],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01586297,"threshold_uncertainty_score":0.08389241,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1340513233802499,"score_gpt":0.4954393638931831,"score_spread":0.3613880405129332,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}