{"id":"W4413750761","doi":"10.2196/78682","title":"Extension of the Consolidated Criteria for Reporting Qualitative Research Guideline to Large Language Models (COREQ+LLM): Protocol for a Multiphase Study","year":2025,"lang":"en","type":"article","venue":"JMIR Research Protocols","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Preprint; Guideline; Protocol (science); Qualitative research; Computer science; Psychology; Medicine; Alternative medicine; World Wide Web; Sociology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2447864,0.005475017,0.007479887,0.009028859,0.007496724,0.007401476,0.006817508,0.008035715,0.08026122],"category_scores_gemma":[0.2968174,0.006902776,0.007332678,0.009682029,0.006168971,0.00843248,0.008245451,0.01325792,0.02285891],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01211016,"about_ca_system_score_gemma":0.06787748,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004867828,"about_ca_topic_score_gemma":0.007447004,"domain_scores_codex":[0.7835706,0.1562605,0.03483429,0.009314484,0.01153217,0.004487931],"domain_scores_gemma":[0.7244757,0.1336423,0.02572462,0.03981114,0.06987073,0.006475459],"domain_codex":null,"domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.02223802,0.003387844,0.003476786,0.160579,0.001165106,0.001835915,0.05528792,0.007777865,0.006892393,0.05985619,0.3834542,0.2940488],"study_design_scores_gemma":[0.04612497,0.004312764,0.009447249,0.1113996,0.0008526474,0.0009243918,0.01883375,0.01291059,0.009159902,0.09121624,0.6932312,0.001586651],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"protocol","genre_gemma":"protocol","genre_scores_codex":[0.0006367589,0.0001772846,0.01374283,0.000621921,0.0003387007,0.9803984,0.00312538,0.0002513597,0.0007073709],"genre_scores_gemma":[0.000326736,0.0000496995,0.01042152,0.0000990921,0.00001075115,0.9887199,0.0002235199,0.00001487281,0.0001339013],"genre_candidate":"protocol","genre_consensus":"protocol","teacher_disagreement_score":0.7552136,"threshold_uncertainty_score":0.9313129,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7942757918621323,"score_gpt":0.7988086140447332,"score_spread":0.004532822182600982,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}