{"id":"W4405749933","doi":"10.1016/j.jval.2024.10.3143","title":"SA62 Evaluating Generative Artificial Intelligence (GenAI) in Health Technology Assessment (HTA) Content Generation: A Proof-of-Concept Using Canadian Agency for Drugs and Technologies in Health (CADTH) Reimbursement Dossier Forms","year":2024,"lang":"en","type":"article","venue":"Value in Health","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Pfizer (Canada)","funders":"","keywords":"Reimbursement; Health technology; Agency (philosophy); Proof of concept; Generative grammar; Regulatory agency; Medicine; Computer science; Artificial intelligence; Political science; Public administration; Health care; Sociology; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02259054,0.0009953134,0.0008202834,0.001376105,0.0006924483,0.003142591,0.001746964,0.001982166,0.01507533],"category_scores_gemma":[0.07553516,0.0005287948,0.001294218,0.001000945,0.001510042,0.002015583,0.002333269,0.001508982,0.002550579],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002622918,"about_ca_system_score_gemma":0.003238817,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01284179,"about_ca_topic_score_gemma":0.009865737,"domain_scores_codex":[0.9825937,0.0120886,0.0005269735,0.0006766408,0.003798166,0.0003158632],"domain_scores_gemma":[0.9480979,0.03685755,0.0008323475,0.004631165,0.008980348,0.0006007216],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.006344477,0.002482978,0.008752552,0.002359784,0.0006990572,0.0002269024,0.001436176,0.1896319,0.009505124,0.05993944,0.04471131,0.6739102],"study_design_scores_gemma":[0.003719375,0.003316195,0.006105093,0.0006449157,0.0004626387,0.0001692546,0.0004800143,0.8722184,0.02357919,0.03988855,0.04923974,0.0001766317],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3148953,0.00247085,0.5234923,0.003768405,0.001078016,0.009768463,0.007007462,0.01823362,0.1192855],"genre_scores_gemma":[0.4975793,0.0004314404,0.4837148,0.0007183932,0.00007365936,0.002570365,0.004440282,0.0008750674,0.009596697],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9973771,"threshold_uncertainty_score":0.1194716,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.628704518258548,"score_gpt":0.5007668926854623,"score_spread":0.1279376255730857,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}