{"id":"W4386699143","doi":"10.18060/26528","title":"Evaluating the Accuracy of scite, a Smart Citation Index","year":2023,"lang":"en","type":"article","venue":"Hypothesis Research Journal for Health Information Professionals","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Regina","funders":"","keywords":"Citation; Meaning (existential); Categorization; Recall; Context (archaeology); Computer science; Sample (material); Information retrieval; Precision and recall; Data science; Psychology; Artificial intelligence; Library science; Cognitive psychology; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.1480266,0.001247623,0.003858205,0.08177944,0.002362367,0.01034667,0.002487741,0.002850952,0.003279234],"category_scores_gemma":[0.5826504,0.0006445558,0.004143128,0.05746917,0.002309988,0.009994769,0.005522617,0.001439676,0.001800784],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002137505,"about_ca_system_score_gemma":0.004059353,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002604447,"about_ca_topic_score_gemma":0.004753674,"domain_scores_codex":[0.8590869,0.03336363,0.05296732,0.007299803,0.04607809,0.001204316],"domain_scores_gemma":[0.2809862,0.4998671,0.07125011,0.03266664,0.1121477,0.003082233],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001211265,0.0003776931,0.5292342,0.01755417,0.005112561,0.0004372094,0.00728715,0.007116647,0.002467466,0.008940025,0.03166762,0.388594],"study_design_scores_gemma":[0.0006028331,0.002771525,0.6398656,0.009892036,0.007466765,0.003498568,0.007969697,0.09591804,0.01219353,0.04080919,0.1778894,0.001122858],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7070305,0.04161347,0.1205456,0.008403323,0.003352431,0.004796448,0.04371217,0.005851183,0.06469496],"genre_scores_gemma":[0.8358282,0.008517957,0.127917,0.0009336971,0.00123897,0.003285787,0.01827276,0.0005769048,0.00342856],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9182206,"threshold_uncertainty_score":0.782849,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7332254577048797,"score_gpt":0.6609661716199537,"score_spread":0.07225928608492593,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}