{"id":"W7132542374","doi":"","title":"Fast & confident probabilistic categorisation","year":2007,"lang":"en","type":"article","venue":"NPARC","topic":"Text and Document Classification Technologies","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Probabilistic logic; Labelling; Set (abstract data type); Anomaly detection; Test (biology); Measure (data warehouse); Test set; Layer (electronics)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007609138,0.001823639,0.002200224,0.004451064,0.001621978,0.005630599,0.005391741,0.004379335,0.04256943],"category_scores_gemma":[0.03592595,0.001127468,0.002122028,0.003195146,0.001166316,0.007207164,0.007804578,0.004876292,0.03249449],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001856559,"about_ca_system_score_gemma":0.002454172,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003193541,"about_ca_topic_score_gemma":0.004158813,"domain_scores_codex":[0.9879881,0.001893932,0.0004891667,0.002331175,0.006395531,0.0009020569],"domain_scores_gemma":[0.9788924,0.006406894,0.0008124552,0.006999095,0.006389069,0.0005000832],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006013323,0.0001108501,0.001545682,0.0003084698,0.0001091537,0.0001994831,0.0001146511,0.03497592,0.008356331,0.03135164,0.1367998,0.7855268],"study_design_scores_gemma":[0.00008943456,0.0001423598,0.001999506,0.0001071957,0.00006502117,0.0009089656,0.0001281926,0.7243891,0.02464646,0.1450758,0.1022835,0.0001644894],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.006809687,0.0008320534,0.953397,0.001199969,0.0009193064,0.0002524161,0.004069015,0.02356276,0.008957735],"genre_scores_gemma":[0.1395788,0.0006135359,0.7973995,0.0008396141,0.0009388326,0.0004360411,0.02057671,0.003708216,0.03590876],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.04256943,"threshold_uncertainty_score":0.1424089,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01793904926341709,"score_gpt":0.2566820421824322,"score_spread":0.2387429929190151,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}