{"id":"W4386204668","doi":"10.1145/3603719.3603725","title":"InfoMoD: Information-theoretic Model Diagnostics","year":2023,"lang":"en","type":"article","venue":"","topic":"Explainable Artificial Intelligence (XAI)","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Automatic summarization; Computer science; Debugging; Data modeling; Data mining; Machine learning; Artificial intelligence; Software engineering; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01219695,0.002313393,0.001760142,0.004605854,0.000891992,0.004491138,0.004289171,0.00218465,0.00606602],"category_scores_gemma":[0.07099595,0.001253533,0.002813569,0.002249141,0.002282904,0.008013631,0.00507624,0.004176598,0.001549108],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002107511,"about_ca_system_score_gemma":0.004157858,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001609086,"about_ca_topic_score_gemma":0.002194138,"domain_scores_codex":[0.9907951,0.004266382,0.0006433598,0.001075696,0.002936797,0.0002826081],"domain_scores_gemma":[0.9505073,0.0340777,0.003430779,0.009048597,0.002463336,0.0004723434],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001022584,0.0004828951,0.01013964,0.0009882742,0.0007125084,0.0006885354,0.0005518639,0.2371966,0.003902711,0.3274119,0.05033604,0.3665664],"study_design_scores_gemma":[0.00006793359,0.0001103471,0.0003700549,0.00008363055,0.00005835669,0.0001408463,0.00004817507,0.7764168,0.005770406,0.210585,0.006301803,0.00004659218],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.006004408,0.0002740693,0.9765852,0.00121021,0.00009176599,0.0001680248,0.001760861,0.01129228,0.002613123],"genre_scores_gemma":[0.2608418,0.000428201,0.7284473,0.001059633,0.0002181875,0.00085683,0.004581926,0.001824538,0.001741576],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01219695,"threshold_uncertainty_score":0.06450444,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02157812953750826,"score_gpt":0.2580000841401901,"score_spread":0.2364219546026818,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}