{"id":"W2888029456","doi":"10.1109/tvcg.2018.2865138","title":"Evaluating ‘Graphical Perception’ with CNNs","year":2018,"lang":"en","type":"article","venue":"IEEE Transactions on Visualization and Computer Graphics","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":68,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"National Institutes of Health; National Science Foundation","keywords":"Computer science; Visualization; Convolutional neural network; Perception; Task (project management); Artificial intelligence; Visual perception; Data visualization; Human–computer interaction","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003112648,0.001402397,0.000512893,0.001085843,0.0002249234,0.001710517,0.001029683,0.001257077,0.003436852],"category_scores_gemma":[0.02256771,0.0003300051,0.0005902458,0.000630369,0.0006749214,0.003340925,0.001363966,0.00099322,0.0007217261],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009682707,"about_ca_system_score_gemma":0.0004321721,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004531352,"about_ca_topic_score_gemma":0.005449507,"domain_scores_codex":[0.998544,0.0004749755,0.0001199904,0.0003599965,0.000331791,0.0001693729],"domain_scores_gemma":[0.9926291,0.004750494,0.0007099214,0.0007910207,0.0007759933,0.0003435182],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003145482,0.0006158438,0.05357856,0.001346825,0.0008656926,0.0003676326,0.0005564086,0.3689007,0.04260948,0.006184694,0.009439706,0.512389],"study_design_scores_gemma":[0.00007292184,0.001035044,0.02077615,0.0000971365,0.0001488571,0.0001539949,0.0001943283,0.9455691,0.0224265,0.007158481,0.002315328,0.00005206175],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.885145,0.002031676,0.09827959,0.0008505883,0.0002725679,0.0001766085,0.001156493,0.002201302,0.009886122],"genre_scores_gemma":[0.9743646,0.0003882663,0.02287612,0.000136577,0.0000383612,0.00003935624,0.001173522,0.00008733747,0.000895852],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.004531352,"threshold_uncertainty_score":0.01646143,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.043289634611307,"score_gpt":0.3476999976530299,"score_spread":0.304410363041723,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}