{"id":"W2806245989","doi":"10.1002/sdtp.12154","title":"P‐31: A Statistical Paradigm for Assessment of Subjective Image Quality Results","year":2018,"lang":"en","type":"article","venue":"SID Symposium Digest of Technical Papers","topic":"Image and Signal Denoising Methods","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"Qualcomm (Canada); York University","funders":"","keywords":"Codec; Computer science; Selection (genetic algorithm); Quality (philosophy); Image quality; Artificial intelligence; Machine learning; Image (mathematics); Data mining; Telecommunications","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02345884,0.001364606,0.0008853235,0.003732126,0.001258167,0.002724913,0.001608513,0.001378676,0.009964115],"category_scores_gemma":[0.05534513,0.0005656136,0.001310359,0.002579377,0.003108896,0.002337185,0.002899535,0.003016787,0.002788636],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000899608,"about_ca_system_score_gemma":0.002331044,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009826078,"about_ca_topic_score_gemma":0.001897492,"domain_scores_codex":[0.9854867,0.006021385,0.001629113,0.001502366,0.005051339,0.0003090017],"domain_scores_gemma":[0.9640176,0.01944792,0.002835263,0.004870832,0.008270589,0.0005577924],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001355645,0.0004925616,0.012228,0.002658317,0.0003178243,0.0005767681,0.002997872,0.01221632,0.1001519,0.1933473,0.03704724,0.6366102],"study_design_scores_gemma":[0.0005183717,0.006010749,0.06933773,0.001593199,0.0003806081,0.004106585,0.002439089,0.1876927,0.1018663,0.3821485,0.2429765,0.000929755],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.004898356,0.0001282288,0.9853212,0.0001715705,0.0001085597,0.0009474679,0.0007096683,0.001316416,0.006398528],"genre_scores_gemma":[0.05141722,0.000218931,0.939141,0.0002341195,0.00008584557,0.005013004,0.0008500329,0.0007375835,0.002302212],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02345884,"threshold_uncertainty_score":0.1240637,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03242513996299233,"score_gpt":0.3716313176160926,"score_spread":0.3392061776531002,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}