{"id":"W7131067696","doi":"10.1109/iccvw69036.2025.00597","title":"AIM 2025 Challenge on Screen-Content Video Quality Assessment: Methods and Results","year":2025,"lang":"","type":"article","venue":"","topic":"Image and Video Quality Assessment","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Alexander von Humboldt-Stiftung","keywords":"Video quality; Quality (philosophy); Set (abstract data type); Subjective video quality; Source code; Frame (networking); Videoconferencing","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01204858,0.002166176,0.001180758,0.002596832,0.001202392,0.002910909,0.001895379,0.002291578,0.007498875],"category_scores_gemma":[0.02688775,0.0003568463,0.001200436,0.001297207,0.001046818,0.001648517,0.005071635,0.002003011,0.006243018],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001976124,"about_ca_system_score_gemma":0.002817367,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01030623,"about_ca_topic_score_gemma":0.009473897,"domain_scores_codex":[0.9838364,0.005026978,0.0008364677,0.001737556,0.007512994,0.001049688],"domain_scores_gemma":[0.9817872,0.003695537,0.0006068563,0.001915489,0.01012792,0.001867014],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002623809,0.002561342,0.01503088,0.005130656,0.0005698617,0.0006270997,0.001367579,0.04271265,0.04807262,0.01074528,0.266983,0.6035751],"study_design_scores_gemma":[0.0009416583,0.00613731,0.07347284,0.002519976,0.0004508725,0.002542548,0.002803777,0.3534996,0.1249292,0.02153694,0.4104578,0.0007074473],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1522516,0.01157732,0.6697431,0.00489398,0.00346837,0.01458203,0.03661517,0.01949995,0.08736863],"genre_scores_gemma":[0.3936965,0.00270181,0.4669888,0.002094069,0.0007943439,0.007774318,0.08946577,0.003608985,0.03287539],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01204858,"threshold_uncertainty_score":0.06371969,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2289077325429648,"score_gpt":0.4907456582736023,"score_spread":0.2618379257306375,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}