{"id":"W2550082179","doi":"10.1142/s1793351x16400122","title":"An Empirical Study of the Textual Content of Online Videos","year":2016,"lang":"en","type":"article","venue":"International Journal of Semantic Computing","topic":"Video Analysis and Summarization","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Information retrieval; Cluster analysis; Multimedia; Video retrieval; Annotation; Empirical research; Content (measure theory); World Wide Web; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002999664,0.0001743097,0.0001834392,0.002693712,0.0005285401,0.001127612,0.0004695737,0.0005802761,0.002189477],"category_scores_gemma":[0.05873467,0.000117737,0.0001871857,0.002620818,0.0007116491,0.002550118,0.0005926159,0.0006184714,0.0005352627],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005398158,"about_ca_system_score_gemma":0.000422017,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003308867,"about_ca_topic_score_gemma":0.003539747,"domain_scores_codex":[0.9975425,0.001178136,0.0002672027,0.0002792247,0.0006057862,0.0001272084],"domain_scores_gemma":[0.9056381,0.06872185,0.01330745,0.00207281,0.008548211,0.001711589],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0009223216,0.001949838,0.8807224,0.001296887,0.0001441028,0.0008962794,0.02205521,0.0007586079,0.007045439,0.001781398,0.003769215,0.07865829],"study_design_scores_gemma":[0.00003430695,0.0009592821,0.9440367,0.0003165549,0.00009645177,0.0009880958,0.03462138,0.006382254,0.00347118,0.000755056,0.00828905,0.00004973812],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9948053,0.0002121271,0.00108276,0.0001697402,0.00001296208,0.0001015888,0.001175756,0.00001446665,0.002425298],"genre_scores_gemma":[0.9946842,0.0002930685,0.001986738,0.00008589952,0.00004705056,0.0001170963,0.002149161,0.00001444779,0.0006224066],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003308867,"threshold_uncertainty_score":0.01586396,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04197526496538793,"score_gpt":0.3309049403531081,"score_spread":0.2889296753877201,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}