{"id":"W2894280539","doi":"10.1609/aaai.v33i01.33019062","title":"Multilevel Language and Vision Integration for Text-to-Clip Retrieval","year":2019,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Multimodal Machine Learning Applications","field":"Computer Science","cited_by":332,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Intelligence Advanced Research Projects Activity","keywords":"Computer science; Task (project management); CLIPS; Matching (statistics); Metric (unit); Natural language processing; Artificial intelligence; Sentence; Similarity (geometry); Word (group theory); Recurrent neural network; Artificial neural network; Information retrieval; Image (mathematics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009210044,0.001311605,0.00135685,0.001668145,0.0004621608,0.001620743,0.002430938,0.001864659,0.007957785],"category_scores_gemma":[0.003483669,0.000350951,0.001228622,0.001611571,0.0005271452,0.003263856,0.001694466,0.002130667,0.004059237],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001306627,"about_ca_system_score_gemma":0.001255096,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009208652,"about_ca_topic_score_gemma":0.01418468,"domain_scores_codex":[0.9992666,0.0001095575,0.00004396455,0.0002450061,0.0002018419,0.0001331651],"domain_scores_gemma":[0.9990699,0.0003108155,0.00007922149,0.0002213635,0.0002290329,0.0000898025],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006814227,0.0008924959,0.001006175,0.0005546804,0.0001922486,0.0003552905,0.0001637555,0.1213117,0.07133438,0.008834662,0.03320715,0.7614659],"study_design_scores_gemma":[0.00003350159,0.0002388138,0.0003530096,0.0000139356,0.00004535774,0.0001026446,0.00002898068,0.9749228,0.01543631,0.005325906,0.003473097,0.00002567412],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05728419,0.002737205,0.9063554,0.0008489378,0.0003668681,0.0004311829,0.001641363,0.02171342,0.00862141],"genre_scores_gemma":[0.5687347,0.0009429358,0.4088047,0.0009682454,0.0005305567,0.0004781554,0.00626005,0.0007969667,0.01248369],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009208652,"threshold_uncertainty_score":0.02662146,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04201553110016543,"score_gpt":0.3481929253520091,"score_spread":0.3061773942518437,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}