{"id":"W4412889699","doi":"10.18653/v1/2025.acl-long.1470","title":"ViGiL3D: A Linguistically Diverse Dataset for 3D Visual Grounding","year":2025,"lang":"en","type":"article","venue":"","topic":"Human Pose and Action Recognition","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Computer science; Ground; Artificial intelligence; Natural language processing; Engineering","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001049972,0.003720922,0.001352982,0.003760487,0.00129609,0.002093499,0.004170658,0.003284836,0.01308089],"category_scores_gemma":[0.006181912,0.0006850848,0.002689359,0.003354011,0.001309812,0.002083256,0.004401857,0.002879892,0.01414911],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001180168,"about_ca_system_score_gemma":0.001304604,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01641998,"about_ca_topic_score_gemma":0.04490652,"domain_scores_codex":[0.9980033,0.0004142656,0.0002043411,0.000575814,0.0006166076,0.0001856488],"domain_scores_gemma":[0.9976476,0.0005614093,0.0001841771,0.0008976772,0.0004532344,0.0002558963],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0009256667,0.0007471475,0.007500657,0.003299061,0.0002948981,0.001221366,0.0008973829,0.01209433,0.01394839,0.005418651,0.7910814,0.1625711],"study_design_scores_gemma":[0.0007427886,0.00080123,0.02648235,0.00117169,0.0001945024,0.00350254,0.003326101,0.09223821,0.02757384,0.01765893,0.8258365,0.0004712014],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.04866042,0.00292165,0.04618729,0.001118348,0.00105697,0.001756063,0.8362199,0.04317515,0.01890413],"genre_scores_gemma":[0.051388,0.0004556029,0.05743248,0.000462385,0.00008522567,0.001176563,0.8838065,0.001373992,0.003819173],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.01641998,"threshold_uncertainty_score":0.04375994,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02781625247821911,"score_gpt":0.3431837223646392,"score_spread":0.3153674698864201,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}