{"id":"W1515253087","doi":"","title":"Using Statistical Word Associations for the Retrieval of Strongly-Textual Cases.","year":2003,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Natural language processing; Word (group theory); Similarity (geometry); Artificial intelligence; Process (computing); Information retrieval; Translation (biology); Machine translation; Statistical model; Statistical analysis; Linguistics; Mathematics; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004119542,0.00006530227,0.00009824492,0.00003475174,0.000131422,0.00007253381,0.000353532,0.00004468396,0.00001766096],"category_scores_gemma":[0.001314504,0.00004314835,0.00003593408,0.0002501523,0.00004840123,0.0001624901,0.00005609313,0.00008843096,7.599382e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005330584,"about_ca_system_score_gemma":0.0001248891,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004724046,"about_ca_topic_score_gemma":0.00001306442,"domain_scores_codex":[0.9992816,0.0000471875,0.000168261,0.000144523,0.0001923625,0.0001660733],"domain_scores_gemma":[0.9984511,0.001046696,0.00008980393,0.0002278657,0.0001563675,0.00002815231],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000004485923,0.00002522681,0.00009762556,0.000006279515,0.00001357524,0.000002732753,0.00008707593,0.00002348425,0.0009592313,0.9915808,0.0007671717,0.006432272],"study_design_scores_gemma":[0.001558403,0.0005549331,0.001034067,0.00007586616,0.0001905515,0.0001863009,0.0006262564,0.4462172,0.2188578,0.3245074,0.005176253,0.001014961],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001208752,0.000268783,0.9977201,0.0001386577,0.00007254504,0.0001660062,0.0000251075,0.0001033736,0.0002966922],"genre_scores_gemma":[0.434752,9.935424e-7,0.5651144,0.00004006484,0.00001163252,0.000001785567,0.000001291558,0.000003046808,0.00007467964],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.6670734,"threshold_uncertainty_score":0.1759539,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05522528577050666,"score_gpt":0.3498113241993679,"score_spread":0.2945860384288612,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}