{"id":"W2509251152","doi":"10.18653/v1/w16-2370","title":"BAD LUC$@$WMT 2016: a Bilingual Document Alignment Platform Based on Lucene","year":2016,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"Fonds de recherche du Québec – Nature et technologies","keywords":"Computer science; Task (project management); Information retrieval; Natural language processing; Heuristic; Artificial intelligence; World Wide Web","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005151579,0.002300632,0.001648348,0.002869365,0.001906913,0.002361775,0.002735517,0.001281562,0.02558825],"category_scores_gemma":[0.01010649,0.00135941,0.001458482,0.002976236,0.0009059504,0.006791395,0.005246431,0.002503587,0.03092904],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001161129,"about_ca_system_score_gemma":0.003189013,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01087756,"about_ca_topic_score_gemma":0.01249289,"domain_scores_codex":[0.995133,0.001350241,0.0004319145,0.001644328,0.0009485604,0.0004919973],"domain_scores_gemma":[0.9954931,0.0008666567,0.0002157423,0.001844598,0.001110172,0.000469755],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.006243238,0.001469306,0.005236063,0.002556762,0.0007222635,0.001394329,0.001896339,0.009424642,0.1177966,0.01323431,0.4674285,0.3725977],"study_design_scores_gemma":[0.001905393,0.002683583,0.01523584,0.0003258513,0.0004402226,0.001883952,0.001455628,0.1395826,0.2568608,0.0178594,0.5608222,0.0009445348],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"software","genre_gemma":"software","genre_scores_codex":[0.1129139,0.00196323,0.2637239,0.00109552,0.001233659,0.001901879,0.08479615,0.5005349,0.03183693],"genre_scores_gemma":[0.2332027,0.000430289,0.4012369,0.0006316502,0.0002735208,0.001476038,0.3151494,0.02676586,0.02083373],"genre_candidate":"software","genre_consensus":"software","teacher_disagreement_score":0.02558825,"threshold_uncertainty_score":0.08560121,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01097485922180609,"score_gpt":0.267082588178196,"score_spread":0.2561077289563899,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}