{"id":"W7104390420","doi":"10.35111/5b6x-2e75","title":"LORELEI Ilocano Incident Language Pack","year":2025,"lang":"","type":"dataset","venue":"Linguistic Data Consortium Catalog","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Resource (disambiguation); Natural language; Language technology; Language identification; Event (particle physics); Information extraction","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005045874,0.001058892,0.000726147,0.002335825,0.001609904,0.003001187,0.00228499,0.001026766,0.1214663],"category_scores_gemma":[0.01222573,0.0008222414,0.0004862691,0.00165954,0.000844127,0.004371448,0.003992337,0.002330973,0.08633213],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002195725,"about_ca_system_score_gemma":0.003419498,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01908165,"about_ca_topic_score_gemma":0.01880484,"domain_scores_codex":[0.9963661,0.0009734045,0.0003070294,0.0004760773,0.001603451,0.0002737908],"domain_scores_gemma":[0.9897583,0.001934815,0.0003406903,0.001712001,0.005706435,0.0005478588],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004840009,0.0001878163,0.001222601,0.0005331404,0.00001183162,0.0002057952,0.0009757393,0.0006164578,0.004759135,0.003719558,0.9200239,0.06725996],"study_design_scores_gemma":[0.0001314874,0.0001533745,0.00279139,0.0001568024,0.00001277433,0.0002301932,0.00139148,0.00299089,0.009612032,0.001901995,0.9805377,0.00008987542],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.04298235,0.0005192096,0.07597896,0.006985287,0.002504914,0.008123074,0.3851765,0.1141159,0.3636138],"genre_scores_gemma":[0.06602241,0.0003436512,0.1008435,0.002721413,0.0003525377,0.0065219,0.6870985,0.01373578,0.1223603],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.1214663,"threshold_uncertainty_score":0.4063453,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02692544569742328,"score_gpt":0.3228691225035973,"score_spread":0.295943676806174,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}