{"id":"W6891701842","doi":"10.48448/x931-fw41","title":"An Effective, Performant Named Entity Recognition System forNoisy Business Telephone Conversation Transcripts","year":2022,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Stornoway Diamond (Canada)","funders":"","keywords":"Conversation; Telephony; Named-entity recognition; Noise (video); Entity linking; Named entity; Speaker recognition","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.002940891,0.0006489542,0.0006744661,0.002351988,0.0007901263,0.0003385404,0.001232715,0.0003075198,0.004387156],"category_scores_gemma":[0.0001658439,0.0006499245,0.0001119307,0.00400343,0.001176221,0.001391164,0.0001416656,0.0006299004,0.002505574],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002710636,"about_ca_system_score_gemma":0.0008356217,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002128456,"about_ca_topic_score_gemma":0.001743815,"domain_scores_codex":[0.9943815,0.0004239252,0.0005829724,0.001496359,0.002209932,0.0009053004],"domain_scores_gemma":[0.9972124,0.00006266492,0.0007498428,0.001000564,0.0006410698,0.0003334263],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001804466,0.005896348,0.01170413,0.0112405,0.0009542748,0.0004041928,0.01445668,0.001788404,0.3888106,0.001514391,0.1375566,0.4238693],"study_design_scores_gemma":[0.02533313,0.004689901,0.06010794,0.005758988,0.003094528,0.001295453,0.0367217,0.4350076,0.02662852,0.0006289271,0.3870863,0.01364703],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.4897593,0.001059963,0.02453575,0.0004076699,0.02327673,0.02497379,0.01033882,0.01461255,0.4110354],"genre_scores_gemma":[0.9852831,0.00003695394,0.001981404,0.00008519705,0.0006451436,0.0005100687,0.003776936,0.001004645,0.006676587],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4955238,"threshold_uncertainty_score":0.9995952,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01448046842101758,"score_gpt":0.2546382423848095,"score_spread":0.240157773963792,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}