{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":4,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":4,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"a68eee857730","filters":{"venue":"NLPRS"}},"results":[{"id":"W21176108","doi":"10.1111/j.1742-7843.2010.00655.x","title":"Topic Segmentation : A First Stage to Dialog-Based Information Extraction.","year":2001,"lang":"en","type":"article","venue":"NLPRS","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal","funders":"","keywords":"Segmentation; Computer science; Dialog box; Information extraction; Artificial intelligence; Natural language processing; Hidden Markov model; Speech recognition; World Wide Web","authors":[{"name":"Narjès Boufaden","is_ca":false},{"name":"Guy Lapalme","is_ca":false},{"name":"Yoshua Bengio","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01560239395001572,"gpt":0.2559230316549126,"spread":0.2403206377048969,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003087852,0.003002737,0.002105126,0.011139,0.002089927,0.00373371,0.002498693,0.002670517,0.01371516],"category_scores_gemma":[0.005537625,0.0008360325,0.002793939,0.005864418,0.0006043862,0.005175916,0.003078575,0.001918719,0.01195059],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001146686,"about_ca_system_score_gemma":0.002678487,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006231713,"about_ca_topic_score_gemma":0.008846205,"domain_scores_codex":[0.9973835,0.0006217832,0.0002978571,0.0008778066,0.0005085934,0.0003103871],"domain_scores_gemma":[0.9972144,0.001423819,0.0001583882,0.0003906047,0.0006004698,0.0002124578],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008017761,0.0003801351,0.004104978,0.00185694,0.0004008806,0.0005268946,0.001207163,0.002669426,0.03070962,0.005175165,0.05552555,0.8966414],"study_design_scores_gemma":[0.0002363291,0.001273299,0.02423609,0.0009298821,0.00138611,0.002578937,0.006205135,0.5532376,0.08415081,0.05474171,0.2705853,0.0004387568],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02103043,0.007569425,0.8798203,0.001373708,0.0007750961,0.002211341,0.02438341,0.05175575,0.01108044],"genre_scores_gemma":[0.1552708,0.00209731,0.7846671,0.0003840277,0.0007642869,0.001328609,0.04438111,0.001495669,0.009611067],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01371516,"threshold_uncertainty_score":0.04588175,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W74649020","doi":"","title":"Efficient Parsing for Word Structure.","year":2001,"lang":"en","type":"article","venue":"NLPRS","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Parsing; Computer science; Natural language processing; Covert; Morpheme; Artificial intelligence; Word (group theory); Selection (genetic algorithm); Linguistics","authors":[{"name":"Anna Maria Di Sciullo","is_ca":true},{"name":"Sandiway Fong","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.013491939885216,"gpt":0.2799348932808102,"spread":0.2664429533955942,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001898769,0.0009292592,0.0007393193,0.001368467,0.001011155,0.002464562,0.001680733,0.001017832,0.01535321],"category_scores_gemma":[0.004577035,0.0008621961,0.00140592,0.001104858,0.001219927,0.005157597,0.002524561,0.001691167,0.01230003],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007516315,"about_ca_system_score_gemma":0.001064823,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007490705,"about_ca_topic_score_gemma":0.001332007,"domain_scores_codex":[0.9983312,0.0005198657,0.0001442469,0.0003421701,0.0005330369,0.0001294176],"domain_scores_gemma":[0.9978135,0.001002416,0.000119187,0.0006322007,0.0003927643,0.00003988416],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00008072981,0.00005313018,0.0006156477,0.0005329509,0.00007145283,0.0003390152,0.0005464825,0.006238042,0.02322337,0.6196018,0.04188585,0.3068115],"study_design_scores_gemma":[0.0000240345,0.00003758774,0.0005438165,0.00008957706,0.00006154212,0.0005184382,0.0001192258,0.08821229,0.01916764,0.7861305,0.1050405,0.00005472385],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001296956,0.0002152112,0.9869398,0.0002236025,0.00006824567,0.00006544595,0.0004019259,0.005831528,0.004957328],"genre_scores_gemma":[0.07692629,0.0006057006,0.9069836,0.0003876949,0.0002244446,0.0002226372,0.002829248,0.002591187,0.009229143],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01535321,"threshold_uncertainty_score":0.05136156,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W25291738","doi":"10.1109/tnnls.2013.2296627","title":"Estimating Reliability of Contextual Evidences in Decision-List Classifiers under Bayesian Learning","year":2001,"lang":"en","type":"article","venue":"NLPRS","topic":"Bayesian Modeling and Causal Inference","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Artificial intelligence; Machine learning; Classifier (UML); Bayesian probability; Reliability (semiconductor); Naive Bayes classifier; Data mining; Support vector machine","authors":[{"name":"Yoshimasa Tsuruoka","is_ca":false},{"name":"Takashi Chikayama","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04001177265858651,"gpt":0.3101971451735926,"spread":0.2701853725150061,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01499206,0.001303288,0.002719442,0.004526392,0.001181041,0.002508292,0.002979112,0.002856248,0.001451808],"category_scores_gemma":[0.0795247,0.0009872816,0.00129312,0.003076787,0.001862075,0.005977898,0.002354766,0.002309509,0.0006983232],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001464181,"about_ca_system_score_gemma":0.001631916,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002996712,"about_ca_topic_score_gemma":0.003824129,"domain_scores_codex":[0.9913756,0.004072263,0.0006074857,0.001418017,0.002134448,0.0003921646],"domain_scores_gemma":[0.9458712,0.04537637,0.002873207,0.002262623,0.003227972,0.0003886952],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007620443,0.0001989395,0.00897707,0.0005850611,0.0003508101,0.0001647004,0.0005253156,0.4903235,0.002304103,0.05219103,0.002540518,0.4410769],"study_design_scores_gemma":[0.00003140233,0.00004463506,0.001089833,0.00004067667,0.00005845638,0.00003690579,0.00003773202,0.9639696,0.001247062,0.03304739,0.0003701242,0.00002617432],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03031716,0.0005295404,0.9678984,0.0002593525,0.00002369414,0.00005478899,0.00008249735,0.0002267021,0.0006078482],"genre_scores_gemma":[0.637905,0.0007189353,0.3590775,0.0001861691,0.0002376883,0.0003006872,0.0006750897,0.0001132184,0.00078579],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01499206,"threshold_uncertainty_score":0.07928652,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W37346518","doi":"10.7717/peerj-cs.1363","title":"A Simple Closed-Class/Open-Class Factorization for Improved Language Modeling.","year":2001,"lang":"en","type":"article","venue":"NLPRS","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"Zemkopības ministrija","keywords":"Perplexity; Language model; Class (philosophy); Computer science; Smoothing; Generalization; Function (biology); Simple (philosophy); Artificial intelligence; Natural language processing; Mathematics","authors":[{"name":"Fuchun Peng","is_ca":true},{"name":"Dale Schuurmans","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0361677065083973,"gpt":0.2954346646159682,"spread":0.2592669581075709,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002990567,0.001232381,0.000809958,0.001532922,0.001402299,0.002692837,0.002351217,0.001674497,0.02499277],"category_scores_gemma":[0.009523786,0.0007657891,0.003145942,0.00113473,0.0008467557,0.004625705,0.002416585,0.002932444,0.01315085],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001078982,"about_ca_system_score_gemma":0.003156163,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01210399,"about_ca_topic_score_gemma":0.01210599,"domain_scores_codex":[0.9972988,0.0006348408,0.0002486841,0.0008127977,0.0006991182,0.0003056965],"domain_scores_gemma":[0.9970432,0.00120269,0.000171963,0.0006042671,0.0008377488,0.0001401796],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005385297,0.0004456624,0.002760569,0.00039317,0.0001336346,0.000433233,0.0006457425,0.06156517,0.01263201,0.1175097,0.03131507,0.7716276],"study_design_scores_gemma":[0.00005026591,0.0000917454,0.0005668219,0.00006925564,0.00004352451,0.0002654941,0.0002549492,0.8593537,0.004988818,0.08811453,0.04614744,0.0000534578],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.002825585,0.0001112798,0.9896128,0.000208973,0.0001587875,0.000223159,0.0007503459,0.003211345,0.002897833],"genre_scores_gemma":[0.09122168,0.0001713712,0.8902231,0.0002436185,0.0001610731,0.000666845,0.004409222,0.001064779,0.01183824],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02499277,"threshold_uncertainty_score":0.0836091,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}