{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":10,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":10,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"f55b3b497170","filters":{"venue":"Recent Advances in Natural Language Processing"}},"results":[{"id":"W2402187144","doi":"","title":"A Large Wordnet-based Sentiment Lexicon for Polish.","year":2015,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":43,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"","keywords":"WordNet; Lexicon; Computer science; Sentiment analysis; Annotation; Natural language processing; Selection (genetic algorithm); Artificial intelligence; Resource (disambiguation); Process (computing); Information retrieval; Point (geometry)","authors":[{"name":"Monika Zaśko-Zielińska","is_ca":false},{"name":"Maciej Piasecki","is_ca":false},{"name":"Stan Śzpakowicz","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01883846270494322,"gpt":0.3323440766371095,"spread":0.3135056139321662,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009385917,0.001021132,0.0005070033,0.004749244,0.0009992822,0.001761518,0.0006159398,0.0004694656,0.01625445],"category_scores_gemma":[0.004671175,0.0007210153,0.0005030768,0.003779347,0.0004629839,0.004994878,0.002077173,0.0009577815,0.01400483],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008512179,"about_ca_system_score_gemma":0.002237835,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002981931,"about_ca_topic_score_gemma":0.005476093,"domain_scores_codex":[0.9993412,0.000116504,0.000183164,0.0001575387,0.0001629511,0.00003850085],"domain_scores_gemma":[0.9986388,0.0003219368,0.0001880558,0.000198981,0.0005523689,0.00009982139],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0006322758,0.0001913391,0.008574314,0.004704412,0.0001166108,0.001593183,0.006006107,0.003660967,0.0583645,0.08089661,0.3340762,0.5011835],"study_design_scores_gemma":[0.00004967387,0.00006405151,0.009548044,0.0003744931,0.00006601266,0.000953792,0.001067053,0.00856407,0.01150725,0.01928675,0.9484636,0.00005532633],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1029156,0.001737843,0.4456548,0.002129104,0.001057258,0.002514964,0.3082911,0.02538662,0.1103128],"genre_scores_gemma":[0.1903492,0.001651541,0.3286728,0.0004432782,0.0001765566,0.003671825,0.4357735,0.005869615,0.03339174],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01625445,"threshold_uncertainty_score":0.05437654,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2251088109","doi":"","title":"What Sentiments Can Be Found in Medical Forums","year":2013,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"","keywords":"Sentiment analysis; Gratitude; Categorization; Computer science; Confusion; Class (philosophy); Natural language processing; Artificial intelligence; Information retrieval; Psychology; Social psychology","authors":[{"name":"Marina Sokolova","is_ca":true},{"name":"Victoria Bobicev","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01053726599896035,"gpt":0.3149843429458523,"spread":0.3044470769468919,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002326291,0.0002766982,0.0002816689,0.003200342,0.0006244402,0.001697577,0.0001278873,0.0004108622,0.003365168],"category_scores_gemma":[0.01361945,0.0001446739,0.0002597371,0.00135986,0.0004716712,0.002073872,0.0006217672,0.0003348061,0.0008480299],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003309658,"about_ca_system_score_gemma":0.0002209678,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004775877,"about_ca_topic_score_gemma":0.0008732674,"domain_scores_codex":[0.9987036,0.000565619,0.0001068774,0.0001515501,0.0003394838,0.0001329383],"domain_scores_gemma":[0.9883736,0.006431619,0.002927152,0.0003026506,0.001435371,0.0005295328],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001133967,0.0002299901,0.4719251,0.001890041,0.0003959645,0.00148651,0.02482965,0.0006801726,0.03973388,0.007558876,0.02773036,0.4224055],"study_design_scores_gemma":[0.00006920555,0.0004850009,0.8142021,0.001424308,0.0003890289,0.003186057,0.02355869,0.009420719,0.01013216,0.01687516,0.1200847,0.0001728461],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9383897,0.005068159,0.01133301,0.008086378,0.0007093844,0.0001075428,0.003498076,0.0002653361,0.0325423],"genre_scores_gemma":[0.9899572,0.001283077,0.004389472,0.0005809523,0.00058613,0.00003911458,0.0008744371,0.00006927392,0.002220307],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003365168,"threshold_uncertainty_score":0.01230276,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2120344709","doi":"","title":"Beyond the Transfer-and-Merge Wordnet Construction: plWordNet and a Comparison with WordNet","year":2013,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"","keywords":"WordNet; Computer science; Merge (version control); Natural language processing; Artificial intelligence; Perspective (graphical); Information retrieval","authors":[{"name":"Marek Maziarz","is_ca":false},{"name":"Maciej Piasecki","is_ca":false},{"name":"Ewa Rudnicka","is_ca":false},{"name":"Stan Śzpakowicz","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005192038935594544,"gpt":0.2609067758639921,"spread":0.2557147369283975,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004084546,0.0009378631,0.001074031,0.006172776,0.002738977,0.00705978,0.001705684,0.002072882,0.007441776],"category_scores_gemma":[0.01316569,0.0004061795,0.0008318539,0.007909585,0.006519688,0.0256948,0.004417378,0.002568766,0.001505948],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002088344,"about_ca_system_score_gemma":0.001249616,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001813416,"about_ca_topic_score_gemma":0.002692984,"domain_scores_codex":[0.9975777,0.001327453,0.0001388153,0.0003627542,0.0004550125,0.0001383488],"domain_scores_gemma":[0.9952404,0.002710063,0.0004081501,0.0007413118,0.0006230351,0.0002770651],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.00006908691,0.00003065193,0.0008566981,0.0001522131,0.00003107147,0.0001182774,0.0005771181,0.002003904,0.0004628937,0.9483007,0.002657265,0.04474027],"study_design_scores_gemma":[0.000007776835,0.00004124305,0.0006082351,0.0001188379,0.00001815861,0.0002779418,0.0005799131,0.01628547,0.0009659378,0.9482406,0.03283354,0.00002230706],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.06801297,0.02062702,0.7526988,0.01769158,0.001806928,0.0002466696,0.0009060086,0.001308953,0.136701],"genre_scores_gemma":[0.6331913,0.01115903,0.331707,0.001840707,0.001205487,0.000493242,0.001558135,0.000853185,0.01799191],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007441776,"threshold_uncertainty_score":0.02489525,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2250988804","doi":"","title":"Classification of Emotion Words in Russian and Romanian Languages","year":2009,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Children's Hospital of Eastern Ontario","funders":"","keywords":"Surprise; Sadness; Anger; WordNet; Disgust; Root (linguistics); Spelling; Computer science; Natural language processing; Artificial intelligence; Emotion classification; Word (group theory); Romanian; Psychology; Linguistics; Communication; Social psychology","authors":[{"name":"Marina Sokolova","is_ca":true},{"name":"Victoria Bobicev","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.008528628059636015,"gpt":0.3052329617792707,"spread":0.2967043337196347,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000663907,0.0002562782,0.0002597487,0.001829351,0.0003848037,0.0007631287,0.000173866,0.0001997768,0.00113708],"category_scores_gemma":[0.002966837,0.00009151538,0.0003806903,0.001305321,0.0004854683,0.0009636676,0.0005085873,0.0004229713,0.0004226623],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003515631,"about_ca_system_score_gemma":0.000180642,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001425048,"about_ca_topic_score_gemma":0.0009235585,"domain_scores_codex":[0.9992299,0.000353111,0.0001000767,0.0001376114,0.0001068763,0.00007245471],"domain_scores_gemma":[0.9986802,0.0006906112,0.0002807216,0.00006836435,0.0002398354,0.00004016205],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"not_applicable","study_design_scores_codex":[0.002020527,0.0002922069,0.4295055,0.001148119,0.0003041065,0.001635353,0.02079045,0.005994046,0.09938136,0.01742468,0.00438354,0.4171201],"study_design_scores_gemma":[0.00007304696,0.0006985682,0.8651155,0.0003000666,0.000201682,0.003581697,0.02053952,0.04741829,0.02138858,0.008212774,0.03235018,0.0001200964],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9884973,0.0006226515,0.005524499,0.0001291813,0.00004199674,0.00002270198,0.0004869211,0.0000385008,0.00463629],"genre_scores_gemma":[0.9935666,0.0002628646,0.004369452,0.00002807581,0.00001823829,0.00002334756,0.0009976354,0.00002248431,0.0007114109],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001829351,"threshold_uncertainty_score":0.003803909,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2250240387","doi":"","title":"How Joe and Jane Tweet about Their Health: Mining for Personal Health Information on Twitter","year":2013,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University; University of Ottawa","funders":"","keywords":"WordNet; Computer science; Social media; World Wide Web; Ontology; The Internet; Personally identifiable information; Information retrieval; Internet privacy; Information extraction; Health information; Data science; Health care; Computer security","authors":[{"name":"Marina Sokolova","is_ca":true},{"name":"Stan Matwin","is_ca":true},{"name":"Yasser Jafer","is_ca":true},{"name":"David Schramm","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06336643424205922,"gpt":0.4017052128905336,"spread":0.3383387786484743,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008171994,0.0004169996,0.0003398897,0.004649482,0.0008643738,0.001150161,0.00044038,0.0009189016,0.001359244],"category_scores_gemma":[0.006165479,0.0002469923,0.0005171373,0.004687574,0.0004216931,0.002413569,0.0008125749,0.000597552,0.0009457294],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005411186,"about_ca_system_score_gemma":0.0005099008,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006841688,"about_ca_topic_score_gemma":0.01639413,"domain_scores_codex":[0.9992021,0.0001688539,0.0001405571,0.0001665304,0.0002207424,0.0001012537],"domain_scores_gemma":[0.996446,0.001938569,0.000833629,0.0002244253,0.0003882818,0.0001691798],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008416607,0.0005321811,0.7151824,0.001243806,0.0003599966,0.002909599,0.007953608,0.005080105,0.0183055,0.004734932,0.02782689,0.2150293],"study_design_scores_gemma":[0.00006181645,0.0003199388,0.7398688,0.0004049175,0.0003950505,0.003163397,0.0246191,0.1116678,0.01258401,0.01340383,0.09334411,0.000167176],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9604774,0.001095726,0.01166066,0.003910153,0.0002082572,0.0002539318,0.01540136,0.0002292064,0.006763305],"genre_scores_gemma":[0.9548202,0.0009794009,0.02109396,0.0004560307,0.0003132616,0.0002555058,0.01788629,0.00005934925,0.004136072],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006841688,"threshold_uncertainty_score":0.01360375,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W14107570","doi":"","title":"Extracting Synonyms from Dictionary Definitions","year":2009,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Natural language processing; Synonym (taxonomy); Artificial intelligence; Lexicon; Bilingual dictionary; Lemmatisation; Information retrieval","authors":[{"name":"Tong Wang","is_ca":true},{"name":"Graeme Hirst","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01337281418878432,"gpt":0.2994146677861813,"spread":0.286041853597397,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001692514,0.0007831816,0.0009384169,0.0060367,0.0007368438,0.001883717,0.001162527,0.0007096133,0.003841808],"category_scores_gemma":[0.01409825,0.000535399,0.000793286,0.005171304,0.0007602481,0.00480203,0.002198728,0.0008128908,0.002262688],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004210211,"about_ca_system_score_gemma":0.000975082,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004602006,"about_ca_topic_score_gemma":0.001119162,"domain_scores_codex":[0.9973924,0.0008701538,0.0004804314,0.0005695848,0.0006199518,0.00006741135],"domain_scores_gemma":[0.991505,0.004706785,0.001030539,0.00123959,0.001382364,0.0001357828],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0001508424,0.0001751619,0.0101006,0.003293703,0.0002293848,0.001529754,0.002625141,0.004501699,0.03878283,0.0500707,0.01037247,0.8781677],"study_design_scores_gemma":[0.0001963525,0.0006603078,0.02486468,0.001476731,0.0004524961,0.01168272,0.007756027,0.1775702,0.1728542,0.1592556,0.4429152,0.0003154564],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1074765,0.003495861,0.8714902,0.0007348582,0.0003736606,0.0005280678,0.003278814,0.001925298,0.01069664],"genre_scores_gemma":[0.1923433,0.001991506,0.7953666,0.0001878141,0.0001206755,0.0002477057,0.006198232,0.000355804,0.003188408],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0060367,"threshold_uncertainty_score":0.01285213,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2397481291","doi":"","title":"A Procedural Definition of Multi-word Lexical Units","year":2015,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; WordNet; Intuition; Artificial intelligence; Natural language processing; Decision tree; Machine learning","authors":[{"name":"Marek Maziarz","is_ca":false},{"name":"Stan Śzpakowicz","is_ca":true},{"name":"Maciej Piasecki","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03623442409141529,"gpt":0.3289595941006193,"spread":0.292725170009204,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004967845,0.0009005097,0.0008293852,0.002809675,0.002761361,0.006166762,0.003149108,0.002117064,0.01008691],"category_scores_gemma":[0.01616927,0.0008160939,0.001000706,0.003047774,0.01014466,0.0128428,0.003858871,0.005308574,0.004493249],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00103908,"about_ca_system_score_gemma":0.00157326,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007153494,"about_ca_topic_score_gemma":0.001068117,"domain_scores_codex":[0.9949673,0.002124781,0.0007071524,0.001212503,0.0007601455,0.0002281437],"domain_scores_gemma":[0.993579,0.002506229,0.0006357891,0.001791612,0.00125296,0.0002343398],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00002797958,0.00001573901,0.000243348,0.0000934429,0.000009699956,0.00005565286,0.001098662,0.0003246551,0.001842315,0.9720196,0.002738281,0.02153056],"study_design_scores_gemma":[0.0000173274,0.00005584467,0.0005041983,0.0001871518,0.00001916507,0.0004704044,0.0007104517,0.006253182,0.003265853,0.815102,0.1733681,0.00004634921],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004472439,0.0005816506,0.9712195,0.001894704,0.0005551949,0.0002677807,0.0005398344,0.000489648,0.0199792],"genre_scores_gemma":[0.1460954,0.0004465393,0.8411563,0.001508405,0.0003764901,0.001356499,0.0007008374,0.000602998,0.007756425],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01008691,"threshold_uncertainty_score":0.0337441,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2395936782","doi":"","title":"A Comparative Study of Different Sentiment Lexica for Sentiment Analysis of Tweets","year":2015,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Concordia University","funders":"","keywords":"Sentiment analysis; Computer science; Natural language processing; Artificial intelligence; Information retrieval","authors":[{"name":"Canberk Özdemir","is_ca":false},{"name":"Sabine Bergler","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03576092369102291,"gpt":0.3703291697388255,"spread":0.3345682460478026,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001694657,0.0002804194,0.000308197,0.004585302,0.0008016652,0.001782862,0.0002262874,0.0003009344,0.003053707],"category_scores_gemma":[0.008923487,0.0001329775,0.000619637,0.003861733,0.0004982096,0.002193193,0.0005307239,0.0003935395,0.0009299678],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005578285,"about_ca_system_score_gemma":0.0004996489,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001745873,"about_ca_topic_score_gemma":0.003133665,"domain_scores_codex":[0.9987985,0.0005737917,0.0001451127,0.00009573012,0.0003034667,0.00008329131],"domain_scores_gemma":[0.9922071,0.004871798,0.0003819096,0.0002397758,0.002085986,0.0002134478],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.005585454,0.000885453,0.1643093,0.003555635,0.000736593,0.0008629082,0.009145123,0.002119799,0.1597221,0.0184591,0.01228682,0.6223317],"study_design_scores_gemma":[0.0005082184,0.003310381,0.6336344,0.00115321,0.002558153,0.003908779,0.03819314,0.1178802,0.09966154,0.02223182,0.07652228,0.0004380277],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9348572,0.002347174,0.03532362,0.0005831309,0.0001552152,0.0002148256,0.003068693,0.0004320794,0.02301795],"genre_scores_gemma":[0.952366,0.001336647,0.03926075,0.00009864796,0.000112614,0.0001387517,0.004337213,0.0001920996,0.002157243],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.004585302,"threshold_uncertainty_score":0.01021564,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2251989420","doi":"","title":"Towards a Hybrid Rule-based and Statistical Arabic-French Machine Translation System","year":2013,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Machine translation; Computer science; Natural language processing; Artificial intelligence; Phrase; Arabic; Machine translation software usability; Example-based machine translation; Rule-based machine translation; Evaluation of machine translation; Transfer-based machine translation; Computer-assisted translation; Translation (biology); Synchronous context-free grammar; Scheme (mathematics); BLEU; Modern Standard Arabic; Quality (philosophy); Linguistics","authors":[{"name":"Fatiha Sadat","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.006752702082397749,"gpt":0.2728687706527462,"spread":0.2661160685703484,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001012007,0.0007286949,0.0008844508,0.001031791,0.0006296175,0.001441132,0.0008685353,0.0009949697,0.002457865],"category_scores_gemma":[0.001302136,0.0003812601,0.0006612215,0.0007559748,0.0003624783,0.0009271137,0.0006802988,0.0006576891,0.003696815],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004028775,"about_ca_system_score_gemma":0.0009951224,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003873786,"about_ca_topic_score_gemma":0.003565317,"domain_scores_codex":[0.9993771,0.0001440053,0.00009140412,0.000190865,0.000161244,0.00003550105],"domain_scores_gemma":[0.999201,0.0001712735,0.00004997727,0.000100949,0.0004360989,0.00004064298],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000375884,0.0003149104,0.002953924,0.0003316323,0.0002821111,0.001102747,0.0002447088,0.04464685,0.2002144,0.009609201,0.01149619,0.7284275],"study_design_scores_gemma":[0.00007764564,0.0002894713,0.002161464,0.00004480887,0.0002209372,0.0009640969,0.00009473598,0.8816633,0.0832151,0.005204353,0.02598619,0.00007785668],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03080434,0.0005751766,0.9433327,0.0002942282,0.0001575799,0.0002222052,0.0004929796,0.02050359,0.0036171],"genre_scores_gemma":[0.1586613,0.0002664026,0.8334328,0.0002982807,0.0001174806,0.000238727,0.001608801,0.0003314614,0.005044699],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003873786,"threshold_uncertainty_score":0.008222342,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2407195633","doi":"","title":"A Statistical Model for Measuring Structural Similarity between Webpages","year":2015,"lang":"en","type":"article","venue":"Recent Advances in Natural Language Processing","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Similarity (geometry); Computer science; Web page; Statistical model; Task (project management); Measure (data warehouse); Artificial intelligence; Structural similarity; Information retrieval; Natural language processing; Data mining; Image (mathematics); World Wide Web","authors":[{"name":"Zhenisbek Assylbekov","is_ca":true},{"name":"Assulan Nurkas","is_ca":false},{"name":"Inês Russinho Mouga","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03928171059953837,"gpt":0.3505640517397068,"spread":0.3112823411401684,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002785242,0.0007924805,0.0009879731,0.004417133,0.0005316645,0.001381917,0.001810478,0.001536042,0.001905782],"category_scores_gemma":[0.01403848,0.000605488,0.001373427,0.002715086,0.001269836,0.003756871,0.0009085711,0.001592238,0.002039571],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001092542,"about_ca_system_score_gemma":0.00122287,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003529934,"about_ca_topic_score_gemma":0.003101707,"domain_scores_codex":[0.99773,0.0006042411,0.0001458847,0.0006109598,0.000779711,0.0001291879],"domain_scores_gemma":[0.9927382,0.003832511,0.001118814,0.0009972011,0.001136069,0.0001772135],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005636811,0.0008825797,0.04529995,0.000443891,0.0006585313,0.0008334274,0.0007293574,0.5388482,0.04520677,0.1242035,0.007738075,0.234592],"study_design_scores_gemma":[0.00001040139,0.00009926474,0.005682963,0.00001379365,0.00004124791,0.0002543211,0.00003330246,0.9596612,0.001951214,0.03100012,0.001216012,0.0000360574],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04989413,0.0001872014,0.9462584,0.0002361756,0.00003386753,0.0001148222,0.0006827622,0.00103252,0.001560199],"genre_scores_gemma":[0.7521824,0.0004626511,0.2375225,0.0003341252,0.0002002026,0.0009045416,0.003299981,0.0003433567,0.004750206],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004417133,"threshold_uncertainty_score":0.01472992,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}