{"meta":{"query_hash":"4f1cdcbff395","filters":{"venue":"International Journal of Speech Technology"},"cohort_total":28,"direct_labels_cover":0,"predictions_cover":28,"exported":28,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/4f1cdcbff395","api":"https://metacan.xera.ac/api/v1/cohort?venue=International+Journal+of+Speech+Technology"},"results":[{"id":"W1506669403","doi":"10.1023/a:1011323308477","title":"VoiceGrip: A Tool for Programming-by-Voice","year":2001,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Digital Accessibility for Disabilities","field":"Social Sciences","cited_by":22,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada","funders":"National Research Council Canada","keywords":"Computer science; Programmer; Syntax; Programming language; Usability; Symbol (formal); Code (set theory); Confusion; Range (aeronautics); Speech recognition; Artificial intelligence; Human–computer interaction","score_opus":0.017852888560412856,"score_gpt":0.3474971288228051,"score_spread":0.32964424026239225,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1506669403","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004020841,0.0003097732,0.3594983,0.00017294435,0.00036965337,0.00084195565,0.0057948446,0.6133876,0.015604048],"genre_scores_gemma":[0.09356262,0.0011757204,0.45050678,0.0017913341,0.0004304937,0.0056684776,0.03512049,0.29183477,0.11990931],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99865216,0.00026142146,0.00016202797,0.00023601971,0.00048619168,0.00020222404],"domain_scores_gemma":[0.99707854,0.0017113368,0.00010919019,0.0003925207,0.00042666722,0.00028168727],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018221308,0.0034856296,0.0015464997,0.0024748328,0.0007865937,0.002028079,0.0029792646,0.0018604094,0.11557478],"category_scores_gemma":[0.006137641,0.0013741447,0.0016563328,0.0008877834,0.0005958433,0.0026208127,0.0046855635,0.0020418337,0.048753735],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002154074,0.00036436482,0.0016153249,0.0018894069,0.00025979953,0.0017266922,0.0015142439,0.0020543477,0.035659317,0.006576396,0.40376034,0.54242575],"study_design_scores_gemma":[0.0012474043,0.00059188536,0.0044425456,0.0008690299,0.00040072194,0.004450751,0.00054790376,0.047721818,0.14689197,0.019418124,0.7726915,0.0007263053],"about_ca_topic_score_codex":0.0012226006,"about_ca_topic_score_gemma":0.0016654109,"teacher_disagreement_score":0.11557478,"about_ca_system_score_codex":0.00041709465,"about_ca_system_score_gemma":0.0006749414,"threshold_uncertainty_score":0.38663614},"labels":[],"label_agreement":null},{"id":"W1963733617","doi":"10.1007/s10772-012-9146-4","title":"Speaker-independent ASR for Modern Standard Arabic: effect of regional accents","year":2012,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; Hidden Markov model; Arabic; Stress (linguistics); Modern Standard Arabic; Natural language processing; Artificial intelligence; Linguistics","score_opus":0.020494706954978407,"score_gpt":0.304830386805333,"score_spread":0.2843356798503546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1963733617","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8844714,0.0016014476,0.09667365,0.00031317212,0.00036039788,0.00009493879,0.0009633867,0.0021557182,0.013365866],"genre_scores_gemma":[0.9436872,0.00092983,0.04426977,0.00016729525,0.00013991659,0.00006768337,0.0015565774,0.00089394354,0.00828776],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9993099,0.00024655391,0.00005133557,0.0001482212,0.00015685885,0.00008703492],"domain_scores_gemma":[0.99530196,0.0029435714,0.00015324203,0.0003716691,0.0010797197,0.00014982585],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009314899,0.0009597995,0.00063359534,0.0003247899,0.00038867182,0.0007722515,0.00042507684,0.0006727576,0.006791135],"category_scores_gemma":[0.004594365,0.00027040954,0.00036687887,0.0003485848,0.00031528267,0.0009825237,0.00057407276,0.00091302244,0.0032823686],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0073426734,0.00023780654,0.0018395368,0.00044921474,0.00013835751,0.00043281342,0.00041339817,0.010556588,0.7722173,0.00075977715,0.0019029921,0.20370948],"study_design_scores_gemma":[0.00027307007,0.0030481813,0.037182007,0.000108354136,0.0008923093,0.0026204903,0.0006283313,0.19540338,0.7488014,0.0013746091,0.009476407,0.00019148353],"about_ca_topic_score_codex":0.0015769453,"about_ca_topic_score_gemma":0.00266878,"teacher_disagreement_score":0.006791135,"about_ca_system_score_codex":0.00015458962,"about_ca_system_score_gemma":0.00040919633,"threshold_uncertainty_score":0.022718668},"labels":[],"label_agreement":null},{"id":"W1976677479","doi":"10.1007/s10772-015-9276-6","title":"Feature selection for robust automatic speech recognition: a temporal offset approach","year":2015,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Computer science; Speech recognition; Offset (computer science); Pattern recognition (psychology); Mel-frequency cepstrum; Feature selection; Artificial intelligence; Noise (video); Selection (genetic algorithm); Feature (linguistics); Feature extraction","score_opus":0.05480987488323085,"score_gpt":0.28389007859278653,"score_spread":0.22908020370955567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1976677479","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017404208,0.00048125253,0.9807582,0.000070952265,0.00006628854,0.000027692426,0.000088199675,0.00048756567,0.00061569427],"genre_scores_gemma":[0.40232277,0.00097241206,0.58792436,0.00013667146,0.00023277005,0.00019019085,0.00096170005,0.00042422808,0.006834802],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99963045,0.00006847889,0.000028622902,0.00007928431,0.00013844452,0.00005469796],"domain_scores_gemma":[0.9995184,0.00018397071,0.000040842067,0.00006587406,0.00016902995,0.000021802782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005744324,0.0005721557,0.00080063957,0.00066037383,0.00037885885,0.0005704214,0.0005883424,0.00042034374,0.0022933423],"category_scores_gemma":[0.0013396824,0.00023630136,0.0007345921,0.00086358935,0.00024765634,0.00062280486,0.0005830406,0.00064505544,0.0008628293],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005947057,0.00016501015,0.0011062326,0.00011531347,0.00009550109,0.00014316684,0.00004367608,0.022265632,0.1478152,0.0040229307,0.0019631982,0.8216694],"study_design_scores_gemma":[0.000054145316,0.00046250754,0.00831192,0.000024519308,0.00018550122,0.00038776503,0.00006756776,0.8821193,0.095848516,0.0048027085,0.0076823076,0.000053233787],"about_ca_topic_score_codex":0.0015460118,"about_ca_topic_score_gemma":0.002119605,"teacher_disagreement_score":0.0022933423,"about_ca_system_score_codex":0.00020767389,"about_ca_system_score_gemma":0.00065173546,"threshold_uncertainty_score":0.007672012},"labels":[],"label_agreement":null},{"id":"W2011408835","doi":"10.1007/s10772-014-9244-6","title":"Dialogue POMDP components (part I): learning states and observations","year":2014,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Partially observable Markov decision process; Computer science; Artificial intelligence; Context (archaeology); Machine learning; Process (computing); Set (abstract data type); Markov model; Markov chain","score_opus":0.018496216936909258,"score_gpt":0.24163162216468634,"score_spread":0.22313540522777708,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011408835","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022529464,0.0002792068,0.9646601,0.0002346744,0.000093418894,0.00035583848,0.0010796546,0.0017526589,0.009014952],"genre_scores_gemma":[0.49863,0.0005240998,0.48228925,0.00013322817,0.00009297261,0.0008609987,0.0025177205,0.0005091499,0.014442517],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994375,0.00012722868,0.000038012982,0.00021013364,0.00014000441,0.000047151043],"domain_scores_gemma":[0.99903584,0.0005275487,0.000064104956,0.00016110177,0.0001679695,0.00004356425],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00088448287,0.00082238164,0.00058489596,0.0003325827,0.00036403092,0.0018463377,0.0010602019,0.0009048609,0.012855056],"category_scores_gemma":[0.0061449814,0.0006188284,0.00076288,0.0004098815,0.0007621443,0.0022409556,0.0011900181,0.0016407523,0.0025067911],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008020483,0.00041319823,0.012309902,0.00088156096,0.00019267893,0.00046033127,0.0021808567,0.19307151,0.03228014,0.102510884,0.0093333395,0.6455636],"study_design_scores_gemma":[0.000061223094,0.00032437572,0.013288772,0.00019373377,0.00014225594,0.00025140998,0.00046141725,0.80870557,0.047615755,0.10236093,0.02649376,0.000100909405],"about_ca_topic_score_codex":0.004901627,"about_ca_topic_score_gemma":0.002867171,"teacher_disagreement_score":0.012855056,"about_ca_system_score_codex":0.0007272318,"about_ca_system_score_gemma":0.0012918045,"threshold_uncertainty_score":0.043004453},"labels":[],"label_agreement":null},{"id":"W2015313388","doi":"10.1007/s10772-014-9224-x","title":"Dialogue POMDP components (Part II): learning the reward function","year":2014,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Partially observable Markov decision process; Computer science; Reinforcement learning; Markov decision process; Context (archaeology); Artificial intelligence; Function (biology); Process (computing); Bellman equation; Machine learning; Markov process; Markov chain; Markov model; Mathematical optimization; Mathematics","score_opus":0.012141879733216104,"score_gpt":0.23098924759122247,"score_spread":0.21884736785800638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2015313388","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017489366,0.00023640103,0.9759453,0.00025951344,0.000118975375,0.00025530398,0.000274823,0.0013660747,0.004054229],"genre_scores_gemma":[0.52951384,0.00030409984,0.45804608,0.0002002034,0.00011497899,0.0006686873,0.00078997185,0.0004900264,0.009872055],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992594,0.00018979707,0.000038640486,0.00024959465,0.00016205863,0.0001005701],"domain_scores_gemma":[0.99883324,0.00060580065,0.000055709606,0.00019468518,0.00022235612,0.00008824966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014771431,0.0010278726,0.0011280462,0.00031202743,0.00042839404,0.0018250992,0.0016256302,0.0014127197,0.0145713445],"category_scores_gemma":[0.00714266,0.00077650644,0.00069336087,0.00031073255,0.00065955863,0.002063914,0.0017440345,0.0026214386,0.0020306478],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012078967,0.00040293796,0.0031867374,0.00051842997,0.00017351224,0.00020435001,0.0005211631,0.32050046,0.021788673,0.056221653,0.007973084,0.5873011],"study_design_scores_gemma":[0.00007420477,0.00017125117,0.0011617535,0.00004813558,0.000046824294,0.000052465086,0.00004672063,0.9512985,0.012525552,0.030452223,0.0040868386,0.000035607103],"about_ca_topic_score_codex":0.0043152696,"about_ca_topic_score_gemma":0.0036105693,"teacher_disagreement_score":0.0145713445,"about_ca_system_score_codex":0.000931944,"about_ca_system_score_gemma":0.0019310797,"threshold_uncertainty_score":0.04874599},"labels":[],"label_agreement":null},{"id":"W2016053816","doi":"10.1007/s10772-012-9186-9","title":"MCRA noise estimation for KLT-VRE-based speech enhancement","year":2013,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; Noise (video); Estimation; Speech enhancement; Artificial intelligence; Pattern recognition (psychology); Noise reduction","score_opus":0.00989396939828999,"score_gpt":0.2753188794034044,"score_spread":0.26542491000511437,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2016053816","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018666249,0.0012128602,0.97469974,0.00017273147,0.00017233084,0.00006684704,0.00016803436,0.0014965654,0.0033446334],"genre_scores_gemma":[0.29093954,0.0015972663,0.6938124,0.00038828474,0.00014701416,0.00013993676,0.0010302926,0.0005084263,0.011436788],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99925405,0.00015007102,0.000048412596,0.00011916035,0.0003507281,0.00007768671],"domain_scores_gemma":[0.9991295,0.000337705,0.000054011616,0.00009015506,0.00035209654,0.00003663804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007756219,0.0011872097,0.00076415215,0.00084079965,0.0003903818,0.0007695892,0.0006882597,0.0012748325,0.0051776026],"category_scores_gemma":[0.0020016409,0.0003605768,0.0006737984,0.00046978836,0.000289256,0.0010351395,0.0008457308,0.00097295723,0.003566538],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011029737,0.00019012592,0.0012308,0.00043397574,0.00011226848,0.00025801183,0.00013929463,0.020326123,0.47019124,0.0017451853,0.0022527038,0.50201726],"study_design_scores_gemma":[0.000050100283,0.0003240295,0.004058638,0.00013903812,0.00017686737,0.0009335517,0.000104758474,0.54445523,0.43004468,0.0010015815,0.018622315,0.00008925517],"about_ca_topic_score_codex":0.0017541711,"about_ca_topic_score_gemma":0.0038523504,"teacher_disagreement_score":0.0051776026,"about_ca_system_score_codex":0.00023859381,"about_ca_system_score_gemma":0.0005666661,"threshold_uncertainty_score":0.017320871},"labels":[],"label_agreement":null},{"id":"W2018093467","doi":"10.1007/s10772-009-9039-3","title":"Synthetic speech in foreign language learning: an evaluation by learners","year":2008,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Natural (archaeology); Active listening; Speech synthesis; Comprehension; Speech recognition; Natural language processing; Foreign language; Linguistics; Artificial intelligence; Psychology; Communication","score_opus":0.017741914160635894,"score_gpt":0.28750836916179695,"score_spread":0.26976645500116103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2018093467","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99181753,0.00027722798,0.004653205,0.00007090984,0.00006816134,0.00030744897,0.0003853278,0.00020193169,0.0022182649],"genre_scores_gemma":[0.98666775,0.00052855816,0.007134277,0.00009250675,0.00007397689,0.00056002307,0.0013956612,0.00010380816,0.003443404],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99512637,0.0032943212,0.00033392923,0.00036212656,0.0007448766,0.00013839774],"domain_scores_gemma":[0.9811473,0.012000853,0.0004969353,0.001412008,0.0030412877,0.0019016704],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063696727,0.0011351018,0.0011576898,0.00089053303,0.0005885126,0.0013415753,0.00081021787,0.0016097977,0.0029792534],"category_scores_gemma":[0.020712648,0.00025087516,0.0006939989,0.00038569627,0.0007718752,0.0012415125,0.00186906,0.00065329607,0.0012889986],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.07240538,0.03125343,0.09350332,0.005202436,0.0013746748,0.0032050712,0.05337587,0.030216888,0.10129282,0.0017835404,0.0061506475,0.6002359],"study_design_scores_gemma":[0.009578382,0.21487187,0.3528445,0.0010081704,0.0032032472,0.010677264,0.05605473,0.10799064,0.19755653,0.0048386273,0.040500507,0.0008755053],"about_ca_topic_score_codex":0.00113357,"about_ca_topic_score_gemma":0.00082517765,"teacher_disagreement_score":0.0063696727,"about_ca_system_score_codex":0.0004502956,"about_ca_system_score_gemma":0.0006820581,"threshold_uncertainty_score":0.0336864},"labels":[],"label_agreement":null},{"id":"W2022504354","doi":"10.1007/s10772-013-9203-7","title":"A novel sub-band adaptive filtering for acoustic echo cancellation based on empirical mode decomposition algorithm","year":2013,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; Hilbert–Huang transform; Algorithm; Microphone; Echo (communications protocol); Adaptive filter; Transfer function; SIGNAL (programming language); Mode (computer interface); Noise (video); Speech recognition; Filter (signal processing); Artificial intelligence; Telecommunications","score_opus":0.019891338903754226,"score_gpt":0.34177033193445233,"score_spread":0.3218789930306981,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2022504354","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023930683,0.00017799325,0.99665856,0.000025485766,0.00004443021,0.000013735147,0.000013118072,0.00019295371,0.00048068998],"genre_scores_gemma":[0.038200855,0.0003773341,0.9581895,0.00008090384,0.000062116844,0.000070903545,0.000112899055,0.00005488828,0.002850596],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99964356,0.000059878097,0.000022386934,0.00006477405,0.00018381118,0.000025603966],"domain_scores_gemma":[0.9996872,0.000105127605,0.00002110761,0.000039861734,0.00012912421,0.000017523507],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003441287,0.00071413897,0.00075941905,0.00047507999,0.00028954266,0.00053605513,0.0007762138,0.00081777154,0.003000512],"category_scores_gemma":[0.000676039,0.0003202091,0.00068595173,0.00059426157,0.000224837,0.0008325347,0.0005368794,0.00080644933,0.0016804673],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032615045,0.00014139572,0.00046450074,0.00019030576,0.00012499948,0.00011065314,0.000069118025,0.025289185,0.31703877,0.00755924,0.0026159487,0.64606977],"study_design_scores_gemma":[0.000037840684,0.00018420379,0.00076310826,0.000020608282,0.000059629943,0.00039895737,0.000018124087,0.9342129,0.051991377,0.0016719197,0.01059439,0.00004684739],"about_ca_topic_score_codex":0.001025269,"about_ca_topic_score_gemma":0.0019791762,"teacher_disagreement_score":0.003000512,"about_ca_system_score_codex":0.00015740473,"about_ca_system_score_gemma":0.00047611247,"threshold_uncertainty_score":0.010037661},"labels":[],"label_agreement":null},{"id":"W2031495521","doi":"10.1007/s10772-011-9104-6","title":"Using speech rhythm knowledge to improve dysarthric speech recognition","year":2011,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Phonetics and Phonology Research","field":"Psychology","cited_by":25,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institut National de la Recherche Scientifique; Université du Québec à Montréal; Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; Dysarthria; Intelligibility (philosophy); Rhythm; Hidden Markov model; Classifier (UML); Artificial intelligence; Pattern recognition (psychology); Psychology","score_opus":0.10366588810498256,"score_gpt":0.3905004229513346,"score_spread":0.286834534846352,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2031495521","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9233896,0.0011668373,0.06637714,0.00035900643,0.00013683458,0.000116095,0.0002503454,0.0010145835,0.007189523],"genre_scores_gemma":[0.97418255,0.00062556093,0.02216676,0.00016459054,0.000062168714,0.00004207119,0.00034172516,0.00006441194,0.002350106],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9998392,0.000027624965,0.00002365116,0.0000646025,0.000029677709,0.000015337268],"domain_scores_gemma":[0.9992368,0.0004908092,0.000065875975,0.00006455311,0.000108971864,0.000032961823],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00026244993,0.00039169678,0.00042186474,0.00027751084,0.00016112383,0.00055039045,0.0002829727,0.00042133767,0.0034875087],"category_scores_gemma":[0.0025078035,0.00013593624,0.00021217304,0.00015865361,0.00013590268,0.0006257199,0.00028683685,0.0004459592,0.0008398836],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013470866,0.0015567212,0.0066611604,0.0002862956,0.00014297228,0.00040709806,0.00024768573,0.0043568793,0.29482996,0.0003738932,0.0011693019,0.688621],"study_design_scores_gemma":[0.0016567458,0.008099997,0.22806293,0.0003353063,0.002906078,0.0072955685,0.0012579702,0.22632957,0.50408536,0.0068539744,0.012910293,0.00020612222],"about_ca_topic_score_codex":0.0010046144,"about_ca_topic_score_gemma":0.0020508382,"teacher_disagreement_score":0.0034875087,"about_ca_system_score_codex":0.000096712654,"about_ca_system_score_gemma":0.00027959212,"threshold_uncertainty_score":0.011666834},"labels":[],"label_agreement":null},{"id":"W2052003572","doi":"10.1007/s10772-005-2166-6","title":"Aligning Text and Phonemes for Speech Technology Applications Using an EM-Like Algorithm","year":2005,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada; National Research Council Institute for Biodiagnostics","funders":"","keywords":"Computer science; Speech recognition; Speech synthesis; Speech technology; Algorithm; Artificial intelligence; Natural language processing","score_opus":0.021730622613951044,"score_gpt":0.3048551054452593,"score_spread":0.28312448283130826,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052003572","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004090573,0.000048673908,0.99410003,0.000053979657,0.00007383529,0.000029509354,0.000046293557,0.0009597861,0.0005973086],"genre_scores_gemma":[0.045578364,0.000116056566,0.9501069,0.00011079921,0.00006088551,0.00011712106,0.0004496025,0.00043915774,0.0030210703],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994305,0.00016010119,0.00004898547,0.00020350516,0.00011210715,0.000044793556],"domain_scores_gemma":[0.9989512,0.0004890775,0.00006472386,0.00015769753,0.0002967943,0.000040404324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010521736,0.0011897915,0.0007895868,0.0007732836,0.0006378596,0.0010163336,0.0010118252,0.0018465547,0.0074474276],"category_scores_gemma":[0.0047006225,0.0005945097,0.0010384277,0.0012026167,0.0004879997,0.0015636873,0.0010940806,0.0016474976,0.005624262],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006241585,0.00015596673,0.00079536386,0.00020474005,0.00015424774,0.00019187108,0.00014600513,0.08807941,0.07523761,0.009647713,0.004805758,0.8199572],"study_design_scores_gemma":[0.00007546267,0.00017077333,0.0009964156,0.000032702534,0.000085718115,0.0003565903,0.00010558551,0.9047321,0.07089716,0.010464537,0.012036175,0.000046741134],"about_ca_topic_score_codex":0.0014419524,"about_ca_topic_score_gemma":0.0021153348,"teacher_disagreement_score":0.0074474276,"about_ca_system_score_codex":0.00027579296,"about_ca_system_score_gemma":0.0008490049,"threshold_uncertainty_score":0.024914086},"labels":[],"label_agreement":null},{"id":"W2061284695","doi":"10.1007/s10772-013-9189-1","title":"Computational auditory models in predicting noise reduction performance for wideband telephony applications","year":2013,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Computer science; Speech recognition; Noise (video); Wideband; Noise reduction; Reliability (semiconductor); Wideband audio; Reduction (mathematics); Telephony; Quality (philosophy); Artificial intelligence; Speech coding; Telecommunications; Mathematics","score_opus":0.009768127122746243,"score_gpt":0.2514530187062966,"score_spread":0.24168489158355036,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061284695","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.63305163,0.00067749777,0.36125264,0.00030526295,0.000116065254,0.000050968167,0.0001923935,0.0010028975,0.0033506905],"genre_scores_gemma":[0.9840338,0.00014085727,0.014476281,0.000029991415,0.000019003512,0.000025933732,0.00007539813,0.000025740062,0.0011729472],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99989533,0.0000313637,0.000006693656,0.000016728962,0.000033025946,0.00001690322],"domain_scores_gemma":[0.99907696,0.0007045615,0.000048047077,0.00003089988,0.00011509736,0.00002453368],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00039034704,0.0005278805,0.00037200324,0.00039701795,0.00023545642,0.0006583783,0.00045197774,0.0006979992,0.0009507373],"category_scores_gemma":[0.002758866,0.0003110417,0.00039139963,0.00021701635,0.00018582313,0.0004978236,0.00030926807,0.00057523337,0.00039288172],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017420124,0.00007670093,0.0011401942,0.000020499758,0.00002383258,0.00003038864,0.000021345017,0.97059196,0.0036424156,0.00041791954,0.0002183161,0.02364211],"study_design_scores_gemma":[0.0000017440348,0.000014910573,0.00018444005,0.0000011306583,0.0000045355137,0.0000044159965,0.00000306172,0.9991798,0.00045066027,0.00012965697,0.000023401673,0.0000021618905],"about_ca_topic_score_codex":0.009143298,"about_ca_topic_score_gemma":0.009577746,"teacher_disagreement_score":0.009143298,"about_ca_system_score_codex":0.0002983496,"about_ca_system_score_gemma":0.0004545271,"threshold_uncertainty_score":0.018180132},"labels":[],"label_agreement":null},{"id":"W2072245166","doi":"10.1007/s10772-005-2168-4","title":"Post Recognition Speech Localization","year":2005,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Phrase; Speech recognition; SIGNAL (programming language); Speech processing; Multilateration; Word (group theory); Artificial intelligence; Pattern recognition (psychology); Acoustics; Mathematics","score_opus":0.01544005197725855,"score_gpt":0.2639430521250483,"score_spread":0.24850300014778975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2072245166","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059196223,0.001329557,0.83592594,0.00068382773,0.0016162186,0.00046160351,0.0031160603,0.035329908,0.06234072],"genre_scores_gemma":[0.36234188,0.0011837651,0.35202426,0.0012952344,0.000779735,0.00053583604,0.010505081,0.003369854,0.26796436],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99937075,0.000050190105,0.000027193015,0.00021119301,0.00023692769,0.00010378558],"domain_scores_gemma":[0.99923646,0.000114053364,0.000041259595,0.00022465114,0.0003360207,0.00004765528],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004161278,0.0015734371,0.0008839445,0.0012626041,0.0009813055,0.0022204383,0.00083306833,0.001467887,0.0753638],"category_scores_gemma":[0.001022132,0.0004591483,0.0006218152,0.00071330776,0.00041455278,0.0013217378,0.001197927,0.00095684984,0.07170521],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007466071,0.00012984595,0.0008554319,0.00018883352,0.000032714528,0.0002793304,0.00007844881,0.000733297,0.44833794,0.002603237,0.01141822,0.5345961],"study_design_scores_gemma":[0.00005765078,0.00045539613,0.007499203,0.000051062852,0.00011199923,0.0015608046,0.00012006257,0.028237326,0.8710956,0.0016373972,0.089120194,0.000053335996],"about_ca_topic_score_codex":0.0016647856,"about_ca_topic_score_gemma":0.0034046345,"teacher_disagreement_score":0.0753638,"about_ca_system_score_codex":0.0004316439,"about_ca_system_score_gemma":0.00096853275,"threshold_uncertainty_score":0.25211704},"labels":[],"label_agreement":null},{"id":"W2085830557","doi":"10.1007/s10772-009-9025-9","title":"A noise-robust front-end for distributed speech recognition in mobile communications","year":2007,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; Front and back ends; Formant; Mel-frequency cepstrum; GSM; Speech processing; Cepstrum; Noise (video); Task (project management); Artificial intelligence; Feature extraction; Telecommunications","score_opus":0.029785846712475042,"score_gpt":0.30922723126381185,"score_spread":0.2794413845513368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2085830557","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020936575,0.0005033545,0.97165585,0.00015088846,0.00018005571,0.00007539974,0.00012302186,0.0043558944,0.0020190298],"genre_scores_gemma":[0.270538,0.00052100874,0.7059007,0.0008360972,0.00034275668,0.00021362977,0.0008413203,0.00046946385,0.020336978],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9993155,0.000095204676,0.000032482923,0.00011362236,0.0003791456,0.000064002175],"domain_scores_gemma":[0.999303,0.00023114632,0.000030469164,0.00009857916,0.00030051175,0.00003627521],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005792323,0.0009026246,0.0010470025,0.00058755727,0.00065543014,0.0010052252,0.0011696038,0.0017742814,0.0048939297],"category_scores_gemma":[0.0012080111,0.0004019007,0.0005233879,0.00042572868,0.0002865037,0.0008271174,0.0007182026,0.0009147143,0.0059210635],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017956885,0.0003245188,0.0005528027,0.00020284274,0.000106323714,0.0003669587,0.000095991556,0.009566078,0.56283164,0.0030027619,0.006282269,0.41487214],"study_design_scores_gemma":[0.00015452964,0.00067870476,0.0013927664,0.00005091684,0.00015749453,0.0010661889,0.000045095705,0.46939012,0.50683624,0.0023923877,0.017760608,0.000074918804],"about_ca_topic_score_codex":0.0009897368,"about_ca_topic_score_gemma":0.0021019513,"teacher_disagreement_score":0.0048939297,"about_ca_system_score_codex":0.00033843116,"about_ca_system_score_gemma":0.00042623203,"threshold_uncertainty_score":0.016371846},"labels":[],"label_agreement":null},{"id":"W2134558312","doi":"10.1007/s10772-012-9157-1","title":"The CARES corpus: a database of older adult actor simulated emergency dialogue for developing a personal emergency response system","year":2012,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Social Robot Interaction and HRI","field":"Psychology","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Rehabilitation Institute; University of Toronto","funders":"Canadian Institutes of Health Research; University of Toronto; Toronto Rehabilitation Institute","keywords":"Computer science; Emergency response; Human–computer interaction; Multimedia; World Wide Web; Database; Natural language processing; Medical emergency; Medicine","score_opus":0.03739795723703559,"score_gpt":0.38223702902467155,"score_spread":0.34483907178763595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134558312","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21992563,0.0038112947,0.024020907,0.0008733115,0.00074677553,0.0015889986,0.7219898,0.009638702,0.01740456],"genre_scores_gemma":[0.13341042,0.0009357687,0.023652066,0.0004072074,0.00014402469,0.0019984741,0.8302736,0.00094840914,0.008230018],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99910176,0.00032440055,0.00013443842,0.00020287307,0.00016787215,0.00006872575],"domain_scores_gemma":[0.9975303,0.0013116669,0.00013562178,0.00033195905,0.00047219335,0.00021830447],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010467496,0.0015214868,0.0007976301,0.0024551174,0.000957397,0.0011349856,0.0015113817,0.0023246827,0.015700437],"category_scores_gemma":[0.006089718,0.00035674407,0.0006305198,0.0016884514,0.00064189703,0.0011287439,0.0016895698,0.0010360364,0.008979673],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031357394,0.002129857,0.0170811,0.009924881,0.00060568174,0.005861538,0.007798238,0.0066206804,0.03539844,0.0037868347,0.6915376,0.21611938],"study_design_scores_gemma":[0.0011674557,0.00074734044,0.09530591,0.001598558,0.0006180386,0.0062515805,0.0078004627,0.019136826,0.024954518,0.0040001664,0.8378934,0.0005256615],"about_ca_topic_score_codex":0.010229755,"about_ca_topic_score_gemma":0.017643018,"teacher_disagreement_score":0.015700437,"about_ca_system_score_codex":0.0006769458,"about_ca_system_score_gemma":0.001256067,"threshold_uncertainty_score":0.052523196},"labels":[],"label_agreement":null},{"id":"W2158112478","doi":"10.1007/s10772-008-9007-3","title":"VoiceMarks: restructuring hierarchical voice menus for improving navigation","year":2006,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Computer science; Ticket; Human–computer interaction; Process (computing); Schedule; Interface (matter); User interface; Telephony; Multimedia; Telecommunications; Computer network","score_opus":0.0069514658770851835,"score_gpt":0.25311129350439066,"score_spread":0.24615982762730548,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158112478","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05636932,0.0005868045,0.7687687,0.00017352114,0.0003813628,0.00024067875,0.0012317412,0.16900915,0.0032388289],"genre_scores_gemma":[0.2920172,0.00039505653,0.67982584,0.00032420363,0.00016344791,0.00033664325,0.0033191214,0.011241783,0.012376735],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9993019,0.00010807965,0.00006246151,0.00015943199,0.00028062132,0.000087450055],"domain_scores_gemma":[0.9969332,0.0014796115,0.00017829258,0.0006700171,0.00054150535,0.00019739933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006956642,0.0017324019,0.0010788867,0.0010088822,0.00063647865,0.0012063903,0.0027735627,0.0014815419,0.021944407],"category_scores_gemma":[0.0056194826,0.0009698129,0.00072537136,0.00087223254,0.0004842962,0.0028226506,0.0021529314,0.0012246689,0.004559311],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019798826,0.0005064749,0.0021341378,0.00057706103,0.00008072113,0.00042163604,0.00067850214,0.007878907,0.120610185,0.0039268676,0.03607687,0.8251287],"study_design_scores_gemma":[0.0013533634,0.0018013851,0.005676449,0.00028012655,0.000605601,0.0013112813,0.0009884557,0.52010906,0.34477326,0.020800425,0.101878956,0.0004215947],"about_ca_topic_score_codex":0.0031346541,"about_ca_topic_score_gemma":0.004689755,"teacher_disagreement_score":0.021944407,"about_ca_system_score_codex":0.00028515203,"about_ca_system_score_gemma":0.0007522276,"threshold_uncertainty_score":0.073411345},"labels":[],"label_agreement":null},{"id":"W2163339323","doi":"10.1007/s10772-011-9116-2","title":"Bayesian on-line spectral change point detection: a soft computing approach for on-line ASR","year":2011,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":36,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institut National de la Recherche Scientifique; Université de Moncton; Université du Québec à Montréal","funders":"","keywords":"Computer science; Noise (video); Line (geometry); Speech recognition; Dynamic mode decomposition; Artificial intelligence; Pattern recognition (psychology); Machine learning","score_opus":0.06346383785389761,"score_gpt":0.3007303888762885,"score_spread":0.2372665510223909,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2163339323","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004597894,0.000073276424,0.993972,0.000087014916,0.000018288558,0.00003841499,0.00003674453,0.00042643675,0.00074992556],"genre_scores_gemma":[0.28832537,0.00029750346,0.7042506,0.00037383556,0.0001592107,0.00021152967,0.0002919414,0.00032891086,0.0057611642],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99803513,0.0006104523,0.00013141637,0.00029184844,0.0007664159,0.00016465332],"domain_scores_gemma":[0.9971635,0.0014993153,0.00028869702,0.00028637223,0.0006738942,0.00008822135],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015109997,0.001290021,0.0020999177,0.0012979519,0.00064653315,0.0016167077,0.0019267254,0.001769592,0.0037868086],"category_scores_gemma":[0.005247887,0.000817895,0.00095593726,0.0014272715,0.000806731,0.0016735882,0.0017591177,0.00184855,0.0017378366],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041064105,0.00035418922,0.00090233405,0.0001776929,0.00012150003,0.000112925205,0.000120080505,0.23755705,0.028633902,0.006722337,0.0020680963,0.7228193],"study_design_scores_gemma":[0.000006306856,0.00003427283,0.00028584956,0.00000780995,0.000011283467,0.000031476502,0.0000100474645,0.9937103,0.0031906604,0.002243612,0.0004577512,0.000010714529],"about_ca_topic_score_codex":0.0037854593,"about_ca_topic_score_gemma":0.005720092,"teacher_disagreement_score":0.0037868086,"about_ca_system_score_codex":0.00060325325,"about_ca_system_score_gemma":0.001055829,"threshold_uncertainty_score":0.012668133},"labels":[],"label_agreement":null},{"id":"W2479628911","doi":"10.1007/s10772-016-9352-6","title":"Audio steganalysis using deep belief networks","year":2016,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Music and Audio Processing","field":"Computer Science","cited_by":29,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Steganalysis; Computer science; Artificial intelligence; Support vector machine; Pattern recognition (psychology); Steganography; Deep belief network; Classifier (UML); Mixture model; Speech recognition; Deep learning; Image (mathematics)","score_opus":0.010908966867149933,"score_gpt":0.2630156662380046,"score_spread":0.25210669937085467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2479628911","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055900503,0.00045868297,0.9407657,0.0003020912,0.000058634025,0.000025219866,0.000058988215,0.0008163514,0.0016138413],"genre_scores_gemma":[0.8689856,0.0003217211,0.12569502,0.0001431663,0.000048931128,0.000039541002,0.00018574014,0.00006113796,0.004519128],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9998171,0.00003792496,0.000009303985,0.000039864368,0.00005476246,0.000041212723],"domain_scores_gemma":[0.99921215,0.00049152126,0.00006386168,0.0000620745,0.0001450651,0.000025266083],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004618528,0.0006135704,0.0005103423,0.0004604746,0.00021747206,0.0004994991,0.0005380118,0.00069731305,0.0011945582],"category_scores_gemma":[0.0015852902,0.00038992398,0.00048012144,0.0002711704,0.00040588397,0.000820905,0.0008859581,0.0012149498,0.0002985906],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023658863,0.00009876129,0.0012043159,0.00006129304,0.00009386914,0.00008752603,0.000037513808,0.7481489,0.014208264,0.0048947465,0.0010519348,0.22987624],"study_design_scores_gemma":[0.0000017791959,0.000008313098,0.000048614034,0.0000017099545,0.0000033165156,0.0000055134087,0.0000015587319,0.99781704,0.0013212032,0.00073665637,0.000052963085,0.0000014263109],"about_ca_topic_score_codex":0.0043316586,"about_ca_topic_score_gemma":0.00558308,"teacher_disagreement_score":0.0043316586,"about_ca_system_score_codex":0.00043402976,"about_ca_system_score_gemma":0.0004942898,"threshold_uncertainty_score":0.008612871},"labels":[],"label_agreement":null},{"id":"W2799838911","doi":"10.1007/s10772-018-9507-8","title":"Gain optimization for millimeter wave reflectarray antennas based on a phase gradient approach","year":2018,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Advanced Antenna and Metasurface Technologies","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Computer science; Extremely high frequency; Linear phase; Bandwidth (computing); Phase (matter); Base station; Unit (ring theory); Antenna (radio); Millimeter; Electronic engineering; Telecommunications; Optics; Physics; Mathematics; Engineering","score_opus":0.026951814528730033,"score_gpt":0.2978482421224721,"score_spread":0.27089642759374205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2799838911","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06757108,0.00034656952,0.9096383,0.00034871357,0.00005102296,0.000037168626,0.0000631616,0.00027194823,0.021672146],"genre_scores_gemma":[0.65995806,0.0005268766,0.3262611,0.00016900546,0.000054912955,0.00012650044,0.00013450923,0.000306101,0.012462889],"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99989223,0.000024443007,0.000002466239,0.000011773963,0.000054940094,0.000014066078],"domain_scores_gemma":[0.99992657,0.000030462399,0.000011762089,0.0000073216725,0.000019769042,0.000004068569],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00016321051,0.00052990054,0.0003652324,0.00021214088,0.00012104893,0.0005291727,0.00039214906,0.0005266706,0.0018124146],"category_scores_gemma":[0.00035922465,0.00024557754,0.00036038266,0.0002761205,0.00021986134,0.0004293022,0.0003586607,0.00033557785,0.0007097077],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036061014,0.00015023942,0.0008614463,0.00021980357,0.00009134364,0.0001272518,0.00015249681,0.6242268,0.20520517,0.06346237,0.0030538465,0.102088585],"study_design_scores_gemma":[0.000024042603,0.000072931376,0.0002414468,0.000007883052,0.000012907649,0.000058204496,0.00002436497,0.9812944,0.013390259,0.0028996298,0.0019615488,0.000012393375],"about_ca_topic_score_codex":0.00037958878,"about_ca_topic_score_gemma":0.00082289043,"teacher_disagreement_score":0.0018124146,"about_ca_system_score_codex":0.00029393614,"about_ca_system_score_gemma":0.00026835874,"threshold_uncertainty_score":0.0060631633},"labels":[],"label_agreement":null},{"id":"W2901429777","doi":"10.1007/s10772-018-09564-8","title":"Evaluating noise suppression methods for recovering the Lombard speech from vocal output in an external noise field","year":2018,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"QUIET; Computer science; Noise (video); Noise reduction; Headphones; Acoustics; Background noise; Microphone; Speech recognition; Intelligibility (philosophy); Speech perception; Speech enhancement; Perception; Sound pressure; Telecommunications; Physics; Artificial intelligence; Psychology","score_opus":0.053492707641162304,"score_gpt":0.42766334640486187,"score_spread":0.37417063876369955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2901429777","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58972424,0.0029146506,0.40378413,0.00012689747,0.00012273419,0.00018063086,0.00013759595,0.00074813946,0.0022609574],"genre_scores_gemma":[0.8053404,0.0012769358,0.18911119,0.000077756384,0.00007233613,0.00011256427,0.00039974425,0.00015618837,0.0034529064],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99935323,0.00016046588,0.000053393043,0.000111757334,0.00025955826,0.000061639206],"domain_scores_gemma":[0.99646604,0.0024327144,0.00015953514,0.00013380528,0.0006928701,0.00011494809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016120924,0.0011591153,0.00078754814,0.00085543306,0.00037920265,0.00071231904,0.00058232306,0.0013301806,0.0013236388],"category_scores_gemma":[0.005033276,0.0002840339,0.0005681041,0.0003996081,0.00045723727,0.00075711973,0.00063670834,0.00043477572,0.00053295144],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0076343636,0.00089996145,0.005151076,0.0010536321,0.00047514134,0.00023112855,0.00026690087,0.12941527,0.32099143,0.0006567411,0.00051967095,0.53270465],"study_design_scores_gemma":[0.0001508818,0.0021340956,0.0075286515,0.00003492746,0.00032459415,0.0002531247,0.00018935758,0.8421642,0.1462851,0.00028886707,0.00060064136,0.00004559254],"about_ca_topic_score_codex":0.0033785866,"about_ca_topic_score_gemma":0.0039579985,"teacher_disagreement_score":0.0033785866,"about_ca_system_score_codex":0.0003304714,"about_ca_system_score_gemma":0.00069889845,"threshold_uncertainty_score":0.00852567},"labels":[],"label_agreement":null},{"id":"W2982012035","doi":"10.1007/s10772-019-09642-5","title":"Maximum entropy PLDA for robust speaker recognition under speech coding distortion","year":2019,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; TIMIT; Robustness (evolution); Artificial intelligence; Pattern recognition (psychology); Hidden Markov model","score_opus":0.021086434745969065,"score_gpt":0.263887749614766,"score_spread":0.24280131486879697,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2982012035","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017622713,0.0005876019,0.9801328,0.00010761109,0.000045673605,0.000025248533,0.00014217851,0.0007009908,0.0006351287],"genre_scores_gemma":[0.44566366,0.00092023617,0.5462569,0.0001244794,0.00012957148,0.0001253587,0.00095941615,0.0002386451,0.00558172],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994809,0.00018193228,0.000044315322,0.00009746309,0.00014718271,0.000048300808],"domain_scores_gemma":[0.9991767,0.0004705055,0.000060720442,0.00011484843,0.00015432836,0.000022815444],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00091646786,0.0007188253,0.00071141304,0.00041770362,0.00032485308,0.0007216653,0.00052182924,0.0005425895,0.0021090454],"category_scores_gemma":[0.0022177706,0.00035287533,0.0004567134,0.0004051698,0.00034445478,0.0009642651,0.0008080119,0.0007715542,0.000960287],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00095767685,0.00012331887,0.0009465584,0.00025308214,0.00011612233,0.00029405873,0.00011179033,0.11618878,0.13176782,0.008962232,0.0028945561,0.7373841],"study_design_scores_gemma":[0.000012337181,0.00009253761,0.0010904077,0.000014653867,0.000021798369,0.00012946225,0.000014745745,0.96399516,0.030385833,0.0025317064,0.0016908896,0.000020348876],"about_ca_topic_score_codex":0.0011889259,"about_ca_topic_score_gemma":0.0018590743,"teacher_disagreement_score":0.0021090454,"about_ca_system_score_codex":0.00028322102,"about_ca_system_score_gemma":0.0005359683,"threshold_uncertainty_score":0.0070554614},"labels":[],"label_agreement":null},{"id":"W3007770218","doi":"10.1007/s10772-020-09688-w","title":"Low-complexity disordered speech quality estimation","year":2020,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec en Outaouais; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Speech recognition; Quality (philosophy); Estimation; Artificial intelligence","score_opus":0.03829898257176356,"score_gpt":0.3238917484867665,"score_spread":0.28559276591500293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3007770218","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17553067,0.0006766398,0.8203096,0.00013685475,0.00007569479,0.00006132553,0.00030459274,0.00088878983,0.0020158365],"genre_scores_gemma":[0.8397583,0.00042245246,0.15686826,0.000068886366,0.000058148322,0.000035098456,0.00062411686,0.0000829488,0.0020818652],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997092,0.000052741485,0.00002106279,0.000056972563,0.00012294906,0.00003698807],"domain_scores_gemma":[0.9994721,0.00023850154,0.000041826934,0.00006276058,0.00015566817,0.00002917377],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00030807214,0.00057434506,0.00046321453,0.0005150747,0.00019968895,0.0005302492,0.00034134206,0.0005006123,0.0016290434],"category_scores_gemma":[0.0018228967,0.00019097407,0.0002818502,0.0002908724,0.00017825261,0.00050951866,0.00048568493,0.00045723113,0.000622305],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020382635,0.00024207294,0.010618796,0.00042450195,0.00011913118,0.00071185816,0.00017607688,0.047925856,0.33028948,0.0026230789,0.001681666,0.6031492],"study_design_scores_gemma":[0.000047000714,0.00027480416,0.019786725,0.000028072423,0.00009004601,0.0009094312,0.000066709814,0.9063671,0.06910307,0.001209838,0.0020789993,0.000038210947],"about_ca_topic_score_codex":0.0025305913,"about_ca_topic_score_gemma":0.0032666388,"teacher_disagreement_score":0.0025305913,"about_ca_system_score_codex":0.00018058796,"about_ca_system_score_gemma":0.00038327972,"threshold_uncertainty_score":0.0054497123},"labels":[],"label_agreement":null},{"id":"W3013233519","doi":"10.1007/s10772-020-09697-9","title":"Correction to: Low-complexity disordered speech quality estimation","year":2020,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec en Outaouais; Western University","funders":"","keywords":"Mistake; Spelling; Computer science; Estimation; Quality (philosophy); Speech recognition; Artificial intelligence; Linguistics; Epistemology; Philosophy; Law; Management","score_opus":0.03186906875116981,"score_gpt":0.3246419416956319,"score_spread":0.2927728729444621,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3013233519","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017640468,0.0010147478,0.0075814687,0.0215666,0.96294415,0.00008497302,0.001232174,0.001990214,0.001821696],"genre_scores_gemma":[0.18153316,0.008291119,0.059870966,0.052338865,0.41622376,0.00073765905,0.0061633815,0.0074388403,0.26740214],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9979381,0.0002121498,0.00057214085,0.00035251077,0.00071893475,0.00020616967],"domain_scores_gemma":[0.9790101,0.0057370155,0.0011245055,0.0025108764,0.0105470475,0.0010705076],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00154257,0.002105599,0.0027797415,0.002583321,0.0019274618,0.0022636026,0.0026844407,0.009685124,0.09592108],"category_scores_gemma":[0.037219048,0.001125141,0.0012622614,0.0015592983,0.0014073551,0.0016538226,0.0018455102,0.0073992023,0.051361557],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057574984,0.000055411023,0.00046947526,0.0007085121,0.00008299313,0.008456113,0.00017184184,0.00029562513,0.0024896776,0.0014733067,0.91949975,0.06572155],"study_design_scores_gemma":[0.00026663527,0.00021898584,0.0052965903,0.00044354025,0.00009334177,0.018014215,0.00032331815,0.0036420764,0.0068731885,0.003381494,0.9612356,0.00021098864],"about_ca_topic_score_codex":0.0039712796,"about_ca_topic_score_gemma":0.006087271,"teacher_disagreement_score":0.09592108,"about_ca_system_score_codex":0.001327093,"about_ca_system_score_gemma":0.0012107557,"threshold_uncertainty_score":0.32088792},"labels":[],"label_agreement":null},{"id":"W4318350603","doi":"10.1007/s10772-023-10018-z","title":"Plain-to-clear speech video conversion for enhanced intelligibility","year":2023,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Social Sciences and Humanities Research Council of Canada; Simon Fraser University","keywords":"Computer science; Intelligibility (philosophy); Speech recognition; Image warping; Perception; Artificial intelligence; Psychology","score_opus":0.01663494020198911,"score_gpt":0.30902520948653456,"score_spread":0.2923902692845454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318350603","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.68760645,0.00063750974,0.30462995,0.0001362415,0.0001645433,0.00030117188,0.00054458965,0.0015127945,0.00446693],"genre_scores_gemma":[0.8086301,0.00047980677,0.18655173,0.00011961585,0.0000486987,0.0002438465,0.00049227115,0.0002604411,0.0031735017],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.999858,0.000029593817,0.00001659018,0.00003206031,0.00004811542,0.000015593092],"domain_scores_gemma":[0.99939656,0.0002974033,0.00005322814,0.00007984922,0.00013151861,0.00004143653],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00031209202,0.00047137876,0.00020240735,0.0003215855,0.00011365095,0.00040725307,0.00027658502,0.00032495713,0.003347678],"category_scores_gemma":[0.0016352814,0.00012932008,0.00022354847,0.00015071622,0.0002461364,0.00047502792,0.00043986703,0.00037384283,0.00056919944],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031694805,0.00009190913,0.00047585234,0.00021297086,0.000011861998,0.00014837635,0.000102317346,0.0021124631,0.94232213,0.00048053535,0.00029768565,0.053426974],"study_design_scores_gemma":[0.000049662234,0.0011119618,0.007865658,0.00003107048,0.000051160605,0.000544506,0.000104104394,0.028282106,0.95746017,0.00036781683,0.0040988754,0.000032977317],"about_ca_topic_score_codex":0.00023484364,"about_ca_topic_score_gemma":0.00035636558,"teacher_disagreement_score":0.003347678,"about_ca_system_score_codex":0.00008682053,"about_ca_system_score_gemma":0.00012977986,"threshold_uncertainty_score":0.011199057},"labels":[],"label_agreement":null},{"id":"W4324027600","doi":"10.1007/s10772-023-10027-y","title":"The perception of artificial-intelligence (AI) based synthesized speech in younger and older adults","year":2023,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Hearing Loss and Rehabilitation","field":"Neuroscience","cited_by":53,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Baycrest Hospital; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Intelligibility (philosophy); Speech perception; Computer science; Perception; Speech recognition; Speech processing; Voice activity detection; Speech synthesis; Audiology; Masking (illustration); Psychology; Medicine","score_opus":0.021525813469131787,"score_gpt":0.31455021828447377,"score_spread":0.293024404815342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4324027600","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99899834,0.00013034648,0.000053651813,0.000021647336,0.0000067871383,0.000005296309,0.00005233704,0.0000020853317,0.0007295637],"genre_scores_gemma":[0.9990988,0.00009114264,0.00005804893,0.000044500823,0.0000069799257,0.0000046129826,0.000064589934,0.0000017690496,0.0006295979],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9997924,0.0000262018,0.000028290242,0.00004794942,0.00006611879,0.000039065297],"domain_scores_gemma":[0.9985044,0.00054402865,0.00030176062,0.000049491,0.00027374973,0.00032662443],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005357601,0.0003463903,0.000332294,0.00051449024,0.00020679361,0.0012445428,0.00018608946,0.0005822584,0.0029518732],"category_scores_gemma":[0.0048390036,0.00015380888,0.00022786095,0.00016832647,0.0003273208,0.0006456868,0.00061237626,0.00043099013,0.00047778053],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0073488806,0.0009392058,0.7259345,0.0005367828,0.00033058814,0.0021416098,0.069372505,0.0005011874,0.13095912,0.00053041324,0.0013211425,0.06008401],"study_design_scores_gemma":[0.000036137197,0.0008148658,0.98719645,0.000016532465,0.000050445047,0.0006043874,0.009384739,0.00035137302,0.00089148205,0.00021193808,0.00042464552,0.000017098679],"about_ca_topic_score_codex":0.0061040274,"about_ca_topic_score_gemma":0.0056870286,"teacher_disagreement_score":0.0061040274,"about_ca_system_score_codex":0.0002634741,"about_ca_system_score_gemma":0.0001482067,"threshold_uncertainty_score":0.012136996},"labels":[],"label_agreement":null},{"id":"W4378231186","doi":"10.1007/s10772-023-10030-3","title":"Mouth2Audio: intelligible audio synthesis from videos with distinctive vowel articulation","year":2023,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Social Sciences and Humanities Research Council of Canada; Simon Fraser University","keywords":"Computer science; Speech recognition; Formant; Spectrogram; Manner of articulation; Landmark; Vowel; Articulation (sociology); Artificial intelligence","score_opus":0.009332505270161847,"score_gpt":0.25164903389289384,"score_spread":0.24231652862273198,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4378231186","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23910303,0.0019444438,0.7051635,0.00038438188,0.0010142636,0.0005244021,0.008740818,0.023637112,0.019488038],"genre_scores_gemma":[0.5264291,0.0008605495,0.42808557,0.00025264907,0.0003611635,0.00047024392,0.012745547,0.0028540853,0.02794107],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9997992,0.000029955978,0.000010911698,0.00004622735,0.000086581684,0.00002711394],"domain_scores_gemma":[0.9997943,0.00009476554,0.000008249465,0.000026668995,0.000048757218,0.000027309607],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00036230433,0.00081946613,0.00047187984,0.00052693894,0.00018361451,0.0006000875,0.00046587473,0.000744897,0.016039146],"category_scores_gemma":[0.00091591483,0.00018154441,0.00025758342,0.00028906413,0.00019737858,0.000411289,0.0007350207,0.0003202604,0.0024924455],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030346334,0.00012525321,0.00080240064,0.00065292715,0.000070658476,0.0007508974,0.00019139714,0.005037567,0.57211715,0.0019560927,0.010923388,0.40433758],"study_design_scores_gemma":[0.00085703784,0.0016543927,0.007710631,0.00012782053,0.00011690107,0.0022372804,0.0002910107,0.20623761,0.7202672,0.0021502925,0.058214486,0.0001353723],"about_ca_topic_score_codex":0.00077697204,"about_ca_topic_score_gemma":0.0018745121,"teacher_disagreement_score":0.016039146,"about_ca_system_score_codex":0.00012449134,"about_ca_system_score_gemma":0.00019949007,"threshold_uncertainty_score":0.05365622},"labels":[],"label_agreement":null},{"id":"W4388380244","doi":"10.1007/s10772-023-10059-4","title":"Attention-based factorized TDNN for a noise-robust and spoof-aware speaker verification system","year":2023,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Spoofing attack; Speech recognition; Speaker verification; Encoder; Speaker recognition; Artificial neural network; Context (archaeology); Mel-frequency cepstrum; Artificial intelligence; Word error rate; Frame (networking); Pattern recognition (psychology); Feature extraction; Telecommunications","score_opus":0.02756174976548047,"score_gpt":0.27208361846283263,"score_spread":0.24452186869735215,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388380244","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.096314035,0.0014484735,0.8951883,0.00026161142,0.0004662087,0.00009307338,0.00027784432,0.0029873615,0.0029629974],"genre_scores_gemma":[0.8156336,0.0006064271,0.1767054,0.00025144467,0.00014835774,0.00007733767,0.00044776706,0.00010699022,0.006022633],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99967015,0.00004534048,0.000024368876,0.000109783155,0.0000883696,0.00006203257],"domain_scores_gemma":[0.99960214,0.00008574382,0.000023745752,0.00003191801,0.0002336643,0.000022789725],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00054931553,0.0005609195,0.0006070452,0.0004133502,0.00041884521,0.00044268096,0.0007791077,0.00067272905,0.0027790202],"category_scores_gemma":[0.00073168747,0.00021493959,0.000499081,0.00031515403,0.00019718277,0.0006561039,0.0005208225,0.00064520637,0.0010126213],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009929306,0.0001768036,0.0012336263,0.00012769712,0.00008661102,0.0001439487,0.00006582738,0.027131885,0.19907957,0.0008085289,0.0027876312,0.7673649],"study_design_scores_gemma":[0.000023919181,0.00026388888,0.002444819,0.000019940693,0.00009328317,0.00025678021,0.000029278093,0.9287469,0.065181196,0.000554322,0.0023511997,0.00003443846],"about_ca_topic_score_codex":0.009221364,"about_ca_topic_score_gemma":0.01299119,"teacher_disagreement_score":0.009221364,"about_ca_system_score_codex":0.00042804112,"about_ca_system_score_gemma":0.00069292623,"threshold_uncertainty_score":0.018335402},"labels":[],"label_agreement":null},{"id":"W4400357331","doi":"10.1007/s10772-024-10120-w","title":"Pathological voice classification system based on CNN-BiLSTM network using speech enhancement and multi-stream approach","year":2024,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"","keywords":"Computer science; Speech recognition; Artificial intelligence; Voice activity detection; Natural language processing; Speech processing","score_opus":0.037110030700195654,"score_gpt":0.30198433189472046,"score_spread":0.2648743011945248,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400357331","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2765184,0.0031241882,0.70165515,0.0006788142,0.0009271121,0.00036077364,0.001331932,0.0077580223,0.0076455683],"genre_scores_gemma":[0.8666736,0.0013157263,0.11859674,0.00035279786,0.0002732718,0.00015804858,0.0015448555,0.00019559043,0.010889369],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99981326,0.000016249096,0.000013692221,0.000067147834,0.00006138546,0.000028239345],"domain_scores_gemma":[0.9998266,0.000026698104,0.000011419884,0.000015440717,0.00010071704,0.00001914982],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00033076518,0.0006604808,0.0005229147,0.00066786807,0.00022011848,0.00049138285,0.0005094995,0.00069306826,0.0025047043],"category_scores_gemma":[0.00047049127,0.00017402701,0.00041365394,0.00019765127,0.0001251851,0.00047488348,0.00045946156,0.00038286706,0.0013079365],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008345084,0.00020483662,0.016099395,0.00024583229,0.00013777743,0.0011048669,0.00007508645,0.008493412,0.18864436,0.0005622431,0.005867397,0.7777303],"study_design_scores_gemma":[0.00008799595,0.0005866573,0.051592954,0.00008466346,0.0004228952,0.0046633612,0.00017452583,0.79453313,0.13915117,0.0018091653,0.0068060406,0.0000874158],"about_ca_topic_score_codex":0.002161674,"about_ca_topic_score_gemma":0.0048644245,"teacher_disagreement_score":0.0025047043,"about_ca_system_score_codex":0.00021032663,"about_ca_system_score_gemma":0.0003959991,"threshold_uncertainty_score":0.008379102},"labels":[],"label_agreement":null},{"id":"W586724576","doi":"10.1007/s10772-015-9280-x","title":"Mobile spoken dialogue system using parser dependencies and ontology","year":2015,"lang":"en","type":"article","venue":"International Journal of Speech Technology","topic":"Speech and dialogue systems","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton; Université du Québec à Montréal","funders":"","keywords":"Computer science; Parsing; Sentence; Natural language processing; Mobile phone; Android (operating system); Artificial intelligence; Spoken language; Dependency (UML)","score_opus":0.029085445274014795,"score_gpt":0.27848607373452006,"score_spread":0.24940062846050526,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W586724576","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05472217,0.0005237845,0.83886296,0.00022356345,0.00022428847,0.00025082033,0.0038007288,0.096250996,0.0051406673],"genre_scores_gemma":[0.46602184,0.00029184498,0.51105803,0.0002465284,0.000076223194,0.00035085497,0.009092656,0.0031204112,0.009741642],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9996152,0.00006440964,0.00004504243,0.0001557567,0.00008742544,0.000032095926],"domain_scores_gemma":[0.99940026,0.00024572265,0.00003113282,0.00009043908,0.00019273256,0.000039759678],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00067521736,0.0006262372,0.0010821817,0.0008057024,0.0006020935,0.0012238008,0.0008366346,0.00064823765,0.0063862563],"category_scores_gemma":[0.0014304523,0.0005314261,0.0006419081,0.00048317295,0.00020385647,0.001979273,0.0011089399,0.0007802065,0.0029380904],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017903633,0.00044878438,0.0037823024,0.0009250576,0.00031134067,0.0013792121,0.0016885346,0.011496286,0.19670264,0.0151028745,0.03916004,0.7272126],"study_design_scores_gemma":[0.00041837193,0.00045978863,0.004875418,0.00014929152,0.00073641783,0.0014508168,0.0009880105,0.69640946,0.17697512,0.017874312,0.099351965,0.0003110749],"about_ca_topic_score_codex":0.004807733,"about_ca_topic_score_gemma":0.0047370885,"teacher_disagreement_score":0.0063862563,"about_ca_system_score_codex":0.00038665844,"about_ca_system_score_gemma":0.0013567739,"threshold_uncertainty_score":0.021364152},"labels":[],"label_agreement":null}]}