{"meta":{"query_hash":"40ccdc7a803e","filters":{"venue":"NTCIR"},"cohort_total":4,"direct_labels_cover":0,"predictions_cover":4,"exported":4,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/40ccdc7a803e","api":"https://metacan.xera.ac/api/v1/cohort?venue=NTCIR"},"results":[{"id":"W2157365731","doi":"","title":"Thomson Legal and Regulatory at NTCIR-4: Monolingual and Pivot-Language Retrieval Experiments","year":2004,"lang":"en","type":"article","venue":"NTCIR","topic":"Information Retrieval and Search Behavior","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Thomson Reuters (Canada)","funders":"","keywords":"Computer science; Task (project management); Natural language processing; Artificial intelligence; Information retrieval; Relevance (law); Quality (philosophy)","score_opus":0.013338833862058457,"score_gpt":0.2747150190288032,"score_spread":0.2613761851667447,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2157365731","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9542228,0.0011196425,0.008795639,0.00073065975,0.0002851544,0.0030688476,0.0067985863,0.00397046,0.02100823],"genre_scores_gemma":[0.92506367,0.00039036502,0.030803781,0.0014820728,0.00023866426,0.0033986461,0.019965999,0.0011203099,0.017536417],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99021155,0.005469103,0.0010655525,0.0010596109,0.0014288398,0.0007653964],"domain_scores_gemma":[0.96318007,0.025663478,0.00078103074,0.004159362,0.0041553006,0.0020606837],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008568047,0.0014049849,0.0020077475,0.0012175982,0.0023158025,0.0018222402,0.0017722482,0.0021799328,0.010517656],"category_scores_gemma":[0.035768382,0.00083932834,0.00062390603,0.001392038,0.0011400225,0.0036123095,0.0026612468,0.0019299889,0.0053792354],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.04542645,0.047463413,0.034437828,0.010846561,0.0013475587,0.0055991234,0.023644682,0.033910304,0.24888515,0.009196055,0.23923272,0.30001023],"study_design_scores_gemma":[0.026027963,0.060843267,0.12829396,0.00057648343,0.0017451002,0.004688042,0.017693672,0.23998474,0.28288025,0.014596769,0.22037345,0.0022963532],"about_ca_topic_score_codex":0.02260366,"about_ca_topic_score_gemma":0.027480362,"teacher_disagreement_score":0.02260366,"about_ca_system_score_codex":0.0017715379,"about_ca_system_score_gemma":0.002241026,"threshold_uncertainty_score":0.045312703},"labels":[],"label_agreement":null},{"id":"W2395937579","doi":"","title":"QA System Metis Based on Semantic Graph Matching at NTCIR 6.","year":2007,"lang":"en","type":"article","venue":"NTCIR","topic":"Topic Modeling","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Metis; Artificial intelligence; Natural language processing; Graph; Matching (statistics); Information retrieval; World Wide Web; Theoretical computer science; Mathematics; Statistics","score_opus":0.015687917336282126,"score_gpt":0.2348742655769794,"score_spread":0.21918634824069727,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2395937579","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050563514,0.0014332449,0.6749339,0.0023277022,0.000907688,0.0020589188,0.027138967,0.17156003,0.06907608],"genre_scores_gemma":[0.38995475,0.0004046786,0.50161636,0.00046357536,0.00029970947,0.0007946591,0.07597366,0.0056974897,0.024795199],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969119,0.001267541,0.00023786655,0.0006497231,0.0006783804,0.00025455988],"domain_scores_gemma":[0.99591583,0.001021349,0.0001740735,0.000876023,0.001811406,0.00020144235],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044835526,0.00085872423,0.0013366676,0.004336286,0.0017118509,0.0032294025,0.0015254036,0.00149607,0.02697256],"category_scores_gemma":[0.009658419,0.0006076961,0.0011750063,0.0021246143,0.0004650592,0.005165939,0.0018685057,0.0012859171,0.015818607],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024384363,0.0008324897,0.009152831,0.0017365367,0.00049786974,0.0005669512,0.0013667198,0.016536666,0.04964442,0.050060738,0.32638398,0.5407824],"study_design_scores_gemma":[0.00056219957,0.0007422489,0.009726512,0.00019489577,0.00050061854,0.0006418305,0.0010874477,0.5764121,0.09977302,0.041329034,0.26877138,0.00025874167],"about_ca_topic_score_codex":0.016579987,"about_ca_topic_score_gemma":0.0122614065,"teacher_disagreement_score":0.02697256,"about_ca_system_score_codex":0.0016485435,"about_ca_system_score_gemma":0.0036673045,"threshold_uncertainty_score":0.09023219},"labels":[],"label_agreement":null},{"id":"W2396216261","doi":"","title":"UQAM's System Description for the NTCIR-10 Japanese and English PatentMT Evaluation Tasks.","year":2013,"lang":"en","type":"article","venue":"NTCIR","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science; Natural language processing; Machine translation; Artificial intelligence; Domain (mathematical analysis); Translation (biology); Linguistics","score_opus":0.025567362361244093,"score_gpt":0.2600134725910629,"score_spread":0.2344461102298188,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2396216261","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02233527,0.0066615813,0.42173642,0.002777863,0.0024388751,0.0119020175,0.27467713,0.14991276,0.10755811],"genre_scores_gemma":[0.06121739,0.0016698262,0.35307974,0.0015207957,0.0003545659,0.011241419,0.5047929,0.008637343,0.05748603],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99728465,0.0007473238,0.00039308518,0.00041437018,0.0008966816,0.00026399377],"domain_scores_gemma":[0.9970323,0.00040896563,0.00016341744,0.00054259005,0.0016331214,0.0002196484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034343386,0.0017615176,0.001267271,0.0034264892,0.0015413491,0.0020041715,0.0020074542,0.0013916828,0.032857966],"category_scores_gemma":[0.0061446377,0.00070017343,0.0006568399,0.0029266067,0.00044555572,0.0021885848,0.0019082024,0.001401537,0.04091974],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004957732,0.00022901452,0.0033018517,0.0020378837,0.00013216112,0.00046640792,0.0005957224,0.0032778785,0.047070775,0.0053750873,0.6989241,0.23809335],"study_design_scores_gemma":[0.000301198,0.0004903073,0.009945541,0.0002708638,0.00013618951,0.0014004274,0.0003687586,0.01950816,0.038460046,0.0029275815,0.9259445,0.00024632673],"about_ca_topic_score_codex":0.03235619,"about_ca_topic_score_gemma":0.03076643,"teacher_disagreement_score":0.032857966,"about_ca_system_score_codex":0.0015440343,"about_ca_system_score_gemma":0.004518042,"threshold_uncertainty_score":0.1099208},"labels":[],"label_agreement":null},{"id":"W2401796064","doi":"","title":"ClueWeb09 and TREC Diversity.","year":2010,"lang":"en","type":"article","venue":"NTCIR","topic":"Information Retrieval and Search Behavior","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Information retrieval; Task (project management); World Wide Web; Set (abstract data type); Search engine; Web page","score_opus":0.010717057301256794,"score_gpt":0.2261840300999137,"score_spread":0.2154669727986569,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2401796064","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031930115,0.02270776,0.02046297,0.01404947,0.015721723,0.012177727,0.64792883,0.047618724,0.18740267],"genre_scores_gemma":[0.032271825,0.0013927277,0.030787038,0.00432455,0.0015692643,0.0061776848,0.8535456,0.003777121,0.06615412],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9730387,0.0070162644,0.0017564012,0.0040589655,0.011088646,0.0030410239],"domain_scores_gemma":[0.9463991,0.008240032,0.0024117583,0.010639574,0.022971848,0.009337746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0254788,0.004245597,0.0037204092,0.017741226,0.004794414,0.0086051645,0.007566846,0.007462893,0.037689902],"category_scores_gemma":[0.0497833,0.0013650521,0.0020117576,0.011294403,0.002030761,0.011156475,0.006924308,0.0055855107,0.03933259],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005833996,0.00047820632,0.0010368073,0.0005409302,0.00007865022,0.00006961839,0.0001038179,0.0010533425,0.0017888753,0.0017474086,0.9531012,0.03941765],"study_design_scores_gemma":[0.0012934961,0.0007648604,0.011043656,0.00036145025,0.00008717691,0.00032138484,0.00038712143,0.008913883,0.008019732,0.0039647506,0.96442056,0.00042195636],"about_ca_topic_score_codex":0.13606153,"about_ca_topic_score_gemma":0.15651445,"teacher_disagreement_score":0.13606153,"about_ca_system_score_codex":0.013349049,"about_ca_system_score_gemma":0.0145945465,"threshold_uncertainty_score":0.27053916},"labels":[],"label_agreement":null}]}