{"meta":{"query_hash":"57e0b6922e06","filters":{"venue":"PhysioNet"},"cohort_total":17,"direct_labels_cover":0,"predictions_cover":17,"exported":17,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/57e0b6922e06","api":"https://metacan.xera.ac/api/v1/cohort?venue=PhysioNet"},"results":[{"id":"W6884851608","doi":"10.13026/1wf7-pm14","title":"Asclepius-R : Clinical Large Language Model Built On MIMIC-III Discharge Summaries","year":2023,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Usability; Resource (disambiguation); Language model; Benchmark (surveying); Data modeling","score_opus":0.06624195068223274,"score_gpt":0.3947683611672638,"score_spread":0.32852641048503106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6884851608","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12571013,0.0021690784,0.113471515,0.004176186,0.0012062399,0.0016596362,0.6630643,0.07886009,0.009682839],"genre_scores_gemma":[0.15449134,0.0006496493,0.08025023,0.0008994576,0.00013127939,0.0015993842,0.75512767,0.001141898,0.0057091718],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99878865,0.00048155055,0.00018664665,0.00031650084,0.00014940037,0.00007723178],"domain_scores_gemma":[0.99624,0.0023405186,0.00017875884,0.00052263937,0.0005434932,0.0001745791],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002115645,0.0018161961,0.00056629296,0.001594089,0.00035512296,0.0011282853,0.0018035029,0.0011417902,0.010562502],"category_scores_gemma":[0.014183883,0.00046361625,0.0013108886,0.0011223091,0.00035363997,0.0011222456,0.0013753996,0.0017038665,0.008720625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016172461,0.0006208483,0.021363411,0.002028333,0.00042545248,0.0015915831,0.0006074365,0.07469667,0.005321099,0.0041471026,0.6721111,0.21546987],"study_design_scores_gemma":[0.0014479456,0.0011154024,0.018551795,0.0007531462,0.00033975558,0.0023963943,0.0010107682,0.6558383,0.018617684,0.018461866,0.2810947,0.0003723188],"about_ca_topic_score_codex":0.01368725,"about_ca_topic_score_gemma":0.02492492,"teacher_disagreement_score":0.01368725,"about_ca_system_score_codex":0.0012781918,"about_ca_system_score_gemma":0.0030126798,"threshold_uncertainty_score":0.035335124},"labels":[],"label_agreement":null},{"id":"W6884882244","doi":"10.13026/p8zc-cs44","title":"Annotation dataset of social determinants of health from MIMIC-III Clinical Care Database","year":2023,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Annotation; Social determinants of health; Health care; Agreement; Social care; MEDLINE; Social media; Dual (grammatical number)","score_opus":0.13220818322804898,"score_gpt":0.468883117840802,"score_spread":0.336674934612753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6884882244","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058432415,0.0015960109,0.010247072,0.001879299,0.00046887074,0.0012626611,0.9169501,0.0019539038,0.007209674],"genre_scores_gemma":[0.035222568,0.00033872484,0.016253203,0.0005449153,0.00012647375,0.00226827,0.942827,0.00015332951,0.0022654317],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99664307,0.0012003679,0.0007351079,0.0007449956,0.00051538483,0.00016114594],"domain_scores_gemma":[0.98814255,0.0065693343,0.001039097,0.0014620917,0.0022513666,0.000535647],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028750803,0.00076959433,0.00061240955,0.002550814,0.0010327627,0.00083732774,0.0012075031,0.0014784631,0.0061167656],"category_scores_gemma":[0.013544936,0.00026766778,0.0005583993,0.001990941,0.00057916215,0.0005678364,0.0017471695,0.0011837138,0.0057676136],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013786614,0.0005043571,0.046080686,0.007753758,0.00018747656,0.003103592,0.0042414684,0.002535362,0.017998189,0.003308251,0.819309,0.09359925],"study_design_scores_gemma":[0.0006318461,0.00037080448,0.17726353,0.001536955,0.0002481485,0.0020668672,0.003328065,0.010542751,0.010274774,0.004112309,0.7893989,0.00022510902],"about_ca_topic_score_codex":0.009999248,"about_ca_topic_score_gemma":0.018894505,"teacher_disagreement_score":0.009999248,"about_ca_system_score_codex":0.001498102,"about_ca_system_score_gemma":0.00305188,"threshold_uncertainty_score":0.020462632},"labels":[],"label_agreement":null},{"id":"W6884909244","doi":"10.13026/vc0e-th79","title":"WiDS (Women in Data Science) Datathon 2020: ICU Mortality Prediction","year":2020,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vector Institute; University of Toronto","funders":"","keywords":"Big data; Mortality rate; Intensive care unit; MEDLINE; Data source; Health care","score_opus":0.07746496477094239,"score_gpt":0.3559154355650454,"score_spread":0.278450470794103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6884909244","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00017030831,0.00008021995,0.00028383246,0.00042352095,0.00011304533,0.00002365136,0.99609023,0.0016770752,0.0011380784],"genre_scores_gemma":[0.00056433736,0.00007236309,0.0007769033,0.0002897683,0.00002441298,0.00009564962,0.9969284,0.00034262464,0.0009055381],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983412,0.00039642546,0.00019896176,0.0003766119,0.00043562514,0.00025114548],"domain_scores_gemma":[0.9961831,0.00081642094,0.00028430266,0.0009883324,0.0008202802,0.00090759905],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031481977,0.0020600478,0.0011246786,0.002287688,0.00092670834,0.0030196945,0.002656044,0.0019234684,0.07669754],"category_scores_gemma":[0.01149613,0.0009357223,0.0013591893,0.004757979,0.00046234255,0.0029978543,0.004875647,0.0026801901,0.107297175],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004351773,0.000007746987,0.00046244118,0.00014918653,0.00001267771,0.0000088434745,0.000011045522,0.00007742974,0.000057613208,0.0003257673,0.99715185,0.0016919792],"study_design_scores_gemma":[0.00032371868,0.000030130004,0.0037956976,0.00023617048,0.000028472647,0.0000649327,0.000059784365,0.00063676457,0.00042017965,0.0017238016,0.9926414,0.000038930375],"about_ca_topic_score_codex":0.019748406,"about_ca_topic_score_gemma":0.033368886,"teacher_disagreement_score":0.07669754,"about_ca_system_score_codex":0.0013164931,"about_ca_system_score_gemma":0.0029274377,"threshold_uncertainty_score":0.25657886},"labels":[],"label_agreement":null},{"id":"W6922363832","doi":"10.13026/zsgv-8w31","title":"Annotation dataset of social determinants of health from MIMIC-III Clinical Care Database","year":2024,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Historical Geopolitical and Social Dynamics","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Annotation; Social determinants of health; Health care; Agreement; Social care; MEDLINE; Social media; Dual (grammatical number)","score_opus":0.06688549351667016,"score_gpt":0.44420817155020814,"score_spread":0.377322678033538,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6922363832","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058432415,0.0015960109,0.010247072,0.001879299,0.00046887074,0.0012626611,0.9169501,0.0019539038,0.007209674],"genre_scores_gemma":[0.035222568,0.00033872484,0.016253203,0.0005449153,0.00012647375,0.00226827,0.942827,0.00015332951,0.0022654317],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99664307,0.0012003679,0.0007351079,0.0007449956,0.00051538483,0.00016114594],"domain_scores_gemma":[0.98814255,0.0065693343,0.001039097,0.0014620917,0.0022513666,0.000535647],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028750803,0.00076959433,0.00061240955,0.002550814,0.0010327627,0.00083732774,0.0012075031,0.0014784631,0.0061167656],"category_scores_gemma":[0.013544936,0.00026766778,0.0005583993,0.001990941,0.00057916215,0.0005678364,0.0017471695,0.0011837138,0.0057676136],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013786614,0.0005043571,0.046080686,0.007753758,0.00018747656,0.003103592,0.0042414684,0.002535362,0.017998189,0.003308251,0.819309,0.09359925],"study_design_scores_gemma":[0.0006318461,0.00037080448,0.17726353,0.001536955,0.0002481485,0.0020668672,0.003328065,0.010542751,0.010274774,0.004112309,0.7893989,0.00022510902],"about_ca_topic_score_codex":0.009999248,"about_ca_topic_score_gemma":0.018894505,"teacher_disagreement_score":0.009999248,"about_ca_system_score_codex":0.001498102,"about_ca_system_score_gemma":0.00305188,"threshold_uncertainty_score":0.020462632},"labels":[],"label_agreement":null},{"id":"W6922631198","doi":"10.13026/ckbf-pt70","title":"Asclepius-R : Clinical Large Language Model Built On MIMIC-III Discharge Summaries","year":2024,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Usability; Resource (disambiguation); Language model; Benchmark (surveying); Data modeling","score_opus":0.04527118146809302,"score_gpt":0.3859986484987003,"score_spread":0.3407274670306073,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6922631198","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12413639,0.0021502369,0.1101584,0.0041540964,0.0012097062,0.0016439839,0.66938794,0.077561185,0.009598103],"genre_scores_gemma":[0.15086597,0.0006436942,0.078452826,0.0008906812,0.00013033484,0.0015888411,0.76059985,0.001131141,0.005696642],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987834,0.0004841906,0.00018772675,0.0003172837,0.00014979618,0.000077563825],"domain_scores_gemma":[0.99622715,0.0023458402,0.00017976826,0.00052475673,0.00054559927,0.00017692416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021194848,0.0018233644,0.0005683161,0.0016061869,0.0003564524,0.0011268965,0.0018148316,0.0011486525,0.010690505],"category_scores_gemma":[0.014279839,0.00046567273,0.0013076955,0.0011341965,0.00035650114,0.0011279408,0.0013820088,0.0017094235,0.00886385],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016002714,0.0006186069,0.021210086,0.0020249372,0.00041814367,0.0015755546,0.00060176605,0.07254389,0.0052335896,0.0040685334,0.67838424,0.21172044],"study_design_scores_gemma":[0.0014764863,0.0011310749,0.018981928,0.00076901534,0.0003419706,0.0024326828,0.001030667,0.64722806,0.018764006,0.018541275,0.28892466,0.00037812899],"about_ca_topic_score_codex":0.013655268,"about_ca_topic_score_gemma":0.025027143,"teacher_disagreement_score":0.013655268,"about_ca_system_score_codex":0.0012803351,"about_ca_system_score_gemma":0.0030200563,"threshold_uncertainty_score":0.035763323},"labels":[],"label_agreement":null},{"id":"W6941079881","doi":"10.13026/37yb-1t42","title":"Bridge2AI-Voice: An ethically-sourced, diverse voice dataset linked to health information","year":2025,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Mycorrhizal Fungi and Plant Interactions","field":"Agricultural and Biological Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Baycrest Hospital; Lunenfeld-Tanenbaum Research Institute; Trillium Health Centre; Université de Montréal; University of Toronto; SickKids Foundation; Dalhousie University; Hospital for Sick Children; Bridgepoint Active Healthcare; Simon Fraser University","funders":"","keywords":"Spectrogram; Voice analysis; Mood; Data collection; Big data","score_opus":0.022130786647277582,"score_gpt":0.2896273029604329,"score_spread":0.2674965163131553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6941079881","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004817178,0.00026439276,0.000996266,0.000284516,0.00008581317,0.00010302964,0.9915809,0.00058631564,0.0012816367],"genre_scores_gemma":[0.0040925094,0.000065279586,0.001142949,0.00011645361,0.000018007426,0.00020526322,0.99357224,0.00003284007,0.0007544373],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99885714,0.00033405342,0.00013865453,0.00030505672,0.00023991057,0.00012520756],"domain_scores_gemma":[0.9981998,0.0005991175,0.0002132492,0.00039207496,0.00037790925,0.00021779616],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012270455,0.0011309604,0.0007895086,0.001776111,0.00066453475,0.0012440141,0.0021651099,0.0024422028,0.009161026],"category_scores_gemma":[0.006071701,0.00030778325,0.0008720301,0.0021745358,0.00046143212,0.000757385,0.002278642,0.001190284,0.012962501],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006540586,0.00019596716,0.016418898,0.0018401601,0.00020291434,0.0004492345,0.00029993427,0.0014318163,0.0017299824,0.0013536133,0.95428944,0.02113401],"study_design_scores_gemma":[0.00072841253,0.00025903608,0.0717278,0.000687273,0.00017578514,0.001218809,0.0008666512,0.006357846,0.0027324085,0.0036777903,0.9113964,0.0001717026],"about_ca_topic_score_codex":0.014560504,"about_ca_topic_score_gemma":0.040139787,"teacher_disagreement_score":0.014560504,"about_ca_system_score_codex":0.0009184539,"about_ca_system_score_gemma":0.0014268107,"threshold_uncertainty_score":0.030646682},"labels":[],"label_agreement":null},{"id":"W6941313737","doi":"10.13026/cqt2-0b27","title":"MIMIC-IV on FHIR","year":2024,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Mycorrhizal Fungi and Plant Interactions","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children","funders":"","keywords":"Interoperability; Terminology; Health care; ENCODE; Information system; Restructuring; Process (computing); Health informatics; Data warehouse","score_opus":0.013698811187891392,"score_gpt":0.22804762082628155,"score_spread":0.21434880963839015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6941313737","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023940313,0.00036800047,0.0008509388,0.00034153287,0.000120436176,0.000088077366,0.9902221,0.0028848958,0.002729932],"genre_scores_gemma":[0.0024839845,0.0000864654,0.001589155,0.00012207305,0.000012311328,0.00010376303,0.99488443,0.00013758696,0.0005803493],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99708265,0.0006850322,0.00037986075,0.0008698985,0.00062593847,0.00035654762],"domain_scores_gemma":[0.99718755,0.00059532427,0.00022034922,0.0011885787,0.0005804941,0.00022765496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028253775,0.0016747868,0.0010124582,0.0035903906,0.00096661015,0.0026062028,0.0031481632,0.0018848726,0.01801292],"category_scores_gemma":[0.01211841,0.0005457795,0.0020047438,0.004560824,0.00064495276,0.001816394,0.0032861817,0.0015151651,0.02913027],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033993996,0.00008001651,0.006905858,0.0009876324,0.00013488145,0.00011621743,0.00010247491,0.0022331653,0.00057139865,0.0024351932,0.9741479,0.011945363],"study_design_scores_gemma":[0.00031952647,0.00008736276,0.009949462,0.00038618228,0.0000692048,0.0002503552,0.00022742724,0.0038329319,0.001282203,0.0033797615,0.98015094,0.00006465982],"about_ca_topic_score_codex":0.029771708,"about_ca_topic_score_gemma":0.048336845,"teacher_disagreement_score":0.029771708,"about_ca_system_score_codex":0.0016763684,"about_ca_system_score_gemma":0.002650788,"threshold_uncertainty_score":0.060259163},"labels":[],"label_agreement":null},{"id":"W6959883823","doi":"10.13026/249v-w155","title":"Bridge2AI-Voice: An ethically-sourced, diverse voice dataset linked to health information","year":2025,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Spectrogram; Voice analysis; Mood; Data collection; Big data","score_opus":0.0316463037866117,"score_gpt":0.35347112923944546,"score_spread":0.32182482545283375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6959883823","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0057622297,0.00027925614,0.0019003367,0.00031415853,0.00014226859,0.00016400253,0.9884647,0.0012165391,0.0017565371],"genre_scores_gemma":[0.0044974526,0.00006351138,0.0016530805,0.00010441927,0.00002607424,0.00027566834,0.9923759,0.000059643677,0.000944142],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9985561,0.00041290114,0.00016962309,0.00036507772,0.00034398222,0.00015229499],"domain_scores_gemma":[0.9977114,0.0007135793,0.00023585495,0.00056728965,0.0004980058,0.00027386437],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014366468,0.0013483937,0.0008449882,0.0018890171,0.00074093905,0.0013444889,0.0022481924,0.0024422074,0.010208024],"category_scores_gemma":[0.006787174,0.00035840503,0.00088027155,0.002101523,0.0005682592,0.0008887177,0.0026933174,0.0013054388,0.01667736],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000619087,0.00019371742,0.010936699,0.0014442647,0.00015213309,0.0004306813,0.00033761407,0.001326108,0.0021955466,0.0012056619,0.95843345,0.022725081],"study_design_scores_gemma":[0.0007515288,0.00033610992,0.06560598,0.00061359466,0.00015819442,0.0014783959,0.0010027855,0.00792421,0.0038928408,0.004137745,0.91387564,0.00022296823],"about_ca_topic_score_codex":0.012683476,"about_ca_topic_score_gemma":0.03221663,"teacher_disagreement_score":0.012683476,"about_ca_system_score_codex":0.0008494654,"about_ca_system_score_gemma":0.0014288715,"threshold_uncertainty_score":0.03414917},"labels":[],"label_agreement":null},{"id":"W6959989302","doi":"10.13026/3xt6-rf05","title":"Bridge2AI-Voice: An ethically-sourced, diverse voice dataset linked to health information","year":2025,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Plant pathogens and resistance mechanisms","field":"Agricultural and Biological Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; University of Toronto; SickKids Foundation; Dalhousie University; Hospital for Sick Children; Simon Fraser University","funders":"","keywords":"Spectrogram; Voice analysis; Mood; Data collection; Human voice","score_opus":0.02480228992026199,"score_gpt":0.2753309313074211,"score_spread":0.2505286413871591,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6959989302","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006366241,0.00030366884,0.0043933764,0.0004949848,0.00020205395,0.0002470824,0.98291516,0.0016414805,0.003435897],"genre_scores_gemma":[0.008379677,0.000107289015,0.00431874,0.00023230388,0.000055497607,0.000620431,0.98403925,0.00015492982,0.002091746],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983822,0.00049372076,0.0001936062,0.0003975027,0.0003760305,0.00015694086],"domain_scores_gemma":[0.9967636,0.0010679789,0.00036146233,0.0007801408,0.00068563706,0.0003412572],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016189072,0.00088339,0.0006767217,0.0017678989,0.00067481305,0.0013694227,0.0016867612,0.0021100591,0.01407916],"category_scores_gemma":[0.0090401815,0.0002898788,0.0007397284,0.0020467045,0.0004816295,0.0009990156,0.0028534296,0.00110047,0.017183946],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079114217,0.00016467484,0.014269631,0.0016374034,0.00013886108,0.00044300975,0.000563152,0.0010968774,0.003278699,0.0021743602,0.93986183,0.03558038],"study_design_scores_gemma":[0.00046645597,0.00022735224,0.062049095,0.00057677,0.00011684332,0.0008825085,0.0010196716,0.004853554,0.0035315275,0.0051740985,0.9209353,0.00016689663],"about_ca_topic_score_codex":0.009560876,"about_ca_topic_score_gemma":0.022494636,"teacher_disagreement_score":0.01407916,"about_ca_system_score_codex":0.0007493179,"about_ca_system_score_gemma":0.0014380079,"threshold_uncertainty_score":0.04709947},"labels":[],"label_agreement":null},{"id":"W6960159768","doi":"10.13026/s5rz-1j65","title":"Asclepius-R : Clinical Large Language Model Built On MIMIC-III Discharge Summaries","year":2024,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Phytochemistry and Biological Activities","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Usability; Resource (disambiguation); Language model; Benchmark (surveying); Data modeling","score_opus":0.04396920669721984,"score_gpt":0.31361604946006827,"score_spread":0.26964684276284845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6960159768","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.105012804,0.0021385609,0.07953645,0.0040021627,0.0010908236,0.0014766881,0.74467814,0.054448362,0.007616007],"genre_scores_gemma":[0.123158775,0.00063320994,0.06391034,0.0009149756,0.00012466562,0.0014933796,0.8043425,0.0007887985,0.0046333764],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99886703,0.0004346098,0.00018459205,0.000304821,0.0001345723,0.000074453375],"domain_scores_gemma":[0.9964108,0.0022183643,0.00017915542,0.00051045837,0.0005034803,0.00017773513],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019533853,0.0017658409,0.0005610992,0.0015654437,0.00035101836,0.0011055361,0.0017808964,0.0012500291,0.010288156],"category_scores_gemma":[0.012532333,0.00041973853,0.0014515476,0.00106417,0.0003474445,0.0010885337,0.0013472127,0.0017405644,0.008138789],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018036464,0.00068215374,0.024871211,0.0024488745,0.00045744688,0.0017569754,0.0005645839,0.058532823,0.005708527,0.0038978085,0.69451016,0.20476578],"study_design_scores_gemma":[0.0017986814,0.0013949403,0.023931963,0.00089732534,0.00042909652,0.0029925741,0.0011754368,0.56127685,0.0197441,0.019488487,0.3664565,0.00041406066],"about_ca_topic_score_codex":0.012262453,"about_ca_topic_score_gemma":0.024343478,"teacher_disagreement_score":0.012262453,"about_ca_system_score_codex":0.0012816126,"about_ca_system_score_gemma":0.0028453062,"threshold_uncertainty_score":0.03441727},"labels":[],"label_agreement":null},{"id":"W7080721321","doi":"10.13026/5b8h-jx61","title":"mcPHASES: A Dataset of Physiological, Hormonal, and Self-reported Events and Symptoms for Menstrual Health Tracking with Wearables","year":2025,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Menstrual cycle; Distress; Wearable computer; Wearable technology; Activity tracker; Reproductive health; Tracking (education)","score_opus":0.024297886433895258,"score_gpt":0.28948594551326184,"score_spread":0.2651880590793666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7080721321","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03920393,0.0018394806,0.0027410008,0.0004383057,0.00020909848,0.00028541448,0.9499317,0.0014575411,0.0038936436],"genre_scores_gemma":[0.060341988,0.00091159396,0.00610582,0.0002486917,0.00008383637,0.0006933051,0.92925596,0.000097090466,0.0022617339],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995141,0.00007083628,0.000060706316,0.00015278457,0.00011761371,0.00008406131],"domain_scores_gemma":[0.9990526,0.00017435435,0.0001327843,0.00020313954,0.00029175312,0.00014536403],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004349963,0.0010614748,0.00081326196,0.0019193589,0.0006275672,0.00086352683,0.0012184869,0.0011444717,0.003811674],"category_scores_gemma":[0.0030398981,0.0002762269,0.00086328085,0.0025754867,0.000306213,0.0005498163,0.0017020159,0.0007836232,0.0039076046],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017769871,0.00037424278,0.20768261,0.0050184424,0.0007052775,0.001329294,0.0015533516,0.002754553,0.008986934,0.0018747489,0.65723056,0.11071298],"study_design_scores_gemma":[0.00023800423,0.0002590412,0.5127205,0.0008749339,0.00024518982,0.0008858461,0.0017507283,0.0047166278,0.0029094166,0.0015667684,0.4736423,0.00019065215],"about_ca_topic_score_codex":0.096132606,"about_ca_topic_score_gemma":0.22820508,"teacher_disagreement_score":0.096132606,"about_ca_system_score_codex":0.0010729863,"about_ca_system_score_gemma":0.0017193151,"threshold_uncertainty_score":0.19114608},"labels":[],"label_agreement":null},{"id":"W7080721330","doi":"10.13026/zx6a-2c81","title":"mcPHASES: A Dataset of Physiological, Hormonal, and Self-reported Events and Symptoms for Menstrual Health Tracking with Wearables","year":2025,"lang":"en","type":"dataset","venue":"PhysioNet","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Menstrual cycle; Distress; Wearable computer; Wearable technology; Activity tracker; Reproductive health; Tracking (education)","score_opus":0.024297886433895258,"score_gpt":0.28948594551326184,"score_spread":0.2651880590793666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7080721330","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03920393,0.0018394806,0.0027410008,0.0004383057,0.00020909848,0.00028541448,0.9499317,0.0014575411,0.0038936436],"genre_scores_gemma":[0.060341988,0.00091159396,0.00610582,0.0002486917,0.00008383637,0.0006933051,0.92925596,0.000097090466,0.0022617339],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9995141,0.00007083628,0.000060706316,0.00015278457,0.00011761371,0.00008406131],"domain_scores_gemma":[0.9990526,0.00017435435,0.0001327843,0.00020313954,0.00029175312,0.00014536403],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004349963,0.0010614748,0.00081326196,0.0019193589,0.0006275672,0.00086352683,0.0012184869,0.0011444717,0.003811674],"category_scores_gemma":[0.0030398981,0.0002762269,0.00086328085,0.0025754867,0.000306213,0.0005498163,0.0017020159,0.0007836232,0.0039076046],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017769871,0.00037424278,0.20768261,0.0050184424,0.0007052775,0.001329294,0.0015533516,0.002754553,0.008986934,0.0018747489,0.65723056,0.11071298],"study_design_scores_gemma":[0.00023800423,0.0002590412,0.5127205,0.0008749339,0.00024518982,0.0008858461,0.0017507283,0.0047166278,0.0029094166,0.0015667684,0.4736423,0.00019065215],"about_ca_topic_score_codex":0.096132606,"about_ca_topic_score_gemma":0.22820508,"teacher_disagreement_score":0.096132606,"about_ca_system_score_codex":0.0010729863,"about_ca_system_score_gemma":0.0017193151,"threshold_uncertainty_score":0.19114608},"labels":[],"label_agreement":null},{"id":"W7115697022","doi":"10.13026/k81f-qr68","title":"Bridge2AI-Voice: An ethically-sourced, diverse voice dataset linked to health information","year":2025,"lang":"","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; Université de Montréal; University of Toronto; SickKids Foundation; Dalhousie University; Hospital for Sick Children; Simon Fraser University","funders":"","keywords":"Spectrogram; Voice analysis; Mood; Data collection; Big data","score_opus":0.03248821624541169,"score_gpt":0.35334038130166123,"score_spread":0.3208521650562495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115697022","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060076998,0.00023785896,0.0014546893,0.0002978814,0.0001045044,0.0001409527,0.98924303,0.00087762956,0.0016357142],"genre_scores_gemma":[0.0051775216,0.00005770687,0.0013602539,0.00011120681,0.000023882034,0.00026095938,0.99209166,0.000046936344,0.0008697762],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99875355,0.00036531835,0.00014378317,0.00031378664,0.00029025562,0.00013327836],"domain_scores_gemma":[0.9979722,0.0006347384,0.00023633182,0.00047761883,0.00041923212,0.000259767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012098149,0.0011264188,0.00074101775,0.0018859736,0.0006668383,0.0012266997,0.002033394,0.0022926235,0.0098422],"category_scores_gemma":[0.006089785,0.00031194833,0.000796166,0.0021521081,0.00050228427,0.00076040137,0.0025072622,0.0011940531,0.014370836],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058235927,0.00018863699,0.013704551,0.0013351545,0.00014987064,0.00040374277,0.00031572138,0.0012431219,0.0018937233,0.0013200691,0.95735544,0.021507708],"study_design_scores_gemma":[0.00071357476,0.00031006933,0.077731945,0.0006119653,0.0001514149,0.001398902,0.0009935256,0.0074046077,0.0034852142,0.0042730863,0.90273035,0.00019538452],"about_ca_topic_score_codex":0.012605704,"about_ca_topic_score_gemma":0.031295817,"teacher_disagreement_score":0.012605704,"about_ca_system_score_codex":0.00082575507,"about_ca_system_score_gemma":0.0013764709,"threshold_uncertainty_score":0.032925367},"labels":[],"label_agreement":null},{"id":"W7115910046","doi":"10.13026/mf9s-5r03","title":"Bridge2AI-Voice Pediatric Dataset","year":2025,"lang":"","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Baycrest Hospital; Sinai Health System; Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital; SickKids Foundation; University of Toronto; Dalhousie University; Hospital for Sick Children; Bridgepoint Active Healthcare; Simon Fraser University","funders":"","keywords":"Spectrogram; Measure (data warehouse); Data collection; Mood; Voice analysis","score_opus":0.017295758935052686,"score_gpt":0.3052028607778872,"score_spread":0.2879071018428345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115910046","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022067826,0.0003583617,0.00055980834,0.0002215744,0.0000868009,0.00008935024,0.99401456,0.0011160895,0.0013467664],"genre_scores_gemma":[0.0013609945,0.000067576904,0.0006212115,0.00007910508,0.000018437537,0.00018816441,0.99702066,0.000043037493,0.00060085265],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986595,0.0002783493,0.00013071924,0.0004184885,0.00034566515,0.00016720057],"domain_scores_gemma":[0.9986532,0.0004358843,0.000118373544,0.00028901608,0.00033654564,0.00016701577],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012941443,0.002765737,0.0015418614,0.0026167762,0.0010019343,0.0015962465,0.0040505407,0.0030186924,0.023890587],"category_scores_gemma":[0.00484492,0.0005042045,0.0015517983,0.0030436506,0.0005622529,0.0010193522,0.0022085935,0.0020732877,0.04461743],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017681866,0.0001208459,0.0021867196,0.0006719644,0.00006781427,0.00015800525,0.000043089916,0.00079654343,0.00044163584,0.00037514654,0.9870609,0.007900539],"study_design_scores_gemma":[0.0010122171,0.00029458973,0.024687463,0.00050800125,0.00018074682,0.0015200514,0.00038213414,0.0076024975,0.001886213,0.0027216799,0.9590526,0.00015187058],"about_ca_topic_score_codex":0.017979506,"about_ca_topic_score_gemma":0.03850677,"teacher_disagreement_score":0.023890587,"about_ca_system_score_codex":0.0012276296,"about_ca_system_score_gemma":0.0019260554,"threshold_uncertainty_score":0.07992196},"labels":[],"label_agreement":null},{"id":"W7115911116","doi":"10.13026/y7mp-eh56","title":"Bridge2AI-Voice Pediatric Dataset","year":2025,"lang":"","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sinai Health System; Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital; SickKids Foundation; University of Toronto; Dalhousie University; Hospital for Sick Children; Simon Fraser University","funders":"","keywords":"Spectrogram; Measure (data warehouse); Data collection; Mood; Voice analysis","score_opus":0.017295758935052686,"score_gpt":0.3052028607778872,"score_spread":0.2879071018428345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115911116","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019909262,0.0003364289,0.0005261958,0.00021516679,0.000086064785,0.000083918014,0.9943157,0.0011243076,0.0013213581],"genre_scores_gemma":[0.0012847387,0.00006406525,0.0005944056,0.0000777823,0.00001802835,0.00017751157,0.9971506,0.00004226954,0.0005906605],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99861586,0.0002873221,0.00013736427,0.0004294679,0.00035645487,0.00017355068],"domain_scores_gemma":[0.99859375,0.000461015,0.000122315,0.00030405744,0.00034855437,0.0001703717],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013210324,0.0028467486,0.0015551271,0.0026950468,0.0010296479,0.0016764652,0.0040630307,0.003115746,0.024852606],"category_scores_gemma":[0.0049718935,0.0005065722,0.0015724562,0.0031182675,0.0005688759,0.0010582645,0.0022547299,0.0020901493,0.047231577],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017211806,0.00011446427,0.002114401,0.0006663268,0.000065974156,0.00015137855,0.000042564112,0.00077069766,0.0004311436,0.00036634537,0.98734915,0.007755462],"study_design_scores_gemma":[0.0009594335,0.00027808247,0.023472851,0.0005011001,0.00017384572,0.0014500864,0.00037900306,0.0075199795,0.0018936575,0.00269001,0.9605309,0.00015108501],"about_ca_topic_score_codex":0.018639836,"about_ca_topic_score_gemma":0.039537776,"teacher_disagreement_score":0.024852606,"about_ca_system_score_codex":0.0012772987,"about_ca_system_score_gemma":0.0019619379,"threshold_uncertainty_score":0.083140254},"labels":[],"label_agreement":null},{"id":"W7123274677","doi":"10.13026/pk42-4v91","title":"Lunguage: A Benchmark for Structured and Sequential Chest X-ray Interpretation","year":2025,"lang":"","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Benchmark (surveying); Pairwise comparison; SNOMED CT; Semantics (computer science); Interpretation (philosophy); Gold standard (test); Resource (disambiguation)","score_opus":0.00878072575010086,"score_gpt":0.2949954740640469,"score_spread":0.28621474831394605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7123274677","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05247109,0.006641935,0.015106504,0.002011987,0.00029081525,0.000711191,0.89027894,0.02445606,0.008031536],"genre_scores_gemma":[0.033479307,0.00061601156,0.023123335,0.00035480264,0.000051916104,0.00035363418,0.9407431,0.0004195973,0.0008582001],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99548507,0.0011745736,0.0007936307,0.0012947125,0.0010125259,0.00023951488],"domain_scores_gemma":[0.9918047,0.003996614,0.0008875327,0.0014785365,0.0012969446,0.0005356196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032002982,0.0027662446,0.0008906777,0.0059795477,0.000872496,0.0027222964,0.004385602,0.0029401192,0.005644734],"category_scores_gemma":[0.017335257,0.0005725662,0.0019200881,0.004333711,0.000847208,0.002227815,0.0029834374,0.0014945974,0.005407282],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013768704,0.00076298526,0.034994792,0.0059110215,0.0007488492,0.0015870103,0.0006691951,0.022252468,0.0052374015,0.0050154636,0.8140541,0.10738991],"study_design_scores_gemma":[0.0016414981,0.0007096727,0.06760655,0.0023188526,0.00054675655,0.0056240615,0.0017603406,0.13456392,0.01861577,0.015009923,0.75124604,0.00035663255],"about_ca_topic_score_codex":0.02176316,"about_ca_topic_score_gemma":0.038137358,"teacher_disagreement_score":0.02176316,"about_ca_system_score_codex":0.0025342193,"about_ca_system_score_gemma":0.0032839396,"threshold_uncertainty_score":0.043272913},"labels":[],"label_agreement":null},{"id":"W7123307329","doi":"10.13026/t075-g517","title":"Lunguage: A Benchmark for Structured and Sequential Chest X-ray Interpretation","year":2025,"lang":"","type":"dataset","venue":"PhysioNet","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Benchmark (surveying); Pairwise comparison; SNOMED CT; Semantics (computer science); Interpretation (philosophy); Gold standard (test); Resource (disambiguation)","score_opus":0.00878072575010086,"score_gpt":0.2949954740640469,"score_spread":0.28621474831394605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7123307329","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05247109,0.006641935,0.015106504,0.002011987,0.00029081525,0.000711191,0.89027894,0.02445606,0.008031536],"genre_scores_gemma":[0.033479307,0.00061601156,0.023123335,0.00035480264,0.000051916104,0.00035363418,0.9407431,0.0004195973,0.0008582001],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99548507,0.0011745736,0.0007936307,0.0012947125,0.0010125259,0.00023951488],"domain_scores_gemma":[0.9918047,0.003996614,0.0008875327,0.0014785365,0.0012969446,0.0005356196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032002982,0.0027662446,0.0008906777,0.0059795477,0.000872496,0.0027222964,0.004385602,0.0029401192,0.005644734],"category_scores_gemma":[0.017335257,0.0005725662,0.0019200881,0.004333711,0.000847208,0.002227815,0.0029834374,0.0014945974,0.005407282],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013768704,0.00076298526,0.034994792,0.0059110215,0.0007488492,0.0015870103,0.0006691951,0.022252468,0.0052374015,0.0050154636,0.8140541,0.10738991],"study_design_scores_gemma":[0.0016414981,0.0007096727,0.06760655,0.0023188526,0.00054675655,0.0056240615,0.0017603406,0.13456392,0.01861577,0.015009923,0.75124604,0.00035663255],"about_ca_topic_score_codex":0.02176316,"about_ca_topic_score_gemma":0.038137358,"teacher_disagreement_score":0.02176316,"about_ca_system_score_codex":0.0025342193,"about_ca_system_score_gemma":0.0032839396,"threshold_uncertainty_score":0.043272913},"labels":[],"label_agreement":null}]}