{"meta":{"query_hash":"7bf2fb011e30","filters":{"venue":"Journal of Classification"},"cohort_total":46,"direct_labels_cover":0,"predictions_cover":46,"exported":46,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/7bf2fb011e30","api":"https://metacan.xera.ac/api/v1/cohort?venue=Journal+of+Classification"},"results":[{"id":"W1510262632","doi":"10.1007/s00357-019-09319-3","title":"A Mixture of Coalesced Generalized Hyperbolic Distributions","year":2019,"lang":"en","type":"preprint","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; University of Waterloo; MacEwan University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Bayesian information criterion; Identifiability; Mathematics; Convexity; Hyperbolic function; Applied mathematics; Regular polygon; Distribution (mathematics); Selection (genetic algorithm); Function (biology); Class (philosophy); Model selection; Mathematical analysis; Computer science; Statistics; Artificial intelligence; Geometry","score_opus":0.044589174929418086,"score_gpt":0.31198831372007,"score_spread":0.2673991387906519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1510262632","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055951204,0.00086393784,0.9385738,0.00096714514,0.00013923636,0.00011713512,0.0003950623,0.00028015257,0.0027124116],"genre_scores_gemma":[0.72041214,0.0019045594,0.2420817,0.0009473977,0.0005649832,0.0004947574,0.001608757,0.00051229884,0.031473294],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99631137,0.0013935723,0.00017669733,0.0012365325,0.00059499126,0.00028679715],"domain_scores_gemma":[0.98594505,0.008781787,0.0011062659,0.001821833,0.001721993,0.0006231256],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007267507,0.0010947468,0.0029386922,0.003908297,0.0016044802,0.0059563746,0.007299975,0.00484136,0.008153831],"category_scores_gemma":[0.024030874,0.0025060663,0.0029276253,0.0033619918,0.0053366683,0.009181201,0.004853685,0.0054737064,0.0018944977],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029519465,0.00013887869,0.0074036466,0.000259212,0.0002850258,0.00044282238,0.00083275617,0.17731094,0.002054334,0.7698132,0.004237422,0.036926676],"study_design_scores_gemma":[0.000049185397,0.00002889674,0.000995247,0.00006761986,0.000082840335,0.00022741512,0.00011708672,0.733068,0.00046128727,0.26264167,0.002173123,0.00008763847],"about_ca_topic_score_codex":0.005552986,"about_ca_topic_score_gemma":0.0053696134,"teacher_disagreement_score":0.008153831,"about_ca_system_score_codex":0.002904181,"about_ca_system_score_gemma":0.001409657,"threshold_uncertainty_score":0.038434684},"labels":[],"label_agreement":null},{"id":"W1898940374","doi":"10.1007/s00357-015-9188-9","title":"Fractionally-Supervised Classification","year":2015,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; McGill University","funders":"","keywords":"Pattern recognition (psychology); A priori and a posteriori; Mixture model; Gaussian; Statistical classification; One-class classification","score_opus":0.12305360804815736,"score_gpt":0.3333380223894209,"score_spread":0.21028441434126355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1898940374","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03178503,0.0005388009,0.9631093,0.0007374396,0.00014099242,0.000051723182,0.00019734596,0.00071168307,0.0027276264],"genre_scores_gemma":[0.5380135,0.00041573858,0.44869038,0.00042137734,0.0004678447,0.00018171188,0.0012499242,0.00029804016,0.0102614],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969319,0.0012694525,0.0001792717,0.00078956765,0.0006237387,0.00020612706],"domain_scores_gemma":[0.9927901,0.0034407615,0.00037218616,0.0020793779,0.0011197736,0.000197645],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004454647,0.0007804121,0.0019266531,0.0016881477,0.0016724716,0.00215002,0.002336385,0.0025649457,0.0041580107],"category_scores_gemma":[0.013853417,0.00052802317,0.0016124371,0.0013320753,0.0016489304,0.0032101811,0.0024577067,0.0023482107,0.0011829332],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006736381,0.00031017375,0.0033797177,0.00025137496,0.00019931285,0.00009131126,0.00032328782,0.15673698,0.0077095083,0.1760454,0.013234863,0.64104444],"study_design_scores_gemma":[0.000012510991,0.000023914256,0.00031365748,0.000014261917,0.000016883356,0.00003597152,0.00001645524,0.921515,0.0016941213,0.07481273,0.0015328422,0.000011666043],"about_ca_topic_score_codex":0.0028588835,"about_ca_topic_score_gemma":0.003882903,"teacher_disagreement_score":0.004454647,"about_ca_system_score_codex":0.0014792242,"about_ca_system_score_gemma":0.0016809938,"threshold_uncertainty_score":0.023558676},"labels":[],"label_agreement":null},{"id":"W191887720","doi":"10.1007/s00357-001-0018-x","title":"Optimal Variable Weighting for Ultrametric and Additive Trees and K-means Partitioning: Methods and Software","year":2001,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":96,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Ultrametric space; Weighting; Outlier; Cluster analysis; Recursive partitioning; Variable (mathematics); Partition (number theory); Computer science; Monte Carlo method; Algorithm; Data mining; Tree (set theory); Mathematics; Statistics; Artificial intelligence; Machine learning; Combinatorics","score_opus":0.05001129746715327,"score_gpt":0.3724863672266711,"score_spread":0.32247506975951784,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W191887720","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002044137,0.00014621305,0.9974004,0.00003842065,0.000022507036,0.000016495593,0.000013240444,0.00019734893,0.00012128633],"genre_scores_gemma":[0.02586521,0.00015172624,0.9728602,0.000024127512,0.000043540123,0.00011086659,0.00008319924,0.00019661066,0.0006644399],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99472946,0.002558931,0.0003978141,0.00082459935,0.0012626793,0.00022650698],"domain_scores_gemma":[0.9892697,0.006981115,0.0004912786,0.0012973113,0.001704729,0.00025592075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008898418,0.0012730409,0.002567802,0.0023673917,0.001412633,0.0028389276,0.003776597,0.002133588,0.0031884857],"category_scores_gemma":[0.023992287,0.001667014,0.0020839733,0.0035730444,0.0015233771,0.0047191796,0.003360583,0.003349282,0.0011968167],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002089806,0.00013504208,0.0008346335,0.00027137392,0.00012941545,0.00002811904,0.0003352667,0.2004033,0.0025582383,0.0916884,0.0032549086,0.7001524],"study_design_scores_gemma":[0.000027304048,0.0000349376,0.00022978494,0.00002303432,0.000038603823,0.00003680491,0.000037472924,0.92560834,0.0015250107,0.07050094,0.0019114024,0.000026427444],"about_ca_topic_score_codex":0.0054918705,"about_ca_topic_score_gemma":0.0077487766,"teacher_disagreement_score":0.008898418,"about_ca_system_score_codex":0.0017232603,"about_ca_system_score_gemma":0.0025962356,"threshold_uncertainty_score":0.047059894},"labels":[],"label_agreement":null},{"id":"W1983989808","doi":"10.1007/s00357-005-0018-3","title":"Analysis of Global k-Means, an Incremental Heuristic for Minimum Sum-of-Squares Clustering","year":2005,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":56,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal; Group for Research in Decision Analysis; HEC Montréal","funders":"","keywords":"Cluster analysis; Heuristic; Explained sum of squares; Mathematics; Artificial intelligence; Pattern recognition (psychology); Combinatorics; Computer science; Statistics","score_opus":0.05400124671072944,"score_gpt":0.37078076021751716,"score_spread":0.31677951350678774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1983989808","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06870507,0.0012902197,0.92482984,0.0003955549,0.00010132238,0.00010389991,0.000119295546,0.0006948782,0.0037599006],"genre_scores_gemma":[0.6132319,0.0006084343,0.38115734,0.00018831331,0.00014519105,0.00017506472,0.0007003073,0.0007445176,0.0030489669],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997959,0.00075025356,0.00005940099,0.00028367073,0.000733383,0.00021420821],"domain_scores_gemma":[0.9853253,0.011016349,0.00045545326,0.00091337407,0.0020725287,0.00021697803],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038584084,0.0013715737,0.0017215016,0.0015277644,0.0011153123,0.0018825307,0.002697124,0.0013191635,0.0037733607],"category_scores_gemma":[0.020613922,0.0007924715,0.0013107025,0.0015355576,0.0012533715,0.0030412697,0.0015742703,0.0016535596,0.00045553994],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078470045,0.00022561902,0.0029473118,0.00035844892,0.00020502921,0.000093567825,0.0002269529,0.79640937,0.003618287,0.043784074,0.005363621,0.145983],"study_design_scores_gemma":[0.000013980657,0.00006235634,0.0004206551,0.000008332356,0.000028934275,0.000026140686,0.00003231671,0.9891867,0.0006814051,0.00910072,0.0004297025,0.000008768442],"about_ca_topic_score_codex":0.006103414,"about_ca_topic_score_gemma":0.00700483,"teacher_disagreement_score":0.006103414,"about_ca_system_score_codex":0.0017896089,"about_ca_system_score_gemma":0.0025633653,"threshold_uncertainty_score":0.020405412},"labels":[],"label_agreement":null},{"id":"W2014176749","doi":"10.1007/s00357-007-0014-x","title":"Algorithms for ℓ1-Embeddability and Related Problems","year":2007,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Computational Geometry and Mesh Generation","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Group for Research in Decision Analysis; HEC Montréal","funders":"","keywords":"Mathematics; Heuristics; Constructive; Tabu search; Quadratic equation; Combinatorics; Variable (mathematics); Column generation; Algorithm; Mathematical optimization; Discrete mathematics; Computer science; Geometry; Process (computing); Mathematical analysis","score_opus":0.046190332217472735,"score_gpt":0.31476854169308316,"score_spread":0.2685782094756104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2014176749","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017827531,0.0010404068,0.97108614,0.0014502765,0.00024253369,0.000111665184,0.0002706916,0.0009564945,0.0070142727],"genre_scores_gemma":[0.19474596,0.0016262833,0.780612,0.0005704462,0.0006210969,0.00045110966,0.0017542114,0.0009447174,0.018674165],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99825484,0.000383128,0.00012744246,0.0005649902,0.00048789152,0.00018163599],"domain_scores_gemma":[0.9853262,0.010579658,0.0006842767,0.002005394,0.0009568846,0.00044758208],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026680897,0.0019469721,0.0022643749,0.0032417807,0.0017039354,0.0044778395,0.0061275824,0.0034654222,0.014865583],"category_scores_gemma":[0.021481896,0.0014484788,0.0021793968,0.003906838,0.0034046925,0.013371513,0.0056602224,0.006286112,0.002647228],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039879375,0.0003238734,0.0014464533,0.00071063865,0.000107681546,0.00011528859,0.0005655286,0.091806434,0.0023569942,0.53740114,0.026478838,0.33828825],"study_design_scores_gemma":[0.00008086071,0.000041745094,0.00015990905,0.0000487969,0.000037199738,0.0000889814,0.00012602957,0.25102812,0.001271995,0.74151325,0.0055819065,0.000021277148],"about_ca_topic_score_codex":0.0016426139,"about_ca_topic_score_gemma":0.002267773,"teacher_disagreement_score":0.014865583,"about_ca_system_score_codex":0.0020162505,"about_ca_system_score_gemma":0.0010630069,"threshold_uncertainty_score":0.0497303},"labels":[],"label_agreement":null},{"id":"W2016102556","doi":"10.1007/s00357-007-0011-0","title":"The Metric Bridge Partition Problem: Partitioning of a Metric Space into Two Subspaces Linked by an Edge in Any Optimal Realization","year":2007,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Digital Image Processing Techniques","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Combinatorics; Mathematics; Vertex (graph theory); Realization (probability); Partition (number theory); Linear subspace; Discrete mathematics; Metric space; Graph; Geometry","score_opus":0.03605375981681319,"score_gpt":0.3333145787183773,"score_spread":0.2972608189015641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2016102556","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16672488,0.00057999295,0.82428205,0.0014262695,0.0000827703,0.00013042126,0.00045925216,0.00018200376,0.006132344],"genre_scores_gemma":[0.66531116,0.00091134926,0.32358292,0.00030126097,0.00016718087,0.00036820132,0.001941386,0.0002735992,0.0071430025],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9991398,0.00028018115,0.000044046006,0.00024308807,0.00016422111,0.0001286],"domain_scores_gemma":[0.99877757,0.00067229196,0.0001359344,0.0002042607,0.00009643845,0.00011340167],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013530111,0.00085833,0.0020002478,0.0008831612,0.0012586855,0.0023900066,0.0018655102,0.0030368923,0.004400631],"category_scores_gemma":[0.005040849,0.0008580299,0.00094672566,0.0013449808,0.0021215926,0.00525949,0.0027977854,0.0020892045,0.0005792199],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076596736,0.00028186725,0.0017200082,0.00052846887,0.00014285535,0.0003075842,0.00070467853,0.20429529,0.007914607,0.6199449,0.013395332,0.14999843],"study_design_scores_gemma":[0.00010780179,0.00017106919,0.0006506351,0.000058175112,0.000049203736,0.00018396856,0.00039653503,0.35201022,0.001724808,0.6395933,0.005018607,0.00003573556],"about_ca_topic_score_codex":0.0011243273,"about_ca_topic_score_gemma":0.0010653203,"teacher_disagreement_score":0.004400631,"about_ca_system_score_codex":0.0007802377,"about_ca_system_score_gemma":0.001034077,"threshold_uncertainty_score":0.014721632},"labels":[],"label_agreement":null},{"id":"W2019936812","doi":"10.1007/s00357-013-9138-3","title":"Model Selection for the Trend Vector Model","year":2013,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Model selection; Bayesian information criterion; Statistics; Mathematics; Selection (genetic algorithm); Marginal likelihood; Likelihood function; Akaike information criterion; Likelihood-ratio test; Estimator; Curse of dimensionality; Statistic; Estimation theory; Computer science; Maximum likelihood; Artificial intelligence","score_opus":0.04080810075278901,"score_gpt":0.27637256924185954,"score_spread":0.23556446848907053,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2019936812","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03456063,0.00020242721,0.9625712,0.00065293227,0.00008355229,0.00006159086,0.00036372046,0.0005401221,0.00096379727],"genre_scores_gemma":[0.7230966,0.0005226926,0.25681114,0.0003635224,0.0002196172,0.00060608826,0.0030625393,0.0008323714,0.0144854095],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99671066,0.0024503344,0.000087738124,0.00041665335,0.00016478031,0.00016988053],"domain_scores_gemma":[0.9840078,0.013988516,0.0003416742,0.0005676917,0.00088780717,0.00020644546],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009596147,0.00086313195,0.0017913133,0.0013611155,0.00079245307,0.0013884769,0.0022694275,0.0012882813,0.008147713],"category_scores_gemma":[0.025983334,0.00081080984,0.001448754,0.0014550741,0.0006673606,0.0023292566,0.0011495677,0.002180435,0.0014345939],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063927955,0.00013696493,0.008314818,0.00015293303,0.00066636095,0.00014942256,0.00015350628,0.7887545,0.0009984935,0.08020142,0.0089786425,0.11085356],"study_design_scores_gemma":[0.000040595212,0.00003515626,0.0005138177,0.000008646262,0.000031343025,0.0000227419,0.000009239921,0.9783668,0.00006175066,0.020512672,0.0003861484,0.000011085092],"about_ca_topic_score_codex":0.008099256,"about_ca_topic_score_gemma":0.006750161,"teacher_disagreement_score":0.009596147,"about_ca_system_score_codex":0.0008954202,"about_ca_system_score_gemma":0.0018536734,"threshold_uncertainty_score":0.050749898},"labels":[],"label_agreement":null},{"id":"W2049017883","doi":"10.1007/s00357-014-9161-z","title":"Ward’s Hierarchical Agglomerative Clustering Method: Which Algorithms Implement Ward’s Criterion?","year":2014,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":3773,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Hierarchical clustering; Cluster analysis; Software; Computer science; Data mining; Algorithm; Single-linkage clustering; Mathematics; Artificial intelligence; Canopy clustering algorithm; Correlation clustering","score_opus":0.039587181575319444,"score_gpt":0.3420034486997508,"score_spread":0.30241626712443137,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2049017883","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009740884,0.0022046058,0.98115516,0.002530707,0.00039726697,0.00021499954,0.00037493368,0.0007867717,0.002594568],"genre_scores_gemma":[0.09204724,0.0027267025,0.897986,0.00057262974,0.0002672454,0.0004406262,0.0008617684,0.0008033323,0.0042944616],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99127126,0.0039683487,0.0008561944,0.0008811488,0.0026285516,0.00039447792],"domain_scores_gemma":[0.98924595,0.0031174836,0.00080555945,0.0011334708,0.005323748,0.00037383303],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013757154,0.0013043148,0.003279242,0.003026616,0.0021692407,0.004241122,0.0044386764,0.0031526363,0.003743544],"category_scores_gemma":[0.038770143,0.0011804871,0.0016772154,0.006054485,0.0020147248,0.004531956,0.0019527661,0.0019248815,0.00361695],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037334423,0.000115227165,0.006070847,0.0010447317,0.00086746993,0.000117888405,0.0007458263,0.02841209,0.0025944083,0.0901348,0.06349298,0.8060304],"study_design_scores_gemma":[0.00019532732,0.0002504356,0.0109982705,0.0006314501,0.00045549337,0.0007943392,0.0013566493,0.66690046,0.0079536075,0.2422206,0.067694806,0.0005485734],"about_ca_topic_score_codex":0.013496442,"about_ca_topic_score_gemma":0.017022945,"teacher_disagreement_score":0.013757154,"about_ca_system_score_codex":0.0024424258,"about_ca_system_score_gemma":0.0045859097,"threshold_uncertainty_score":0.072755635},"labels":[],"label_agreement":null},{"id":"W2071486909","doi":"10.1007/s00357-009-9028-x","title":"Assessing Congruence Among Ultrametric Distance Matrices","year":2009,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":37,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Ultrametric space; Mathematics; Resampling; Congruence (geometry); Type I and type II errors; Permutation (music); Mantel test; Distance matrices in phylogeny; Combinatorics; Statistics; Statistic; Normalization (sociology); Discrete mathematics; Biology; Genetics","score_opus":0.042940639641067625,"score_gpt":0.35797349114821986,"score_spread":0.3150328515071522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2071486909","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.72373146,0.0008354628,0.2674646,0.00052050024,0.00012095046,0.00014337603,0.00059398595,0.00027443454,0.0063153175],"genre_scores_gemma":[0.943681,0.00018629064,0.054724805,0.000063283514,0.000086683445,0.00010313232,0.00080908893,0.00006288752,0.00028281804],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9695267,0.01333373,0.0033042033,0.0039221253,0.009029598,0.0008835287],"domain_scores_gemma":[0.751346,0.18777448,0.016586322,0.01677227,0.023209965,0.00431097],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019001858,0.0007794474,0.0014065111,0.009130489,0.0020729208,0.0056097545,0.0024474557,0.0019978124,0.0023242335],"category_scores_gemma":[0.21541218,0.00090674247,0.0010457957,0.0067938017,0.003933574,0.008256392,0.006484689,0.001988923,0.000585747],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026797196,0.00049493514,0.3392873,0.00093288335,0.00092074525,0.00097181427,0.010040252,0.042650986,0.01748925,0.29076958,0.0037840703,0.28997847],"study_design_scores_gemma":[0.00022055654,0.0015095586,0.07179579,0.00036263195,0.0003030727,0.001961833,0.008377644,0.2777443,0.008407819,0.62380755,0.005311518,0.00019774331],"about_ca_topic_score_codex":0.0012376303,"about_ca_topic_score_gemma":0.001108028,"teacher_disagreement_score":0.019001858,"about_ca_system_score_codex":0.0012191422,"about_ca_system_score_gemma":0.0012222164,"threshold_uncertainty_score":0.1004926},"labels":[],"label_agreement":null},{"id":"W2073247434","doi":"10.1007/s00357-003-0011-7","title":"Maximum Split Clustering Under Connectivity Constraints","year":2003,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Data Management and Algorithms","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal; Université de Montréal","funders":"","keywords":"Heuristic; Partition (number theory); Mathematics; Combinatorics; Contiguity; Cluster analysis; Set (abstract data type); Algorithm; Computer science; Mathematical optimization","score_opus":0.04863080670212839,"score_gpt":0.2771362547617657,"score_spread":0.2285054480596373,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2073247434","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09671127,0.0011480537,0.8926807,0.0015118963,0.00010048783,0.00026741842,0.0010668058,0.00081969955,0.0056936364],"genre_scores_gemma":[0.5551834,0.00088341703,0.4291569,0.0004787666,0.00039305835,0.0006266503,0.0045864806,0.0005638683,0.008127429],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978085,0.0009412046,0.00012232213,0.00047080207,0.00046963678,0.00018755354],"domain_scores_gemma":[0.9872416,0.008202769,0.0008138771,0.0019143268,0.0012631827,0.0005641967],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035664435,0.0011965277,0.0031867581,0.0022601183,0.002188465,0.002448618,0.004996639,0.0032315229,0.0064529646],"category_scores_gemma":[0.018958755,0.001465611,0.0011000617,0.0037124308,0.0016983907,0.006061402,0.0038512873,0.0020606194,0.0011785782],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001672325,0.00034323553,0.002998495,0.0007092441,0.00030237276,0.0003530519,0.0007567679,0.61030364,0.005007157,0.14988908,0.025132999,0.20253162],"study_design_scores_gemma":[0.000094602954,0.00007783726,0.0005966058,0.000038214737,0.000042260588,0.000117054915,0.000113554284,0.8158615,0.0012453945,0.17985046,0.0019462416,0.000016222826],"about_ca_topic_score_codex":0.0023703396,"about_ca_topic_score_gemma":0.0038424362,"teacher_disagreement_score":0.0064529646,"about_ca_system_score_codex":0.0015776227,"about_ca_system_score_gemma":0.0017847508,"threshold_uncertainty_score":0.021587372},"labels":[],"label_agreement":null},{"id":"W2075711194","doi":"10.1007/s00357-013-9139-2","title":"Variable Selection for Clustering and Classification","year":2013,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":60,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Cluster analysis; Feature selection; Variable (mathematics); Computer science; Selection (genetic algorithm); Data mining; Artificial intelligence; Clustering high-dimensional data; Machine learning; Pattern recognition (psychology); Subspace topology; Mathematics","score_opus":0.041396182228672196,"score_gpt":0.2910300057636183,"score_spread":0.24963382353494612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075711194","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010865737,0.0024082507,0.9951265,0.00038140596,0.0001349424,0.000029894216,0.00009277932,0.0003693804,0.00037019013],"genre_scores_gemma":[0.05518713,0.0037450877,0.934746,0.00028630404,0.00068633753,0.00047827227,0.00094716786,0.00043191185,0.003491711],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99202687,0.0047338977,0.00041992657,0.0011337699,0.001476965,0.00020859683],"domain_scores_gemma":[0.9855611,0.010425871,0.00057718944,0.0017059646,0.0015386889,0.00019115293],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00850153,0.0016661468,0.004116811,0.0042443173,0.0018429848,0.0032635569,0.0042776866,0.0030716644,0.0040747426],"category_scores_gemma":[0.025160132,0.0015491792,0.0027702055,0.006384783,0.002507354,0.003512613,0.0025765796,0.005030063,0.0024876145],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017916363,0.00014205107,0.0011599107,0.0007995934,0.00054432504,0.000087271415,0.0002838859,0.12224802,0.0018709524,0.18663633,0.027013231,0.65903527],"study_design_scores_gemma":[0.000029334919,0.000027365715,0.00049145956,0.00008939204,0.000066022265,0.00006510198,0.000034057637,0.69175184,0.0009803261,0.29789278,0.008534071,0.000038290425],"about_ca_topic_score_codex":0.0054728887,"about_ca_topic_score_gemma":0.0050837714,"teacher_disagreement_score":0.00850153,"about_ca_system_score_codex":0.0017388999,"about_ca_system_score_gemma":0.0020660618,"threshold_uncertainty_score":0.044960916},"labels":[],"label_agreement":null},{"id":"W2076089275","doi":"10.1007/s00357-006-0018-y","title":"Generation of Random Clusters with Specified Degree of Separation","year":2006,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":122,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Mathematics; Cluster (spacecraft); Constraint (computer-aided design); Dimension (graph theory); Degree (music); Outlier; Covariance; Set (abstract data type); Separation (statistics); Combinatorics; Pattern recognition (psychology); Algorithm; Artificial intelligence; Computer science; Statistics","score_opus":0.12329393467636098,"score_gpt":0.3420131434182264,"score_spread":0.21871920874186546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2076089275","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25491083,0.00016717575,0.7369395,0.00048685123,0.0002448337,0.00096722355,0.0003602703,0.0014617285,0.004461527],"genre_scores_gemma":[0.7322626,0.00007461704,0.26218885,0.00018497738,0.000032611235,0.0008232982,0.0007136718,0.00032538234,0.0033939455],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983619,0.0005692735,0.00008852066,0.00037554838,0.00038741098,0.00021733517],"domain_scores_gemma":[0.99005425,0.0042649936,0.00036693626,0.0023809546,0.0025560132,0.0003768146],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031838906,0.0006837457,0.0009940829,0.001431462,0.0010380282,0.001154957,0.0021674703,0.0015860596,0.004110915],"category_scores_gemma":[0.017296238,0.00075149356,0.0009582366,0.0011115554,0.0009323521,0.0012609919,0.0019762772,0.0011740632,0.0010585266],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0033267075,0.00078740384,0.007430605,0.00049275527,0.00025259957,0.00067507575,0.001339301,0.66712415,0.05402616,0.06855782,0.012843171,0.18314426],"study_design_scores_gemma":[0.00030447345,0.00015997046,0.00064852234,0.000020813393,0.00004629567,0.0001428325,0.00012195657,0.96113783,0.019804858,0.015705772,0.0018614016,0.000045333174],"about_ca_topic_score_codex":0.00099074,"about_ca_topic_score_gemma":0.0013030823,"teacher_disagreement_score":0.004110915,"about_ca_system_score_codex":0.0011939825,"about_ca_system_score_gemma":0.0010070158,"threshold_uncertainty_score":0.016838193},"labels":[],"label_agreement":null},{"id":"W2076491140","doi":"10.1007/s00357-014-9155-x","title":"Globally Optimal Clusterwise Regression By Column Generation Enhanced with Heuristics, Sequencing and Ending Subset Optimization","year":2014,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Multi-Criteria Decision Making","field":"Decision Sciences","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Heuristics; Column generation; Heuristic; Column (typography); Branch and bound; Mathematical optimization; Mathematics; Combinatorial optimization; Computer science; Algorithm","score_opus":0.1351499648291038,"score_gpt":0.3820421806903929,"score_spread":0.24689221586128912,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2076491140","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018286904,0.000205713,0.978749,0.00013034702,0.00006416808,0.0000975305,0.00015547386,0.0012163436,0.001094466],"genre_scores_gemma":[0.23376624,0.00013110874,0.7608936,0.00018620736,0.000084959036,0.00034643683,0.0010551207,0.0005558269,0.0029806057],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987319,0.00064192474,0.00005572654,0.00022070983,0.00018782343,0.0001619198],"domain_scores_gemma":[0.9955688,0.0029914936,0.00018799132,0.00037906325,0.0007276248,0.0001449681],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021839973,0.0020161518,0.0026650997,0.0017807548,0.0009433406,0.0013452049,0.0019185991,0.0015585448,0.0043752124],"category_scores_gemma":[0.0064016734,0.001010106,0.0015249627,0.0020881272,0.0008501657,0.0014031229,0.0012497731,0.002104302,0.0013847314],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038432088,0.00022696957,0.0006043737,0.0001475334,0.00009821097,0.000087017324,0.00006937302,0.843175,0.0043720626,0.005517576,0.0056362334,0.13968132],"study_design_scores_gemma":[0.000013544917,0.000034053122,0.000054291188,0.0000040207447,0.000010922463,0.000007873429,0.000006820094,0.99701023,0.00089746906,0.0017890047,0.00016571407,0.0000060579505],"about_ca_topic_score_codex":0.007223477,"about_ca_topic_score_gemma":0.008555426,"teacher_disagreement_score":0.007223477,"about_ca_system_score_codex":0.00071149034,"about_ca_system_score_gemma":0.0028964682,"threshold_uncertainty_score":0.014636576},"labels":[],"label_agreement":null},{"id":"W2077969766","doi":"10.1007/s00357-013-9127-6","title":"Optimal Quantization of the Support of a Continuous Multivariate Distribution based on Mutual Information","year":2013,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Image and Signal Denoising Methods","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton; Université de Sherbrooke","funders":"","keywords":"Mutual information; Multivariate statistics; Mathematics; Multivariate analysis; Pattern recognition (psychology); Artificial intelligence; Quantization (signal processing); Statistics; Computer science","score_opus":0.022056487569102282,"score_gpt":0.2730957291643648,"score_spread":0.25103924159526253,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077969766","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024176475,0.00017863538,0.9747677,0.00025680184,0.000025048952,0.000012364185,0.000057267458,0.00008911158,0.00043648525],"genre_scores_gemma":[0.6245697,0.000562891,0.3727411,0.00015757646,0.00014527384,0.000087720146,0.0003707413,0.0001437433,0.0012212483],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99899036,0.00039358533,0.00007061655,0.00019615392,0.00027035957,0.00007893262],"domain_scores_gemma":[0.996662,0.0022246772,0.00021658889,0.0003476503,0.0003951323,0.00015392381],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019218433,0.0005058462,0.0012923761,0.0009333227,0.00037734388,0.0014111707,0.0013158319,0.0012393905,0.0015702187],"category_scores_gemma":[0.0094388835,0.00045501717,0.0007375881,0.0008259833,0.0013899521,0.0025322782,0.0015970112,0.0019434921,0.00030269768],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008679203,0.00023393452,0.0021733895,0.0003677791,0.00014453499,0.00012400259,0.00035085963,0.41380093,0.02539814,0.23187873,0.0041121645,0.3205476],"study_design_scores_gemma":[0.000017100514,0.00003748899,0.00029866648,0.000014110473,0.000008577294,0.000029011739,0.000016041113,0.9623615,0.0013409732,0.035615496,0.0002451654,0.000015888754],"about_ca_topic_score_codex":0.0011175547,"about_ca_topic_score_gemma":0.001433672,"teacher_disagreement_score":0.0019218433,"about_ca_system_score_codex":0.00076736475,"about_ca_system_score_gemma":0.0009065506,"threshold_uncertainty_score":0.010163844},"labels":[],"label_agreement":null},{"id":"W2133276644","doi":"10.1007/s00357-008-9016-6","title":"The Metric Cutpoint Partition Problem","year":2008,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Digital Image Processing Techniques","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"","keywords":"Combinatorics; Mathematics; Vertex (graph theory); Partition (number theory); Linear subspace; Realization (probability); Discrete mathematics; Graph; Metric (unit); Metric space; Statistics; Geometry","score_opus":0.04848917196264458,"score_gpt":0.2817536667559093,"score_spread":0.23326449479326472,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2133276644","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07263685,0.0033087716,0.908535,0.0026390296,0.00023980119,0.0002029311,0.0010950837,0.000446252,0.010896301],"genre_scores_gemma":[0.53359187,0.0033128024,0.4368418,0.00079722964,0.00091238663,0.0006278605,0.005113154,0.000560881,0.018242035],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99830866,0.0005187082,0.00008461423,0.00047093944,0.00048639544,0.00013065425],"domain_scores_gemma":[0.99661404,0.002181519,0.0002577551,0.00040844778,0.00030788287,0.00023035293],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001765241,0.0011075552,0.002576815,0.0018504305,0.0012706545,0.0032765064,0.00274924,0.00369659,0.008422522],"category_scores_gemma":[0.010548986,0.0008081875,0.00094584515,0.0027595416,0.0021522618,0.005361264,0.0032244285,0.0030192365,0.001037732],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005799057,0.0002583948,0.0019655437,0.00079643104,0.00023037246,0.00032917105,0.00038199095,0.14970228,0.0042882715,0.4680984,0.041960694,0.3314085],"study_design_scores_gemma":[0.00011608158,0.00013717412,0.0009507761,0.00008436309,0.000054972123,0.0003727798,0.0001534327,0.29983267,0.0016179911,0.68101597,0.015628736,0.00003502942],"about_ca_topic_score_codex":0.0015201863,"about_ca_topic_score_gemma":0.0011563457,"teacher_disagreement_score":0.008422522,"about_ca_system_score_codex":0.0011340021,"about_ca_system_score_gemma":0.0010006707,"threshold_uncertainty_score":0.028176129},"labels":[],"label_agreement":null},{"id":"W2560940630","doi":"10.1007/s00357-018-9280-z","title":"On Fractionally-Supervised Classification: Weight Selection and Extension to the Multivariate t-Distribution","year":2018,"lang":"en","type":"preprint","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Extension (predicate logic); Multivariate statistics; Selection (genetic algorithm); Cluster analysis; Gaussian; Artificial intelligence; Resolution (logic); Multivariate normal distribution; Model selection; Pattern recognition (psychology); Computer science; Machine learning; Mathematics; Chemistry","score_opus":0.053785955787808676,"score_gpt":0.32347412047800156,"score_spread":0.26968816469019286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2560940630","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010253209,0.00023068323,0.9883393,0.0003894995,0.000043350377,0.000024395544,0.000041397107,0.000117272735,0.0005609172],"genre_scores_gemma":[0.347992,0.0012727253,0.6407431,0.00069263094,0.0009425775,0.00027695898,0.0006440708,0.0004130827,0.007022891],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99614173,0.0018419897,0.00018661807,0.00079957687,0.0007579037,0.00027219142],"domain_scores_gemma":[0.98190975,0.011992365,0.0010460785,0.0024385205,0.0020310984,0.00058219535],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010868202,0.0011136613,0.0024356004,0.0021475612,0.0015214048,0.0023682332,0.0042649484,0.0035288874,0.0033872616],"category_scores_gemma":[0.033716977,0.00085957564,0.0021025934,0.0027142458,0.0032806902,0.0058550653,0.0039613578,0.003760689,0.0006596982],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038970207,0.0003444306,0.0027142188,0.00032141287,0.00023371576,0.00019251648,0.00044896285,0.32874346,0.0036763852,0.40520966,0.008115913,0.24960963],"study_design_scores_gemma":[0.00001119513,0.00001428164,0.00018103658,0.000014394063,0.000012571427,0.000026707303,0.000009077062,0.89300036,0.00023449937,0.106064305,0.00042122544,0.000010331177],"about_ca_topic_score_codex":0.0049144733,"about_ca_topic_score_gemma":0.005273479,"teacher_disagreement_score":0.010868202,"about_ca_system_score_codex":0.0018432671,"about_ca_system_score_gemma":0.0023227988,"threshold_uncertainty_score":0.057477236},"labels":[],"label_agreement":null},{"id":"W2767631755","doi":"10.1007/s00357-019-9309-y","title":"Mixtures of Hidden Truncation Hyperbolic Factor Analyzers","year":2019,"lang":"en","type":"preprint","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Truncation (statistics); Cluster analysis; Factor (programming language); Gaussian; Applied mathematics; Computer science; Mixture model; Process (computing); Mathematics; Statistics; Pattern recognition (psychology); Algorithm; Artificial intelligence; Physics","score_opus":0.05285534351087375,"score_gpt":0.3160797611992984,"score_spread":0.2632244176884247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2767631755","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021506207,0.00020866588,0.9760743,0.00016471007,0.00004088393,0.000035622477,0.00016479146,0.0002477919,0.0015570176],"genre_scores_gemma":[0.61648965,0.0009138157,0.35875648,0.00032077366,0.0002515684,0.00024178505,0.0012232545,0.0004955792,0.021307081],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9962767,0.0015386951,0.0002320839,0.00086097786,0.000735743,0.00035576252],"domain_scores_gemma":[0.9888149,0.0069058808,0.00064507045,0.0017485771,0.0013988403,0.0004868314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005577076,0.0012273525,0.0016423098,0.0022300028,0.0008918649,0.003931538,0.002593714,0.0020757923,0.007982793],"category_scores_gemma":[0.02147285,0.0014396639,0.0019793918,0.0019315521,0.0027138742,0.007000729,0.003802619,0.003184089,0.0019979922],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007129946,0.00013279504,0.0043177768,0.00016661537,0.00022042786,0.00024077744,0.000493925,0.107727185,0.0061615603,0.7691837,0.0034135228,0.10722883],"study_design_scores_gemma":[0.000024822342,0.000031797925,0.0005565859,0.000028397386,0.000037236,0.00010444838,0.0000643912,0.7359207,0.0015972928,0.2601857,0.0014006353,0.000047954214],"about_ca_topic_score_codex":0.0022480898,"about_ca_topic_score_gemma":0.0026199205,"teacher_disagreement_score":0.007982793,"about_ca_system_score_codex":0.0014995907,"about_ca_system_score_gemma":0.0012005618,"threshold_uncertainty_score":0.029494703},"labels":[],"label_agreement":null},{"id":"W2922529999","doi":"10.1007/s00357-024-09479-x","title":"Flexible Clustering with a Sparse Mixture of Generalized Hyperbolic Distributions","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Canada Research Chairs; E.W.R. Steacie Memorial Fund","keywords":"Cluster analysis; Parametrization (atmospheric modeling); Covariance; Mathematics; Covariance matrix; Component (thermodynamics); Interpretation (philosophy); Matrix (chemical analysis); Clustering high-dimensional data; Mixture model; Algorithm; Computer science; Applied mathematics; Statistics","score_opus":0.037729005645200264,"score_gpt":0.2992783221185225,"score_spread":0.26154931647332225,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2922529999","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010162681,0.00012457362,0.988977,0.00014486379,0.000020231068,0.000038663202,0.000057489724,0.00016552156,0.00030890983],"genre_scores_gemma":[0.39008462,0.00039451287,0.60273474,0.0003195583,0.00014762065,0.00034043545,0.0007627237,0.0003009401,0.004914767],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9959669,0.0020298052,0.00020137931,0.0009551233,0.00063051307,0.00021626533],"domain_scores_gemma":[0.99110794,0.0049321204,0.0006383247,0.0019977107,0.0009952625,0.0003285864],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0073285066,0.0009234493,0.0024765132,0.0022304836,0.0015102489,0.0031456428,0.0057496903,0.0033255809,0.002324958],"category_scores_gemma":[0.018627558,0.002120417,0.0027293686,0.0025839193,0.002914393,0.005161807,0.0050061615,0.0034440511,0.0012280219],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004090647,0.00015273916,0.0027768887,0.00020802599,0.00027965766,0.00014297839,0.00065423426,0.7054292,0.003724321,0.19136767,0.0034574848,0.091397695],"study_design_scores_gemma":[0.000016248541,0.000011180106,0.00014591814,0.000010132358,0.000014148596,0.000024057315,0.00001805229,0.9627775,0.00029848312,0.03628308,0.00038157136,0.000019577586],"about_ca_topic_score_codex":0.0070022307,"about_ca_topic_score_gemma":0.0088349655,"teacher_disagreement_score":0.0073285066,"about_ca_system_score_codex":0.0021057092,"about_ca_system_score_gemma":0.0014191834,"threshold_uncertainty_score":0.038757324},"labels":[],"label_agreement":null},{"id":"W2953751292","doi":"10.1007/s00357-022-09427-7","title":"Model-Based Clustering and Classification Using Mixtures of Multivariate Skewed Power Exponential Distributions","year":2023,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; University of Waterloo; Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Stiefel manifold; Mixture model; Skewness; Mathematics; Expectation–maximization algorithm; Cluster analysis; Exponential family; Multivariate statistics; Multivariate normal distribution; Exponential function; Gaussian; Maximization; Linear discriminant analysis; Kurtosis; Applied mathematics; Statistics; Pattern recognition (psychology); Artificial intelligence; Computer science; Mathematical optimization; Maximum likelihood; Mathematical analysis; Chemistry","score_opus":0.08359715212252727,"score_gpt":0.34054818044832663,"score_spread":0.25695102832579936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2953751292","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009171426,0.00022750859,0.98996127,0.00012334349,0.000029878516,0.000040517723,0.00004226086,0.00019605622,0.00020777059],"genre_scores_gemma":[0.3432157,0.00077204884,0.6506288,0.00027932547,0.00023058716,0.0004322104,0.0009216462,0.00027553792,0.0032440785],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9951939,0.002173565,0.0002913936,0.001166889,0.00086997385,0.00030429673],"domain_scores_gemma":[0.98619545,0.0093185,0.0008195941,0.0016081701,0.0018165697,0.00024171777],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009659286,0.0011863343,0.002948074,0.003159022,0.0017343615,0.0035676316,0.004668653,0.0033863683,0.0020350514],"category_scores_gemma":[0.028477876,0.0012931161,0.0031882734,0.003020444,0.0021021392,0.004676546,0.0032844264,0.0038011812,0.0014157722],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005594362,0.0003234574,0.0052569336,0.0002797983,0.00035027426,0.00015206003,0.0008575842,0.61882013,0.0036597676,0.101988144,0.0047335103,0.2630189],"study_design_scores_gemma":[0.000009966252,0.000013446648,0.00026732715,0.000015322747,0.000015632755,0.000032661137,0.00002455141,0.9703607,0.00039468374,0.028488433,0.00036041922,0.000016960039],"about_ca_topic_score_codex":0.00611676,"about_ca_topic_score_gemma":0.0060441634,"teacher_disagreement_score":0.009659286,"about_ca_system_score_codex":0.0018914479,"about_ca_system_score_gemma":0.001333229,"threshold_uncertainty_score":0.051083803},"labels":[],"label_agreement":null},{"id":"W3006387108","doi":"10.1007/s00357-019-09353-1","title":"Modified Subspace Constrained Mean Shift Algorithm","year":2020,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Data Compression Techniques","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vector Institute; St. Michael's Hospital; Public Safety Canada; University of Toronto","funders":"","keywords":"Algorithm; Mathematics; Principal component analysis; Kernel (algebra); Subspace topology; Kernel density estimation; Mean-shift; Cluster analysis; Kernel principal component analysis; Projection (relational algebra); Kernel method; Pattern recognition (psychology); Computer science; Artificial intelligence; Support vector machine; Statistics","score_opus":0.05620725276592743,"score_gpt":0.3001003185265803,"score_spread":0.2438930657606529,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3006387108","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007981109,0.00046003048,0.9889764,0.00014276532,0.00017251293,0.00003966333,0.00011820263,0.0006303133,0.0014788721],"genre_scores_gemma":[0.08522712,0.00056292664,0.90204614,0.00023509438,0.00016163349,0.00015435492,0.0007841399,0.00023477177,0.010593837],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992562,0.00010826213,0.000042194464,0.00016636717,0.000365337,0.00006164039],"domain_scores_gemma":[0.99945396,0.00007887096,0.00003343236,0.0001246751,0.0002802543,0.000028786737],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00046365912,0.00066323,0.0010545056,0.0008727929,0.0006225645,0.0009699917,0.0011991411,0.001145341,0.005257679],"category_scores_gemma":[0.001291719,0.0003191053,0.0007408137,0.0015216774,0.00044984062,0.000998616,0.0011759587,0.00095624203,0.0030957006],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030236234,0.00011317291,0.00068826607,0.00013014922,0.00011889977,0.000084660314,0.000068561385,0.038527183,0.04464013,0.009720327,0.010013564,0.89559263],"study_design_scores_gemma":[0.000055810106,0.0001627456,0.0014148224,0.000021793776,0.0000655643,0.0005002366,0.000050529496,0.92497647,0.037352044,0.010978413,0.02435976,0.00006183622],"about_ca_topic_score_codex":0.0030750993,"about_ca_topic_score_gemma":0.004863737,"teacher_disagreement_score":0.005257679,"about_ca_system_score_codex":0.0003058909,"about_ca_system_score_gemma":0.0018881083,"threshold_uncertainty_score":0.017588675},"labels":[],"label_agreement":null},{"id":"W3041770541","doi":"10.1007/s00357-020-09376-z","title":"Editorial: Journal of Classification Vol. 37-2","year":2020,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Optics and Image Analysis","field":"Business, Management and Accounting","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Artificial intelligence; Pattern recognition (psychology); Computer science","score_opus":0.021693667172733223,"score_gpt":0.263290762339074,"score_spread":0.2415970951663408,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3041770541","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000030591233,0.0013457012,0.00009217714,0.015942305,0.9796911,0.000022951075,0.000071439186,0.00007528016,0.0027284555],"genre_scores_gemma":[0.00055121485,0.0024498592,0.00014726663,0.011073713,0.9564564,0.00003300032,0.00012318454,0.000100320765,0.02906497],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99405354,0.0008147184,0.0006871142,0.0005837661,0.0034000254,0.0004609634],"domain_scores_gemma":[0.9750675,0.00495003,0.0011266725,0.00086489675,0.014365487,0.003625419],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054724477,0.0044524763,0.004251544,0.0072149364,0.0042956336,0.011292502,0.0036944132,0.012869204,0.04872735],"category_scores_gemma":[0.027404016,0.0012429984,0.0028403238,0.002830183,0.002686135,0.0041444977,0.0017537845,0.012817134,0.04804365],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019098294,0.000007371452,0.000016026463,0.000056548564,0.0000052445735,0.000040483912,0.0000023169614,0.00001305807,0.000024723637,0.00012880418,0.99712795,0.002558456],"study_design_scores_gemma":[0.00004418602,0.000021699076,0.00033676813,0.00026327785,0.000022459026,0.00017200444,0.000022584438,0.00019185974,0.00008151791,0.00097576226,0.99785125,0.000016546466],"about_ca_topic_score_codex":0.0028807193,"about_ca_topic_score_gemma":0.008371111,"teacher_disagreement_score":0.04872735,"about_ca_system_score_codex":0.0040312717,"about_ca_system_score_gemma":0.0042203343,"threshold_uncertainty_score":0.16300929},"labels":[],"label_agreement":null},{"id":"W3118804762","doi":"10.1007/s00357-023-09452-0","title":"Logistic Normal Multinomial Factor Analyzers for Clustering Microbiome Data","year":2023,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Simons Foundation","keywords":"Cluster analysis; Microbiome; Multinomial logistic regression; Mixture model; Computer science; Multinomial distribution; Expectation–maximization algorithm; Human microbiome; Gaussian; Data mining; Pattern recognition (psychology); Artificial intelligence; Statistics; Mathematics; Machine learning; Bioinformatics; Biology; Maximum likelihood","score_opus":0.2580616931963199,"score_gpt":0.39386718861884285,"score_spread":0.13580549542252296,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3118804762","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008173595,0.000113096605,0.98892933,0.00008430878,0.00001734606,0.000055180633,0.00026319834,0.0021376736,0.0002262723],"genre_scores_gemma":[0.1076403,0.00015898755,0.8880195,0.000089654066,0.000042482017,0.00031627528,0.0016749097,0.0007220923,0.0013357594],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9938692,0.0031498417,0.00052724464,0.0009909956,0.0011541595,0.00030844417],"domain_scores_gemma":[0.9873947,0.007621143,0.00080318446,0.0018707861,0.0018995871,0.00041063473],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0115385605,0.0013102364,0.001363982,0.0040681665,0.0015595595,0.0027087478,0.002277297,0.0015539113,0.004846766],"category_scores_gemma":[0.03862406,0.0008939008,0.0020912148,0.0034839013,0.0010230273,0.0030375044,0.0032380463,0.0025374263,0.0028665357],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015353183,0.00033137438,0.022109056,0.00025402283,0.00045730604,0.00021293048,0.0007855508,0.062710755,0.018143108,0.0367548,0.010155599,0.8465503],"study_design_scores_gemma":[0.000058529764,0.00007155648,0.0028836338,0.000049514507,0.000052891002,0.00024225164,0.00018911,0.9291076,0.005896087,0.057477865,0.0038970478,0.00007389505],"about_ca_topic_score_codex":0.0066768113,"about_ca_topic_score_gemma":0.009943715,"teacher_disagreement_score":0.0115385605,"about_ca_system_score_codex":0.0011667913,"about_ca_system_score_gemma":0.002630155,"threshold_uncertainty_score":0.06102252},"labels":[],"label_agreement":null},{"id":"W3158446859","doi":"10.1007/s00357-021-09389-2","title":"Matrix Normal Cluster-Weighted Models","year":2021,"lang":"en","type":"preprint","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Università di Catania","keywords":"Covariate; Univariate; Mathematics; Cluster analysis; Independence (probability theory); Statistics; Data set; Multivariate statistics; Grouped data; Econometrics; Conditional independence","score_opus":0.04685364537515465,"score_gpt":0.31580409727873926,"score_spread":0.26895045190358463,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3158446859","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014682309,0.00024769155,0.98273796,0.0002712673,0.0000415712,0.00008176815,0.0003099468,0.00020361868,0.0014237952],"genre_scores_gemma":[0.67244864,0.0009035009,0.30195266,0.0003389091,0.00026607193,0.0007582764,0.0019673354,0.00033947005,0.021025099],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99482095,0.002678779,0.00017180783,0.0013313207,0.000663026,0.0003340701],"domain_scores_gemma":[0.9901815,0.0059356764,0.001218164,0.0011871047,0.0012630966,0.00021436332],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006854059,0.0013913594,0.0020350832,0.0030552286,0.00065918633,0.0024711853,0.004319078,0.0019749666,0.007287305],"category_scores_gemma":[0.01824919,0.0008551947,0.0017274265,0.0037774283,0.0026044545,0.002944565,0.0021342013,0.0024132254,0.0013518964],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015716559,0.00007561252,0.0024310767,0.00012983095,0.00021438109,0.00010491353,0.00023187144,0.5452694,0.0006596297,0.41733956,0.0029273948,0.03045915],"study_design_scores_gemma":[0.000015493933,0.000015852607,0.0004785875,0.000015604364,0.000019631014,0.000029480123,0.00002239009,0.8721939,0.00013507718,0.12582415,0.0012322627,0.000017551389],"about_ca_topic_score_codex":0.010739468,"about_ca_topic_score_gemma":0.008261653,"teacher_disagreement_score":0.010739468,"about_ca_system_score_codex":0.0020531125,"about_ca_system_score_gemma":0.0009714771,"threshold_uncertainty_score":0.036248147},"labels":[],"label_agreement":null},{"id":"W4200604627","doi":"10.1007/s00357-021-09404-6","title":"Editorial: Journal of Classification Vol. 38-3","year":2021,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Artificial intelligence; Pattern recognition (psychology); Mathematics; Computer science","score_opus":0.02128713241038138,"score_gpt":0.2993501570993756,"score_spread":0.27806302468899424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200604627","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000023715076,0.0025315448,0.0001166023,0.018636016,0.97660613,0.000023898501,0.000063666645,0.00007372525,0.0019247612],"genre_scores_gemma":[0.0003749611,0.0031367545,0.00014235325,0.013499243,0.9662171,0.00003351295,0.00008342459,0.00007366225,0.016438968],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.994548,0.0007545437,0.0006560843,0.00061216945,0.0030509837,0.00037809252],"domain_scores_gemma":[0.97214377,0.0063570286,0.0013513112,0.00085346017,0.015340162,0.003954335],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005877354,0.0047967783,0.005918266,0.0077319625,0.0042791776,0.010756681,0.0040592235,0.0144298915,0.03365941],"category_scores_gemma":[0.026211245,0.0015504187,0.0034259616,0.0029467423,0.0030054813,0.0044398126,0.0016652317,0.015996074,0.038650792],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000027769029,0.000007886213,0.000014306203,0.00008370708,0.000008279346,0.000047999984,0.0000019937493,0.000015052558,0.000028358232,0.00011076257,0.99661106,0.003042882],"study_design_scores_gemma":[0.00007402134,0.000026976175,0.00033029672,0.0003315923,0.000041473453,0.00025595163,0.000018113245,0.00023762649,0.00010609329,0.0011237995,0.99743325,0.00002083963],"about_ca_topic_score_codex":0.002530998,"about_ca_topic_score_gemma":0.0076004113,"teacher_disagreement_score":0.03365941,"about_ca_system_score_codex":0.0041117547,"about_ca_system_score_gemma":0.003890622,"threshold_uncertainty_score":0.112601876},"labels":[],"label_agreement":null},{"id":"W4206298479","doi":"10.1007/s00357-021-09396-3","title":"Chimeral Clustering","year":2021,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Cluster analysis; Pattern recognition (psychology); Artificial intelligence; Mathematics; Computer science","score_opus":0.04135846136028306,"score_gpt":0.301972910995361,"score_spread":0.26061444963507796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206298479","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009336002,0.0005406286,0.97255695,0.00039520132,0.00024859206,0.00019983982,0.0010239955,0.004189987,0.0115089305],"genre_scores_gemma":[0.109033644,0.00042143563,0.859972,0.00034263995,0.00011848849,0.00030472662,0.0049867798,0.0026900468,0.022130206],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9949615,0.0012274708,0.00026324418,0.001596442,0.0015255957,0.00042586325],"domain_scores_gemma":[0.9939767,0.00077568524,0.00020177948,0.0029058878,0.0018530881,0.00028687154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043643876,0.0012509652,0.0023681994,0.005187965,0.00376905,0.0064467066,0.0043182536,0.003761059,0.02248697],"category_scores_gemma":[0.010451348,0.001331199,0.0030273038,0.004841652,0.001841992,0.0036863254,0.0046146223,0.0033834437,0.012199412],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00070117455,0.00025000697,0.0031875994,0.00044821,0.0004983746,0.00025112816,0.00062177464,0.09139207,0.017097745,0.18854317,0.059581738,0.637427],"study_design_scores_gemma":[0.000057809466,0.00007834744,0.0019231415,0.00010782837,0.0001295653,0.0006431371,0.0003038169,0.760258,0.024682108,0.117059216,0.09462377,0.00013324796],"about_ca_topic_score_codex":0.0076149195,"about_ca_topic_score_gemma":0.012157932,"teacher_disagreement_score":0.02248697,"about_ca_system_score_codex":0.0022237254,"about_ca_system_score_gemma":0.0035839449,"threshold_uncertainty_score":0.07522637},"labels":[],"label_agreement":null},{"id":"W4214724944","doi":"10.1007/s00357-021-09407-3","title":"On Assessments of Agreement Between Fuzzy Partitions","year":2022,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Data Management and Algorithms","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Foundation for Innovation","keywords":"Interpretability; Fuzzy logic; Probabilistic logic; Property (philosophy); Monte Carlo method; Mathematics; Measure (data warehouse); Cluster (spacecraft); Computer science; Data mining; Artificial intelligence; Statistics","score_opus":0.07695818300159624,"score_gpt":0.33464940112893354,"score_spread":0.2576912181273373,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4214724944","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.45167705,0.0023372641,0.51955754,0.00201464,0.00029493604,0.0005061861,0.0010900876,0.00034919794,0.022173034],"genre_scores_gemma":[0.93111366,0.00026142228,0.066503696,0.00014565946,0.00014859639,0.0001913619,0.0006799476,0.00006078433,0.00089481863],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93958664,0.029081535,0.005412976,0.0072750514,0.016951546,0.0016922551],"domain_scores_gemma":[0.5263161,0.40825772,0.015434688,0.016734445,0.029350666,0.003906382],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0718672,0.0013779209,0.0020626178,0.012501561,0.0022834113,0.0077305436,0.0035217113,0.003598412,0.0043588565],"category_scores_gemma":[0.2875439,0.00087379804,0.0019568866,0.0049467087,0.0074235997,0.015462201,0.0076728933,0.0040376117,0.0005379146],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007880915,0.00063770165,0.17381331,0.001704189,0.0030505005,0.0007225145,0.012025488,0.12947437,0.006677094,0.31668591,0.006485012,0.34084305],"study_design_scores_gemma":[0.0002258688,0.0015887092,0.04503184,0.0007867861,0.00063537905,0.00067361136,0.0055230395,0.35274997,0.004283902,0.5845307,0.0036802723,0.00028996376],"about_ca_topic_score_codex":0.0028114978,"about_ca_topic_score_gemma":0.0023195976,"teacher_disagreement_score":0.0718672,"about_ca_system_score_codex":0.0033050333,"about_ca_system_score_gemma":0.0014294554,"threshold_uncertainty_score":0.38007462},"labels":[],"label_agreement":null},{"id":"W4220965753","doi":"10.1007/s00357-022-09410-2","title":"Editorial: Journal of Classification Vol. 39-1","year":2022,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Optics and Image Analysis","field":"Business, Management and Accounting","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Mathematics; Pattern recognition (psychology); Artificial intelligence; Computer science","score_opus":0.018933321706511377,"score_gpt":0.26371312415886977,"score_spread":0.2447798024523584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220965753","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00003099706,0.0012996861,0.00009152089,0.01617322,0.9800612,0.000023631814,0.000060513656,0.000064939384,0.0021944663],"genre_scores_gemma":[0.0005117923,0.0021236057,0.00013163578,0.010608195,0.96523815,0.000031779393,0.00009382006,0.000081524944,0.021179467],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9937079,0.0009158005,0.0007776287,0.00064803165,0.00349186,0.00045878824],"domain_scores_gemma":[0.9751002,0.0052623777,0.0012777795,0.0009526595,0.013801368,0.0036054456],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0058728475,0.004768535,0.0045128358,0.007316016,0.004691104,0.010287223,0.0038461923,0.013485056,0.036773063],"category_scores_gemma":[0.02904484,0.0012892842,0.003013134,0.0029021078,0.0028875167,0.0040622726,0.0017474273,0.013696085,0.035628717],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002081932,0.000008283841,0.000018312598,0.000060892453,0.0000062718977,0.00005501411,0.000002781169,0.000014573284,0.00002847621,0.00012683382,0.99715036,0.0025075655],"study_design_scores_gemma":[0.000046828853,0.000022304805,0.00037997647,0.00026253768,0.000026147658,0.00020795949,0.000025141091,0.0002109328,0.00009396435,0.0010000545,0.99770653,0.000017572009],"about_ca_topic_score_codex":0.0028663953,"about_ca_topic_score_gemma":0.007919769,"teacher_disagreement_score":0.036773063,"about_ca_system_score_codex":0.004151557,"about_ca_system_score_gemma":0.004039449,"threshold_uncertainty_score":0.123018146},"labels":[],"label_agreement":null},{"id":"W4285797528","doi":"10.1007/s00357-022-09418-8","title":"Editorial: Journal of Classification Vol. 39-2","year":2022,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Pattern recognition (psychology); Artificial intelligence; Mathematics; Computer science","score_opus":0.022274262870595644,"score_gpt":0.29671976253157534,"score_spread":0.2744454996609797,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285797528","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00002508426,0.002454767,0.00011266821,0.017446784,0.9779912,0.000023183156,0.00006631127,0.00007104838,0.001808911],"genre_scores_gemma":[0.00036978105,0.0028372274,0.00013199876,0.012631601,0.96869487,0.000030613417,0.00008403877,0.000070874594,0.015148946],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99451715,0.0007602086,0.00066085963,0.00063471624,0.003051058,0.00037601357],"domain_scores_gemma":[0.97294486,0.0063290857,0.0013703818,0.0008757805,0.014567292,0.0039127097],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005967005,0.0050718375,0.0060159266,0.007837839,0.004177449,0.010574025,0.003975386,0.014133086,0.03214505],"category_scores_gemma":[0.026020758,0.0016160952,0.00353067,0.0029245038,0.0030266375,0.0045470158,0.0016545265,0.016367942,0.036317416],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029662677,0.000009088909,0.000015451307,0.00008633686,0.000009694305,0.000053069394,0.000002137993,0.000015444575,0.000032914508,0.00010906094,0.9967895,0.0028476226],"study_design_scores_gemma":[0.00008425499,0.000030436375,0.00037374988,0.00032931686,0.000047945054,0.00028419553,0.000019098727,0.00024903272,0.00012060836,0.0011108151,0.9973283,0.000022162749],"about_ca_topic_score_codex":0.0023868526,"about_ca_topic_score_gemma":0.006717244,"teacher_disagreement_score":0.03214505,"about_ca_system_score_codex":0.003837763,"about_ca_system_score_gemma":0.003728309,"threshold_uncertainty_score":0.1075359},"labels":[],"label_agreement":null},{"id":"W4321098151","doi":"10.1007/s00357-023-09430-6","title":"Classification Trees with Mismeasured Responses","year":2023,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Machine Learning and Data Classification","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Waterloo","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Set (abstract data type); Computer science; Inference; Identification (biology); Decision tree; Tree (set theory); Variety (cybernetics); Feature (linguistics); Machine learning; Artificial intelligence; Statistics; Data mining; Mathematics","score_opus":0.0656833040863915,"score_gpt":0.3119337141698363,"score_spread":0.24625041008344478,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321098151","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18544137,0.0007982219,0.7946124,0.0031580508,0.00171331,0.00051537744,0.0030800402,0.005812668,0.0048684957],"genre_scores_gemma":[0.85907006,0.00014082398,0.12762484,0.0006698044,0.00051878946,0.00040755587,0.0037071954,0.0003259662,0.007534951],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9903092,0.00429084,0.0007868075,0.0020808617,0.0017847973,0.000747512],"domain_scores_gemma":[0.9565362,0.028540269,0.0015242096,0.00731943,0.00558103,0.0004989547],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012575785,0.0010709735,0.0015519822,0.0016359268,0.0011133141,0.0020635072,0.0028517926,0.0028043624,0.006457432],"category_scores_gemma":[0.057147168,0.000519345,0.0013046986,0.001579916,0.00081993564,0.0027923086,0.0017492756,0.0030100874,0.003684342],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037473862,0.0009475182,0.04841376,0.0005138687,0.00062554603,0.0016331306,0.0010677014,0.14161572,0.0097950045,0.028519038,0.050955333,0.712166],"study_design_scores_gemma":[0.00007430197,0.00021081828,0.0033648564,0.00008764853,0.00023462094,0.00044103712,0.00022861728,0.916977,0.0078027737,0.0638823,0.006650025,0.00004608598],"about_ca_topic_score_codex":0.0018591637,"about_ca_topic_score_gemma":0.0024079655,"teacher_disagreement_score":0.012575785,"about_ca_system_score_codex":0.0007549695,"about_ca_system_score_gemma":0.0014959287,"threshold_uncertainty_score":0.066507936},"labels":[],"label_agreement":null},{"id":"W4366997948","doi":"10.1007/s00357-023-09436-0","title":"Editorial: Journal of Classification Vol. 40-1","year":2023,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Mathematics; Pattern recognition (psychology); Artificial intelligence; Computer science","score_opus":0.02877144256539424,"score_gpt":0.3114594561092894,"score_spread":0.28268801354389517,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366997948","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000022505987,0.0026949684,0.00010485603,0.016829945,0.97859144,0.000022154612,0.00006071114,0.00006701525,0.001606528],"genre_scores_gemma":[0.00031714817,0.0030679123,0.00012448161,0.012036228,0.97106844,0.000030136216,0.00007925538,0.00006684992,0.013209576],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9939114,0.0009082047,0.0007663665,0.0006863293,0.0033176804,0.00041005292],"domain_scores_gemma":[0.968275,0.0073809014,0.0016315808,0.0009548085,0.017354824,0.004402817],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006516001,0.00502954,0.0064343675,0.008249437,0.0042904112,0.011161863,0.0041418495,0.014546675,0.03346737],"category_scores_gemma":[0.029414736,0.0016310012,0.0036934987,0.0032335292,0.003088178,0.004787998,0.0017386904,0.016463472,0.038932264],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003064547,0.0000087826775,0.000015254128,0.00009649027,0.000009880255,0.0000486718,0.0000020811133,0.000015762049,0.00002961018,0.00010690874,0.99661994,0.0030159368],"study_design_scores_gemma":[0.000084215455,0.000031368134,0.00036100057,0.00039157158,0.000048563994,0.000284548,0.000019739118,0.00026023787,0.0001110684,0.0012500845,0.9971341,0.000023592413],"about_ca_topic_score_codex":0.0024119834,"about_ca_topic_score_gemma":0.007185187,"teacher_disagreement_score":0.03346737,"about_ca_system_score_codex":0.0043204585,"about_ca_system_score_gemma":0.004027733,"threshold_uncertainty_score":0.11195958},"labels":[],"label_agreement":null},{"id":"W4382654511","doi":"10.1007/s00357-023-09442-2","title":"Editorial: Journal of Classification Vol. 40-2","year":2023,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Artificial intelligence; Pattern recognition (psychology); Mathematics; Computer science","score_opus":0.029120320865816274,"score_gpt":0.3119859986530865,"score_spread":0.28286567778727023,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382654511","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024840878,0.0025288786,0.00011240885,0.017807892,0.9776084,0.000023653154,0.00006463715,0.00007318122,0.0017560703],"genre_scores_gemma":[0.00035608042,0.0028683133,0.00013200956,0.012913284,0.96897084,0.000031489566,0.00008074694,0.00007069784,0.014576565],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99434847,0.00082134095,0.0006873056,0.00063764834,0.003118599,0.0003867586],"domain_scores_gemma":[0.9712054,0.0065977643,0.0014322109,0.00088935206,0.015767043,0.004108318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0062201987,0.005043727,0.0062878584,0.007839624,0.0042309486,0.01097731,0.004032648,0.014560578,0.032383822],"category_scores_gemma":[0.026962401,0.0016392026,0.0036627916,0.0030353523,0.0030512041,0.004709045,0.0016593862,0.016797945,0.037939183],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003194431,0.000009253223,0.000015624517,0.000089871304,0.000009871388,0.00005149361,0.0000021020703,0.00001592111,0.00003161095,0.000109057415,0.99675167,0.002881624],"study_design_scores_gemma":[0.0000921382,0.00003223027,0.0003821108,0.00036475228,0.000050702427,0.00029224547,0.000020053209,0.00027545737,0.00012083222,0.0012186068,0.9971271,0.000023762776],"about_ca_topic_score_codex":0.0024450389,"about_ca_topic_score_gemma":0.0071269837,"teacher_disagreement_score":0.032383822,"about_ca_system_score_codex":0.0040611094,"about_ca_system_score_gemma":0.0038585255,"threshold_uncertainty_score":0.10833472},"labels":[],"label_agreement":null},{"id":"W4388630951","doi":"10.1007/s00357-023-09453-z","title":"Model-Based Clustering with Nested Gaussian Clusters","year":2023,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Cluster analysis; Linear subspace; Pattern recognition (psychology); Artificial intelligence; Mathematics; Hierarchical clustering; Model selection; Single-linkage clustering; Mixture model; Bayesian information criterion; Gaussian; Computer science; Determining the number of clusters in a data set; Correlation clustering; CURE data clustering algorithm; Physics","score_opus":0.05773895718962707,"score_gpt":0.3019908204385257,"score_spread":0.24425186324889864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388630951","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039199037,0.00013735828,0.9953852,0.00007483754,0.000019189503,0.000035225796,0.0000341829,0.00016572175,0.00022836974],"genre_scores_gemma":[0.18180496,0.00037005468,0.8134942,0.00019509869,0.00009776387,0.0003227365,0.0007287508,0.00032875952,0.0026576929],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992238,0.00399463,0.00042581078,0.0015668296,0.0013935067,0.00038123594],"domain_scores_gemma":[0.98521847,0.0088160485,0.00080848817,0.0027213946,0.0020249258,0.00041071183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010846571,0.0014109947,0.0039967154,0.0029920521,0.0021928197,0.003331116,0.006926597,0.0036706512,0.0021438347],"category_scores_gemma":[0.033089023,0.0025043113,0.004262086,0.003052935,0.0027228429,0.004781808,0.005841838,0.003785285,0.0013748221],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003586486,0.0001745217,0.0018463208,0.00023358887,0.0003769505,0.00011008394,0.0006021117,0.7888804,0.00191002,0.10078795,0.0030290748,0.10169032],"study_design_scores_gemma":[0.000010985031,0.000012371492,0.00010843346,0.000010768041,0.000017016722,0.000023332752,0.000013561973,0.9630184,0.00025211775,0.03620001,0.00031930997,0.0000137238785],"about_ca_topic_score_codex":0.012129708,"about_ca_topic_score_gemma":0.012981856,"teacher_disagreement_score":0.012129708,"about_ca_system_score_codex":0.0025414326,"about_ca_system_score_gemma":0.0024575756,"threshold_uncertainty_score":0.057362854},"labels":[],"label_agreement":null},{"id":"W4388731756","doi":"10.1007/s00357-023-09454-y","title":"Editorial: Journal of Classification Vol. 40-3","year":2023,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Artificial intelligence; Pattern recognition (psychology); Computer science","score_opus":0.028885792649539624,"score_gpt":0.31177137130583826,"score_spread":0.28288557865629865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388731756","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00002415791,0.0025726168,0.00011588887,0.018042924,0.9772486,0.000024247027,0.00006316808,0.00007582788,0.0018326065],"genre_scores_gemma":[0.00036541626,0.0030446795,0.00013547513,0.013236121,0.96806985,0.00003234979,0.00007993071,0.00007383054,0.014962239],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99427915,0.0008110221,0.000693497,0.0006296057,0.0031882671,0.00039842885],"domain_scores_gemma":[0.97124726,0.0063329004,0.001409543,0.0008901388,0.0160602,0.004059958],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006198257,0.004995326,0.006359646,0.007957714,0.004392026,0.01122339,0.0041757687,0.0155037,0.032920714],"category_scores_gemma":[0.02664631,0.001658554,0.0038413631,0.003107454,0.0031434486,0.004634414,0.0017001914,0.017173361,0.03884876],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003051865,0.000008780331,0.000015197624,0.00008791228,0.000009668068,0.000051109946,0.0000020385241,0.000015958645,0.000030829873,0.00011141338,0.9967242,0.0029123656],"study_design_scores_gemma":[0.00008796354,0.000029994948,0.0003678549,0.00036479524,0.000049624992,0.00028856026,0.00001951455,0.00027726789,0.000119574404,0.0012258871,0.9971456,0.000023344368],"about_ca_topic_score_codex":0.0026340128,"about_ca_topic_score_gemma":0.007778295,"teacher_disagreement_score":0.032920714,"about_ca_system_score_codex":0.0043172864,"about_ca_system_score_gemma":0.003997336,"threshold_uncertainty_score":0.11013079},"labels":[],"label_agreement":null},{"id":"W4390639551","doi":"10.1007/s00357-023-09460-0","title":"Unsupervised Classification with a Family of Parsimonious Contaminated Shifted Asymmetric Laplace Mixtures","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MacEwan University; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Outlier; Series (stratigraphy); Mathematics; Bayesian information criterion; Bayesian probability; Expectation–maximization algorithm; Artificial intelligence; Computer science; Convergence (economics); Pattern recognition (psychology); Model selection; Algorithm; Statistics; Maximum likelihood","score_opus":0.029639951270204308,"score_gpt":0.28335772333249026,"score_spread":0.25371777206228596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390639551","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018893171,0.00033320437,0.97964776,0.00025893163,0.000034345794,0.00003422697,0.000066454064,0.00020222775,0.00052977126],"genre_scores_gemma":[0.5466477,0.0008357011,0.4450847,0.00051625934,0.00037613598,0.0002813025,0.00091213913,0.00025793046,0.0050882096],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9954306,0.002169935,0.00025881745,0.00085328566,0.0010610343,0.00022641257],"domain_scores_gemma":[0.9884036,0.0076302183,0.00081810344,0.0016624853,0.0011937837,0.0002918038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007843604,0.0009944566,0.0015843471,0.0022586884,0.001179983,0.002418172,0.0036437374,0.0030969353,0.0018432498],"category_scores_gemma":[0.024045538,0.0010349143,0.0020267332,0.0017842929,0.00284321,0.0039065173,0.0031358371,0.0032427483,0.0009940483],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001029657,0.00034743664,0.006954783,0.0003159643,0.00041856215,0.00038229354,0.0008279232,0.31491822,0.014770791,0.27097255,0.005442336,0.3836195],"study_design_scores_gemma":[0.000018228808,0.000032496708,0.00048400072,0.000021420588,0.00003083788,0.0001260349,0.000024857512,0.9242261,0.0013541547,0.072747774,0.000908797,0.000025286914],"about_ca_topic_score_codex":0.0013744705,"about_ca_topic_score_gemma":0.0015751633,"teacher_disagreement_score":0.007843604,"about_ca_system_score_codex":0.0010499271,"about_ca_system_score_gemma":0.001036852,"threshold_uncertainty_score":0.041481435},"labels":[],"label_agreement":null},{"id":"W4393073718","doi":"10.1007/s00357-024-09469-z","title":"Editorial: Journal of Classification Vol. 41-1","year":2024,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Optics and Image Analysis","field":"Business, Management and Accounting","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Pattern recognition (psychology); Artificial intelligence; Mathematics; Computer science","score_opus":0.018330536475646586,"score_gpt":0.2715214721715441,"score_spread":0.2531909356958975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393073718","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00003050455,0.0012512567,0.00008986038,0.016309902,0.98007935,0.000022828926,0.00005645877,0.00006441698,0.0020954227],"genre_scores_gemma":[0.00047922082,0.0019938545,0.00012775025,0.010107799,0.9668493,0.000030710624,0.00008558769,0.00007530719,0.020250408],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99367636,0.00094619195,0.0007944252,0.0006490523,0.003464611,0.0004692921],"domain_scores_gemma":[0.9736549,0.005476607,0.0012930107,0.0009752727,0.014847736,0.0037523652],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0059885755,0.004711122,0.0046523954,0.007285142,0.00480263,0.010686758,0.0038776482,0.013641962,0.0376652],"category_scores_gemma":[0.02945384,0.0013201231,0.0030854165,0.002925516,0.002910516,0.004136652,0.0017467728,0.014011436,0.036396995],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022038113,0.000008562051,0.000018499515,0.00006250587,0.000006491761,0.000052356965,0.0000027684791,0.000014743924,0.000027996295,0.00013059624,0.9970976,0.0025557834],"study_design_scores_gemma":[0.000050280305,0.000023916135,0.00037893042,0.0002673069,0.000028419076,0.00021073845,0.000026607475,0.00022221087,0.00009748077,0.0010542923,0.99762124,0.000018605984],"about_ca_topic_score_codex":0.0027166707,"about_ca_topic_score_gemma":0.007917783,"teacher_disagreement_score":0.0376652,"about_ca_system_score_codex":0.004258168,"about_ca_system_score_gemma":0.004117458,"threshold_uncertainty_score":0.12600261},"labels":[],"label_agreement":null},{"id":"W4396675678","doi":"10.1007/s00357-024-09470-6","title":"Skew Multiple Scaled Mixtures of Normal Distributions with Flexible Tail Behavior and Their Application to Clustering","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"National Science Council","keywords":"Cluster analysis; Skew; Mathematics; Skew normal distribution; Pattern recognition (psychology); Statistics; Normal distribution; Computer science; Statistical physics; Artificial intelligence; Physics","score_opus":0.021196143170225674,"score_gpt":0.28421407031829893,"score_spread":0.26301792714807326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396675678","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007596761,0.00032769717,0.9913816,0.00011731745,0.00004013496,0.00003791305,0.00003522784,0.00014987626,0.00031353527],"genre_scores_gemma":[0.3538446,0.0015166805,0.63740224,0.0003403349,0.0005282176,0.00053508586,0.0006316067,0.0003866841,0.004814547],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99456644,0.0032775712,0.00024798478,0.0006749226,0.0009992766,0.00023385296],"domain_scores_gemma":[0.9610333,0.030289598,0.0022014722,0.0030902452,0.0026277006,0.0007575977],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013908233,0.0013401564,0.0022508309,0.0034394357,0.0013470106,0.0026866768,0.0039800047,0.0034776672,0.0023552857],"category_scores_gemma":[0.06687306,0.001812759,0.0022511478,0.0038319516,0.0038058045,0.0041571697,0.0037841795,0.0037288265,0.0008895522],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026130266,0.0001425037,0.003021046,0.0002522133,0.00016814981,0.00028503287,0.0008743008,0.46262163,0.0028030933,0.44643667,0.0029646629,0.0801693],"study_design_scores_gemma":[0.000010686608,0.000018326578,0.00033738918,0.000019881838,0.00001507795,0.000080366015,0.00003224944,0.90635085,0.00023885537,0.09220515,0.0006609065,0.000030294563],"about_ca_topic_score_codex":0.0030732024,"about_ca_topic_score_gemma":0.0030497508,"teacher_disagreement_score":0.013908233,"about_ca_system_score_codex":0.0017325521,"about_ca_system_score_gemma":0.0013111039,"threshold_uncertainty_score":0.073554695},"labels":[],"label_agreement":null},{"id":"W4399158654","doi":"10.1007/s00357-024-09473-3","title":"Finding Outliers in Gaussian Model-based Clustering","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Canada Research Chairs","keywords":"Outlier; Cluster analysis; Pattern recognition (psychology); Artificial intelligence; Mathematics; Gaussian; Computer science; Statistics; Physics","score_opus":0.05584761604273475,"score_gpt":0.3315201195779214,"score_spread":0.27567250353518663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399158654","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024188275,0.00055199326,0.974342,0.00016495693,0.00005114306,0.00003323692,0.000060160306,0.0003888746,0.00021929509],"genre_scores_gemma":[0.5333211,0.00061360287,0.46236572,0.00016122879,0.0001794051,0.00015735715,0.0010809508,0.00045570033,0.0016649332],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99172276,0.0033800697,0.00056973,0.0014016795,0.002461716,0.0004640262],"domain_scores_gemma":[0.9741149,0.018318241,0.00171336,0.0021845347,0.0030985996,0.000570238],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010761701,0.0014184559,0.0038188272,0.0047520935,0.0018576088,0.0036070754,0.005235739,0.00410092,0.00096131774],"category_scores_gemma":[0.052168906,0.0019079236,0.0019365997,0.0040689376,0.002791654,0.0041128932,0.0035586366,0.0037601176,0.00062636845],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011368498,0.00038590978,0.014578354,0.0004208816,0.00056925573,0.00021349941,0.0006295023,0.76374996,0.0044379216,0.033157505,0.0048193703,0.17590101],"study_design_scores_gemma":[0.000012198042,0.000024479603,0.0005842736,0.000014394934,0.000020595538,0.000038890084,0.00004744069,0.9788902,0.00074287655,0.019281164,0.0003262615,0.00001728951],"about_ca_topic_score_codex":0.0099717425,"about_ca_topic_score_gemma":0.008308856,"teacher_disagreement_score":0.010761701,"about_ca_system_score_codex":0.0018779088,"about_ca_system_score_gemma":0.0016421675,"threshold_uncertainty_score":0.056913972},"labels":[],"label_agreement":null},{"id":"W4400293933","doi":"10.1007/s00357-024-09485-z","title":"Editorial: Journal of Classification Vol. 41-2","year":2024,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Pattern recognition (psychology); Artificial intelligence; Computer science; Mathematics","score_opus":0.02155354905929521,"score_gpt":0.3052997013690565,"score_spread":0.2837461523097613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400293933","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024523637,0.0023951905,0.00010915887,0.017471801,0.9781115,0.000022377906,0.00006089063,0.000068676316,0.0017359029],"genre_scores_gemma":[0.00034988354,0.0026972226,0.00012665219,0.012038764,0.9699822,0.000029668163,0.000075744836,0.00006470896,0.014635171],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99440515,0.0008037569,0.00068728253,0.0006421374,0.0030744097,0.00038719104],"domain_scores_gemma":[0.97170234,0.006518249,0.0013783955,0.00089930644,0.015510107,0.0039915405],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061099688,0.0050333645,0.006171217,0.00788071,0.00434305,0.010881799,0.0040561636,0.01433792,0.032466043],"category_scores_gemma":[0.026504658,0.001644127,0.0035986803,0.0029781372,0.003077799,0.0046940907,0.0016757431,0.016729385,0.03667238],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003060119,0.000009261338,0.000015200511,0.00008846055,0.000009827721,0.000049890208,0.0000021419144,0.000015467873,0.000031908297,0.00011405212,0.9967643,0.002868825],"study_design_scores_gemma":[0.00008745549,0.0000318281,0.00036979953,0.0003368833,0.00005022007,0.00028406954,0.000020397589,0.00025782816,0.00012327392,0.0011664347,0.9972485,0.000023268178],"about_ca_topic_score_codex":0.0022890912,"about_ca_topic_score_gemma":0.0067169648,"teacher_disagreement_score":0.032466043,"about_ca_system_score_codex":0.0039847577,"about_ca_system_score_gemma":0.0037616915,"threshold_uncertainty_score":0.108609796},"labels":[],"label_agreement":null},{"id":"W4403170718","doi":"10.1007/s00357-024-09493-z","title":"Mixed-Type Distance Shrinkage and Selection for Clustering via Kernel Metric Learning","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia, Okanagan Campus; University of British Columbia","funders":"University of British Columbia","keywords":"Cluster analysis; Shrinkage; Selection (genetic algorithm); Mathematics; Kernel (algebra); Artificial intelligence; Metric (unit); Pattern recognition (psychology); Type (biology); Statistics; Computer science; Combinatorics; Geology; Engineering","score_opus":0.04542069984512903,"score_gpt":0.3289202876242669,"score_spread":0.28349958777913786,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403170718","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003714703,0.00009850148,0.99566084,0.000069353766,0.000026521631,0.000027758855,0.000024463414,0.00020801082,0.00016974597],"genre_scores_gemma":[0.13789101,0.00022456536,0.8571922,0.00013950511,0.00015389909,0.0003422742,0.00045010148,0.00036839006,0.0032379907],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9951515,0.0023687084,0.00029071863,0.00082270894,0.0011664433,0.00019972172],"domain_scores_gemma":[0.9909478,0.0040112548,0.0005419038,0.0015878131,0.0026073144,0.0003038938],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007872747,0.0011073637,0.002477767,0.0015312902,0.001195905,0.0016469904,0.004303803,0.0022038575,0.0021279259],"category_scores_gemma":[0.02221743,0.0010288502,0.0018655875,0.0018169873,0.001509908,0.0033915685,0.0035039214,0.0031627843,0.0015336038],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007978904,0.0003578387,0.002410116,0.0004994697,0.00043353686,0.00013158552,0.00042369255,0.2844838,0.016833313,0.101807825,0.008891745,0.5829292],"study_design_scores_gemma":[0.000021901324,0.00006680658,0.0002389184,0.000012341484,0.00002146158,0.000044306194,0.00001923242,0.98083824,0.0024917922,0.015045536,0.0011793106,0.000020201167],"about_ca_topic_score_codex":0.0017727695,"about_ca_topic_score_gemma":0.0028495383,"teacher_disagreement_score":0.007872747,"about_ca_system_score_codex":0.0011371798,"about_ca_system_score_gemma":0.0019498412,"threshold_uncertainty_score":0.041635573},"labels":[],"label_agreement":null},{"id":"W4403438151","doi":"10.1007/s00357-024-09494-y","title":"Vine Copula-Based Classifiers with Applications","year":2024,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Horticultural and Viticultural Research","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Technische Universität München; Deutsche Forschungsgemeinschaft","keywords":"Copula (linguistics); Vine copula; Artificial intelligence; Pattern recognition (psychology); Computer science; Mathematics; Natural language processing; Machine learning; Statistics; Econometrics","score_opus":0.05394189423688334,"score_gpt":0.3027071154114639,"score_spread":0.24876522117458055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403438151","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02056089,0.0017055222,0.9742959,0.000362117,0.000109818946,0.00007296629,0.00016210279,0.0011739866,0.0015567167],"genre_scores_gemma":[0.4878665,0.0010644564,0.5054775,0.0003983292,0.00025841178,0.00016520673,0.00068626914,0.0003607487,0.003722583],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978689,0.0009092246,0.00011622048,0.0004662107,0.00048632445,0.00015317538],"domain_scores_gemma":[0.9945831,0.003312533,0.00029676568,0.0004750907,0.0011965304,0.0001360571],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004204092,0.0011488288,0.001640073,0.0030519147,0.00085525005,0.0016329599,0.0014625883,0.0012527037,0.0027225309],"category_scores_gemma":[0.012504564,0.00046771334,0.0012719326,0.0024389243,0.0006788067,0.0014229747,0.001691543,0.0018221576,0.0013222799],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018775552,0.00015374675,0.0032035294,0.00012053102,0.00021224994,0.00012392626,0.00014571659,0.49539632,0.0030176411,0.018122198,0.0077701886,0.4715462],"study_design_scores_gemma":[0.0000048100364,0.000011734635,0.00022365335,0.000008472922,0.0000058887904,0.000019380474,0.000008331972,0.9939772,0.00040969581,0.004674591,0.00064988714,0.000006358756],"about_ca_topic_score_codex":0.005278674,"about_ca_topic_score_gemma":0.0035368875,"teacher_disagreement_score":0.005278674,"about_ca_system_score_codex":0.0010133402,"about_ca_system_score_gemma":0.00077713863,"threshold_uncertainty_score":0.022233665},"labels":[],"label_agreement":null},{"id":"W4404725773","doi":"10.1007/s00357-024-09496-w","title":"Editorial: Journal of Classification Vol. 41-3","year":2024,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; MacEwan University","funders":"","keywords":"Mathematics; Artificial intelligence; Pattern recognition (psychology); Computer science","score_opus":0.021368677956954095,"score_gpt":0.30503049146691724,"score_spread":0.28366181350996317,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404725773","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000023729785,0.0024362204,0.000112500835,0.017826041,0.97764814,0.000023121467,0.00005986424,0.00007109827,0.0017992848],"genre_scores_gemma":[0.0003548311,0.0028534778,0.00012937548,0.012421177,0.96927166,0.000030605774,0.000074475196,0.00006679473,0.014797672],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9943129,0.00079515204,0.00069692574,0.0006352378,0.0031626674,0.00039717546],"domain_scores_gemma":[0.97157335,0.006359664,0.0013754747,0.00090919837,0.015810102,0.003972245],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006154024,0.0049719973,0.006219503,0.008014003,0.004502708,0.011110534,0.0042136805,0.015390719,0.032627795],"category_scores_gemma":[0.026438283,0.0016634911,0.003789684,0.003064531,0.0031812282,0.0046244604,0.0017172465,0.01717836,0.037116576],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029293475,0.000008871855,0.000014901452,0.00008739764,0.000009670858,0.00005009332,0.000002090078,0.00001558185,0.000031013253,0.00011614868,0.9967276,0.002907282],"study_design_scores_gemma":[0.000083308936,0.00002960223,0.00035710324,0.0003374863,0.00004939672,0.00028013188,0.00001977587,0.00025784597,0.00012152073,0.0011675023,0.9972735,0.000022842327],"about_ca_topic_score_codex":0.002496583,"about_ca_topic_score_gemma":0.0073402477,"teacher_disagreement_score":0.032627795,"about_ca_system_score_codex":0.0042407797,"about_ca_system_score_gemma":0.003913974,"threshold_uncertainty_score":0.10915083},"labels":[],"label_agreement":null},{"id":"W4408349876","doi":"10.1007/s00357-025-09505-6","title":"Editorial: Journal of Classification Vol. 42-1","year":2025,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Pattern recognition (psychology); Artificial intelligence; Computer science; Mathematics","score_opus":0.017133976611363583,"score_gpt":0.3023350735259501,"score_spread":0.28520109691458656,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408349876","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000022506185,0.0026527215,0.00010859823,0.015712202,0.9796832,0.000021354568,0.000059238195,0.000066584296,0.0016736044],"genre_scores_gemma":[0.0003190185,0.0029554192,0.00012938271,0.011326644,0.97149694,0.000028785553,0.00008122843,0.0000647675,0.013597827],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9940309,0.0008878819,0.0007399252,0.00068414933,0.0032612602,0.00039582915],"domain_scores_gemma":[0.96871054,0.007281351,0.0015871259,0.0009340144,0.017105114,0.0043818564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063555855,0.0048827427,0.006204623,0.008078168,0.004200857,0.011189004,0.003950072,0.013625757,0.03473884],"category_scores_gemma":[0.028151553,0.0015610474,0.0035207444,0.0030647162,0.0029554274,0.00459779,0.001686835,0.015794905,0.03984909],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030207351,0.00000881116,0.0000150973165,0.00009733789,0.000009737507,0.00004559382,0.000002077205,0.000015628339,0.000030213687,0.000112435,0.9965049,0.0031280073],"study_design_scores_gemma":[0.000079536694,0.0000312649,0.00035246095,0.00037686902,0.000046775185,0.00026972764,0.000019736526,0.000251628,0.000111459136,0.0012159387,0.99722195,0.000022661254],"about_ca_topic_score_codex":0.00212042,"about_ca_topic_score_gemma":0.0066414746,"teacher_disagreement_score":0.03473884,"about_ca_system_score_codex":0.0040413043,"about_ca_system_score_gemma":0.003852667,"threshold_uncertainty_score":0.116212964},"labels":[],"label_agreement":null},{"id":"W4412177048","doi":"10.1007/s00357-025-09514-5","title":"Editorial: Journal of Classification Vol. 42-2","year":2025,"lang":"en","type":"editorial","venue":"Journal of Classification","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Pattern recognition (psychology); Mathematics; Artificial intelligence; Computer science","score_opus":0.017361618188325673,"score_gpt":0.3030496181655725,"score_spread":0.28568799997724686,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412177048","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024650828,0.0024976265,0.00011498897,0.016683197,0.97870433,0.000022688106,0.000063020714,0.00007249414,0.0018170326],"genre_scores_gemma":[0.00035554613,0.0027610827,0.00013656102,0.012189813,0.96943843,0.0000299776,0.00008203752,0.000068286405,0.014938262],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9944283,0.00080911646,0.00066609285,0.0006392116,0.0030809355,0.00037631535],"domain_scores_gemma":[0.97132295,0.0065565445,0.0014091998,0.0008748577,0.015710823,0.0041256347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061015887,0.004907913,0.0060865646,0.0077020144,0.004159859,0.011039742,0.0038542359,0.013723534,0.033653323],"category_scores_gemma":[0.025911693,0.0015725543,0.0035169036,0.0028873906,0.002936783,0.00454546,0.00162114,0.01615385,0.03893618],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003142763,0.000009299731,0.000015385955,0.00009046338,0.000009670946,0.000048178023,0.0000020940336,0.000015631436,0.00003187764,0.00011419252,0.9966426,0.0029890775],"study_design_scores_gemma":[0.00008693742,0.0000321836,0.0003708518,0.00035289818,0.00004874371,0.0002767066,0.000020139465,0.00026472364,0.00012063863,0.0011929042,0.99721044,0.000022824095],"about_ca_topic_score_codex":0.002167989,"about_ca_topic_score_gemma":0.006653698,"teacher_disagreement_score":0.033653323,"about_ca_system_score_codex":0.0038193057,"about_ca_system_score_gemma":0.0037212432,"threshold_uncertainty_score":0.11258155},"labels":[],"label_agreement":null},{"id":"W4415830087","doi":"10.1007/s00357-025-09525-2","title":"Editorial: Journal of Classification Vol. 42-3","year":2025,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Library Science and Information Systems","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"","score_opus":0.025546650572988605,"score_gpt":0.27815162940695665,"score_spread":0.25260497883396804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415830087","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00004319626,0.001183905,0.00009429912,0.023473043,0.9735832,0.000030061781,0.000087287895,0.00007947911,0.0014254041],"genre_scores_gemma":[0.0006881629,0.0024478529,0.0001632614,0.025783794,0.9543939,0.00005968862,0.00014055046,0.00009166811,0.016231155],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932549,0.0009327095,0.00096324424,0.00084779965,0.0033772397,0.0006240537],"domain_scores_gemma":[0.970543,0.0066437125,0.0016420153,0.001293112,0.016095014,0.0037831708],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008161682,0.0052514505,0.0057413443,0.0080279,0.004900597,0.011936479,0.0049923453,0.022923576,0.035386715],"category_scores_gemma":[0.032320715,0.0020151504,0.004840278,0.0038698667,0.0034254587,0.0046726232,0.0018026009,0.019854467,0.032262485],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000033185202,0.000014623696,0.000033565466,0.000098033044,0.0000114366085,0.00003696055,0.0000034062307,0.000016791033,0.00003890266,0.00011779154,0.99740237,0.0021929995],"study_design_scores_gemma":[0.000088279645,0.000032681077,0.00070163753,0.0004022688,0.000060451057,0.00015896944,0.000028935498,0.00025415115,0.00012613137,0.0008408317,0.99727815,0.000027498318],"about_ca_topic_score_codex":0.0037166271,"about_ca_topic_score_gemma":0.008384996,"teacher_disagreement_score":0.035386715,"about_ca_system_score_codex":0.0051506558,"about_ca_system_score_gemma":0.005036338,"threshold_uncertainty_score":0.11838037},"labels":[],"label_agreement":null},{"id":"W4415853390","doi":"10.1007/s00357-025-09526-1","title":"Extending Cluster-Weighted Factor Analyzers for Multivariate Prediction and Interpretability","year":2025,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Canada Excellence Research Chairs, Government of Canada","keywords":"Interpretability; Disjoint sets; Multivariate statistics; Maximization; Latent variable; Set (abstract data type); Support vector machine; Expectation–maximization algorithm; Factor analysis","score_opus":0.028036922328684596,"score_gpt":0.33200583274420276,"score_spread":0.30396891041551816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415853390","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028111052,0.00007099333,0.99560225,0.00005974259,0.000013171829,0.00003261726,0.00010226987,0.0009565156,0.00035123285],"genre_scores_gemma":[0.13527408,0.0002138163,0.86111104,0.00013521826,0.00008407197,0.00020788019,0.0008115649,0.000913703,0.0012485862],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99218154,0.0035110698,0.00066388166,0.0016284923,0.0016816055,0.00033344713],"domain_scores_gemma":[0.9627321,0.023789851,0.0018522339,0.005818319,0.0052441233,0.00056339725],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012449758,0.0024431765,0.0020177106,0.005642099,0.0012863072,0.0041291635,0.0028572378,0.00138804,0.006285159],"category_scores_gemma":[0.055307787,0.0011699147,0.003050766,0.004554051,0.0017529733,0.007474918,0.0040188218,0.003232403,0.0022790323],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010025343,0.00037235895,0.005693873,0.00038235352,0.0009150591,0.00032234602,0.0010873153,0.068953715,0.011740351,0.18904589,0.006973091,0.71351117],"study_design_scores_gemma":[0.000036488924,0.000045676232,0.00079928216,0.0000484004,0.0001137844,0.00008780787,0.00009830396,0.6861369,0.002990021,0.30717078,0.0024225856,0.00004999102],"about_ca_topic_score_codex":0.004601484,"about_ca_topic_score_gemma":0.0048493496,"teacher_disagreement_score":0.012449758,"about_ca_system_score_codex":0.0009908023,"about_ca_system_score_gemma":0.0020938693,"threshold_uncertainty_score":0.06584138},"labels":[],"label_agreement":null},{"id":"W4416943890","doi":"10.1007/s00357-025-09522-5","title":"Implications of Different Encodings of Binned Data when Clustering","year":2025,"lang":"en","type":"article","venue":"Journal of Classification","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Cluster analysis; Encoding (memory); Latent class model; ENCODE; Class (philosophy); Pattern recognition (psychology); Medoid; Latent variable; Single-linkage clustering","score_opus":0.088042672940701,"score_gpt":0.3476281171019941,"score_spread":0.2595854441612931,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416943890","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4136867,0.0019838873,0.5692377,0.0062645706,0.0005119417,0.000510605,0.001703331,0.0011465282,0.0049548233],"genre_scores_gemma":[0.7061318,0.0002937288,0.29140377,0.00057840283,0.000044131397,0.00019940632,0.00074523105,0.00018469668,0.00041876215],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9418401,0.046768483,0.0034431089,0.002501334,0.004578121,0.0008688928],"domain_scores_gemma":[0.7209245,0.22805701,0.008426394,0.021594344,0.01937121,0.0016264474],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.046837304,0.00070040097,0.0010605954,0.0027061997,0.0015391199,0.0061735776,0.002609991,0.0018135804,0.0019569937],"category_scores_gemma":[0.30726254,0.00066122465,0.00095086,0.0049063624,0.0031991908,0.009074188,0.0035938092,0.00365905,0.00036935788],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0054026083,0.0006525126,0.048310615,0.0015345378,0.0007605346,0.0004737673,0.007725656,0.32515648,0.009348635,0.2298053,0.010229574,0.3605998],"study_design_scores_gemma":[0.0003109917,0.00048608746,0.012359216,0.0010158999,0.00019144837,0.00047282135,0.0060775243,0.6816877,0.014013261,0.2779355,0.0051714755,0.0002779531],"about_ca_topic_score_codex":0.0039752517,"about_ca_topic_score_gemma":0.004769667,"teacher_disagreement_score":0.046837304,"about_ca_system_score_codex":0.0037903176,"about_ca_system_score_gemma":0.0017614195,"threshold_uncertainty_score":0.2477023},"labels":[],"label_agreement":null}]}