{"id":"W3037695460","doi":"10.4230/lipics.icalp.2020.85","title":"Proportionally Fair Clustering Revisited","year":2020,"lang":"en","type":"article","venue":"DROPS (Schloss Dagstuhl – Leibniz Center for Informatics)","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Cluster analysis; Metric space; Mathematics; Centroid; Combinatorics; Metric (unit); Generalization; Discrete mathematics; Cluster (spacecraft); Approximation algorithm; k-medians clustering; Correlation clustering; Computer science; CURE data clustering algorithm; Statistics; Geometry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","open_science"],"consensus_categories":["open_science"],"category_scores_codex":[0.0005569632,0.0004218209,0.0004786222,0.0002185735,0.0003175285,0.0006441103,0.01974155,0.0002666756,0.00003610745],"category_scores_gemma":[0.005973261,0.0003919136,0.0002155887,0.000764918,0.0001359039,0.003219399,0.04132275,0.000602368,0.0003069672],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001359608,"about_ca_system_score_gemma":0.0001115463,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000004431647,"about_ca_topic_score_gemma":0.000002852429,"domain_scores_codex":[0.9966422,0.0000336604,0.001264372,0.0005192132,0.0007154868,0.0008251028],"domain_scores_gemma":[0.9941276,0.0001163953,0.0005573355,0.004621547,0.0003027445,0.0002743535],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002252666,0.0004336815,0.008652539,0.003293205,0.0005076223,0.00007690783,0.006109662,0.0003304223,0.0007759525,0.03092714,0.8670623,0.08160525],"study_design_scores_gemma":[0.001792094,0.0003195309,0.0005586349,0.000203826,0.00002272515,0.00007396035,0.000272232,0.8406884,0.001512901,0.01156964,0.1422127,0.0007733284],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008930656,0.00005824353,0.955951,0.02810499,0.0004923666,0.001252974,0.0004411736,0.002060068,0.002708577],"genre_scores_gemma":[0.291193,0.00006154185,0.7008077,0.006748678,0.0002252281,0.0001633175,0.0006714549,0.000062119,0.00006696801],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.840358,"threshold_uncertainty_score":0.9998533,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03339787288379148,"score_gpt":0.2676198671543172,"score_spread":0.2342219942705257,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}