{"id":"W4399695341","doi":"10.48550/arxiv.2406.08880","title":"Jackknife inference with two-way clustering","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; Danmarks Grundforskningsfond; National Research Foundation","keywords":"Jackknife resampling; Inference; Cluster analysis; Computer science; Artificial intelligence; Mathematics; Data mining; Statistics","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0001266047,0.0002892044,0.0002381861,0.0002568414,0.0001100172,0.0002908537,0.001180883,0.0001767172,0.00005618306],"category_scores_gemma":[0.00001211722,0.0002713743,0.0001109887,0.000485005,0.00006821349,0.0003329631,0.003449605,0.0007109825,0.0006693699],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000100268,"about_ca_system_score_gemma":0.0001760951,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001530508,"about_ca_topic_score_gemma":0.0001247917,"domain_scores_codex":[0.9983287,0.0000677369,0.0001413759,0.001049032,0.000108075,0.000305042],"domain_scores_gemma":[0.9986556,0.00007232906,0.0001182526,0.0008809546,0.0001195988,0.0001533249],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001235142,0.0001897769,0.00173998,0.0008861886,0.0003158116,0.00335475,0.001468639,0.8242451,0.0006378952,0.14909,0.00245336,0.01549502],"study_design_scores_gemma":[0.0004619409,0.00007842081,0.0002159097,0.000979132,0.00006673242,0.00001442366,0.00008729594,0.9305045,0.0007142143,0.06552802,0.000713852,0.0006355785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2756025,0.0000572414,0.7096434,0.0001761317,0.0007195476,0.0002140194,0.00001162484,0.0005145527,0.01306106],"genre_scores_gemma":[0.9942848,0.00007985358,0.003136675,0.0001170158,0.00006927779,0.000001753271,0.0000115201,0.0000175599,0.002281552],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7186823,"threshold_uncertainty_score":0.9999738,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06961469638243965,"score_gpt":0.1993471919658493,"score_spread":0.1297324955834096,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}