{"id":"W4398239158","doi":"10.1145/3639478.3640035","title":"AntiCopyPaster 2.0: Whitebox just-in-time code duplicates extraction","year":2024,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"École de Technologie Supérieure; Université du Québec à Montréal","funders":"","keywords":"Code refactoring; Plug-in; Computer science; Workflow; Source code; Programming language; Code (set theory); Software engineering; Database; Software; Set (abstract data type)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005680416,0.003629701,0.001403468,0.004782951,0.0010751,0.004010771,0.003933128,0.002376851,0.02996999],"category_scores_gemma":[0.03307751,0.002788824,0.002430008,0.001660359,0.001115126,0.005929341,0.005947144,0.002993269,0.02522961],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000909192,"about_ca_system_score_gemma":0.002522822,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002468395,"about_ca_topic_score_gemma":0.004598602,"domain_scores_codex":[0.9950996,0.000769379,0.0004816203,0.001082735,0.002279949,0.0002866817],"domain_scores_gemma":[0.9832126,0.007854519,0.001410133,0.005025487,0.001974971,0.0005223209],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.001530072,0.0003468422,0.007566855,0.002831071,0.0003672716,0.00131051,0.001965106,0.002831549,0.03967101,0.01005748,0.4348114,0.4967108],"study_design_scores_gemma":[0.0003828186,0.0004074217,0.007157664,0.00108253,0.0002581105,0.002720434,0.0005580735,0.08726683,0.1797574,0.02431362,0.6954713,0.0006237461],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"software","genre_gemma":"methods","genre_scores_codex":[0.003957966,0.0004441081,0.2361721,0.000300692,0.0003100626,0.0003765642,0.004557418,0.7494455,0.004435543],"genre_scores_gemma":[0.07077068,0.001060542,0.5578607,0.00158023,0.0002500638,0.001297543,0.02722135,0.3066909,0.03326791],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.02996999,"threshold_uncertainty_score":0.1002596,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02113027810197013,"score_gpt":0.3056974043315239,"score_spread":0.2845671262295537,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}