{"id":"W1807333353","doi":"10.1109/wpc.1998.693328","title":"Parsing minimization when extracting information from code in the presence of conditional compilation","year":2002,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Parsing; Source code; Code (set theory); Programming language; Set (abstract data type); Heuristic; Information extraction; Minification; Natural language processing; Artificial intelligence; Information retrieval; Data mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002544658,0.00004259239,0.00005000928,0.0001007313,0.00003977245,0.00009125409,0.0003350869,0.00002686013,0.00008104392],"category_scores_gemma":[0.0005614012,0.00003508327,0.00001218185,0.0002429518,0.00001755054,0.001547128,0.00003999053,0.00008775387,0.00001940543],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002824589,"about_ca_system_score_gemma":0.00001117132,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00006146923,"about_ca_topic_score_gemma":0.000007556692,"domain_scores_codex":[0.9992155,0.00005491056,0.0001980258,0.00007829653,0.0003581383,0.00009509009],"domain_scores_gemma":[0.9981447,0.001525934,0.00006388829,0.0001805704,0.00007041302,0.00001451415],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000292451,0.0004085217,0.2693438,0.0001131045,0.00003954618,0.00001090028,0.09153473,0.3755234,0.002406172,0.0673475,0.02253201,0.1707112],"study_design_scores_gemma":[0.0001323446,0.000008950068,0.1481641,0.00001728675,6.119419e-7,0.000002051435,0.00008889587,0.849096,0.0004699652,0.001604561,0.0003747063,0.00004054106],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05788764,0.00001964873,0.9405689,0.0006803043,0.00005845937,0.0001141934,0.000007383227,0.00005120821,0.0006123075],"genre_scores_gemma":[0.9486985,0.000002536257,0.05117133,0.00006260572,0.00001526557,0.000006615019,0.0000324434,0.000001504306,0.000009258309],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8908108,"threshold_uncertainty_score":0.1430654,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0403953958266925,"score_gpt":0.2609324790138389,"score_spread":0.2205370831871464,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}