{"id":"W2953431343","doi":"10.1109/icse-companion.2019.00039","title":"Witt: Querying Technology Terms Based on Automated Classification","year":2019,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Categorization; Software; Term (time); Java; Spurious relationship; Information retrieval; Data mining; Artificial intelligence; Machine learning; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002239754,0.001901744,0.001097745,0.02374663,0.001507416,0.003755121,0.002009042,0.001729545,0.01070893],"category_scores_gemma":[0.0190658,0.0008404555,0.002406118,0.01520878,0.0007592714,0.0110726,0.004916588,0.001180836,0.006958304],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001802996,"about_ca_system_score_gemma":0.002086335,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01308434,"about_ca_topic_score_gemma":0.01497348,"domain_scores_codex":[0.9961466,0.0005626896,0.0009378187,0.0006872453,0.001420736,0.0002450192],"domain_scores_gemma":[0.9939858,0.002316524,0.0007766295,0.001199702,0.001427505,0.0002939167],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007983904,0.0003320296,0.02315052,0.004674704,0.000508558,0.00168555,0.007631649,0.0119858,0.02851284,0.08948096,0.2214821,0.6097569],"study_design_scores_gemma":[0.0002259425,0.0003287271,0.01378864,0.001310609,0.000352442,0.002378711,0.005189854,0.2665892,0.02953707,0.1741496,0.5057692,0.0003800847],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04059015,0.001613171,0.7480807,0.001010844,0.0002563829,0.001452925,0.08808026,0.0943663,0.02454923],"genre_scores_gemma":[0.1343098,0.001287372,0.7020797,0.0004280361,0.0001487113,0.001535453,0.1491414,0.0046238,0.00644569],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02374663,"threshold_uncertainty_score":0.03582495,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01472741856136428,"score_gpt":0.2683685151964147,"score_spread":0.2536410966350504,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}