{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":6,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":6,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"7a3547c421a9","filters":{"venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)"}},"results":[{"id":"W4205689130","doi":"10.1109/ase51524.2021.9678888","title":"SMARTIAN: Enhancing Smart Contract Fuzzing with Static and Dynamic Data-Flow Analyses","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Advanced Malware Detection Techniques","field":"Computer Science","cited_by":165,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Fuzz testing; Computer science; Database transaction; Static analysis; Code (set theory); Code coverage; Construct (python library); Smart contract; Software bug; Database; Software engineering; Programming language; Software; Set (abstract data type)","authors":[{"name":"Jaeseung Choi","is_ca":true},{"name":"Doyeon Kim","is_ca":true},{"name":"Soomin Kim","is_ca":true},{"name":"Gustavo Grieco","is_ca":true},{"name":"Alex Groce","is_ca":true},{"name":"Sang Kil","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03912733686987249,"gpt":0.3268875456929596,"spread":0.2877602088230872,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004066743,0.001599336,0.0008604447,0.003293842,0.0007055061,0.001757971,0.002297905,0.001358383,0.002109539],"category_scores_gemma":[0.02960371,0.0009920557,0.00137682,0.001268354,0.002320582,0.005850363,0.003060619,0.002020039,0.0008283956],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001049136,"about_ca_system_score_gemma":0.002888114,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004403519,"about_ca_topic_score_gemma":0.006199884,"domain_scores_codex":[0.9950129,0.00108007,0.0003935301,0.0009728833,0.002234424,0.0003060036],"domain_scores_gemma":[0.98067,0.01120375,0.001590105,0.004413777,0.001833539,0.0002888094],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001039779,0.0009568399,0.05981112,0.001047113,0.0003734866,0.001152231,0.002214973,0.1493052,0.09352568,0.02743243,0.01897952,0.6441616],"study_design_scores_gemma":[0.00008811581,0.000239275,0.004033957,0.0000870938,0.0000748774,0.0003668302,0.0001656371,0.9143898,0.05192642,0.02066203,0.007877143,0.00008874325],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1475373,0.0004858825,0.7597989,0.001020343,0.0001021554,0.0005715412,0.001147237,0.08636992,0.002966794],"genre_scores_gemma":[0.4652986,0.0002764528,0.5248548,0.0006153135,0.00005541509,0.0003131874,0.002651801,0.003945327,0.001989117],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004403519,"threshold_uncertainty_score":0.02150726,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4210294742","doi":"10.1109/ase51524.2021.9678520","title":"Subtle Bugs Everywhere: Generating Documentation for Data Wrangling Code","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Software Engineering Research","field":"Computer Science","cited_by":25,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Documentation; Code (set theory); Programming language; Reuse; Plug-in; Software bug; Database; Software engineering; Software; Engineering; Set (abstract data type)","authors":[{"name":"Chenyang Yang","is_ca":false},{"name":"Shurui Zhou","is_ca":true},{"name":"Jin Guo","is_ca":true},{"name":"Christian Kästner","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07020492043842771,"gpt":0.3442052189351064,"spread":0.2740002984966787,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004737252,0.001555875,0.0005639002,0.002839777,0.0007894303,0.001831752,0.002091566,0.001297279,0.007066806],"category_scores_gemma":[0.03725714,0.001385562,0.0009914874,0.001398122,0.001010242,0.002981326,0.003048274,0.001900553,0.003398976],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005400458,"about_ca_system_score_gemma":0.001528988,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009069199,"about_ca_topic_score_gemma":0.001584968,"domain_scores_codex":[0.9964803,0.0008949452,0.0003945734,0.0006477146,0.001415122,0.0001673214],"domain_scores_gemma":[0.9633649,0.01695174,0.00287752,0.01175532,0.004397837,0.0006526492],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008525086,0.0008759429,0.0181716,0.001645414,0.0001511066,0.002125724,0.007643867,0.01778179,0.06844699,0.01407025,0.08685815,0.7813765],"study_design_scores_gemma":[0.0006822046,0.001340452,0.01190691,0.001176003,0.000246298,0.003550001,0.001509689,0.3994898,0.2912216,0.03177271,0.2566788,0.0004255109],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04873287,0.0002277585,0.7281107,0.0006325449,0.0001762971,0.0006041682,0.00271605,0.2133293,0.005470246],"genre_scores_gemma":[0.1759035,0.0002449866,0.7641879,0.0003582699,0.00006428248,0.0007065772,0.006920453,0.04444754,0.00716644],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007066806,"threshold_uncertainty_score":0.02505332,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4205513494","doi":"10.1109/ase51524.2021.9678640","title":"Is Historical Data an Appropriate Benchmark for Reviewer Recommendation Systems? : A Case Study of the Gerrit Community","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Software Engineering Research","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo; Polytechnique Montréal; McGill University","funders":"","keywords":"Context (archaeology); Pessimism; Computer science; Benchmark (surveying); Replicate; Task (project management); Data science; History; Epistemology; Management","authors":[{"name":"Ian Gauthier","is_ca":true},{"name":"Maxime Lamothe","is_ca":true},{"name":"Gunter Mussbacher","is_ca":true},{"name":"Shane McIntosh","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1459378586426111,"gpt":0.3631536798642139,"spread":0.2172158212216028,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03990285,0.0004654721,0.0007826616,0.004814048,0.003822972,0.003339028,0.001904087,0.002095913,0.001294335],"category_scores_gemma":[0.1941079,0.0004792735,0.0005547709,0.004891448,0.001476458,0.004909103,0.001803669,0.001491019,0.0007009175],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002961204,"about_ca_system_score_gemma":0.002903485,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02088401,"about_ca_topic_score_gemma":0.04176582,"domain_scores_codex":[0.9538686,0.030837,0.002590176,0.003709339,0.008021301,0.0009735426],"domain_scores_gemma":[0.6025497,0.2783934,0.02805292,0.02027108,0.06323623,0.007496602],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001634384,0.001946606,0.4526021,0.002860971,0.0003622911,0.007178135,0.1841349,0.00649564,0.009586056,0.003111941,0.01575354,0.3143335],"study_design_scores_gemma":[0.0005145927,0.005599404,0.5615504,0.002055454,0.0004527682,0.007123231,0.2091733,0.06415552,0.0165475,0.005892315,0.1260109,0.0009246325],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9839527,0.001148049,0.007267767,0.001804078,0.00005674351,0.0004369847,0.0005413618,0.0002659285,0.004526332],"genre_scores_gemma":[0.9826123,0.0003752549,0.01402393,0.0003155615,0.00007086336,0.0002358108,0.0006293292,0.000125736,0.001611189],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9600971,"threshold_uncertainty_score":0.211029,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4205678875","doi":"10.1109/ase51524.2021.9678871","title":"DeepMemory: Model-based Memorization Analysis of Deep Neural Language Models","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Adversarial Robustness in Machine Learning","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University; Concordia University; Huawei Technologies (Canada)","funders":"","keywords":"Computer science; Perplexity; Memorization; Language model; Artificial intelligence; Artificial neural network; Machine learning; Data modeling; Robustness (evolution); Natural language processing; Database","authors":[{"name":"Derui Zhu","is_ca":false},{"name":"Jinfu Chen","is_ca":true},{"name":"Weiyi Shang","is_ca":true},{"name":"Xuebing Zhou","is_ca":false},{"name":"Jens Großklags","is_ca":false},{"name":"Ahmed E. Hassan","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02093544744193205,"gpt":0.2813157815033691,"spread":0.2603803340614371,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001729058,0.001069164,0.0007092992,0.001229561,0.0003448018,0.001033433,0.001502185,0.0006577314,0.001271956],"category_scores_gemma":[0.01037721,0.0003643798,0.0009969985,0.0005662029,0.0005183704,0.002939186,0.001371772,0.002028399,0.000376172],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001090988,"about_ca_system_score_gemma":0.001071509,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003994116,"about_ca_topic_score_gemma":0.005709801,"domain_scores_codex":[0.9991678,0.0002087232,0.00008302704,0.0002353313,0.0002094276,0.00009579878],"domain_scores_gemma":[0.9957151,0.002162507,0.0006785806,0.0007986831,0.0005353322,0.0001097685],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000870982,0.0004005059,0.01971267,0.0004055548,0.0003745064,0.0005269333,0.0005264099,0.4233956,0.02339659,0.009290509,0.007040185,0.5140596],"study_design_scores_gemma":[0.00001165077,0.00009126831,0.0008535247,0.00001108236,0.0000281488,0.00004982919,0.00003471318,0.9850172,0.007703545,0.005690846,0.0004949721,0.00001327977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.208484,0.001013444,0.7779106,0.0007086614,0.0001013011,0.0001739109,0.001016314,0.009314076,0.001277754],"genre_scores_gemma":[0.8941908,0.0003689225,0.1011194,0.0002658123,0.00005876254,0.0001998825,0.001600919,0.0002246765,0.001970847],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003994116,"threshold_uncertainty_score":0.009144247,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3196824794","doi":"10.1109/ase51524.2021.9678596","title":"Leveraging Code Clones and Natural Language Processing for Log Statement Prediction","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Software System Performance and Reliability","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Source code; Statement (logic); Debugging; Java; Context (archaeology); Programming language; Data mining; Database; Artificial intelligence; Information retrieval","authors":[{"name":"Sina Gholamian","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02070793589757158,"gpt":0.2854924140753931,"spread":0.2647844781778215,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001846288,0.001182991,0.0006567198,0.004526947,0.0005224606,0.00127086,0.001184905,0.001037629,0.0006846739],"category_scores_gemma":[0.02477377,0.0004654823,0.0009052115,0.002065909,0.0007297627,0.003565067,0.001161675,0.001506621,0.0006622943],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008132317,"about_ca_system_score_gemma":0.001740325,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006767068,"about_ca_topic_score_gemma":0.01035821,"domain_scores_codex":[0.9974784,0.0004843742,0.0002147674,0.0008634591,0.0008444141,0.0001145766],"domain_scores_gemma":[0.9727451,0.01606071,0.004787893,0.002280603,0.003768389,0.0003574325],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006011467,0.0006989743,0.1997158,0.001043417,0.0001718485,0.002449713,0.003756263,0.04525928,0.04852207,0.003787496,0.0087505,0.6852436],"study_design_scores_gemma":[0.00005402234,0.0003012383,0.04700322,0.0001244892,0.0001390336,0.001055506,0.0007656749,0.8972716,0.03462742,0.01004084,0.008507118,0.0001098067],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4035246,0.0009716442,0.5601614,0.0008244008,0.00007607491,0.0004948025,0.004084822,0.02769995,0.002162344],"genre_scores_gemma":[0.6872912,0.000330005,0.3012359,0.0002293753,0.00004781324,0.0003493096,0.008550915,0.0007404284,0.001224939],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006767068,"threshold_uncertainty_score":0.01345533,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4205795599","doi":"10.1109/ase51524.2021.9678554","title":"Automatically Annotating Sentences for Task-specific Bug Report Summarization","year":2021,"lang":"en","type":"article","venue":"2021 36th IEEE/ACM International Conference on Automated Software Engineering (ASE)","topic":"Software Engineering Research","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Lethbridge; University of Alberta","funders":"","keywords":"Automatic summarization; Computer science; Task (project management); DevOps; Annotation; Software engineering; Information retrieval; World Wide Web; Natural language processing; Software; Artificial intelligence; Programming language; Engineering","authors":[{"name":"Akalanka Galappaththi","is_ca":true},{"name":"John Anvik","is_ca":true},{"name":"Rafat Bin Islam","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03620246813544579,"gpt":0.3043772340185386,"spread":0.2681747658830928,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009600126,0.002382908,0.001214788,0.008525165,0.001466486,0.002736897,0.001567486,0.00163364,0.004272044],"category_scores_gemma":[0.04510896,0.0008044557,0.001047687,0.004025651,0.0005918401,0.003796048,0.002652354,0.002038059,0.005055931],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008242657,"about_ca_system_score_gemma":0.002473848,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002461384,"about_ca_topic_score_gemma":0.004875251,"domain_scores_codex":[0.9909019,0.00417686,0.001299873,0.001503343,0.001730192,0.0003878623],"domain_scores_gemma":[0.9471923,0.02177239,0.006037434,0.004130394,0.01984029,0.001027238],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005924125,0.0003166121,0.0154941,0.004914821,0.0002792693,0.00127612,0.01106327,0.00634506,0.1093784,0.006551608,0.2765972,0.5671911],"study_design_scores_gemma":[0.0002338581,0.001142117,0.04883312,0.001621171,0.001153642,0.002109,0.00940651,0.189657,0.1407398,0.0280257,0.57643,0.0006481782],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1024886,0.003071757,0.7949791,0.003874854,0.002154323,0.001413601,0.03194063,0.04888074,0.01119637],"genre_scores_gemma":[0.1451099,0.001076362,0.7696705,0.0007128794,0.0009311578,0.001481557,0.06965651,0.004588292,0.00677276],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.009600126,"threshold_uncertainty_score":0.05077094,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}