{"id":"W4393712098","doi":"10.5281/zenodo.10256770","title":"Dataset fot the study of Documentation Practices of Machine Learning Resources","year":2023,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Big Data and Business Intelligence","field":"Business, Management and Accounting","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Queen's University","funders":"","keywords":"Documentation; Computer science; Data science; Artificial intelligence; Natural language processing; Information retrieval; Operating system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.001560697,0.00177779,0.0009416708,0.006901034,0.001046182,0.002005329,0.00229152,0.002280026,0.02236998],"category_scores_gemma":[0.008297682,0.0005567078,0.001352403,0.007609412,0.0005666623,0.001373708,0.001991291,0.002038738,0.03092683],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002384964,"about_ca_system_score_gemma":0.002829453,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.05312104,"about_ca_topic_score_gemma":0.09497078,"domain_scores_codex":[0.9980281,0.0003819173,0.000267359,0.0004059091,0.0006381944,0.0002785511],"domain_scores_gemma":[0.9950753,0.001317114,0.0004754408,0.001347762,0.001350474,0.0004338938],"domain_codex":null,"domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0001749119,0.0001326471,0.002438088,0.0008590653,0.00005241264,0.00007280898,0.0001107443,0.0007534946,0.0003254541,0.001294657,0.9867605,0.007025194],"study_design_scores_gemma":[0.000293093,0.00005763303,0.01706497,0.0004722943,0.00005726835,0.0002145568,0.0004105711,0.001820586,0.001129104,0.00154665,0.9768712,0.00006207463],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.001151375,0.00007491413,0.0001337093,0.0001061242,0.00002786474,0.00002646085,0.997056,0.0003189915,0.001104542],"genre_scores_gemma":[0.000936457,0.00003501155,0.0003818362,0.00002615997,0.00000462486,0.0000584576,0.997825,0.00003570522,0.0006967056],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.9984393,"threshold_uncertainty_score":0.1056237,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1129048958428152,"score_gpt":0.3324644160593067,"score_spread":0.2195595202164916,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}