{"id":"W4393493608","doi":"10.5281/zenodo.3930995","title":"Preprocessing scripts and data for study: Identifying high-confidence capture Hi-C interactions using CHiCANE","year":2020,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institute of Cancer Research","funders":"","keywords":"Scripting language; Preprocessor; Computer science; Artificial intelligence; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00134492,0.002892955,0.001235905,0.002788906,0.0009151344,0.001618725,0.002075867,0.00156355,0.03054404],"category_scores_gemma":[0.004055212,0.0006469366,0.001357684,0.003259931,0.0004218064,0.0006130247,0.001082701,0.001482943,0.03835909],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001071007,"about_ca_system_score_gemma":0.002321886,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01174377,"about_ca_topic_score_gemma":0.02311375,"domain_scores_codex":[0.9990841,0.0001287715,0.000105473,0.0004106807,0.0001562831,0.0001146818],"domain_scores_gemma":[0.9983041,0.0006045254,0.0001313713,0.0004699584,0.0003365814,0.0001534291],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004214787,0.0001331552,0.004335882,0.00173814,0.0001061692,0.0001145394,0.00008391051,0.001362408,0.004100182,0.0007953395,0.9757398,0.01106904],"study_design_scores_gemma":[0.0008347892,0.0001823887,0.01919672,0.0003136365,0.0002301903,0.0004400453,0.000220236,0.008107902,0.01235395,0.004623439,0.9533881,0.000108563],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.001332492,0.0001243491,0.001509354,0.00005207003,0.00003161594,0.0001023869,0.9916889,0.00443685,0.0007221377],"genre_scores_gemma":[0.001224809,0.00004049228,0.002530838,0.00004402675,0.000006222189,0.000400243,0.995,0.0002567635,0.0004965437],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.03054404,"threshold_uncertainty_score":0.10218,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.160977707385079,"score_gpt":0.3419859801446908,"score_spread":0.1810082727596118,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}