{"id":"W4393450135","doi":"10.5281/zenodo.7540792","title":"Caravan - A global community dataset for large-sample hydrology","year":2022,"lang":"en","type":"dataset","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Music and Audio Processing","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Hydrology (agriculture); Sample (material); Environmental science; Geography; Geology; Geotechnical engineering","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001473915,0.001888997,0.001499852,0.002385225,0.0007909709,0.00247461,0.003409914,0.002014917,0.066455],"category_scores_gemma":[0.008253456,0.001054932,0.001798633,0.005544199,0.0004340997,0.002621981,0.002620709,0.002495752,0.09438092],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00108189,"about_ca_system_score_gemma":0.002168064,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03540482,"about_ca_topic_score_gemma":0.04847916,"domain_scores_codex":[0.9989842,0.0001742462,0.0001255009,0.0002933501,0.0002638144,0.0001589478],"domain_scores_gemma":[0.9964415,0.0006458261,0.000253235,0.001264788,0.001009212,0.0003854354],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00003787588,0.00001146162,0.0009028503,0.0002170542,0.00004272473,0.00001855809,0.00002389779,0.0005078281,0.0001210868,0.0004541693,0.9960902,0.001572295],"study_design_scores_gemma":[0.0006804378,0.00002003176,0.01033288,0.0001692587,0.00004803303,0.0000633923,0.00009756125,0.004270988,0.0006962816,0.003189275,0.9803273,0.0001044577],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.0003498181,0.00004826423,0.0003754038,0.000122599,0.00005279096,0.00001777366,0.9920875,0.00616917,0.0007766151],"genre_scores_gemma":[0.001410018,0.00003192843,0.001123833,0.00007554276,0.00002082671,0.00007133349,0.9953491,0.001492366,0.0004251514],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.066455,"threshold_uncertainty_score":0.2223141,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05481088497349262,"score_gpt":0.2909864378229017,"score_spread":0.2361755528494091,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}