{"id":"W4400884871","doi":"10.2196/54590","title":"Data Lake, Data Warehouse, Datamart, and Feature Store: Their Contributions to the Complete Data Reuse Pipeline","year":2024,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Computer science; Data warehouse; Metadata; Identifier; Data science; Pipeline (software); Software; USable; Database; Reuse; Data transformation; Feature (linguistics); Adaptation (eye); World Wide Web","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07587135,0.00228845,0.002305098,0.0143356,0.002342254,0.01924818,0.006697728,0.002805981,0.007855919],"category_scores_gemma":[0.1256646,0.003298617,0.003433804,0.01814466,0.004696522,0.0444335,0.02511305,0.01096271,0.005874387],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003620519,"about_ca_system_score_gemma":0.01565766,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009252587,"about_ca_topic_score_gemma":0.008356311,"domain_scores_codex":[0.970504,0.008632648,0.004038737,0.002702219,0.0130964,0.001025993],"domain_scores_gemma":[0.8568682,0.0546535,0.008835169,0.04267178,0.03053931,0.006432044],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000630348,0.0003693541,0.01840781,0.00215155,0.0004360118,0.0003711188,0.004299555,0.002909253,0.00283263,0.09745914,0.08916258,0.7809707],"study_design_scores_gemma":[0.000211247,0.0004208751,0.01016934,0.004204031,0.0004391746,0.001326704,0.003587476,0.05204624,0.0121818,0.2314317,0.6833436,0.0006378184],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009451209,0.008959663,0.8969205,0.03590042,0.0007743526,0.001187443,0.004316822,0.03057975,0.01190979],"genre_scores_gemma":[0.02728707,0.005061906,0.9491917,0.002794562,0.0004501583,0.0005145163,0.007255026,0.004171039,0.003273982],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9241287,"threshold_uncertainty_score":0.4012508,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2784364691961687,"score_gpt":0.4669328239810727,"score_spread":0.1884963547849041,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}