{"id":"W2966697812","doi":"","title":"Reproducibility and Stability Analysis in Metric-Based Few-Shot Learning.","year":2019,"lang":"en","type":"article","venue":"International Conference on Learning Representations","topic":"Domain Adaptation and Few-Shot Learning","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":false,"ca_institutions":"Université de Montréal; HEC Montréal","funders":"","keywords":"Reproducibility; Metric (unit); Computer science; Stability (learning theory); Artificial intelligence; Mathematics; Machine learning; Statistics; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03473407,0.001211862,0.002372307,0.003006492,0.001997113,0.003441218,0.005577771,0.003075498,0.001727276],"category_scores_gemma":[0.1934738,0.0009987607,0.001437775,0.002440034,0.003942666,0.006711377,0.004908528,0.004289088,0.0008469405],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002064962,"about_ca_system_score_gemma":0.00221395,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00455617,"about_ca_topic_score_gemma":0.00390275,"domain_scores_codex":[0.9814168,0.008559635,0.001337344,0.004970287,0.003153316,0.0005625655],"domain_scores_gemma":[0.8271179,0.123625,0.006814529,0.02495699,0.01526598,0.002219607],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003278554,0.0006354977,0.03543496,0.001675009,0.002043364,0.0005305854,0.001601805,0.4459455,0.02406651,0.09600116,0.01617548,0.3726116],"study_design_scores_gemma":[0.00003402537,0.0001379244,0.003854555,0.00004938972,0.00008036629,0.0001401705,0.00009894645,0.9379247,0.006501077,0.05023381,0.0008916594,0.00005337491],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.05583353,0.001908354,0.9381825,0.0004857699,0.0002439429,0.000113598,0.000401882,0.001442228,0.001388168],"genre_scores_gemma":[0.8191258,0.0004710147,0.1735384,0.0003135831,0.0003497508,0.0003279876,0.002737019,0.001081726,0.002054696],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03473407,"threshold_uncertainty_score":0.1836935,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07488014056526597,"score_gpt":0.3486097859386539,"score_spread":0.273729645373388,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}