{"id":"W6929327088","doi":"10.48448/fbwc-bz58","title":"Graphs, Constraints, and Search for the Abstraction and Reasoning Corpus","year":2023,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"Pancreatic function and diabetes","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Graph; Abstraction; Automated reasoning; Focus (optics); Generalization; Set (abstract data type); Domain (mathematical analysis); Constraint programming","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002909943,0.0008585058,0.000703327,0.001698452,0.001048668,0.002970647,0.002015502,0.001574604,0.008511166],"category_scores_gemma":[0.01414606,0.000624306,0.001199796,0.002504227,0.003084076,0.00650881,0.002792927,0.002887478,0.001314972],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001637809,"about_ca_system_score_gemma":0.00277586,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006232493,"about_ca_topic_score_gemma":0.008961872,"domain_scores_codex":[0.9972356,0.001365398,0.000132865,0.000536826,0.000613647,0.0001156896],"domain_scores_gemma":[0.9928559,0.004832131,0.0003869066,0.001373049,0.0003795989,0.0001724628],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005383749,0.0003093132,0.003210657,0.001150524,0.0001133384,0.0004189005,0.001026718,0.2056985,0.008025708,0.3947387,0.02527231,0.3594969],"study_design_scores_gemma":[0.00009814639,0.0001076093,0.0008116506,0.0001144966,0.00004161205,0.0001848105,0.0005167438,0.5571527,0.009878499,0.3971055,0.03393583,0.00005232776],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"other","genre_scores_codex":[0.06030671,0.0009931087,0.9164973,0.002247398,0.00007983476,0.0003344309,0.001956393,0.005702378,0.01188245],"genre_scores_gemma":[0.2462545,0.0004673077,0.7452677,0.0003517064,0.00002758881,0.0002357832,0.003573212,0.0008434568,0.002978781],"genre_candidate":"other","genre_consensus":null,"teacher_disagreement_score":0.008511166,"threshold_uncertainty_score":0.02847266,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03457587704179631,"score_gpt":0.3169587332001425,"score_spread":0.2823828561583461,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}