{"id":"W6964232954","doi":"10.24433/co.5076807.v1","title":"Benchmark for Cayley graphs","year":2020,"lang":"en","type":"other","venue":"Code Ocean","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université du Québec à Chicoutimi","funders":"","keywords":"Benchmark (surveying); Set (abstract data type); Sequence (biology); Scale (ratio); Quality (philosophy); Test case; Test set","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002209643,0.00165347,0.0007328532,0.002027275,0.0009165101,0.001277376,0.002937882,0.001619961,0.02268262],"category_scores_gemma":[0.01532098,0.0004766113,0.00116609,0.002615137,0.0007072166,0.002157227,0.001224454,0.001649392,0.003224643],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002106907,"about_ca_system_score_gemma":0.001787549,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009991727,"about_ca_topic_score_gemma":0.01373151,"domain_scores_codex":[0.9974092,0.0009403409,0.0001676186,0.0004057254,0.000786345,0.0002908077],"domain_scores_gemma":[0.9854998,0.009127878,0.0004719601,0.002107407,0.002379672,0.0004132968],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001300006,0.001332656,0.006173234,0.002489254,0.0003559666,0.0005460473,0.000281024,0.4611779,0.008509637,0.109426,0.2875031,0.1209051],"study_design_scores_gemma":[0.0008494687,0.0006931115,0.002254672,0.0002204716,0.00009977918,0.0003351748,0.0002232946,0.7690158,0.01271258,0.1231224,0.0904142,0.00005895067],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"software","genre_scores_codex":[0.3138921,0.00510834,0.279579,0.005811945,0.002433091,0.001799857,0.1045091,0.05621356,0.2306532],"genre_scores_gemma":[0.5922033,0.001103506,0.2716544,0.001450259,0.0001644314,0.0009785005,0.1043819,0.005423816,0.02263984],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.02268262,"threshold_uncertainty_score":0.07588089,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02294505366130709,"score_gpt":0.2664278638106731,"score_spread":0.243482810149366,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}