{"id":"W2810424437","doi":"10.29344/07180772.21.862","title":"Análise métrica de questões componentes de testes de rendimento: mecanismo de feedback para aprimorar sua elaboração","year":2014,"lang":"pt","type":"article","venue":"Foro Educacional","topic":"Education and Public Policy","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Discovery Air (Canada)","funders":"","keywords":"Humanities; Psychology; Mathematics; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003049563,0.0004430586,0.0004479392,0.0002990128,0.001047749,0.0004741779,0.0009964689,0.0004187707,0.003033223],"category_scores_gemma":[0.00183204,0.000480333,0.0002448496,0.0009333906,0.0004935549,0.0004584597,0.0001275889,0.000542852,0.0004132946],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001515414,"about_ca_system_score_gemma":0.007981064,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008882918,"about_ca_topic_score_gemma":0.001114273,"domain_scores_codex":[0.9949458,0.001324373,0.0005612908,0.0005796124,0.0007263773,0.001862591],"domain_scores_gemma":[0.9962043,0.001256599,0.0003758142,0.0004472133,0.0002649031,0.001451237],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00009175103,0.00231265,0.1350372,0.0001439668,0.0001941942,0.000008453638,0.0765367,0.00007797938,0.001660242,0.2763595,0.5023064,0.005270947],"study_design_scores_gemma":[0.001114843,0.0002368129,0.1637477,0.0002112498,0.0001591546,0.00007624753,0.0196002,0.001579955,0.001915061,0.03679672,0.7735559,0.0010062],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8931125,0.001564458,0.0006651339,0.0750002,0.001729661,0.0004843449,0.000256825,0.0002393509,0.02694748],"genre_scores_gemma":[0.9676195,0.0003183376,0.005449887,0.006613648,0.003227883,0.000112668,0.0001495418,0.00006382125,0.01644469],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2712494,"threshold_uncertainty_score":0.9997649,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0444491944982146,"score_gpt":0.3675618276049948,"score_spread":0.3231126331067802,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}