{"id":"W4413603663","doi":"10.31219/osf.io/r9fek_v1","title":"Observing Instructional Practice: Can We Consistently Measure Teaching Quality Constructs?","year":2025,"lang":"en","type":"preprint","venue":"","topic":"Online and Blended Learning","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Yorkville University","funders":"Norges Forskningsråd","keywords":"Measure (data warehouse); Quality (philosophy); Computer science; Psychology; Mathematics education; Data mining; Epistemology; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09528182,0.0007895883,0.001688211,0.003828962,0.001740255,0.006214692,0.002401022,0.001988052,0.00172537],"category_scores_gemma":[0.3940681,0.0007924821,0.001184718,0.005694365,0.00672396,0.01078225,0.005795986,0.002755862,0.0007915497],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003497703,"about_ca_system_score_gemma":0.004886122,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006928988,"about_ca_topic_score_gemma":0.007128037,"domain_scores_codex":[0.9119541,0.04770758,0.009156534,0.0108671,0.01881197,0.001502694],"domain_scores_gemma":[0.610409,0.20151,0.06032888,0.08329885,0.04125993,0.003193382],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002371791,0.0004209162,0.5279161,0.003057782,0.001039427,0.00007375765,0.03777853,0.00326883,0.00272793,0.03488542,0.005617914,0.3829762],"study_design_scores_gemma":[0.0002036335,0.001688683,0.6951028,0.005516834,0.000921027,0.00023334,0.02473247,0.01588168,0.006562414,0.1980456,0.0506966,0.0004149035],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4280612,0.005060756,0.5130143,0.01056155,0.000996138,0.002578301,0.001849322,0.0008145422,0.03706398],"genre_scores_gemma":[0.8549982,0.001244815,0.1357377,0.001372962,0.0002134923,0.004322379,0.0009715323,0.0001996624,0.0009392775],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9047182,"threshold_uncertainty_score":0.5039045,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07295237547478339,"score_gpt":0.412679683759971,"score_spread":0.3397273082851876,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}