{"id":"W2113200858","doi":"10.1109/hcc.2002.1046339","title":"Quantifying developer experiences via heuristic and psychometric evaluation","year":2003,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Learnability; Usability; Computer science; Heuristic evaluation; Java; Relation (database); Heuristic; Visibility; Conceptual model; Software engineering; Human–computer interaction; Programming language; Artificial intelligence; Data mining; Database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000932092,0.00007101736,0.00006711081,0.0002804314,0.00007913498,0.0001491669,0.0002542345,0.00002661323,0.00009803365],"category_scores_gemma":[0.001817292,0.0000593085,0.00001069817,0.00127264,0.00002240903,0.0002800752,0.00004993205,0.00006242553,0.00004314562],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0000315939,"about_ca_system_score_gemma":0.00005984734,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000008786617,"about_ca_topic_score_gemma":0.000001659238,"domain_scores_codex":[0.9989623,0.00006687925,0.0001089094,0.0002735262,0.0003939624,0.0001944244],"domain_scores_gemma":[0.999217,0.0003486031,0.00001454634,0.0002369577,0.000110801,0.00007210768],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.000003426562,0.0001141952,0.2572334,0.00006339068,0.00003506064,0.00000661389,0.01023009,0.0005055079,0.001301014,0.03522748,0.00163077,0.693649],"study_design_scores_gemma":[0.001196027,0.0002059,0.5226498,0.00004126879,0.000009794814,0.0001835702,0.0009902249,0.4537617,0.009605534,0.002017729,0.00837152,0.0009669529],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3170853,0.0006589554,0.681066,0.00003034406,0.0002457977,0.00009218745,2.053537e-8,0.0001026309,0.0007187771],"genre_scores_gemma":[0.912393,0.0000153495,0.08743241,0.00002773334,0.000007668538,0.00004595293,1.473808e-7,0.000004203217,0.00007347346],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6926821,"threshold_uncertainty_score":0.241853,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1007537767031116,"score_gpt":0.3549333827517294,"score_spread":0.2541796060486178,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}