{"id":"W1508671393","doi":"","title":"A Framework for Automated Evaluation of Hypertext Search Interfaces","year":2006,"lang":"en","type":"article","venue":"Texas Digital Library (University of Texas)","topic":"Information Retrieval and Search Behavior","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Computer science; Hypertext; Focus (optics); Search engine; Exploratory analysis; Information retrieval; Human–computer interaction; World Wide Web; Data science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002162772,0.00009622685,0.0001730733,0.0002186859,0.00007276441,0.0001295166,0.0008220822,0.00008299089,0.0002003955],"category_scores_gemma":[0.00002972395,0.0001013533,0.0001038757,0.0005161274,0.0001251991,0.004395455,0.0003354363,0.00008258537,0.0000922716],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002576746,"about_ca_system_score_gemma":0.0001807865,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002830272,"about_ca_topic_score_gemma":8.282293e-7,"domain_scores_codex":[0.9988615,0.00004077235,0.0001835673,0.0001791835,0.0005445399,0.0001904502],"domain_scores_gemma":[0.9991605,0.0001418972,0.0001281092,0.00027464,0.0002362172,0.00005859376],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000646482,0.001710979,0.1036198,0.0006783409,0.0002134193,0.00001893964,0.002124026,0.003865894,0.0003939695,0.5462561,0.03943451,0.3010375],"study_design_scores_gemma":[0.00213089,0.0006948885,0.2044659,0.0001907397,0.00005630338,0.000009177026,0.0004371918,0.7406068,0.0113688,0.03351243,0.00603942,0.0004875062],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8934371,0.00005522902,0.09169439,0.0005428103,0.00007866931,0.0005000306,0.0002241107,0.0003834153,0.01308418],"genre_scores_gemma":[0.9740347,0.000002444754,0.02439352,0.00001884008,0.00001319731,2.52353e-7,0.000080887,0.000005861325,0.001450241],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7367409,"threshold_uncertainty_score":0.4133069,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03420229327607789,"score_gpt":0.2550500453625008,"score_spread":0.2208477520864229,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}