{"id":"W1992252434","doi":"10.1371/journal.pone.0007263","title":"Performance of Humans vs. Exploration Algorithms on the Tower of London Test","year":2009,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Cognitive Abilities and Testing","field":"Psychology","cited_by":12,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre for Interdisciplinary Research in Rehabilitation; École de Technologie Supérieure; Institut Universitaire de Gériatrie de Montréal","funders":"","keywords":"Computer science; Test (biology); Task (project management); Algorithm; Focus (optics); Bounded function; Execution time; Machine learning; Artificial intelligence; Mathematics; Parallel computing; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001616551,0.0009695104,0.0006835242,0.001053524,0.0001982698,0.0009997155,0.0004406869,0.0008745364,0.003884919],"category_scores_gemma":[0.008374979,0.0001754823,0.0003570762,0.0002861767,0.0006561261,0.001458481,0.0008091469,0.0003589379,0.001531788],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002345367,"about_ca_system_score_gemma":0.0002534169,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001993448,"about_ca_topic_score_gemma":0.001745155,"domain_scores_codex":[0.9989756,0.0001642966,0.0001963174,0.0002744382,0.0002267109,0.0001625256],"domain_scores_gemma":[0.9952286,0.001759679,0.0007435486,0.0005579299,0.0006559694,0.001054229],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.02144152,0.0031174,0.7346903,0.0005123325,0.0008507073,0.001347064,0.00799487,0.005952375,0.05582038,0.001377113,0.006679492,0.1602164],"study_design_scores_gemma":[0.0004950845,0.01540629,0.9412813,0.00007235197,0.0001423867,0.00138257,0.001799935,0.01410992,0.01783118,0.001904017,0.005356705,0.0002183736],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9965885,0.0001156626,0.000655167,0.00002117832,0.00002158725,0.00003423793,0.0002650724,0.00006152938,0.002237062],"genre_scores_gemma":[0.9955193,0.00005233006,0.0008912018,0.00003455937,0.000009121115,0.00003985611,0.000464306,0.00002135563,0.002967948],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003884919,"threshold_uncertainty_score":0.01299632,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1000508283801219,"score_gpt":0.2827535394975817,"score_spread":0.1827027111174598,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}