{"id":"W2408481345","doi":"","title":"Extracting Data from the Deep Web with Global-as-View Mediators Using Rule-Enriched Semantic Annotations.","year":2014,"lang":"en","type":"article","venue":"","topic":"Web Data Mining and Analysis","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Computer science; Information retrieval; Semantic Web Stack; Deep Web; Semantic Web; Exploit; Social Semantic Web; Data Web; Semantic search; World Wide Web; Web page; Index (typography); Web search engine; Web modeling; Web crawler; Web search query; Search engine; The Internet","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002863013,0.000770513,0.0007179818,0.003587238,0.0006654711,0.00345463,0.001153861,0.001083887,0.00117947],"category_scores_gemma":[0.0103425,0.0004905823,0.000954122,0.003268493,0.000735732,0.003792639,0.003219347,0.001252085,0.0009278923],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006091061,"about_ca_system_score_gemma":0.001506847,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003397747,"about_ca_topic_score_gemma":0.007824672,"domain_scores_codex":[0.9982186,0.0004258726,0.000208474,0.0004094253,0.00065869,0.00007896527],"domain_scores_gemma":[0.9937066,0.003169225,0.0006119392,0.001627901,0.0007112243,0.0001730853],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001464231,0.001408483,0.06054546,0.001523246,0.00068196,0.005708668,0.005220192,0.05114568,0.08160932,0.04532847,0.0204369,0.7249275],"study_design_scores_gemma":[0.00009837488,0.0002455075,0.0100663,0.0003013043,0.0004446097,0.001135877,0.001768599,0.6884685,0.1262996,0.1038848,0.06714243,0.0001440782],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0961656,0.0008137705,0.8654076,0.0007440019,0.00007631682,0.0006312937,0.005678456,0.02504003,0.005442904],"genre_scores_gemma":[0.3766591,0.0004264053,0.6059644,0.0002681011,0.0000298008,0.0003157546,0.01295633,0.0008680084,0.002512044],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.003587238,"threshold_uncertainty_score":0.01514125,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03602283158405946,"score_gpt":0.2909176166049133,"score_spread":0.2548947850208538,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}