{"id":"W4388144777","doi":"10.14569/ijacsa.2023.0141080","title":"A Novel Multidimensional Reference Model for Heterogeneous Textual Datasets using Context, Semantic and Syntactic Clues","year":2023,"lang":"en","type":"article","venue":"International Journal of Advanced Computer Science and Applications","topic":"Text and Document Classification Technologies","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"Universiti Teknologi Petronas","keywords":"Computer science; Context (archaeology); Natural language processing; Information retrieval; Synonym (taxonomy); Dimension (graph theory); Search engine indexing; Semantics (computer science); Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003941191,0.00110191,0.001203286,0.008625826,0.001217733,0.00344296,0.003522684,0.001572795,0.002056161],"category_scores_gemma":[0.01381378,0.0003976086,0.002429908,0.01104691,0.0005958825,0.007553665,0.002573933,0.001132958,0.001686266],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002017512,"about_ca_system_score_gemma":0.002076411,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01482795,"about_ca_topic_score_gemma":0.01734243,"domain_scores_codex":[0.9951794,0.00112227,0.0005878743,0.001662646,0.001217976,0.000229819],"domain_scores_gemma":[0.9953349,0.001374467,0.0006300699,0.0008188903,0.001708459,0.0001332256],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006204217,0.0003930416,0.02580777,0.001098105,0.0005138706,0.001014487,0.001955086,0.08004437,0.01156634,0.0730915,0.02979286,0.7741022],"study_design_scores_gemma":[0.0000425142,0.00034833,0.007016246,0.0002444366,0.0001979251,0.0007465564,0.000865493,0.9022697,0.004083224,0.04475393,0.03931144,0.000120242],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02925133,0.002541716,0.9550046,0.00121662,0.0001565386,0.0004330117,0.004272226,0.003750019,0.003373812],"genre_scores_gemma":[0.2880435,0.001624791,0.6877015,0.0006006269,0.0002150064,0.001193312,0.01462086,0.0003640213,0.005636345],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01482795,"threshold_uncertainty_score":0.02948326,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05753518558212063,"score_gpt":0.3459752786295047,"score_spread":0.288440093047384,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}