{"id":"W4412014287","doi":"10.1038/s41598-025-09052-5","title":"Benchmarking pre-trained text embedding models in aligning built asset information","year":2025,"lang":"en","type":"article","venue":"Scientific Reports","topic":"Topic Modeling","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"École de Technologie Supérieure","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Benchmarking; Computer science; Embedding; Asset (computer security); Data science; Artificial intelligence; Information retrieval; Natural language processing; Business; Computer security","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.002856428,0.0001418321,0.0001801426,0.0007154543,0.0002861767,0.001234716,0.0005401077,0.00008004198,0.000008631453],"category_scores_gemma":[0.0001822518,0.0001443901,0.00006273415,0.001335236,0.00004645739,0.003324116,0.0004217584,0.0001577198,0.000005270059],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001403294,"about_ca_system_score_gemma":0.0003155603,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001336728,"about_ca_topic_score_gemma":0.00004387052,"domain_scores_codex":[0.997515,0.00005031474,0.0008317474,0.0006570196,0.0005436476,0.0004022946],"domain_scores_gemma":[0.9982992,0.00005441473,0.0002857096,0.001145768,0.0001500053,0.0000649127],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000004766013,0.0000683626,0.005364007,0.0001469841,0.00002407228,0.0002106467,0.01134853,0.6758704,0.004753366,0.05021757,0.007533684,0.2444576],"study_design_scores_gemma":[0.00009478279,0.000004362788,0.0007042122,0.0001616396,0.000002769061,0.00003087706,0.00006890103,0.9260587,0.001280832,0.06818911,0.003261543,0.0001422793],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1395043,0.00004755312,0.844281,0.0002416235,0.005475575,0.0002611201,3.417575e-7,0.0001572012,0.0100313],"genre_scores_gemma":[0.9355977,0.00000100063,0.06361409,0.000116257,0.00002741626,0.00002527229,0.0000144717,0.000003534345,0.0006002182],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7960935,"threshold_uncertainty_score":0.9998021,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01602443871516109,"score_gpt":0.279335461706418,"score_spread":0.263311022991257,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}