{"id":"W4415115558","doi":"10.1007/s13437-025-00389-2","title":"Risk maturity model for maritime authorities: testing the internal consistency and inter-rater reliability of the R-Mare matrix","year":2025,"lang":"en","type":"article","venue":"WMU Journal of Maritime Affairs","topic":"Maritime Navigation and Safety","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"Interreg; Natural Sciences and Engineering Research Council of Canada; Aalto-Yliopisto","keywords":"Reliability (semiconductor); Intraclass correlation; Consistency (knowledge bases); Risk management; Test (biology); Risk assessment; Usability; Maturity (psychological)","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1040577,0.0009433563,0.00128998,0.003971163,0.00143312,0.004197739,0.001724226,0.001182121,0.00182977],"category_scores_gemma":[0.2797832,0.0006511568,0.002588175,0.003671098,0.001923458,0.003213926,0.003430962,0.00252405,0.0006305382],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002524111,"about_ca_system_score_gemma":0.003191764,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003252461,"about_ca_topic_score_gemma":0.003025613,"domain_scores_codex":[0.9266383,0.04370198,0.006102589,0.005614751,0.01695916,0.0009832468],"domain_scores_gemma":[0.5979375,0.287864,0.02397408,0.02657253,0.06130224,0.002349704],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001440847,0.00145899,0.7231842,0.001099768,0.002548638,0.0003582949,0.02896307,0.0257512,0.003202848,0.01793167,0.006665194,0.1873953],"study_design_scores_gemma":[0.0003410256,0.003180797,0.6115462,0.001378242,0.0007763081,0.0004464907,0.02401932,0.3168392,0.006141144,0.01929133,0.01544822,0.0005917562],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9171581,0.0003986856,0.06851662,0.0007658243,0.0002465325,0.001915742,0.0007319954,0.0003155698,0.009950861],"genre_scores_gemma":[0.9625142,0.0001111997,0.03460946,0.00004389045,0.00003399243,0.001573131,0.0005332661,0.00004763899,0.0005331914],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1040577,"threshold_uncertainty_score":0.5503163,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01034554862733821,"score_gpt":0.2398684073727708,"score_spread":0.2295228587454326,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}