{"id":"W4413157588","doi":"10.1109/cvpr52734.2025.01239","title":"StoryGPT-V: Large Language Models as Consistent Story Visualizers","year":2025,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006279632,0.001094562,0.0004868165,0.0005616024,0.0002972933,0.001336586,0.00212466,0.001294132,0.00727136],"category_scores_gemma":[0.003961638,0.0006236456,0.001237825,0.0004059225,0.0005229237,0.00186624,0.001545146,0.001670012,0.001905733],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008627693,"about_ca_system_score_gemma":0.0005898482,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003917247,"about_ca_topic_score_gemma":0.007961039,"domain_scores_codex":[0.99964,0.0001459996,0.00001600406,0.0001101739,0.00006234692,0.00002548759],"domain_scores_gemma":[0.9991851,0.0005398852,0.00004412819,0.0001116869,0.00007063274,0.00004860355],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0003505015,0.0001543716,0.001632588,0.000462007,0.0001502848,0.0004753906,0.0007377065,0.7709708,0.0139066,0.03590481,0.01943342,0.1558216],"study_design_scores_gemma":[0.00002402546,0.00001542659,0.00004515519,0.000009453133,0.000006841433,0.00002838236,0.00002066941,0.9882762,0.001342262,0.007696188,0.002528965,0.000006425547],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02896864,0.0005884512,0.9450394,0.0005252659,0.00009322885,0.0001696882,0.001957663,0.01887083,0.003786928],"genre_scores_gemma":[0.4008634,0.0004927388,0.5796304,0.0004492353,0.00006234433,0.0007959586,0.007232552,0.003439391,0.007033957],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00727136,"threshold_uncertainty_score":0.02432507,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01910971149770561,"score_gpt":0.2965980292981831,"score_spread":0.2774883178004775,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}