{"id":"W6966306151","doi":"10.48448/y28t-x953","title":"Constructing Multi-Modal Dialogue Dataset by Replacing Text with Semantically Relevant Images","year":2021,"lang":"en","type":"other","venue":"Underline Science Inc.","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Coherence (philosophical gambling strategy); Sentence; Code (set theory); Training set; Simple (philosophy); Text generation","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.001849123,0.0008387273,0.0009335038,0.0009043699,0.0005192255,0.000706342,0.001617026,0.0003195652,0.001552807],"category_scores_gemma":[0.001661384,0.0006963341,0.00006941573,0.001669378,0.005722633,0.0004635628,0.000901081,0.0009905264,0.0009822855],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004654402,"about_ca_system_score_gemma":0.001868298,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001484768,"about_ca_topic_score_gemma":0.004629793,"domain_scores_codex":[0.9932458,0.0001970038,0.0007331996,0.002497094,0.001872685,0.001454237],"domain_scores_gemma":[0.996029,0.0002932882,0.0008513443,0.001989542,0.0003292066,0.0005075944],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00004384885,0.0003392476,0.001747089,0.0002462688,0.0001555607,0.0006324557,0.0001205496,0.00003031878,0.06953708,0.0009066975,0.9219085,0.004332401],"study_design_scores_gemma":[0.01092094,0.0009637357,0.000328108,0.01098862,0.001134367,0.005756265,0.007783182,0.06255037,0.038031,0.0002405663,0.8506846,0.01061826],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"methods","genre_scores_codex":[0.002376243,0.006136244,0.1311298,0.003181337,0.005110899,0.006914257,0.2611668,0.005961852,0.5780225],"genre_scores_gemma":[0.02553114,0.0001616596,0.7514017,0.001152478,0.001202581,0.00007954167,0.06543405,0.00376162,0.1512752],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.6202719,"threshold_uncertainty_score":0.9997956,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02139262358139108,"score_gpt":0.298142384437435,"score_spread":0.2767497608560439,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}