{"id":"W4283380935","doi":"10.36227/techrxiv.19566040.v1","title":"Multi-Modal Instruction based Reinforcement Learning using MoME Transformer","year":2022,"lang":"en","type":"preprint","venue":"","topic":"IoT-based Smart Home Systems","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Lakehead University","funders":"","keywords":"Transformer; Computer science; Reinforcement learning; MNIST database; Modal; Artificial intelligence; Scalability; Architecture; Natural language processing; Speech recognition; Deep learning; Voltage; Engineering; Database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005446128,0.000528326,0.0005042758,0.0002107886,0.0001752081,0.0005633474,0.001019953,0.0006639931,0.004914576],"category_scores_gemma":[0.001597393,0.0002368707,0.0003788367,0.0001525916,0.0005785796,0.0009000316,0.0007853635,0.001142686,0.0008719699],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000620394,"about_ca_system_score_gemma":0.000666505,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002938275,"about_ca_topic_score_gemma":0.003417515,"domain_scores_codex":[0.9998257,0.00003997542,0.000008112226,0.00005411398,0.00004051729,0.00003161854],"domain_scores_gemma":[0.9996471,0.0001516662,0.00002932072,0.00005224702,0.0000866445,0.00003303081],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000305462,0.0002504139,0.002341533,0.0001002766,0.00007138755,0.0002081434,0.0001286175,0.78148,0.01134098,0.03061326,0.003453766,0.1697062],"study_design_scores_gemma":[0.000009844739,0.00003570985,0.0000665207,0.000003225933,0.000004096797,0.0000159086,0.000003637822,0.9946573,0.001194869,0.003569761,0.0004355242,0.000003517794],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03481102,0.0001677673,0.9561937,0.0003275158,0.00007686485,0.00007442213,0.00009464091,0.002159424,0.006094717],"genre_scores_gemma":[0.9395414,0.00006955109,0.05492497,0.0001577624,0.00001616935,0.0001058456,0.0001042983,0.00006473224,0.005015225],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004914576,"threshold_uncertainty_score":0.01644093,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0256315648545876,"score_gpt":0.2464591566023116,"score_spread":0.220827591747724,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}