{"meta":{"query_hash":"8311dca6a66f","filters":{"venue":"International Journal of Computer Processing Of Languages"},"cohort_total":1,"direct_labels_cover":0,"predictions_cover":1,"exported":1,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/8311dca6a66f","api":"https://metacan.xera.ac/api/v1/cohort?venue=International+Journal+of+Computer+Processing+Of+Languages"},"results":[{"id":"W2048782995","doi":"10.1142/s1793840609002147","title":"Correcting Arabic OCR Errors Using Improved Topic-Based Language Models","year":2009,"lang":"en","type":"article","venue":"International Journal of Computer Processing Of Languages","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"École de Technologie Supérieure","funders":"Université de Montréal","keywords":"Computer science; Natural language processing; Artificial intelligence; Language model; Word error rate; Arabic; Word (group theory); Error detection and correction; Proofreading; Process (computing); Speech recognition; Linguistics; Algorithm; Programming language","score_opus":0.01669986960573842,"score_gpt":0.3202112514965974,"score_spread":0.30351138189085897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2048782995","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06028176,0.001192583,0.93059474,0.00038943483,0.000272754,0.00015079795,0.0004441397,0.005445194,0.0012285752],"genre_scores_gemma":[0.58627814,0.0014288356,0.4003135,0.00024793143,0.0006000324,0.00044664144,0.0018986498,0.0011346231,0.0076516466],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982912,0.0004871092,0.00017355283,0.00045489127,0.00046528404,0.00012799035],"domain_scores_gemma":[0.99520653,0.0019304947,0.0004337557,0.00037923083,0.0019723775,0.000077617995],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021677127,0.0013080456,0.0013227572,0.0025431472,0.00058290333,0.0014282968,0.001567411,0.0013327434,0.0011174286],"category_scores_gemma":[0.0068544135,0.0005936844,0.0019128842,0.0014453139,0.00053116225,0.0026386145,0.0008473401,0.0012715244,0.0013999889],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00087582273,0.0003339661,0.007144189,0.00067758677,0.0005146134,0.00047207664,0.0012356506,0.3373089,0.045658384,0.0067115687,0.008586519,0.5904807],"study_design_scores_gemma":[0.00002387715,0.00005483766,0.0010560964,0.0000139890635,0.000090600086,0.00014226654,0.000050387367,0.98606944,0.0091160415,0.0014365542,0.0019066368,0.000039316],"about_ca_topic_score_codex":0.01135796,"about_ca_topic_score_gemma":0.011167284,"teacher_disagreement_score":0.01135796,"about_ca_system_score_codex":0.0008567248,"about_ca_system_score_gemma":0.0012251548,"threshold_uncertainty_score":0.022583723},"labels":[],"label_agreement":null}]}