{"id":"W1990800148","doi":"10.22318/cscl2009.2.162","title":"Automating the analysis of collaborative discourse: identifying idea clusters","year":2009,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Innovative Teaching and Learning Methods","field":"Psychology","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Complement (music); Latent semantic analysis; Visualization; Qualitative analysis; Data visualization; Quantitative analysis (chemistry); Data science; Semantic analysis (machine learning); Discourse analysis; Scale (ratio); Information retrieval; Natural language processing; Qualitative research; Data mining; Linguistics; Sociology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01518833,0.0006766884,0.0008964614,0.007497381,0.00149676,0.004401227,0.001418567,0.001088592,0.001685978],"category_scores_gemma":[0.0748198,0.0005783604,0.0006205578,0.003831213,0.001529085,0.003229746,0.003601666,0.001000574,0.0006956907],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001024869,"about_ca_system_score_gemma":0.002427488,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001336361,"about_ca_topic_score_gemma":0.002055844,"domain_scores_codex":[0.9880036,0.006767182,0.0009352734,0.002184789,0.001754492,0.0003547187],"domain_scores_gemma":[0.9027606,0.07968941,0.004981529,0.006305524,0.005529917,0.0007329755],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.0008639698,0.0004310785,0.04900152,0.00199743,0.0001374789,0.0004576404,0.2012903,0.00215457,0.07896759,0.008567924,0.001603616,0.6545268],"study_design_scores_gemma":[0.0006104305,0.002336828,0.2220198,0.001517102,0.0004827876,0.002224231,0.2104767,0.2283358,0.1897887,0.0800731,0.06137944,0.0007552035],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.656188,0.0002987964,0.3355237,0.0002451147,0.00004840659,0.001647423,0.0006365773,0.001387969,0.004024031],"genre_scores_gemma":[0.5331458,0.0001134257,0.4638304,0.00003774773,0.00001220241,0.001292055,0.0005011575,0.000132238,0.0009349368],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01518833,"threshold_uncertainty_score":0.08032447,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04006043594522722,"score_gpt":0.3595504102161274,"score_spread":0.3194899742709001,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}