Vers une autonomie croissante de l'apprenant du français langue étrangère ?
Bibliographic record
Abstract
Dans cet article, nous présentons une étude sur les caractéristiques du français parlé. Notre pratique d'enseignement du français langue étrangère (FLE) a démontré qu'un certain nombre d'étudiants universitaires, même de niveau relativement avancé, éprouvent des difficultés de compréhension du journal parlé de Radio France Inter. Afin de déterminer un point de départ pour le développement d'une didactique élaborée de la com-préhension orale, nous avons consulté un certain nombre d'études descriptives sur les différences entre le français parlé et écrit afin de découvrir ce qui les distingue l'un de l'autre. Ensuite, à l'aide des quelques 10 000 mots d'un spécimen de 28 journaux parlés de Radio France Inter, nous avons étudié trois aspects particuliers du » français écrit oralisé «, soit l'intonation, la distribution des pauses et le débit. Il résulte de cette étude que plus de 50 % des phrases examinées ont une intonation montante, même s'il s'agit de phrases non-interrogatives (qui, selon les règles phonétiques » classiques «, devraient avoir une intonation descendante). Dans près de 50 % des phrases, les pauses qu'on retrouverait dans une version écrite du texte en forme de blancs ne figurent pas dans le texte parlé. Le débit de notre corpus est de 205 mots par minute en moyenne, ce qu'on pourrait considérer comme assez rapide selon certains (p. ex., Pimsleur, Hancock et Furey, 1977), ou normal, selon d'autres (p. ex., Caspers, 1994; Goldman-Eisler, 1968; Koopmans-van Beinum, 1992). Ces trois caractéristiques du journal parlé devraient être à la base d'une didactique du français parlé, avant même de passer à d'autres stratégies d'apprentissage du type » top-down «.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.005 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.000 | 0.000 |
| Bibliometrics | 0.001 | 0.001 |
| Science and technology studies | 0.004 | 0.004 |
| Scholarly communication | 0.005 | 0.003 |
| Open science | 0.000 | 0.001 |
| Research integrity | 0.001 | 0.001 |
| Insufficient payload (model declined to judge) | 0.010 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".