Définition
Probabilité estimée d'occurrence d'une séquence particulière de segments phonologiques dans une langue, dérivée des distributions segmentales et des fréquences conditionnelles de séquences dans des corpus ou des grammaires phonologiques ; utilisée comme descripteur quantitatif du caractère « wordlike » et comme entrée pour des modèles de perception, d'accès lexikal et de probabilité d'erreur d'énonciation.

Principe

Principe
La probabilité phonotactique opérationnalise la fréquence relative des séquences de segments : des séquences ayant une probabilité estimée plus élevée sont modélisées comme plus probables ou perçues comme plus ressemblant à des mots par des systèmes fondés sur des preuves distributionnelles ; ces estimations dépendent de l'unité choisie (phonème, biphone, attaque) et du corpus ou modèle utilisé.

Démonstration

Démonstration
Scénario illustratif → Situation : un chercheur construit un modèle de licéité des attaques en anglais pour des expériences avec mots‑nonce. Reconnaissance : calculer les fréquences des groupes d'attaque dans un corpus phonémique représentatif et estimer les probabilités conditionnelles pour les groupes cibles. Action : utiliser ces probabilités pour prédire quels groupes de consonnes les participants accepteront comme « wordlike ». Conséquence : toutes choses égales par ailleurs, les groupes ayant des probabilités estimées plus élevées devraient recevoir des évaluations de ressemblance à mot supérieures dans ce contexte expérimental.

Mauvaise application

Mauvaise application
Appliquer des probabilités phonotactiques calculées dans une langue ou un registre à une autre sans ajustement, ou confondre une forte probabilité phonotactique avec une plausibilité sémantique ; l'erreur est de traiter la probabilité distributionnelle comme une règle universelle de bien‑forméité ou de sens.

Conséquence

Conséquence
Les estimations de probabilité phonotactique alimentent des modèles en perception de la parole, expériences psycholinguistiques, modèles d'acquisition et systèmes de reconnaissance automatique ; des estimations inappropriées peuvent biaiser les prédictions concernant l'acceptabilité, la compétition lexicale ou la performance de reconnaissance.

Inversion

Inversion
Pour les emprunts, noms propres, onomatopées ou cas de frontières morphologiques, les estimations distributionnelles peuvent ne pas prédire l'acceptabilité ou l'occurrence ; des règles phonologiques propres à la langue et la structure morphophonologique peuvent primer sur les probabilités de surface.

Limite

Limite
Clairement dans : estimations de probabilité de séquences segmentales dérivées de corpus représentatifs pour prédire des tendances distributionnelles et la ressemblance à mot. Cas frontière : séquences traversant des frontières morphologiques où la composition affecte la probabilité. Clairement hors : propriétés suprasegmentales (accent, ton) ou bien‑forméité prosodique de niveau supérieur non captées par la probabilité segmentale seule.

Tension sémantique

Tension sémantique
Description statistique fondée sur la fréquence (probabilité phonotactique) ↔ contraintes phonologiques catégoriques ou grammaires fondées sur des règles ; les régularités statistiques prédisent des tendances, tandis que des contraintes catégoriques peuvent interdire des séquences indépendamment de leur fréquence.

Synthèse

Synthèse
La probabilité phonotactique est une mesure descriptive dépendant du modèle qui fournit un proxy probabiliste de la bien‑forméité phonologique et de la probabilité de traitement ; elle complète mais ne remplace pas l'analyse phonologique catégorique et doit s'interpréter par rapport à la méthode de dérivation et au contexte linguistique.