Definición
La probabilidad estimada de ocurrencia de una secuencia particular de segmentos fonológicos en una lengua, derivada de distribuciones segmentales y frecuencias condicionales de secuencias en corpus o gramáticas fonológicas; se usa como descriptor cuantitativo de parecido a palabra y como entrada en modelos de percepción, acceso léxico y probabilidad de errores de habla.
Principio
Principio
La probabilidad fonotáctica operacionaliza la frecuencia relativa de secuencias de segmentos: secuencias con mayor probabilidad estimada son modeladas como más probables o más 'palabrables' por sistemas que usan evidencia distributiva; estas estimaciones dependen de la unidad elegida (fonema, biphone, ataque) y del corpus o modelo usado.
Demostración
Demostración
Escenario ilustrativo → Situación: una investigadora construye un modelo de legalidad de ataques en inglés para experimentos con nonce‑words. Reconocimiento: calcular frecuencias de clústeres de ataque en un corpus fonémico representativo y estimar probabilidades condicionales para los clústeres objetivo. Acción: usar estas probabilidades para predecir qué clústeres aceptarán los participantes como palabrables. Consecuencia: los clústeres con mayores probabilidades estimadas se esperan que reciban valoraciones de palabrabilidad superiores en ese contexto experimental, todo lo demás igual.
Aplicación incorrecta
Aplicación incorrecta
Aplicar probabilidades fonotácticas calculadas en una lengua o registro a otra sin ajuste, o confundir alta probabilidad fonotáctica con plausibilidad semántica; el error es tratar la probabilidad distributiva como regla universal de bienformación o significado.
Consecuencia
Consecuencia
Las estimaciones de probabilidad fonotáctica informan modelos en percepción del habla, experimentos psicolingüísticos, modelado de adquisición y ponderación de léxicos en ASR; estimaciones inapropiadas pueden sesgar predicciones sobre aceptabilidad, competencia léxica o rendimiento de reconocimiento.
Inversión
Inversión
En préstamos, nombres propios, onomatopeyas o casos de límites morfológicos, las estimaciones distributivas pueden no predecir aceptabilidad u ocurrencia; reglas fonológicas específicas de la lengua y la estructura morfofonológica pueden anular las probabilidades de superficie.
Límite
Límite
Claramente dentro: estimaciones de probabilidad de secuencias segmentales derivadas de corpus representativos para predecir tendencias distributivas y parecido a palabra. Caso límite: secuencias que cruzan fronteras morfológicas donde la composición afecta la probabilidad. Claramente fuera: propiedades suprasegmentales (acentuación, tono) o bienformación prosódica de nivel superior no captadas por la probabilidad segmental sola.
Tensión semántica
Tensión semántica
Descripción estadística basada en frecuencia (probabilidad fonotáctica) ↔ restricciones fonológicas categóricas o gramáticas basadas en reglas; las regularidades estadísticas predicen tendencias, mientras que restricciones categóricas pueden prohibir secuencias independientemente de su frecuencia.
Síntesis
Síntesis
La probabilidad fonotáctica es una medida descriptiva dependiente del modelo que proporciona un proxy probabilístico de la bienformación fonológica y la probabilidad de procesamiento; complementa pero no sustituye al análisis fonológico categórico y debe interpretarse respecto al método de derivación y el contexto lingüístico.