LS-017 / Morfología y léxico

Palabra, lexema y morfema

Palabra, lexema, morfema y las unidades que construyen una palabra

Ver secciones del texto
  1. El problema de definir la palabra
  2. Palabra ortográfica y palabra fonológica
  3. Palabra morfosintáctica y palabra semántica
  4. Criterios para identificar palabras
  5. Lexema y forma de palabra
  6. Homonimia léxica
  7. El morfema
  8. Raíz, base y afijo
  9. Flexión y derivación
  10. Alomorfía y supleción
  11. Morfema cero
  12. Exponencia acumulativa y segmentación
  13. Morfología no concatenativa
  14. Clíticos
  15. Compuestos, frases e idiomaticidad
  16. Productividad
  17. Bloqueo y lexicalización
  18. Morfología y significado
  19. Nominalización y agentes ocultos
  20. Neologismo y parafasia morfológica
  21. Morfología y escritura científica
  22. Tokenización, morfemas y sistemas de IA
  23. El estatus teórico del morfema
  24. Cómo segmentar una palabra
  25. Morfología, paradigma, sintagma, fonología y semántica
  26. Síntesis
  27. Referencias

DESARROLLO COMPLETO · BIBLIOGRAFÍA INCLUIDA

El problema de definir la palabra

Después de trabajar con sonidos, fonemas, rasgos y sílabas, el análisis cambia de escala y entra en la morfología, el estudio de la estructura interna de las palabras y de los procesos con que las lenguas crean, modifican y relacionan formas léxicas. La unidad más intuitiva de este nivel sería la palabra. En la escritura ordinaria parece fácil identificarla, porque «paciente deprimido» contiene dos palabras separadas por un espacio. Esa estrategia funciona solo porque existe una convención ortográfica. El habla no contiene espacios, como mostró el texto LS-011. Distintas tradiciones de escritura segmentan, además, de manera diferente expresiones lingüísticamente comparables.

Definir la palabra como una unidad con significado tampoco basta. En niñas pueden distinguirse la base léxica niñ-, el género y el número, por lo que la palabra contiene más de una unidad de significado o función. Dámelo es una sola palabra gráfica que contiene un verbo y dos pronombres, mientras que ha comido tiene dos palabras ortográficas que forman una única construcción verbal. La comparación entre lenguas agrava el problema, porque algunas condensan en una sola forma información que el español distribuye entre varias palabras y otras son mucho más analíticas. La palabra no es una unidad universalmente simple ni definible por un único criterio (Haspelmath y Sims, 2010).

Para avanzar hay que distinguir al menos tres conceptos, la palabra, el lexema y el morfema. Esta lectura examina qué problema resuelve cada uno y por qué la segmentación morfológica es una hipótesis analítica, no una operación mecánica de cortar palabras.

Palabra ortográfica y palabra fonológica

La palabra ortográfica es una secuencia delimitada por espacios u otros signos gráficos. «El paciente duerme bien» contiene cuatro. El criterio es operativo para el procesamiento de textos, los recuentos, la edición y los corpus escritos. No define, sin embargo, una unidad lingüística universal, porque la escritura es secundaria respecto de la capacidad lingüística y puede representar de maneras distintas estructuras semejantes.

La palabra fonológica se define por propiedades prosódicas, como ser un dominio de acento, de reducción, de procesos fonológicos o de silabificación. En español, algunas palabras funcionales carecen de acento propio y se apoyan en otra unidad, como me en me dijo o la en la casa. Esos elementos tienen independencia sintáctica y ortográfica, mientras que su comportamiento prosódico es dependiente, como anticipó el texto LS-014. Una expresión puede contener, así, varias palabras sintácticas dentro de un único dominio prosódico.

Palabra morfosintáctica y palabra semántica

Desde la gramática, una palabra es una unidad que participa en relaciones sintácticas y admite ciertas operaciones morfológicas. Gatos funciona como sustantivo plural dentro de una oración. La sintaxis ordinaria no puede insertar otra palabra entre su raíz y su marca de plural. Nadie dice gat-grande-os por gatos grandes. La palabra es, así, un dominio de integridad relativa, un criterio que se conoce en inglés como lexical integrity, según el cual las reglas sintácticas no operan libremente dentro de la estructura interna de las palabras. La integridad léxica es una generalización y un problema teórico, sin que todas las gramáticas la formulen del mismo modo. La imposibilidad de insertar material dentro de gatos aporta un contraste útil que no decide por sí solo cómo analizar los compuestos, los clíticos o las construcciones de otras lenguas.

La palabra tampoco coincide con una unidad conceptual. Una sola palabra, como desgraciadamente, incorpora relaciones derivativas y evaluativas complejas, mientras que varias palabras pueden formar una unidad semántica convencional, como tomar una decisión, echar de menos o tener en cuenta. Estas expresiones tienen distintos grados de idiomaticidad y convencionalización. La relación entre léxico y sintaxis es más gradual de lo que sugeriría una separación estricta entre palabras y frases.

Criterios para identificar palabras

Un criterio clásico sostiene que una palabra puede moverse como unidad. Ayer ocupa posiciones distintas en «Ayer Juan llegó» y «Juan llegó ayer». El criterio no funciona, sin embargo, para todas las clases de palabras, porque un artículo carece de esa libertad. Un constituyente de varias palabras, como el médico joven, también se desplaza. La movilidad identifica constituyentes y no exclusivamente palabras.

Otro criterio sostiene que no puede insertarse material dentro de una palabra, porque rápidamente no admite rápida muy mente. El criterio favorece el análisis de la forma como una unidad morfológica, pero algunas lenguas tienen morfología discontinua que desafía una definición estricta de la inseparabilidad. Las pausas tampoco son una prueba fiable. En la conversación puede aparecer una pausa entre artículo y sustantivo, como en «la... casa», o dentro de una palabra por vacilación, como en «des... afortunadamente», porque su posición depende de la planificación y no de una frontera gramatical. El acento ayuda en las lenguas en que cada palabra tiene un único acento principal, aunque existen palabras inacentuadas, compuestos con varias prominencias y clíticos. La palabra debe identificarse, por tanto, por la convergencia de varios criterios, sin una prueba única.

Lexema y forma de palabra

El lexema es una unidad léxica abstracta que aparece en distintas formas flexionadas. Canto, cantas, cantamos y cantaban son realizaciones de un mismo lexema, que por convención se escribe en versalitas o mayúsculas, CANTAR, para distinguirlo de una forma concreta (Booij, 2012). CANTAR no es exactamente la palabra ortográfica cantar, porque el infinitivo funciona solo como etiqueta de una unidad abstracta del léxico. La forma de palabra es, en cambio, una realización gramatical específica del lexema, como cantábamos, que contiene información de persona, número, tiempo, aspecto y modo. Varias formas corresponden al mismo lexema. La distinción permite describir los paradigmas flexivos.

Los diccionarios organizan sus entradas en torno a los lexemas. La entrada comer representa como, comes, comíamos o comerán, sin una entrada independiente para cada forma, porque la gramática genera o relaciona el paradigma. La interacción entre léxico y morfología muestra que el lexema no es una cadena de letras almacenada. Es una unidad abstracta con propiedades semánticas, sintácticas y morfológicas.

Homonimia léxica

Una misma forma puede corresponder a lexemas diferentes. Banco designa un asiento o una institución financiera, dos lexemas que pueden representarse como BANCO₁ y BANCO₂. La identidad formal no garantiza la identidad léxica, un punto que la semántica desarrolla.

El morfema

El morfema suele definirse como la unidad mínima de significado o de función gramatical (Aronoff y Fudeman, 2011). En gatos puede segmentarse gat-o-s, donde gat- aporta el contenido léxico, -o la información de género o clase y -s el plural. El morfema es una unidad abstracta. La forma fonológica que lo realiza se llama morfo. La aparente simplicidad de esta definición se quiebra, sin embargo, rápidamente.

El morfema no coincide con la sílaba. La -s de gatos es un morfema pese a no formar sílaba propia. En imposible, la frontera entre im- y posible no coincide con una división silábica sencilla, porque la fonología y la morfología segmentan la cadena según principios diferentes. Tampoco coincide con la palabra. Un morfema puede ser una palabra independiente, como pan, o estar ligado a otra base, como la -s del plural. Los morfemas libres pueden formar una palabra por sí solos; los ligados necesitan asociarse a una base. La distinción es útil, si bien categorías como los clíticos desafían una frontera nítida.

Raíz, base y afijo

La raíz es el núcleo morfológico en torno al cual se organiza una palabra y suele portar su contenido léxico. En nacionalizar, nacion- puede identificarse como raíz en un análisis determinado, aunque el concepto se define de maneras distintas según la teoría. En las lenguas semíticas, las raíces pueden ser discontinuas; una raíz no corresponde necesariamente a una secuencia continua.

Una base es cualquier forma a la que se aplica un proceso morfológico. Nación funciona como base de -al en nacional; nacional es, a su vez, la base de nacionalizar. La base depende de la operación analizada, sin equivaler necesariamente a la raíz.

Un afijo es un elemento ligado que se añade a una base. El prefijo la precede, como en infeliz; el sufijo la sigue, como en felizmente. Un infijo se inserta dentro de la base, como el -um- del tagalo, que convierte sulat 'escribir' en sumulat 'escribió'. Un circunfijo rodea la base con dos partes, como el participio alemán gespielt, formado sobre spielen 'jugar' con ge- y -t (Lieber, 2016). El español usa sobre todo prefijos y sufijos, dentro de una diversidad tipológica mucho mayor.

Flexión y derivación

La morfología distingue dos grandes funciones. La flexión crea formas gramaticales de un mismo lexema, como niño y niños. La derivación crea lexemas nuevos o modifica propiedades léxicas, como nación y nacional. La diferencia parece simple; existen, sin embargo, casos fronterizos.

La flexión suele responder a exigencias gramaticales, producir paradigmas, conservar la categoría léxica y ser muy productiva. Niño y niños pertenecen al mismo lexema nominal, lo mismo que canto, cantaba y cantaré son formas de CANTAR. La derivación puede crear un lexema nuevo, cambiar la categoría, modificar el significado y ser menos productiva, como el paso del adjetivo feliz al sustantivo felicidad. No toda derivación cambia la categoría, porque hacer y rehacer son ambos verbos. Flexión y derivación se distinguen, por eso, mediante un conjunto de propiedades; ninguna basta por sí sola.

Alomorfía y supleción

La relación entre morfema y sonido tampoco es biunívoca, porque un mismo morfema puede tener varias realizaciones, un fenómeno llamado alomorfía. El plural inglés se realiza como [s] en cats, como [z] en dogs y como [ɪz] en horses, según el contexto fonológico, como vio el texto LS-013. Estas formas pueden tratarse como alomorfos del mismo morfema o relacionarse mediante operaciones fonológicas, según el modelo. El hecho observado es la distribución. Elegir un mecanismo requiere hipótesis adicionales.

En otros casos, la forma no puede derivarse con una regla fonológica simple. El inglés go tiene el pasado went; el español ir reúne voy, fui e iba, como mostró el texto LS-005. Este fenómeno se llama supleción, porque un mismo paradigma usa formas de orígenes históricos distintos. La supleción muestra que el léxico puede almacenar relaciones que no se reducen a la composición regular de morfemas.

Morfema cero

La oposición entre gato y gatos plantea cómo representar el singular. Una posibilidad es postular un morfema cero, sin forma audible, que expresaría el singular y mantendría la simetría del paradigma. Algunos análisis del español tratan del mismo modo la persona y el número de la tercera persona singular en canta, frente a cantas o cantan (Real Academia Española y Asociación de Academias de la Lengua Española, 2009). El recurso debe usarse con cuidado. Si se postulan morfemas cero cada vez que falta material, la teoría se vuelve imposible de refutar. Un morfema cero necesita, por eso, evidencia estructural independiente.

La ausencia de un sufijo no demuestra, por sí sola, la presencia de un cero, porque puede describirse simplemente una forma no marcada. La decisión depende del modelo. Una ausencia puede analizarse como estructura, aunque no toda ausencia es una entidad. La morfología reproduce aquí un problema general de las ciencias, el de cuándo postular algo no observable para explicar un patrón.

Exponencia acumulativa y segmentación

Una forma puede expresar varias funciones sin ser insegmentable. Un análisis convencional de cantábamos distingue la raíz cant-, la vocal temática -a-, la marca -ba- del imperfecto de indicativo y la terminación -mos de primera persona del plural (Real Academia Española y Asociación de Academias de la Lengua Española, 2009). La exponencia acumulativa, término de Matthews (1991), aparece porque -mos realiza a la vez la persona y el número. No cabe concluir que toda la secuencia -ábamos sea una pieza indivisible por el solo hecho de que el verbo exprese varios rasgos. Otros modelos relacionan formas completas del paradigma, aunque deben explicitar esa decisión.

El problema opuesto es segmentar demasiado. Si se insiste en asignar un segmento a cada función, pueden inventarse fronteras sin respaldo. Una forma puede expresar múltiples rasgos; un rasgo puede manifestarse en múltiples posiciones, de modo que la correspondencia entre forma y función no es necesariamente biunívoca.

Morfología no concatenativa

La morfología introductoria presenta las palabras como una raíz a la que se añaden afijos, un modelo que funciona bien para muchas formas del español sin describir toda la diversidad de las lenguas. Existen procesos de modificación interna, de reduplicación, de cambio tonal y de plantillas consonánticas y vocálicas, que componen la morfología no concatenativa (Spencer, 1991).

Las lenguas semíticas son el ejemplo clásico. En árabe, muchas relaciones léxicas se organizan en torno a raíces consonánticas discontinuas, como k-t-b, asociada a la escritura, que se combina con distintos patrones vocálicos en kataba 'escribió', kitāb 'libro', kātib 'escritor' o maktab 'oficina'. La forma final no se obtiene añadiendo un sufijo a una raíz continua, lo que muestra que un morfema no equivale necesariamente a una cadena segmental continua.

En la reduplicación se copia una parte o la totalidad de una forma para expresar pluralidad, intensidad, aspecto o distribución. El indonesio forma el plural de rumah 'casa' como rumah-rumah. El tagalo marca el aspecto futuro copiando la primera sílaba, como en susulat 'escribirá'. El español no usa la reduplicación en su morfología estándar, aunque la conversación la emplea para señalar el sentido prototípico de una palabra, como en «¿café café o descafeinado?». La reduplicación muestra que los procesos morfológicos operan sobre la estructura fonológica.

Clíticos

Los clíticos ocupan una posición intermedia entre la palabra independiente y el afijo. En me lo dijo, me y lo se comportan sintácticamente como pronombres y dependen prosódicamente del verbo. En dímelo aparecen unidos a él en la escritura, de manera que el mismo elemento se escribe separado o unido según su posición. El proclítico se apoya en la palabra siguiente, como en me dijo; el enclítico, en la anterior, como en dime. Los clíticos tienen propiedades sintácticas, morfológicas y prosódicas a la vez. Por eso han ocupado un lugar de primer orden en los debates sobre las interfaces gramaticales.

Compuestos, frases e idiomaticidad

Lavaplatos es una palabra compuesta, mientras que lava platos puede ser una secuencia de verbo y sustantivo. La forma gráfica ayuda sin explicar toda la diferencia, que puede estudiarse mediante el acento, la pluralización, el significado, la cohesión interna y la productividad. El plural los lavaplatos no altera el compuesto, lo que muestra que dos bases léxicas pueden formar una unidad morfológica nueva.

Algunas expresiones de varias palabras tienen un significado no composicional. Echar de menos no significa lanzar algo de menos, lo que plantea si esas expresiones pertenecen al léxico o a la sintaxis. Algunas teorías tratan el léxico como un depósito de unidades complejas, mientras que otras hablan de construcciones almacenadas de distintos tamaños. La frontera entre palabra y frase no coincide siempre con la frontera entre léxico y gramática.

Productividad

Un proceso morfológico es productivo cuando puede aplicarse sistemáticamente a bases nuevas. Cuando apareció WhatsApp, los hablantes formaron wasapear con el mismo sufijo verbal -ear de tutear o golpear. Cualquier hispanohablante comprende, además, una forma inédita como descontextualizable. La productividad muestra que la morfología no consiste en memorizar palabras existentes, porque los hablantes tienen un conocimiento generativo.

La productividad no es una propiedad de todo o nada (Bauer, 2003). Un sufijo puede ser muy productivo, limitado o lexicalizado. Puede aplicarse, además, solo a ciertas categorías o a bases con determinadas propiedades fonológicas, como un patrón que acepta bases nominales y rechaza las verbales. La productividad debe medirse, por tanto, según la frecuencia, las restricciones, la aparición de palabras nuevas y su aceptabilidad.

Bloqueo y lexicalización

A veces una forma regular no se usa porque ya existe otra convencional para el mismo concepto, un fenómeno llamado bloqueo. Aronoff (1976) observó que el inglés forma curiosity sobre curious, mientras que furiosity no se forma sobre furious, porque fury ya ocupa ese lugar. El léxico no es independiente de las reglas productivas. Las palabras almacenadas pueden restringir las nuevas formaciones.

Una expresión inicialmente composicional puede adquirir, con el tiempo, un significado propio, un proceso llamado lexicalización. Bolsillo conserva el sufijo diminutivo de bolso, pese a que su significado actual no es el de un bolso pequeño. La historia explica el origen de la forma, mientras que la competencia actual puede almacenarla como un lexema independiente. Reaparece aquí la distinción entre explicación histórica y análisis sincrónico.

Morfología y significado

La relación entre feliz e infeliz sugiere que in- expresa negación, aunque incluso los prefijos más transparentes tienen distintos alcances y sentidos. En imposible, inexacto o incapaz, su contribución se aproxima a la negación, con matices que dependen del tipo de base. La morfología construye significado sin funcionar como un diccionario de afijos con definiciones rígidas.

La derivación transforma, además, la arquitectura conceptual. Normal designa una propiedad, normalidad una abstracción nominal y normalizar un proceso o una acción. Esa transformación tiene consecuencias en la escritura científica.

Nominalización y agentes ocultos

La nominalización convierte verbos o adjetivos en sustantivos, como en decidir y decisión, evaluar y evaluación o normal y normalidad. Permite hablar de procesos como objetos del discurso. La ciencia depende mucho de ella. Conceptos como regulación, integración, clasificación o interpretación permiten construir teorías abstractas.

La nominalización tiene también riesgos. «El comité rechazó la solicitud» nombra al agente, mientras que «Se produjo el rechazo de la solicitud» lo elimina. La nominalización puede volver opacas las relaciones de agencia, responsabilidad y causalidad; no es una simple cuestión de estilo. Modifica qué información queda gramaticalmente en primer plano.

Neologismo y parafasia morfológica

Un neologismo es una forma nueva respecto de un repertorio lingüístico determinado. Una palabra nueva puede ser completamente normal, porque la innovación léxica es constante. Para considerar clínicamente significativo un neologismo hay que estudiar su estructura, su contexto, su función, su inteligibilidad y su relación con otros fenómenos. Neuroconectado puede ser una creación técnica, una metáfora, un término idiosincrásico o parte de un sistema delirante. La forma por sí sola no lo decide.

La morfología permite describir si un neologismo usa procesos productivos, raíces existentes y afijos convencionales. Hiperpensamiento es nuevo en ciertos contextos y morfológicamente transparente, porque se segmenta en hiper- y pensamiento. Una forma como tralumancia puede no mostrar una segmentación reconocible. Ambas innovaciones son lingüísticamente diferentes, como anticipó el texto LS-012 al distinguir las formas inexistentes de las fonológicamente imposibles.

En los trastornos neurológicos pueden aparecer errores de flexión, de derivación o de selección de morfemas. Una persona puede producir una raíz correcta con una terminación verbal inadecuada, como «ayer como» por «ayer comí», lo que sugiere que el léxico, la morfología y la sintaxis pueden disociarse parcialmente. La morfología clínica necesita describir el patrón antes de inferir el mecanismo.

Morfología y escritura científica

La ciencia usa la morfología para crear términos como psicopatología, neurocognitivo, multidimensional o intersubjetividad, que condensan conceptos. Una forma compleja no garantiza, sin embargo, un concepto preciso, porque pueden generarse palabras bien formadas que carecen de una definición clara. La sofisticación morfológica puede producir una ilusión de rigor.

Un texto académico puede acumular operacionalización, dimensionalización, conceptualización y sistematización. Cada palabra puede ser legítima. El problema aparece cuando reemplaza acciones simples sin añadir una distinción conceptual. «Analizamos cómo cambia el diagnóstico» no es menos riguroso que «Realizamos una operacionalización de la modificación diagnóstica», porque el rigor depende del contenido, no del número de sufijos.

Tokenización, morfemas y sistemas de IA

Los modelos de lenguaje dividen el texto en unidades llamadas tokens, que no coinciden necesariamente con los morfemas. Los algoritmos de segmentación subléxica, como la codificación por pares de bytes, reúnen fragmentos frecuentes de caracteres a partir de un corpus (Sennrich et al., 2016). Un análisis lingüístico de desorganización propondría des-, organiz- y -ación, mientras que un tokenizador puede producir otra división, porque ambas segmentaciones responden a objetivos diferentes.

Los sistemas computacionales tropiezan con dificultades particulares en las lenguas con mucha aglutinación, flexión rica o polisíntesis, en las que una sola palabra equivale a una frase de otra lengua. El turco evlerimizde 'en nuestras casas' reúne en una palabra la raíz ev 'casa', el plural -ler, el posesivo -imiz y el locativo -de. Un sistema basado en un vocabulario de palabras completas sufriría una gran dispersión. La segmentación subléxica mejora su capacidad de generalización. Esa segmentación tiene costos desiguales. Petrov et al. (2023) mostraron que un mismo texto traducido a distintas lenguas puede requerir hasta quince veces más tokens en unas que en otras, con consecuencias sobre el costo, la latencia y la cantidad de contexto que el modelo puede procesar.

Los modelos generativos pueden producir palabras inexistentes y morfológicamente plausibles, del mismo modo que un hablante entiende descontextualizable sin haberla visto antes. Humanos y modelos explotan regularidades subléxicas, aunque esa semejanza de conducta no demuestra que ambos representen los morfemas del mismo modo.

El estatus teórico del morfema

La definición clásica del morfema fue muy influyente. Algunas teorías actuales cuestionan, sin embargo, que sea siempre la unidad básica. La supleción, la exponencia acumulativa, los morfemas cero, los cambios internos, la alomorfía y las formas discontinuas motivaron teorías en las que la palabra completa o el paradigma ocupan un lugar preferente. En los enfoques basados en palabras, la unidad principal es la relación entre palabras completas (Blevins, 2016). Cantar, canté y cantaremos pueden relacionarse mediante patrones paradigmáticos sin segmentar cada rasgo en un morfema autónomo, lo que evita algunas segmentaciones artificiales.

Los modelos realizacionales distinguen, por su parte, los rasgos morfosintácticos de las reglas que los realizan fonológicamente (Matthews, 1991). Un rasgo de plural puede recibir formas distintas según el contexto, de modo que el morfema deja de ser una pieza almacenada con forma y significado inseparables. Estos modelos representan mejor la exponencia acumulativa y la alomorfía.

Cómo segmentar una palabra

Segmentar una palabra no se reduce a cortar donde parece. El análisis busca primero las secuencias recurrentes con una función semejante en otras palabras. Después compara formas relacionadas, como gato, gatos, gata y gatas, e identifica qué cambio formal coincide con qué cambio gramatical. Evalúa luego si el patrón se aplica a palabras nuevas, busca contraejemplos en los que la misma secuencia aparezca sin la misma función y evita, por último, postular unidades sin evidencia.

Desigualdades puede segmentarse en des-, igual, -dad y -es, aunque cada frontera debe justificarse. Igual es la base léxica; des- aporta oposición o negación según la base; -dad forma un sustantivo abstracto; -es marca el plural. La estructura es jerárquica, porque des- se une primero a igual, -dad nominaliza después desigual y el plural se añade al final. Esa jerarquía no puede reemplazarse arbitrariamente por otra en la que -dad y -es formen una unidad previa.

En inutilizable, una lectura transparente se analiza como in- más utilizable, «que no es utilizable». Utilizable se relaciona a su vez con UTILIZAR mediante la base verbal utiliza- y el sufijo -ble, sin añadir -ble al infinitivo intacto. La jerarquía propuesta une primero utiliza- con -ble y después el prefijo. Defender otra estructura exigiría mostrar otra interpretación y las formas intermedias pertinentes. Los corchetes de un análisis de este tipo expresan una hipótesis de composición, no una historia etimológica demostrada. El ejemplo distingue la forma de cita del verbo, la base de la derivación y el alcance del prefijo.

Morfología, paradigma, sintagma, fonología y semántica

Las formas flexivas forman paradigmas. CANTAR reúne canto, cantas, canta, cantamos y cantan. Cada forma adquiere parte de su función por oposición a las demás, como estudió el texto LS-006. Los morfemas se combinan, además, en un orden restringido. En español es frecuente la secuencia de raíz, derivación y flexión, como en nacionales. Bybee (1985) propuso que los afijos más pertinentes para el significado de la raíz tienden a situarse más cerca de ella, lo que explica que la derivación preceda a la flexión. Si esa estructura jerárquica procede de la sintaxis general o de un componente morfológico específico es una cuestión teórica abierta. La distinción entre lo sintagmático y lo paradigmático atraviesa, así, varios niveles.

Los morfemas cambian de forma según el contexto fonológico. La fonología depende, a su vez, de las fronteras morfológicas, en la interacción llamada morfofonología que examinó el texto LS-016 con el prefijo in-. La derivación modifica el significado y la flexión expresa relaciones gramaticales, aunque la correspondencia entre forma y significado no es perfecta, porque existen la polisemia, la lexicalización y la irregularidad. La ecuación entre un morfema y un significado resulta demasiado simple. La morfología es un sistema de correspondencias más complejo.

Síntesis

La morfología estudia cómo las lenguas organizan la estructura interna de las palabras y cómo relacionan formas dentro del léxico y de la gramática. La palabra carece de una definición universal única. Sus versiones ortográfica, fonológica, morfosintáctica y semántica pueden no coincidir. Su identificación exige la convergencia de varios criterios. El lexema es una unidad léxica abstracta que aparece en múltiples formas flexionadas; la forma de palabra, una realización gramatical específica del lexema. El morfema es una unidad abstracta de función gramatical o de significado, cuya relación con la forma no siempre es biunívoca. La raíz, la base y el afijo cumplen papeles distintos. La flexión y la derivación se distinguen por un conjunto de propiedades. La alomorfía muestra que un morfema puede tener varias realizaciones; la supleción, que un paradigma puede reunir formas no relacionadas fonológicamente; la exponencia acumulativa, que una forma puede expresar varios rasgos a la vez. La morfología no concatenativa muestra que los procesos no se reducen a añadir prefijos y sufijos. Los clíticos desafían la frontera entre palabra y afijo. Los compuestos y las expresiones idiomáticas muestran que léxico y sintaxis no son compartimentos separados. La productividad muestra que los hablantes generan formas nuevas; la lexicalización, que una forma composicional puede adquirir propiedades idiosincrásicas. En la clínica, la morfología permite diferenciar las innovaciones léxicas, los errores flexivos y los neologismos estructurados. En la escritura científica, ayuda a comprender cómo las nominalizaciones y los tecnicismos modifican la agencia y la abstracción. En la inteligencia artificial, recuerda que los tokens y los morfemas son unidades distintas. Segmentar una palabra es formular una hipótesis sobre las correspondencias sistemáticas entre forma, función, paradigma y estructura, algo muy distinto de dividirla visualmente.

El texto LS-018 estudia la flexión nominal, con el género, el número y el caso. Muestra, además, por qué las categorías gramaticales no deben confundirse con propiedades de los referentes.

Referencias

Aronoff, M. (1976). Word formation in generative grammar. MIT Press.

Aronoff, M. y Fudeman, K. (2011). What is morphology? (2.ª ed.). Wiley-Blackwell.

Bauer, L. (2003). Introducing linguistic morphology (2.ª ed.). Edinburgh University Press.

Blevins, J. P. (2016). Word and paradigm morphology. Oxford University Press.

Booij, G. (2012). The grammar of words: An introduction to linguistic morphology (3.ª ed.). Oxford University Press.

Bybee, J. L. (1985). Morphology: A study of the relation between meaning and form. John Benjamins.

Haspelmath, M. y Sims, A. D. (2010). Understanding morphology (2.ª ed.). Routledge.

Lieber, R. (2016). Introducing morphology (2.ª ed.). Cambridge University Press.

Matthews, P. H. (1991). Morphology (2.ª ed.). Cambridge University Press.

Petrov, A., La Malfa, E., Torr, P. H. S. y Bibi, A. (2023). Language model tokenizers introduce unfairness between languages. En Advances in Neural Information Processing Systems 36. https://proceedings.neurips.cc/paper_files/paper/2023/hash/74bb24dca8334adce292883b4b651eda-Abstract.html

Real Academia Española y Asociación de Academias de la Lengua Española. (2009). Nueva gramática de la lengua española. Espasa.

Sennrich, R., Haddow, B. y Birch, A. (2016). Neural machine translation of rare words with subword units. En Proceedings of the 54th Annual Meeting of the Association for Computational Linguistics (Vol. 1, pp. 1715–1725). Association for Computational Linguistics. https://doi.org/10.18653/v1/P16-1162

Spencer, A. (1991). Morphological theory. Blackwell.

Practicar esta lectura

Las actividades de estas rutas incluyen una respuesta comentada para contrastar tu análisis.

Cómo citar esta lectura

Publicación en la web: · LS-017

APA 7

Alarcón Covarrubias, J. (2026). Palabra, lexema y morfema. Lingüística y Semiótica. https://linguisticaysemiotica.org/temas/ls-017

Chicago

Alarcón Covarrubias, Jonathan. «Palabra, lexema y morfema». Lingüística y Semiótica. 22 de septiembre de 2026. https://linguisticaysemiotica.org/temas/ls-017.

CONTINUAR EXPLORANDO

Buscar en el atlas

Títulos, conceptos y secciones · las tildes no cambian los resultados.