# Dependencias y constituyentes

## Constituyentes y dependencias como representaciones

Una oración puede analizarse según qué palabras forman grupos o según qué palabra depende de cuál. La primera pregunta conduce a una representación de constituyentes y la segunda, a una de dependencias. Como ambas pueden ser jerárquicas, carece de fundamento oponer una sintaxis profunda de constituyentes a una sintaxis meramente lineal de dependencias.

Sea *La médica evaluó al paciente ayer*. Una representación de constituyentes identifica un grupo nominal sujeto y otro que participa como objeto. El verbo, el objeto y el modificador temporal pueden integrarse, a su vez, en un sintagma verbal. Una representación de dependencias relaciona directamente *evaluó* con *médica*, *paciente* y *ayer*. Los determinantes dependen de sus nombres. Queda todavía por decidir cómo representar *al*, que no puede tratarse indistintamente como artículo o como preposición.

Las diferencias entre formalismos importan cuando permiten expresar generalizaciones distintas. Importan también al construir corpus, porque dos equipos pueden analizar una misma construcción con convenciones diferentes y producir árboles incompatibles sin discrepar sobre quién evaluó a quién. Antes de atribuir el desacuerdo a una teoría del lenguaje hay que identificar qué nivel está en discusión.

Hay que separar la teoría gramatical, que propone cómo se organiza la lengua, del esquema de anotación, que establece cómo registrar de manera consistente un conjunto de distinciones. El analizador automático es un tercer objeto, que intenta asignar representaciones según ese esquema. La teoría orienta la anotación y la anotación aporta los datos con que se entrena y se evalúa el programa, aunque los tres sigan siendo objetos distintos.

## La relación de dependencia

Una dependencia conecta un núcleo con un dependiente mediante una relación asimétrica. En *las residentes*, *residentes* puede tomarse como núcleo léxico y *las* como determinante dependiente; en *revisaron los informes*, *informes* depende del verbo mediante una relación de objeto. Estas decisiones pertenecen al análisis adoptado y son independientes de la longitud o del peso informativo de las palabras.

La tradición de dependencias, que arranca de Tesnière (1959), comprende teorías diversas. Las gramáticas de constituyentes tampoco asignan todas el mismo núcleo. Una representación puede considerar que el determinante encabeza una proyección funcional, como en la hipótesis del sintagma determinante vista en el capítulo 25, mientras que otra puede privilegiar el nombre para facilitar la comparación entre lenguas con sistemas de determinación diferentes. En ambos casos el artículo aporta la definitud y el nombre, el contenido léxico principal.

En un árbol básico, cada nodo salvo la raíz tiene exactamente una cabeza. Al seguir sucesivamente las cabezas se llega a la raíz sin volver nunca al nodo inicial, condición que excluye los ciclos. El árbol debe ser, además, conexo, sin palabras aisladas de la estructura principal. Un árbol de ocho nodos tiene, así, siete aristas internas. Si el formato añade una cabeza técnica numerada como cero para señalar la raíz, esa conexión adicional no corresponde a ninguna palabra de la oración.

Se trata de propiedades matemáticas de la representación, que nada dicen sobre si el hablante calcula árboles ni garantizan que toda relación semántica se reduzca a una arista. Un participante puede intervenir en varios eventos y una coordinación puede compartir argumentos. Para representar esas relaciones adicionales se usan grafos que ya no cumplen la condición de una sola cabeza.

## Segmentación y análisis de un ejemplo

La oración construida *La médica evaluó al paciente ayer* tiene seis palabras gráficas separadas por espacios. Para la anotación sintáctica, *al* se separa en *a* y *el*, lo que da siete palabras sintácticas, además del punto final. La diferencia entre el token ortográfico y la palabra sintáctica es decisiva, porque el tamaño del árbol no puede calcularse contando espacios sin conocer la política de segmentación. El esquema 27.1 es una representación frasal de la oración.

Esquema 27.1. Constituyentes de *La médica evaluó al paciente ayer*

```text
(O
  (SN (Det La) (N médica))
  (SV
    (V evaluó)
    (SP (P a) (SN (Det el) (N paciente)))
    (SAdv (Adv ayer))))
```

Para hacer visible la comparación, el árbol asigna una proyección preposicional a la secuencia *a el paciente*. Otros análisis tratan la *a* de objeto como una marca funcional, con un estatuto distinto del de una preposición locativa, cuestión en la que los especialistas discrepan (RAE y ASALE, 2019, s. v. *núcleo*). La función externa sigue siendo la de objeto directo, aunque el nodo se rotule SP. El árbol es una hipótesis de constituyentes declarada expresamente, sin pretensión de clasificar de manera universal la llamada *a* personal.

Para las dependencias se siguen las convenciones de Universal Dependencies (UD). En ellas, *paciente* depende de *evaluó* como `obj`; *a* y *el* dependen de *paciente* como `case` y `det`, respectivamente. El adverbio temporal *ayer* recibe `advmod`, etiqueta que corresponde a un análisis distinto del de `obl` y no debe intercambiarse con ella sin criterios. La tabla 27.1 reúne el análisis completo.

Tabla 27.1. Dependencias de *La médica evaluó al paciente ayer* según UD

| Índice | Unidad | Cabeza | Relación |
|---:|---|---|---|
| 1 | La | médica, 2 | `det` |
| 2 | médica | evaluó, 3 | `nsubj` |
| 3 | evaluó | raíz técnica, 0 | `root` |
| 4 | a | paciente, 6 | `case` |
| 5 | el | paciente, 6 | `det` |
| 6 | paciente | evaluó, 3 | `obj` |
| 7 | ayer | evaluó, 3 | `advmod` |
| 8 | . | evaluó, 3 | `punct` |

UD privilegia en estas construcciones los núcleos de contenido y trata ciertas palabras funcionales como dependientes. Se trata de una política lingüísticamente informada que busca la comparabilidad entre lenguas, sin afirmar que las preposiciones carezcan de significado o de propiedades sintácticas propias (de Marneffe et al., 2021; Universal Dependencies, s. f.).

## El formato CoNLL-U

Un árbol dibujado puede ocultar errores de segmentación o relaciones omitidas. Una serialización, en cambio, obliga a declarar qué información se registra. El formato CoNLL-U usa diez columnas separadas por tabuladores. El registro del esquema 27.2 omite los rasgos morfológicos detallados para concentrarse en la segmentación, la categoría y la dependencia. El guion bajo indica información no especificada.

Esquema 27.2. Registro CoNLL-U de la oración

```conllu
# sent_id = cap27-ejemplo-1
# text = La médica evaluó al paciente ayer.
1	La	el	DET	_	_	2	det	_	_
2	médica	médico	NOUN	_	_	3	nsubj	_	_
3	evaluó	evaluar	VERB	_	_	0	root	_	_
4-5	al	_	_	_	_	_	_	_	_
4	a	a	ADP	_	_	6	case	_	_
5	el	el	DET	_	_	6	det	_	_
6	paciente	paciente	NOUN	_	_	3	obj	_	_
7	ayer	ayer	ADV	_	_	3	advmod	_	SpaceAfter=No
8	.	.	PUNCT	_	_	3	punct	_	_
```

La línea `4-5` conserva el token superficial *al*, que no es un noveno nodo sintáctico ni recibe cabeza propia. Las líneas `4` y `5` contienen sus palabras componentes. `SpaceAfter=No` permite reconstruir que no hay espacio entre *ayer* y el punto. Las palabras sintácticas se recuperan omitiendo las líneas de rango; el texto superficial se reconstruye con *al*.

La documentación distingue, además, las dependencias básicas, que forman un árbol, de las dependencias mejoradas, que pueden formar un grafo con relaciones adicionales. En el registro, la columna del grafo mejorado queda vacía porque ese nivel no se anotó. Dejar sin anotar una capa y anotar una ausencia son decisiones diferentes.

La utilidad del formato es metodológica, porque obliga a asociar las categorías a unidades inequívocas. Un registro puede comprobarse verificando que todas las palabras tengan cabeza, que exista una única raíz y que el texto reconstruido coincida con el original (Universal Dependencies, s. f.). Esas comprobaciones detectan errores formales, aunque todavía no certifican que cada relación lingüística esté bien elegida.

## Conversión entre formalismos

En el análisis de dependencias, la proyección de *médica* contiene *La médica* y la de *paciente*, *a el paciente*. Esos conjuntos se aproximan a los agrupamientos explícitos del árbol frasal, lo que permite construir procedimientos de conversión entre análisis, siempre que se especifiquen reglas para elegir cabezas y preservar etiquetas.

La conversión, sin embargo, no siempre es reversible. Una gramática de constituyentes puede distinguir varios niveles intermedios sobre el mismo núcleo, mientras que una representación dependencial básica puede conectar dos modificadores con ese núcleo sin registrar cuál se adjunta primero. Recuperar el árbol original exigiría información que ya no está en la representación reducida. La coincidencia en las relaciones del verbo con el sujeto y el objeto no garantiza, por tanto, la identidad de toda la estructura.

En *la revisión del manuscrito durante la mañana*, un análisis frasal puede diferenciar la relación próxima entre *revisión* y *del manuscrito* de una modificación temporal adjuntada más arriba, como en el esquema 26.2 del capítulo anterior. Un árbol de dependencias puede relacionar ambos grupos con *revisión* mediante etiquetas diferentes, que conservan parte de la distinción sin reproducir cada nivel intermedio de la teoría X-barra. La representación más compacta encierra, por tanto, un compromiso teórico distinto.

También puede ocurrir lo contrario. Un árbol frasal poco detallado agrupa palabras sin especificar qué dependencia mantiene cada una. La existencia de un SN deja así abierto si su relación externa es la de sujeto, la de objeto o la de término de otra construcción. Comparar formalismos exige preguntar qué información se preserva efectivamente, sin atribuir a una notación las propiedades que solo tendría mediante extensiones.

Toda equivalencia útil debe declararse respecto de una tarea. Dos representaciones pueden bastar para recuperar el participante evaluado y diferir cuando se analiza el alcance, la coordinación o la elipsis, resultado que delimita su equivalencia sin invalidar ninguna de ellas.

## Orden lineal, proyectividad y discontinuidad

En un árbol de dependencias es posible separar las relaciones jerárquicas del orden de sus nodos. Una dependencia puede conectar palabras adyacentes o distantes. La distancia por sí sola no determina si el árbol es proyectivo.

Según la definición habitual, un árbol es proyectivo cuando la proyección de cada cabeza ocupa un intervalo continuo de la secuencia. Si se dibujan las aristas sobre la línea de palabras, esa organización evita los cruces característicos de la no proyectividad. El dibujo es solo una ayuda, porque lo decisivo es la relación entre dominancia y continuidad.

Un ejemplo formal construido lo muestra. Ordenemos cuatro nodos como `A B C D`, con `C` como raíz y las dependencias `C → A`, `C → D` y `D → B`. El conjunto es un árbol, con una raíz, tres aristas y ningún ciclo. La proyección de `D` contiene, sin embargo, las posiciones 2 y 4; la posición 3 pertenece a su antecesor `C`. La proyección es discontinua y los intervalos de `C → A` y `D → B` se cruzan.

El ejemplo demuestra una propiedad del formalismo. Afirmar que una lengua permite ese orden exigiría datos lingüísticos. Admitir árboles no proyectivos amplía, además, lo representable sin explicar por qué ciertas discontinuidades son posibles y otras no.

Las gramáticas de constituyentes también pueden incorporar la discontinuidad mediante el movimiento u otros mecanismos, de modo que la comparación pertinente se establece entre clases concretas de representaciones y las restricciones de cada teoría. Un lenguaje formal capaz de describir cualquier cruce necesita principios adicionales para excluir los que la lengua no admite, porque representar un fenómeno es distinto de explicarlo.

## Coordinación, elipsis y relaciones compartidas

La coordinación pone a prueba una representación en la que cada nodo tiene una sola cabeza. En *Ana revisó y corrigió el informe*, ambos predicados se relacionan semánticamente con Ana y con el informe. Un árbol básico necesita elegir una organización que conserve la condición de una cabeza por nodo. Un grafo ampliado puede representar explícitamente las relaciones compartidas que el árbol básico deja implícitas.

UD tiene convenciones específicas para la coordinación y permite añadir dependencias mejoradas. Elegir el primer coordinado como cabeza técnica no le da mayor peso conceptual ni priva al segundo de argumentos, porque el significado recuperable de la construcción excede lo que registra una arista aislada.

La elipsis plantea una dificultad relacionada. En *Ana revisó el informe y Luis la tabla*, el segundo miembro permite recuperar una revisión sin que el verbo se pronuncie de nuevo. Un análisis puede introducir material no pronunciado; otro representa directamente las relaciones disponibles. Ambos deben explicar por qué la recuperación es posible y qué restricciones la condicionan. Añadir un nodo vacío no demuestra su realidad psicológica, del mismo modo que prohibirlo en el formato no demuestra la ausencia de estructura interpretada.

La dependencia a distancia de *¿Qué informe revisó Ana?* permite otro contraste. Un árbol de dependencias puede enlazar *informe* con *revisó* directamente, mientras que una teoría del movimiento relaciona la posición pronunciada con otra posición estructural. Ambas aproximaciones identifican la relación entre el objeto y el predicado. Las diferencias se vuelven pertinentes al explicar las restricciones de extracción, la reconstrucción y el alcance, cuestiones que exigen más evidencia que un diagrama de una interrogativa sencilla.

Estos casos justifican distinguir un registro básico, suficiente para una tarea, de una teoría completa de la construcción. La representación reducida puede ser útil sin resolver todos los problemas que una teoría intenta explicar.

## Evaluación de un analizador con UAS y LAS

Un analizador de dependencias asigna cabezas y etiquetas. Los analizadores por transiciones, como los deterministas descritos por Nivre (2008), lo hacen de manera incremental mientras recorren la oración. Para comparar su salida con una anotación de referencia se calculan proporciones de coincidencia. La proporción de cabezas correctas se conoce como UAS (*unlabeled attachment score*) y la de cabezas correctas con etiqueta correcta, como LAS (*labeled attachment score*). Hay que declarar qué unidades entran en el denominador y cómo se tratan la segmentación, la puntuación y la raíz, porque sin esa información dos porcentajes aparentemente comparables pueden medir cosas diferentes.

Construyamos una salida inventada con dos errores sobre la oración del ejemplo. Todas las cabezas y etiquetas coinciden con la referencia salvo en dos puntos. *Paciente* conserva como cabeza *evaluó*, pero recibe la etiqueta `obl` donde la referencia tiene `obj`. *Ayer* conserva `advmod`, pero se conecta con *paciente*, cuando su cabeza correcta es *evaluó*.

El cálculo excluye el punto, incluye la identificación de la raíz y cuenta las siete palabras sintácticas, sin volver a contar la línea superficial `4-5`. Hay seis cabezas correctas, porque solo falla la de *ayer*, de modo que UAS = 6/7 × 100 = 85,71 %. En la proporción etiquetada deben coincidir a la vez la cabeza y la relación. *Paciente* falla por la etiqueta y *ayer*, por la cabeza, con lo que quedan cinco coincidencias y LAS = 5/7 × 100 = 71,43 %.

La diferencia entre ambos resultados muestra qué información adicional evalúa LAS. Nada indica sobre la gravedad clínica de cada error ni sobre el reconocimiento del evento, porque una relación sintáctica puede coincidir con la referencia mientras un sistema posterior invierte los participantes al redactar un resumen.

El ejemplo mantiene la misma segmentación en la referencia y en la salida. Una evaluación real puede exigir alinear tokens y palabras cuando el sistema segmenta de otro modo, problema que aquí se controla para aislar la cabeza y la etiqueta. Una evaluación de constituyentes, por su parte, compararía agrupamientos y categorías, con otras unidades en el denominador. Los porcentajes de ambos tipos de análisis no son intercambiables por el hecho de compartir una escala de cero a cien.

La puntuación ilustra otro límite. El punto figura en el árbol, pero quedó fuera del cálculo. Si se añadiera al denominador con su cabeza correcta, los resultados pasarían a 7/8 y 6/8, es decir, a 87,5 % y 75 %, sin que hubiera mejorado ninguna de las dos dependencias problemáticas. Solo habría cambiado el conjunto evaluado. Un lector que recibiera únicamente los porcentajes podría interpretar una mejora inexistente, razón por la cual toda métrica debe acompañarse de su protocolo.

Un resultado global alto puede ocultar, además, errores concentrados en una relación decisiva para una aplicación. En la salida inventada, la etiqueta del objeto es errónea. Una aplicación que extrajera participantes solo a partir de `obj` omitiría al paciente pese a conservar la mayoría de las aristas. La gravedad de un error depende del uso posterior. Para una tarea sobre la determinación serían centrales las relaciones `det`; para una aplicación temporal importaría la conexión de *ayer*. Una evaluación orientada al uso debe declarar esas prioridades sin abandonar una medida general, que impide ocultar los errores que el objetivo local deja fuera.

## Longitud de dependencia

La distancia entre una palabra y su cabeza puede medirse con sus índices lineales, como el valor absoluto |i − j| para una dependencia entre las posiciones i y j. La medida describe la separación en la secuencia anotada sin medir tiempo de procesamiento alguno.

En la oración del ejemplo, excluidas la puntuación y la conexión técnica de la raíz, las seis dependencias suman una distancia de 12, con una media de 2 (tabla 27.2). Si *al* se contara como una sola unidad sin adaptar el análisis, los índices cambiarían, porque la medida depende de una decisión previa de segmentación.

Tabla 27.2. Longitud de las dependencias del ejemplo

| Dependiente | Cabeza | Distancia |
|---|---|---:|
| La (1) | médica (2) | 1 |
| médica (2) | evaluó (3) | 1 |
| a (4) | paciente (6) | 2 |
| el (5) | paciente (6) | 1 |
| paciente (6) | evaluó (3) | 3 |
| ayer (7) | evaluó (3) | 4 |

El cálculo permite comparar versiones construidas de una oración, aunque no basta para afirmar que la versión con media menor será siempre más fácil de comprender. La longitud convive con la frecuencia, la ambigüedad, la estructura informativa y el conocimiento del lector. Tampoco puede convertirse directamente en una medida de la desorganización del discurso de un paciente.

Las hipótesis sobre la longitud de dependencia tienen dos formulaciones principales. En el procesamiento, la teoría de la localidad de Gibson (1998) predice mayor dificultad cuando aumenta la distancia entre los elementos que deben integrarse, lo que exige materiales que separen la longitud de otras propiedades. En la tipología, Futrell et al. (2015) compararon corpus de 37 lenguas y encontraron en todas ellas longitudes menores que las de ordenamientos aleatorios, resultado que depende de controles sobre los órdenes alternativos. Aquí la distancia es una herramienta descriptiva cuyo cálculo puede inspeccionarse.

En la edición de textos, su utilidad es más modesta. Una relación principal enterrada entre muchas expansiones puede motivar una revisión, siempre que la corrección conserve el significado y la organización discursiva. Acercar dos palabras no justifica eliminar una restricción temporal ni trasladar una fuente.

## Sintaxis anotada y fidelidad de una representación

Comparemos *La madre afirma que el paciente llamó al vecino* con *El paciente afirma que la madre llamó al vecino*. Ambas oraciones reciben árboles bien formados y difieren en lo decisivo, que es quién es la fuente y quién participa en el evento comunicado. La buena formación de un árbol no certifica su fidelidad respecto de un documento previo.

Una extracción de información debe conservar al menos dos predicaciones, la de afirmar y la de llamar. Aplanarlas en una lista de entidades pierde la relación entre la fuente y el contenido. Registrar que *madre*, *paciente* y *vecino* aparecen cerca también es insuficiente, porque la dependencia de cada nombre respecto de su predicado distingue historias diferentes.

En producciones difíciles de analizar hay que separar, además, una construcción del hablante de un error del anotador. Un programa entrenado con escritura editada puede asignar una estructura improcedente a un fragmento conversacional. Atribuir una alteración lingüística a una persona exige revisar el material, las convenciones y la adecuación del método. La salida automática no puede ser a la vez una descripción incuestionable y la prueba del déficit que supuestamente detecta.

Una arquitectura de extracción puede usar dependencias como entrada, pero necesitará otras capas para registrar la negación, el tiempo, la fuente y la certeza. La elección entre constituyentes y dependencias debe relacionarse con esa necesidad, porque ninguno de los dos formalismos básicos garantiza, sin operaciones adicionales, que un resumen conserve todos esos componentes.

Dos análisis correctos de una misma proposición permiten precisar ese límite. Si una representación hace de *a* el núcleo del grupo preposicional y otra, siguiendo UD, la hace depender de *paciente*, ambas difieren en la elección de la cabeza sin invertir al evaluador y al evaluado. Una medida calculada entre ellas sin conversión penalizaría esa diferencia, pero su resultado mezclaría una discrepancia de esquema con un error de interpretación.

La comparación de programas exige, por tanto, fijar una misma convención de referencia o diseñar una conversión explícita. En la comparación de teorías, en cambio, la discrepancia puede ser el objeto mismo de la investigación. Preguntar si un programa reproduce la anotación es distinto de preguntar qué anotación expresa mejor una generalización, porque la primera pregunta necesita un patrón estable y la segunda puede cuestionarlo.

El ejemplo de *al* muestra, además, cómo se propaga un error previo al análisis sintáctico. Si el sistema no reconoce la contracción y mantiene un único nodo, no puede registrar por separado la marca de objeto y el determinante bajo la convención adoptada. Una evaluación palabra por palabra exigirá alinear segmentaciones diferentes antes de comparar cabezas. Sería un error atribuir todas las diferencias posteriores al desconocimiento de la relación entre el verbo y el objeto.

## Comparación de teorías

Una comparación rigurosa fija un conjunto común de datos y obliga a cada análisis a declarar qué unidades y relaciones propone. Solo entonces pueden buscarse predicciones que distingan los análisis. Contar nodos evalúa únicamente la economía representacional bajo convenciones particulares, sin reemplazar la comparación de cobertura y generalización.

La afirmación de que la estructura está en un modelo de lenguaje admite, además, dos sentidos. Un clasificador puede recuperar etiquetas sintácticas a partir de una representación numérica, lo que muestra que cierta información es decodificable con ese procedimiento. Hewitt y Manning (2019) encontraron, por ejemplo, una transformación lineal de esas representaciones en la que las distancias entre palabras aproximan las distancias del árbol sintáctico. Establecer que el sistema usa causalmente esa información en una tarea concreta exige, en cambio, otro argumento o una intervención experimental. Una estructura geométrica que se parece a un árbol tampoco convierte sus valores en dependencias gramaticales.

Los formalismos difieren en las relaciones que hacen explícitas y en las restricciones que imponen. En el ejemplo, el árbol frasal expone agrupamientos y el de dependencias, vínculos entre cabezas. El registro CoNLL-U obliga, por su parte, a declarar una segmentación que ambos dibujos podían ocultar.

El capítulo 28 mantiene esa separación entre representación y fenómeno para estudiar la predicación y la estructura argumental, es decir, qué participantes organiza un predicado y cómo se realizan sintácticamente sus relaciones semánticas.

## Referencias

de Marneffe, M.-C., Manning, C. D., Nivre, J., y Zeman, D. (2021). Universal Dependencies. *Computational Linguistics*, *47*(2), 255-308. https://doi.org/10.1162/coli_a_00402

Futrell, R., Mahowald, K., y Gibson, E. (2015). Large-scale evidence of dependency length minimization in 37 languages. *Proceedings of the National Academy of Sciences*, *112*(33), 10336-10341. https://doi.org/10.1073/pnas.1502134112

Gibson, E. (1998). Linguistic complexity: Locality of syntactic dependencies. *Cognition*, *68*(1), 1-76. https://doi.org/10.1016/S0010-0277(98)00034-1

Hewitt, J., y Manning, C. D. (2019). A structural probe for finding syntax in word representations. En *Proceedings of the 2019 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies* (Vol. 1, pp. 4129-4138). Association for Computational Linguistics. https://doi.org/10.18653/v1/N19-1419

Nivre, J. (2008). Algorithms for deterministic incremental dependency parsing. *Computational Linguistics*, *34*(4), 513-553. https://doi.org/10.1162/coli.07-056-R1-07-027

Real Academia Española y Asociación de Academias de la Lengua Española. (2019). *Glosario de términos gramaticales* (versión 1.0 en línea). https://www.rae.es/gtg

Tesnière, L. (1959). *Éléments de syntaxe structurale*. Klincksieck.

Universal Dependencies. (s. f.). *Universal Dependencies* (documentación de la versión 2). https://universaldependencies.org
