La méthode analyzeSyntax renvoie des informations sur la structure linguistique du texte donné. Pour chaque jeton du texte, l'API Natural Language fournit des informations sur sa structure interne (morphologie) et son rôle dans la phrase (syntaxe).
La morphologie est la branche de la linguistique qui étudie la structure interne des mots. Cette discipline se concentre sur la manière dont les parties d'un mot (radicaux, racines, préfixes, suffixes, etc.) sont disposées ou modifiées pour créer des sens différents. L'anglais, par exemple, ajoute souvent "-s" ou "-es" à la fin d'un nom dénombrable pour marquer le pluriel, et "-d" ou "-ed" à la fin d'un verbe pour indiquer le passé. Le suffixe "-ly" est ajouté aux adjectifs pour créer des adverbes (par exemple, "happy" [adjectif] et "happily" [adverbe]).
L'API Natural Language utilise l'analyse morphologique pour déduire des informations grammaticales sur les mots.
La morphologie varie considérablement d'une langue à l'autre. Dans des langues telles que le russe, la terminaison d'un mot indique son rôle dans la phrase (par exemple, "книга" (le livre) [nominatif] devient "книгу" [accusatif] lorsqu'il est objet direct du verbe). Cela signifie que l'ordre des mots peut varier sans changer le sens de la phrase, bien qu'un ordre des mots différent ait une incidence sur la justesse contextuelle. Des langues telles que l'anglais et le mandarin, qui sont dépourvues d'affixes indiquant le cas, reposent davantage sur l'ordre des mots dans la phrase pour indiquer les rôles respectifs des mots. En conséquence, l'analyse morphologique dépend fortement de la langue source et de la compréhension de ce qui est accepté dans cette langue.
La syntaxe est la branche de la linguistique qui étude la structure des syntagmes et des phrases. Ensemble, la syntaxe et la morphologie expriment des relations grammaticales, la division du travail s'opérant différemment en fonction des langues. Par exemple, le russe utilise un affixe pour exprimer le rôle d'objet direct ("у" dans "книгу"), tandis que le français utilise l'ordre des mots, où l'objet direct suit le verbe ("lire le livre").
La réponse analyzeSyntax renvoie des informations morphologiques dans le champ partOfSpeech et la relation syntaxique entre les mots dans le champ dependencyTree.
Classes de mots
Dans une requête syntaxique, les informations morphologiques et sur la classe de mots sont renvoyées dans le champ partOfSpeech de la réponse. Le champ partOfSpeech contient un ensemble de sous-champs avec des informations sur la classe de mots (POS), ainsi que des informations morphologiques plus explicites. Ces sous-champs sont énumérés ci-dessous.
tagindique la classe de mots à l'aide d'un tag POS à faible niveau de précision (NOUN, VERB, etc.) et fournit des informations sur la syntaxe superficielle de niveau supérieur. Les tags POS s'avèrent utiles si vous souhaitez créer des modèles et/ou réduire l'ambiguïté d'une analyse linguistique ultérieure (par exemple, "train" marqué avec le tag NOUN au lieu de VERB).number(nombre) désigne le nombre grammatical d'un mot. En français, le suffixe "-s" est ajouté à un nom dénombrable pour indiquer un nombre supérieur à un (par exemple, "chien + s" indique plus d'un chien). L'absence de suffixe pluriel est souvent appelée forme singulière. Certaines langues, telles que l'arabe, comportent également la notion de duel. Ce champ peut contenir les valeurs suivantes :SINGULAR(singulier) désigne une quantité.PLURAL(pluriel) désigne plus d'une quantité.DUALdésigne précisément deux quantités.
person(personne) identifie la personne grammaticale d'un mot. En français, "je/moi" est la première personne du singulier et désigne le locuteur (ou l'auteur) de l'expression, alors que "tu/vous", "elle/lui" et "il/lui" font référence au destinataire (auditeur) et à une autre personne, respectivement. Ce champ peut contenir les valeurs suivantes :FIRST(première personne) désigne le locuteur.SECOND(deuxième personne) désigne le destinataire prévu, c'est-à-dire la personne à qui on parle.THIRD(troisième personne) désigne les personnes qui ne sont ni locuteurs, ni auditeurs.REFLEXIVE_PERSON(réfléchi) indique, par exemple, que le sujet et l'objet font référence à la même entité, comme dans "Le chat se lèche", où le pronom "se" est utilisé pour indiquer la réflexivité. En russe et en japonais, le pronom réfléchi est autonome. Par exemple, "John s'aime" se traduirait en russe par "Джон лбит себя", où "себя" exprime une réflexivité neutre, tandis qu'en japonais, cette réflexivité neutre serait exprimée par "zibun" dans "Tarō wa zibun o aisuru" (version romanisée). Consultez la page Pronom réfléchi.
gender(genre) désigne le genre grammatical d'un nom. Ce champ peut contenir les valeurs suivantes :- Genre grammatical
FEMININE - Genre grammatical
MASCULINE(masculin) - Genre grammatical
NEUTER
- Genre grammatical
case(cas) désigne le cas grammatical d'un mot et son rôle dans un syntagme ou une phrase. Ce champ peut contenir les valeurs suivantes :- Le cas
ACCUSATIVE(accusatif) indique l'objet direct d'un verbe transitif. - Le cas
ADVERBIAL(adverbial) indique la forme adverbiale d'un adjectif. Notez que l'anglais utilise des mots distincts pour les adverbes et les adjectifs ("well"/"good"). En français, le suffixe -ment permet de créer des adverbes à partir d'adjectifs (par exemple, "heureux" -> "heureusement"), bien que cela ne soit pas considéré comme un "cas". - En chinois, le cas
COMPLEMENTIVE(complémentif) indique un mot nécessaire pour compléter le sens d'une expression potentielle, descriptive ou résultative à l'aide d'une particule conjonctive. - Le cas
DATIVE(datif) indique un objet indirect qui fait référence au référent recevant l'objet direct. En français, l'objet indirect est souvent désigné par la préposition "à" comme dans la phrase "Il a donné la balle à Bobby", où "Bobby" est l'objet indirect et la personne recevant la balle. Dans cet exemple russe "Иван дал книгу маше" (Ivan a donné le livre à Masha), "-e" indique que "маше" est l'objet indirect et que Masha est la personne recevant le livre. - Le cas
GENITIVE(génitif) exprime la possession. Notez que le français exprime la possession avec la préposition "de" et non avec le génitif. Dans cet exemple russe, en revanche, le suffixe "-а" donne à "Антон-" la marque du génitif : "Где книга Антона?" (Où est le livre d'Anton ?). En russe, le génitif est également utilisé comme complément de mots tels que "plusieurs" ou "peu". Par exemple, dans "Зимой здесь мало снега" (En hiver, il y a peu de neige par ici), “-a” donne à "снег" (neige) la marque du génitif, puisqu'il s'agit du complément de "мало" ("peu"). - Le cas
INSTRUMENTAL(instrumental) indique si un nom est l'instrument par lequel une action est effectuée. En russe, la phrase "Il a ouvert la porte avec une clé" serait traduite par "он открыл дверь ключом", où "-om" est attaché à "ключ" (clé) pour indiquer le cas instrumental. - Le cas
LOCATIVE(locatif) indique l'utilisation d'un mot pour désigner un lieu. Le français n'a pas recours au locatif. - Le cas
NOMINATIVE(nominatif) est associé au sujet d'un verbe. En français, le sujet d'une phrase est déterminé par l'ordre des mots et non par le cas grammatical. Dans la phrase "La fille a gagné la course", "la fille" est le sujet qui apparaît à gauche du verbe "a gagné". En russe, "девушка" (la/une fille) peut apparaître avant ou après le verbe : "девушка выиграла гонку" ou "гонку выиграла девушка", où le verbe est "выиграла" (a gagné). - Le cas
OBLIQUE(oblique) indique l'utilisation d'un mot en tant qu'objet d'un verbe ou d'une préposition. - Le cas
PARTITIVE(partitif) exprime le "caractère partiel" ou l'absence d'identité spécifique d'un mot. Un exemple de partitif en français serait "trois de mes amis". En russe, cela s'exprimerait par "трое моих друзей", où "трое" signifie "trois de" (à comparer avec "три друга", où "три" signifie "trois"). - Le cas
PREPOSITIONAL(prépositionnel) indique l'objet d'une préposition.
- Le cas