Нужно придумать нотацию для того, чтобы упоминая слова и словосочетания преобразовывать их в нужную форму. Форма должна указываться для словосочетания, но по разному преобразовывать слова словосочетания. Для этого отношения слов в словосочетании нужно разметить.

Кто из российских лингвистов уже проделал такую работу?


Искомую вами работу в российский лингвистике в значительной степени выполнил Игорь Александрович Мельчук (при участии Александра Константиновича Жолковского и Юрия Дерениковича Апресяна) в рамках теории «Смысл ⇔ Текст».

🧩 Ключевой инструмент: Лексические функции

Для вашей задачи — когда форма задаётся для словосочетания в целом, но слова внутри него преобразуются по-разному, — центральным понятием является аппарат лексических функций (ЛФ).

Вот как это устроено:

  • Суть подхода: Лексическая функция — это не просто «правило склонения», а обобщённый смысл (например, «очень», «делать», «начать»), который по-разному выражается для разных слов. Значение функции вычисляется от конкретного слова-аргумента (С0).
  • Примеры из словаря: Для словосочетания или отдельного слова можно задать, каким словом выражается нужный смысл:
    • Magn (смысл «очень»): Magn(брюнетка) = жгучая, Magn(знать) = назубок.
    • Oper (смысл «делать»): Oper(помощь) = оказывать.
    • Liqu (смысл «ликвидировать»): Liqu(ошибка) = исправить.
  • Как это работает для словосочетаний: Если у вас есть, например, словосочетание «оказать помощь», глагол «оказать» здесь является значением функции Oper для слова «помощь». Если вам нужно поставить всё словосочетание в другую форму (например, прошедшее время), вы применяете морфологическое преобразование к глаголу «оказать», но не к «помощь» — хотя управление падежом («помощь» в винительном падеже) остаётся частью модели управления этого глагола.

📚 Где это описано

Основная работа — это Толково-комбинаторный словарь (ТКС), который является практической реализацией этой модели для русского языка.

Однако стоит отметить, что ТКС — это в первую очередь словарь, а не готовая нотация для разметки произвольных текстов. Он показывает, как слова связаны между собой (модель управления) и какие лексические функции применимы к каждому слову.

🛠️ От теории к практике (АОТ)

Если вам нужна именно программная реализация, которая уже умеет делать морфологический синтез и анализ, стоит обратить внимание на проект АОТ (Автоматическая Обработка Текста) под руководством А. Сокирко. Он включает в себя морфологический процессор, основанный на словаре А. А. Зализняка, и умеет строить парадигмы слов (то есть преобразовывать слово во все его формы). Хотя АОТ не реализует лексические функции Мельчука напрямую, он решает задачу «преобразовать слово в нужную форму» на уровне отдельных словоформ, что является важной частью вашей задачи.

Таким образом, если вам нужна теоретическая база для разметки отношений слов в словосочетании с учётом их разного поведения — это теория «Смысл ⇔ Текст» и ТКС Мельчука. Если нужна готовая технология для морфологического синтеза (получения нужных форм слов) — это разработки группы АОТ.


Прямой ответ на ваш вопрос зависит от того, что именно вы подразумеваете под «нужной формой» и «разметкой отношений». Если речь идет о создании формальной нотации для автоматического синтеза словосочетаний (например, в системах машинного перевода или генерации текста), где для всей группы задается целевой падеж, а каждое слово внутри получает свою морфологическую форму, то прямого аналога такой конкретной нотации в работах российских лингвистов нет.

Однако теоретическую базу для такой разметки — разделение словосочетания на главный и зависимый компоненты с указанием типа связи — заложили и детально разработали несколько ключевых фигур отечественной лингвистики. Их работы описывают, как слова взаимодействуют, что является необходимым условием для создания вашей нотации.

  1. Виктор Владимирович Виноградов Именно он окончательно разграничил словосочетание и предложение, определив словосочетание как синтаксическую конструкцию, основанную на подчинительной связи. Это фундаментальная база для вашей задачи: чтобы преобразовать слова по-разному, вы должны сначала определить, какое из них главное (хозяин), а какое — зависимое (слуга). В концепции Виноградова словосочетание — это «номинативная единица», строительный материал для предложения. Без выделения главного слова (ядра) и зависимого (адъюнкта) ваша нотация не сможет работать, так как именно от главного слова задаются вопросы к зависимому, определяющие его форму.

  2. Алексей Александрович Шахматов Он детально описал грамматическую природу этой связи. Шахматов указывал, что в словосочетании всегда есть грамматически господствующее слово и грамматически подчиненное. Для вашей нотации критически важна его классификация типов синтаксической связи, так как именно тип связи диктует правила преобразования:

Согласование: зависимое слово (обычно прилагательное, причастие, местоимение) полностью копирует грамматические категории главного (род, число, падеж). Пример для вашей нотации: если словосочетанию «красный дом» нужно придать форму творительного падежа, нотация должна указать: Head[дом, Т.п.] -> Depend[красный, м.р., ед.ч., Т.п.]. Управление: главное слово требует от зависимого строго определенной падежной формы (с предлогом или без). Пример: «читать книгу» (вин. п.). Если всей группе нужно стать субъектом действия, нотация должна преобразовать только зависимое: Head[читать, И.п.] -> Depend[книга, И.п.]. При этом само главное слово (глагол) может менять форму (например, по числу или времени) независимо. Примыкание: зависимое слово (наречие, деепричастие, инфинитив) связано с главным только по смыслу и интонационно, его форма неизменна. Пример: «бежать быстро». Как бы вы ни склоняли всю группу, «быстро» останется неизменным.

  1. Алексей Матвеевич Пешковский В своей работе «Русский синтаксис в научном освещении» он подробно проанализировал формальные способы выражения синтаксических связей. Пешковский ввел понятие «синтаксических возможностей» слова (то, что позже назовут валентностью). Для вашей нотации это важно, так как именно валентность главного слова определяет, сколько зависимых компонентов может быть в группе и в каких формах они могут стоять. Он также детально описал порядок слов, который в русском языке часто является дополнительным маркером отношений.

  2. Игорь Александрович Мельчук и модель «Смысл ⇔ Текст» (МТ) Это направление наиболее близко к формальной нотации преобразования, о которой вы спрашиваете, хотя и не сводится к простой разметке одного словосочетания. В рамках этой теории (развивавшейся в том числе совместно с А. К. Жолковским и Ю. Д. Апресяном) язык описывается через переход от глубинно-синтаксической структуры к поверхностно-синтаксической, а затем к морфологической.

В МТ словосочетание представляется в виде дерева зависимостей. Для преобразования используется аппарат парадигматических классов и правил синтаксического развертывания и свертки. В лексических функциях МТ (например, S0, A0, Adv0) заложен механизм, где для одного понятия выбирается нужная часть речи и форма. Если вы создаете нотацию, вам стоит изучить формализм лексических функций МТ — это готовый математический аппарат для того, чтобы из семантического узла (например, чтение) получать разные поверхностные формы (читать книгу, книга для чтения, читающий человек), задавая разные поверхностно-синтаксические параметры.

Как может выглядеть ваша нотация на основе этих теорий: Чтобы преобразовать слова по-разному, нотация должна состоять из двух уровней:

Уровень группы (интерфейсный): задает общую синтаксическую позицию всей группы в предложении (например, Падеж: Родительный, Роль: Субъект). Уровень зависимостей (внутренний): содержит список пар [Индекс_слова -> Правило_трансформации].

Пример: Словосочетание «интересная книга». Задача: поставить в позицию прямого объекта при глаголе «купить» (В.п.), но сохранить атрибутивное значение. Нотация: Group[Case:Acc] -> { Head[книга]: Keep_Base, Depend[интересный]: Agree(Head, Case:Acc, Gender:Fem, Number:Sing) }. Результат: «купить интересную книгу». Здесь главное слово приняло форму В.п., а зависимое согласовалось с ним в новом падеже. Если бы задача была превратить это в субъект («интересная книга куплена»), правило для Head изменилось бы на Passive_Participle или Nom, а для Depend — на Agree(Nom).

Практический современный контекст: Если ваша цель — практическая реализация такой нотации, вам стоит обратиться не только к классической русистике, но и к корпусной лингвистике. Современные нацкорпусы русского языка (например, НКРЯ) используют разметку синтаксических зависимостей (деревья зависимостей), где каждое слово имеет индекс, тип связи (nsubj, obj, amod и т.д.) и ссылку на своего синтаксического хозяина. Формат CoNLL-U, используемый в разметке корпусов, — это и есть готовая машиночитаемая нотация того типа, который вам нужен.


Ваша задача — по сути, формальная нотация для морфологической реализации словосочетания: задать целевую грамматическую форму для всего сочетания, а правила преобразования отдельных слов определяются их синтаксическими ролями внутри него. Это пересекается с несколькими направлениями российской лингвистики, и здесь есть конкретные имена и системы.

И.А. Мельчук — модель «Смысл ⇔ Текст»

Наиболее близко к тому, что вы описываете, — работа Игоря Мельчука (и Александра Жолковского). Их модель «Смысл ⇔ Текст» — это многоуровневая система преобразований, где:

  • Синтаксическая структура представлена деревом зависимостей с именованными отношениями (несколько десятков поверхностно-синтаксических отношений для русского языка).
  • Введено разделение трёх типов зависимостей: семантические, морфологические и синтаксические. Мельчук показал, например, что в сочетании «пять столов» морфологически числительное управляет падежом и числом существительного, но синтаксически числительное зависит от существительного (порядок слов). Это ровно та ситуация, которую вы описываете — разные отношения по-разному определяют преобразование слов.
  • Модель управления лексемы в словаре содержит информацию обо всех актантах и о способах их морфологического и синтаксического выражения — то есть прямо задаёт, в какую форму ставится зависимое слово при данном отношении.
  • На базе модели работает лингвистический процессор ЭТАП (разработка Лаборатории компьютерной лингвистики ИППИ РАН), который выполняет как анализ, так и синтез — то есть порождение правильных словоформ в составе синтаксических структур. 6

СинТагРус — синтаксически размеченный корпус

На базе модели Мельчука создан корпус СинТагРус (Syntactically Tagged Russian Text), доступный в составе Национального корпуса русского языка. Для каждого предложения строится дерево зависимостей, где дуги помечены именами синтаксических отношений, а каждому слову приписана полная морфологическая характеристика. Это готовая система нотации, в которой отношения между словами явно размечены и определяют их морфологические формы. 6

В.В. Виноградов — парадигма словосочетания

Виноградов ввёл понятие системы форм словосочетания (парадигмы словосочетания): форма всего сочетания определяется по начальной форме главного слова, а при изменении этой формы соответственно меняются и формы зависимых слов. Например, «тихое утро → тихого утра → тихому утру…» — форма словосочетания задаётся для целого, но разные слова преобразуются по-разному в зависимости от типа связи (согласование, управление, примыкание). 9

Г.А. Золотова — синтаксема

Галина Золотова предложила понятие синтаксемы — синтаксической формы слова, которая определяется тремя параметрами: морфологическая форма, лексическая семантика и синтаксическая функция. Она показала, что одна и та же морфологическая форма (например, «в саду» vs «в сад») может иметь разные синтаксические значения (локатив vs директив) в зависимости от конструкции. Синтаксемы классифицируются на свободные, обусловленные и связанные — то есть их форма предопределена их ролью в составе конструкции.

Universal Dependencies для русского

Более современная нотация — Universal Dependencies (UD), адаптированная для русского. В ней каждому слову приписываются морфологические признаки (в формате Feature=Value) и одновременно синтаксические отношения (dependency labels, около 45 тегов для русского). На базе UD созданы два русских древобанка: UD-Russian-SynTagRus и UD-Russian-Google.

Резюме

Подход Кто Что даёт для вашей задачи
Модель «Смысл ⇔ Текст» И.А. Мельчук, А.К. Жолковский Разделение типов зависимостей (морфологические/синтаксические/семантические), модель управления, правила морфологической реализации
Парадигма словосочетания В.В. Виноградов Система форм словосочетания — целевая форма для сочетания, разные правила для разных слов по типу связи
Синтаксема Г.А. Золотова Синтаксическая форма слова, определяемая его ролью в конструкции
СинТагРус / UD-Russian ИППИ РАН, НКРЯ Готовая система аннотации: морфология + именованные синтаксические отношения

Если вы хотите построить практическую нотацию, ближе всего будет модель Мельчука — она именно для этого и создавалась: формальное описание перехода от синтаксической структуры (с размеченными отношениями) к морфологическим формам слов. Парадигма словосочетания Виноградова даёт концептуальную базу, а Золотова — операциональную единицу (синтаксему), в которой морфология и синтаксис неразрывно связаны.

Какой практический контекст у вашей задачи — автоматическая генерация текста, разметка корпуса, лингвистическое описание? От этого зависит, какую из этих систем удобнее взять за основу.

  • aary@xn--e1aghfa.xn--e1aqbccjfc.xn--p1acfOP
    link
    fedilink
    Русский
    arrow-up
    1
    ·
    edit-2
    7 days ago

    https://asokirko.livejournal.com/

    Явно не лингвистический блог. Вероятно однофамилец?

    https://asokirko.livejournal.com/3034.html «Случилась неприятность. Мои родители потеряли контроль над своим сайтом. Пришлось открывать новый сайт Виктор Сокирко ( http://www.sokirko.info/ ). Старый сайт пока еще работает, но, наверно, скоро будет закрыт. На новом сайте все те же материалы: слайд-фильмы, папины книги, дневники и сценарии.»

    Или это работа иностранных спецслужб (новый сайт - поддельный)?

    https://sokirko.com/victor/ «Виктор Владимирович Сокирко и Лидия Николаевна Ткаченко»

    Дети on-line: Старший сын Артём (программист) - tyoma@tyoma.com Младший сын Алексей (лингвист) - http://www.aot.ru/ mailto:sokirko@yandex.ru Старшая невестка Ася (переводчик)