Скажем так, отчасти. В настоящее время действительно есть определённый набор методов, выбор из которых определяется личной верой.
Однако за последние годы (десятилетия?) несколько направлений всё-таки «отвалились», и это тоже факт. Например, чистый подход по Хомскому не обрабатывает непроективные конструкции, а их в чешском четверть от общего объёма. Или возьмём нелексикализованные грамматики — в лучшем случае пытаюстся доказать, что они лучше, чем о них раньше думали, но никто не берётся доказывать их «лучшесть» по сравнению с лексикализованными — в общем-то уже договорились, что лексикализация есть добро.
А если собрать все эти особенности воедино, как мне кажется, не так уж много по факту остаётся. Особенно если принять во внимание родственные связи — тот же XDG имеет четырёх близких родственников, стало быть, идеологически они похожи…
Сейчас цены выросли. Года четыре назад можно было, скажем, за евроамериканскую зарплату в течение 3-5 лет скопить на небольшую квартиру без особых сложностей.
По поводу «обзора» — обещать трудно. Дело в том, что я верю в dependency parsing с соответствующим развитием — XDG, синтактико-семантический анализ и далее по программе.
Соответственно, зачем (по моей логике) тратить время на заведомо менее качественные идеи?
— Тема уплыла по следующей философской причине. Мы говорим о смысле слова, о семантике. Как формально определить смысл? Объяснить одно слово через другое? Или как-либо ещё? Простейшее «понимание» смысла выражается в умении подобрать эквивалент на другом языке (тогда смысловое объяснение слова — это просто его перевод).
— Первый пример — это Ru -> En, второй — En -> Ru. Вероятно, следовало объяснить явно.
foo BAR() baz: foo — тип, BAR() — само слово (со списком возможных зависимых слов), baz — перевод.
a/b/c — класс (он же тип) слова, записанный в виде полного пути от базового класса a до наиболее конкретного класса c.
Просто этот пост ещё на главную не попал. По поводу широты — уже отписался. Впрочем, меня тут как раз упрекали в излишней широте и поверхностности — в противовес глубокому описанию отдельных моделей.
А что вас интересует?
Если я в какой-то метод не верю — не буду писать о нём, зачем зря пропагандировать? :)
А если верю, но просто руки не доходят — буду стараться хотя бы затронуть.
В принципе, на то XDG и «extensible» :) Вы можете создать для слова атрибут, содержащий некий «идентификатор», одинаковый для всех слов, произведённых из одной словоформы. Далее по идентификатору находятся другие элементы.
Можно и ещё проще: словоформа -> (морф анализатор) -> начальная форма -> (морф синтезатор) -> требуемая форма.
Это достаточно широкий термин…
Например, то, о чём я говорю, вполне подходит под «Раздел языкознания, изучающий условия использования говорящими языковых знаков».
Про логику аймары… Там довольно сложное описание, но я так понимаю, что ничего сверъестественного, просто есть категория «возможности» на том же уровне, что и «да/нет».
По поводу «языка посередине». Понятно, что такой язык поможет бороться с комбинаторным взрывом, но я всё равно слабо верю в такую штуку. В конце концов, вспомним известные шутки лингвистов про «цепочечный перевод», когда в конце цепочки автор фразы даже близко не может её узнать (было «ах вы сени мои, сени», а стало «ох, вестибюль мой, вестибюль»).
Абстрактно рассуждая, у каждого языка есть своё ментальное поле. И перевод — это отображение ментального поля одного языка на ментальное поле другого. С неизбежными потерями и искажениями смысла. Потому что любое слово вызывает какие-либо ассоциации, оно имеет окраску, другие значения, оттенок архаики или модерна. Формализовать все эти признаки попросту невозможно, потому что даже хороший переводчик выбирает слово на уровне интуиции и чувства, а не формального соответствия признакам. Даже перевод с одного языка на другой труден, если слово имеет (или должно вызывать) какие-либо коннотации. А если мы сначала кастрируем слово переводом на третий язык, а потом переведём на целевой язык это рафинированный остаток, качества не будет. Да и ошибки перевода множатся, это важно. Если постараться, можно привести кучу примеров, где третий язык всё сломает.
Например, диалектное слово в одном языке должно быть переведено не просто диалектным словом в другом языке, но и вызывающим правильные (требуемые) ассоциации.
Однако за последние годы (десятилетия?) несколько направлений всё-таки «отвалились», и это тоже факт. Например, чистый подход по Хомскому не обрабатывает непроективные конструкции, а их в чешском четверть от общего объёма. Или возьмём нелексикализованные грамматики — в лучшем случае пытаюстся доказать, что они лучше, чем о них раньше думали, но никто не берётся доказывать их «лучшесть» по сравнению с лексикализованными — в общем-то уже договорились, что лексикализация есть добро.
А если собрать все эти особенности воедино, как мне кажется, не так уж много по факту остаётся. Особенно если принять во внимание родственные связи — тот же XDG имеет четырёх близких родственников, стало быть, идеологически они похожи…
По поводу «обзора» — обещать трудно. Дело в том, что я верю в dependency parsing с соответствующим развитием — XDG, синтактико-семантический анализ и далее по программе.
Соответственно, зачем (по моей логике) тратить время на заведомо менее качественные идеи?
— Тема уплыла по следующей философской причине. Мы говорим о смысле слова, о семантике. Как формально определить смысл? Объяснить одно слово через другое? Или как-либо ещё? Простейшее «понимание» смысла выражается в умении подобрать эквивалент на другом языке (тогда смысловое объяснение слова — это просто его перевод).
— Первый пример — это Ru -> En, второй — En -> Ru. Вероятно, следовало объяснить явно.
foo BAR() baz: foo — тип, BAR() — само слово (со списком возможных зависимых слов), baz — перевод.
a/b/c — класс (он же тип) слова, записанный в виде полного пути от базового класса a до наиболее конкретного класса c.
Глагол «разбил» ни при каких условиях не совпадёт с «бегал» или «красный». У него тоже есть область допустимых значений.
Если я в какой-то метод не верю — не буду писать о нём, зачем зря пропагандировать? :)
А если верю, но просто руки не доходят — буду стараться хотя бы затронуть.
Можно и ещё проще: словоформа -> (морф анализатор) -> начальная форма -> (морф синтезатор) -> требуемая форма.
Например, то, о чём я говорю, вполне подходит под «Раздел языкознания, изучающий условия использования говорящими языковых знаков».
— ты дочитал статью?
— иди на ...!
В технике тернарной логикой можно назвать обработку исключительных ситуаций. В Википедии приводят пример из языка SQL:
выражение «City = 'Paris'» по идее, равно TRUE или FALSE. Но если поле city не заполнено (NULL), возникает третье логическое значение UNKNOWN.
Причём значение UNKNOWN действительно логическое, и оно дальше может участвовать в выражениях языка («City = 'Paris' OR Balance < 0.0»)
а вот если его крестить не успели, тогда судьба не завидна…
отправится туда же, куда миллиарды нехристей-китайцев.
По поводу «языка посередине». Понятно, что такой язык поможет бороться с комбинаторным взрывом, но я всё равно слабо верю в такую штуку. В конце концов, вспомним известные шутки лингвистов про «цепочечный перевод», когда в конце цепочки автор фразы даже близко не может её узнать (было «ах вы сени мои, сени», а стало «ох, вестибюль мой, вестибюль»).
Абстрактно рассуждая, у каждого языка есть своё ментальное поле. И перевод — это отображение ментального поля одного языка на ментальное поле другого. С неизбежными потерями и искажениями смысла. Потому что любое слово вызывает какие-либо ассоциации, оно имеет окраску, другие значения, оттенок архаики или модерна. Формализовать все эти признаки попросту невозможно, потому что даже хороший переводчик выбирает слово на уровне интуиции и чувства, а не формального соответствия признакам. Даже перевод с одного языка на другой труден, если слово имеет (или должно вызывать) какие-либо коннотации. А если мы сначала кастрируем слово переводом на третий язык, а потом переведём на целевой язык это рафинированный остаток, качества не будет. Да и ошибки перевода множатся, это важно. Если постараться, можно привести кучу примеров, где третий язык всё сломает.
Например, диалектное слово в одном языке должно быть переведено не просто диалектным словом в другом языке, но и вызывающим правильные (требуемые) ассоциации.