Обновить
332
Maxim Mozgovoy@rg_software

university professor and software developer

0,1
Рейтинг
155
Подписчики
Отправить сообщение
Скажем так, отчасти. В настоящее время действительно есть определённый набор методов, выбор из которых определяется личной верой.

Однако за последние годы (десятилетия?) несколько направлений всё-таки «отвалились», и это тоже факт. Например, чистый подход по Хомскому не обрабатывает непроективные конструкции, а их в чешском четверть от общего объёма. Или возьмём нелексикализованные грамматики — в лучшем случае пытаюстся доказать, что они лучше, чем о них раньше думали, но никто не берётся доказывать их «лучшесть» по сравнению с лексикализованными — в общем-то уже договорились, что лексикализация есть добро.

А если собрать все эти особенности воедино, как мне кажется, не так уж много по факту остаётся. Особенно если принять во внимание родственные связи — тот же XDG имеет четырёх близких родственников, стало быть, идеологически они похожи…
Сейчас цены выросли. Года четыре назад можно было, скажем, за евроамериканскую зарплату в течение 3-5 лет скопить на небольшую квартиру без особых сложностей.
Читайте свежевышедшую часть 8 — там есть про WSD.

По поводу «обзора» — обещать трудно. Дело в том, что я верю в dependency parsing с соответствующим развитием — XDG, синтактико-семантический анализ и далее по программе.

Соответственно, зачем (по моей логике) тратить время на заведомо менее качественные идеи?
Эмуляторы БК уже есть :)
ОК, отвечу тут, если кому ещё будет непонятно:

— Тема уплыла по следующей философской причине. Мы говорим о смысле слова, о семантике. Как формально определить смысл? Объяснить одно слово через другое? Или как-либо ещё? Простейшее «понимание» смысла выражается в умении подобрать эквивалент на другом языке (тогда смысловое объяснение слова — это просто его перевод).

— Первый пример — это Ru -> En, второй — En -> Ru. Вероятно, следовало объяснить явно.

foo BAR() baz: foo — тип, BAR() — само слово (со списком возможных зависимых слов), baz — перевод.

a/b/c — класс (он же тип) слова, записанный в виде полного пути от базового класса a до наиболее конкретного класса c.
Можно очертить область значений, так же как и в случае с языком.
Значит, аналогия совсем хороша :)

Глагол «разбил» ни при каких условиях не совпадёт с «бегал» или «красный». У него тоже есть область допустимых значений.
Просто этот пост ещё на главную не попал. По поводу широты — уже отписался. Впрочем, меня тут как раз упрекали в излишней широте и поверхностности — в противовес глубокому описанию отдельных моделей.
А что вас интересует?
Если я в какой-то метод не верю — не буду писать о нём, зачем зря пропагандировать? :)
А если верю, но просто руки не доходят — буду стараться хотя бы затронуть.
Об этом будет следующая часть, хотя и, наверно, с её содержанием можно будет поспорить.
В принципе, на то XDG и «extensible» :) Вы можете создать для слова атрибут, содержащий некий «идентификатор», одинаковый для всех слов, произведённых из одной словоформы. Далее по идентификатору находятся другие элементы.

Можно и ещё проще: словоформа -> (морф анализатор) -> начальная форма -> (морф синтезатор) -> требуемая форма.
Это достаточно широкий термин
Например, то, о чём я говорю, вполне подходит под «Раздел языкознания, изучающий условия использования говорящими языковых знаков».
Ну если вот так сходу, почитайте статью о лингвистической относительности в «Кругосвете». Там и по ссылкам побродить можно.
Я думаю, по-русски это тоже работает, хотя и несколько иначе:

— ты дочитал статью?
— иди на ...!

В технике тернарной логикой можно назвать обработку исключительных ситуаций. В Википедии приводят пример из языка SQL:

выражение «City = 'Paris'» по идее, равно TRUE или FALSE. Но если поле city не заполнено (NULL), возникает третье логическое значение UNKNOWN.

Причём значение UNKNOWN действительно логическое, и оно дальше может участвовать в выражениях языка («City = 'Paris' OR Balance < 0.0»)
новорождённые попадают в чистилище, если не ошибаюсь, а там уже с ними разбираются.
а вот если его крестить не успели, тогда судьба не завидна…

отправится туда же, куда миллиарды нехристей-китайцев.
привёл ссылку в ответе cronfy.
Про логику аймары… Там довольно сложное описание, но я так понимаю, что ничего сверъестественного, просто есть категория «возможности» на том же уровне, что и «да/нет».

По поводу «языка посередине». Понятно, что такой язык поможет бороться с комбинаторным взрывом, но я всё равно слабо верю в такую штуку. В конце концов, вспомним известные шутки лингвистов про «цепочечный перевод», когда в конце цепочки автор фразы даже близко не может её узнать (было «ах вы сени мои, сени», а стало «ох, вестибюль мой, вестибюль»).

Абстрактно рассуждая, у каждого языка есть своё ментальное поле. И перевод — это отображение ментального поля одного языка на ментальное поле другого. С неизбежными потерями и искажениями смысла. Потому что любое слово вызывает какие-либо ассоциации, оно имеет окраску, другие значения, оттенок архаики или модерна. Формализовать все эти признаки попросту невозможно, потому что даже хороший переводчик выбирает слово на уровне интуиции и чувства, а не формального соответствия признакам. Даже перевод с одного языка на другой труден, если слово имеет (или должно вызывать) какие-либо коннотации. А если мы сначала кастрируем слово переводом на третий язык, а потом переведём на целевой язык это рафинированный остаток, качества не будет. Да и ошибки перевода множатся, это важно. Если постараться, можно привести кучу примеров, где третий язык всё сломает.

Например, диалектное слово в одном языке должно быть переведено не просто диалектным словом в другом языке, но и вызывающим правильные (требуемые) ассоциации.

Получается, что мы опять приходим к модели, когда каждая словоформа представляет собой отдельный объект, с собственными правилами согласования.
ОК, оставим этот вопрос — я мимоходом упомянул, не будем сосредотачиваться на мелочах в то время как есть темы посерьёзнее и поинтереснее :)

Информация

В рейтинге
3 172-й
Откуда
Фукусима, Япония
Дата рождения
Зарегистрирован
Активность