вообще в экономической теории чаще измеряют не среднюю зарплату, а медиану: берём всех людей, сортируем по доходам, тычем в середину списка — вот и ответ. если разделение доходов очень неравномерное, медиана более объективно показывает картину.
У нас какая-то разная Япония — мне показалось, что никогда не знаешь, берут в данном конкретном месте кредитку или не берут. В большинстве маленьких магазинов даже шанса нет, поэтому людям проще сунуть банкноту, чем вытащить кредитку, убедиться, что не берут, и вручить-таки банкноту.
Кстати, не думаю, что речевой интерфейс тоже удобнее. Мышкой перетащить десять файлов или сказать «выдели файлы в текущей папке со второго по двадцатый, кроме третьего, и удали с возможностью восстановления».
> Математи́ческая моде́ль — это математическое представление реальности.
Ну, очень мило, кошка — это кошка. Что такое «математическое»? Вот если так, шаг за шагом, описывать конкретику, то станет ясно, что в абсолютно любую сторону можно копать бесконечно. Стало быть, «математическая модель» превращается в очень грубое приближение, которое NLP с каждым годом пытается расширять, но довольно скудно. Прорыва пока нет.
По отдельности разные вещи существуют. Есть, например, проект Cyc, ознакомьтесь. Есть WordNet. Есть трибанки. Всё это и есть составляющие мат. модели, описывающие различные аспекты языка. Но соединить всё вместе не получается.
Ну а чем вам пример с text adventure не нравится? В принципе, эти системы восьмидесятых можно поднять при нынешних возможностях на качественно новый уровень. Просто оказалось, что тыкать мышью проще, чем набирать текст.
Слово «мат. модель» меня вообще применительно к языку смущает. Что это — уравнение? Набор ограничений?
Если очень грубо провести параллель между человеческим языком и языком программирования, то ваш пример — это «программирование действий» на естественном языке. И тогда речь идёт об «интерпретаторе языка», где фраза задаёт действие.
Но проблема в том, что возможности естественного языка шире. На Паскале можно только командовать, а по-русски можно сказать «небо синее», вот и всё.
Ну а простые текстовые команды… гм, вспомним квесты восьмидесятых годов, там это всё реализовано — «иди на восток», «подбери ключи»…
Ну, если совсем коротко, то машинный перевод во многом считается одной из самых сложных связанных с этим делом областей — где и обкатываются многие теории и модели. Как мы видим, успехи переменные.
Сложно назвать сходу одну сверх-проблему. Наверно, можно сказать, что идеального решения даже самой простой задачи в нашей области нужен полноценный интеллект. Вот буквально сегодня видел сравнение: «Jane and Mary are sisters; July and Ann are mothers.»
Вроде бы грамматически одно и то же, однако в первом случае понятно, что девушки — сёстры друг другу, а во втором — обе женщины имеют детей. Это можно понять лишь хорошо зная мир вокруг, а он меняется постоянно и слишком сложен для прямого моделирования.
И так во всём — если по-русски мы говорим «брат-сестра», то японцы обычно уточняют — «старший/младший брат/сестра». Значит, нужен широкий контекст входного документа, чтобы адекватно перевести кусок… а ведь формально машинный перевод — это просто отображение одного языка в другой, трансляция данных без преобразования.
Мы приходим к полуфилософскому вопросу о том, что такое падеж. Если на вопрос «кто?» отвечают слова «Гриша» и «Гриш», как тогда это трактовать? Падеж чётко соответствует некоей языковой ситуации; слова «Гриш» и «Гриша» нельзя использовать наравне, так же как и «сахара-сахару».
А понять различия проще всего сравнивая с другими языками, где данные падежи используются более широко. Например, звательный падеж (насколько знаю) широко ходит в украинском — пусть знатоки поправят.
Партитив очень распространён в финском — он используется вместо винительного падежа обязательно с некоторыми глаголами («я люблю Х» — Х всегда в партитиве), а также когда речь идёт о части или веществе в противовес целому (в русском тоже есть разница — «дай мне чашку и налей молока» — почему тарелка в одном падеже, а молоко в другом?)
Кусочек сахару может быть, потому что это часть целого; а производство сахару быть не может, потому что производим вещество «сахар».
Вообще-то нигде ничего на язык не завязано. Я лишь привожу примеры для разных языков. Для английского примеры просто берутся из личной практики — так удобнее. А так — все алгоритмы работают без изменений и для нашего языка.
Т.е. надо связаться с авторами и попросить.
Ну, очень мило, кошка — это кошка. Что такое «математическое»? Вот если так, шаг за шагом, описывать конкретику, то станет ясно, что в абсолютно любую сторону можно копать бесконечно. Стало быть, «математическая модель» превращается в очень грубое приближение, которое NLP с каждым годом пытается расширять, но довольно скудно. Прорыва пока нет.
По отдельности разные вещи существуют. Есть, например, проект Cyc, ознакомьтесь. Есть WordNet. Есть трибанки. Всё это и есть составляющие мат. модели, описывающие различные аспекты языка. Но соединить всё вместе не получается.
Ну а чем вам пример с text adventure не нравится? В принципе, эти системы восьмидесятых можно поднять при нынешних возможностях на качественно новый уровень. Просто оказалось, что тыкать мышью проще, чем набирать текст.
Если очень грубо провести параллель между человеческим языком и языком программирования, то ваш пример — это «программирование действий» на естественном языке. И тогда речь идёт об «интерпретаторе языка», где фраза задаёт действие.
Но проблема в том, что возможности естественного языка шире. На Паскале можно только командовать, а по-русски можно сказать «небо синее», вот и всё.
Ну а простые текстовые команды… гм, вспомним квесты восьмидесятых годов, там это всё реализовано — «иди на восток», «подбери ключи»…
Сложно назвать сходу одну сверх-проблему. Наверно, можно сказать, что идеального решения даже самой простой задачи в нашей области нужен полноценный интеллект. Вот буквально сегодня видел сравнение: «Jane and Mary are sisters; July and Ann are mothers.»
Вроде бы грамматически одно и то же, однако в первом случае понятно, что девушки — сёстры друг другу, а во втором — обе женщины имеют детей. Это можно понять лишь хорошо зная мир вокруг, а он меняется постоянно и слишком сложен для прямого моделирования.
И так во всём — если по-русски мы говорим «брат-сестра», то японцы обычно уточняют — «старший/младший брат/сестра». Значит, нужен широкий контекст входного документа, чтобы адекватно перевести кусок… а ведь формально машинный перевод — это просто отображение одного языка в другой, трансляция данных без преобразования.
В том или ином виде модели и сейчас существуют.
Но там речь идёт только об опечатках, и корпус не столь велик (около 1000 предложений по-моему?)
А понять различия проще всего сравнивая с другими языками, где данные падежи используются более широко. Например, звательный падеж (насколько знаю) широко ходит в украинском — пусть знатоки поправят.
Партитив очень распространён в финском — он используется вместо винительного падежа обязательно с некоторыми глаголами («я люблю Х» — Х всегда в партитиве), а также когда речь идёт о части или веществе в противовес целому (в русском тоже есть разница — «дай мне чашку и налей молока» — почему тарелка в одном падеже, а молоко в другом?)
Кусочек сахару может быть, потому что это часть целого; а производство сахару быть не может, потому что производим вещество «сахар».
Вообще если был аннотированный корпус предложений с ошибками — это было бы круто. Но нет такого :(
1) звательный («Миш!», «Гриш!», «Господи!»);
2) локатив («о лесе» — предложный, «в лесу» — локатив);
3) партитив («кусочек сахару» — «производство сахара»; «ещё чаю!» — «нет чая»)