Обновить
332
Maxim Mozgovoy@rg_software

university professor and software developer

155
Подписчики
Отправить сообщение
вообще в экономической теории чаще измеряют не среднюю зарплату, а медиану: берём всех людей, сортируем по доходам, тычем в середину списка — вот и ответ. если разделение доходов очень неравномерное, медиана более объективно показывает картину.
а зачем тогда вообще отвечаете? статистику смазать?
У нас какая-то разная Япония — мне показалось, что никогда не знаешь, берут в данном конкретном месте кредитку или не берут. В большинстве маленьких магазинов даже шанса нет, поэтому людям проще сунуть банкноту, чем вытащить кредитку, убедиться, что не берут, и вручить-таки банкноту.
Тогда и гейся, и рикся ;)
Да вот же ж, про Буркина-Фасо тоже не пишут, жаль.
Синтагрус дают скачать для noncommercial research purposes по договорённости.
Т.е. надо связаться с авторами и попросить.
На Амазоне второе английское издание (на основе которого сделан русский перевод) начинается с 20 долларов. Потому что уже третье вышло.
Кстати, не думаю, что речевой интерфейс тоже удобнее. Мышкой перетащить десять файлов или сказать «выдели файлы в текущей папке со второго по двадцатый, кроме третьего, и удали с возможностью восстановления».
> Математи́ческая моде́ль — это математическое представление реальности.
Ну, очень мило, кошка — это кошка. Что такое «математическое»? Вот если так, шаг за шагом, описывать конкретику, то станет ясно, что в абсолютно любую сторону можно копать бесконечно. Стало быть, «математическая модель» превращается в очень грубое приближение, которое NLP с каждым годом пытается расширять, но довольно скудно. Прорыва пока нет.

По отдельности разные вещи существуют. Есть, например, проект Cyc, ознакомьтесь. Есть WordNet. Есть трибанки. Всё это и есть составляющие мат. модели, описывающие различные аспекты языка. Но соединить всё вместе не получается.

Ну а чем вам пример с text adventure не нравится? В принципе, эти системы восьмидесятых можно поднять при нынешних возможностях на качественно новый уровень. Просто оказалось, что тыкать мышью проще, чем набирать текст.
Слово «мат. модель» меня вообще применительно к языку смущает. Что это — уравнение? Набор ограничений?

Если очень грубо провести параллель между человеческим языком и языком программирования, то ваш пример — это «программирование действий» на естественном языке. И тогда речь идёт об «интерпретаторе языка», где фраза задаёт действие.

Но проблема в том, что возможности естественного языка шире. На Паскале можно только командовать, а по-русски можно сказать «небо синее», вот и всё.

Ну а простые текстовые команды… гм, вспомним квесты восьмидесятых годов, там это всё реализовано — «иди на восток», «подбери ключи»…
Ну, если совсем коротко, то машинный перевод во многом считается одной из самых сложных связанных с этим делом областей — где и обкатываются многие теории и модели. Как мы видим, успехи переменные.

Сложно назвать сходу одну сверх-проблему. Наверно, можно сказать, что идеального решения даже самой простой задачи в нашей области нужен полноценный интеллект. Вот буквально сегодня видел сравнение: «Jane and Mary are sisters; July and Ann are mothers.»

Вроде бы грамматически одно и то же, однако в первом случае понятно, что девушки — сёстры друг другу, а во втором — обе женщины имеют детей. Это можно понять лишь хорошо зная мир вокруг, а он меняется постоянно и слишком сложен для прямого моделирования.

И так во всём — если по-русски мы говорим «брат-сестра», то японцы обычно уточняют — «старший/младший брат/сестра». Значит, нужен широкий контекст входного документа, чтобы адекватно перевести кусок… а ведь формально машинный перевод — это просто отображение одного языка в другой, трансляция данных без преобразования.
Вопрос в том, что конкретно понимается под математической моделью языка. Что она должна уметь?

В том или ином виде модели и сейчас существуют.
А, товарищ Фостер, да, знаю её.
Но там речь идёт только об опечатках, и корпус не столь велик (около 1000 предложений по-моему?)
*чашка, тарелка… :)
Мы приходим к полуфилософскому вопросу о том, что такое падеж. Если на вопрос «кто?» отвечают слова «Гриша» и «Гриш», как тогда это трактовать? Падеж чётко соответствует некоей языковой ситуации; слова «Гриш» и «Гриша» нельзя использовать наравне, так же как и «сахара-сахару».

А понять различия проще всего сравнивая с другими языками, где данные падежи используются более широко. Например, звательный падеж (насколько знаю) широко ходит в украинском — пусть знатоки поправят.

Партитив очень распространён в финском — он используется вместо винительного падежа обязательно с некоторыми глаголами («я люблю Х» — Х всегда в партитиве), а также когда речь идёт о части или веществе в противовес целому (в русском тоже есть разница — «дай мне чашку и налей молока» — почему тарелка в одном падеже, а молоко в другом?)

Кусочек сахару может быть, потому что это часть целого; а производство сахару быть не может, потому что производим вещество «сахар».
Ну тогда для этого нужны примеры как корректных предложений, так и ошибочных.

Вообще если был аннотированный корпус предложений с ошибками — это было бы круто. Но нет такого :(
Ну, из совсем очевидного:

1) звательный («Миш!», «Гриш!», «Господи!»);
2) локатив («о лесе» — предложный, «в лесу» — локатив);
3) партитив («кусочек сахару» — «производство сахара»; «ещё чаю!» — «нет чая»)
Вот полная таблица. Да, я думаю, непросто, но выбора нет.
Вообще-то нигде ничего на язык не завязано. Я лишь привожу примеры для разных языков. Для английского примеры просто берутся из личной практики — так удобнее. А так — все алгоритмы работают без изменений и для нашего языка.

Информация

В рейтинге
4 285-й
Откуда
Фукусима, Япония
Дата рождения
Зарегистрирован
Активность