Обновить
5

Пользователь

0,1
Рейтинг
35
Подписчики
Отправить сообщение

А как вы храните важные статьи, чтобы не потерять?

Наваял скрипт на Питоне, с помощью бесплатного ИИ-сервиса, который загружает мои статьи из Хабра на компьютер, причем, отображение максимально похожее, но, не требующее Интернета. Эти статьи я, постепенно (по мере отсутствия лени), выкладываю, затем, на свой сайт: https://lecole.free.nf/articles.php .

Жизнь заставила. Жизнь - это хороший мотиватор.

Не вижу особых противоречий. «Жизнь заставила» – хороший лом и протии «закрытого мозга» и против «больших усилий». Как в том фильме: «Жизнь захочешь – не так раскорячишься!»

Я же веду разговор больше о том, когда жизнь не «заставляет», т.е., можно учить язык, а можно не учить, а если учишь, то скорее со скуки, чем по необходимости.

А так да, знаю одну женщину, которая, в лихие 90-тые, вышла замуж за англичанина. Первое время она ревела навзрыд, не понимая, что вокруг неё говорят. С мужем, наверное, общалась жестами. Ко мне она обращалась, когда надо было перевести её письма с одного языка на другой. После замужества, она ежегодно приезжала в наш город к своим родителям и я всегда, совершенно случайно, с ней встречался, на улице. Так вот, очень быстро заметил, что она не просто научилась говорить по-английски, но и освоила его значительно лучше меня. А мне она казалась абсолютно необучаемой!

У меня же такой сильной мотивации к языкам – нет, скорее, это просто желание проявить свои программистские способности в этой области, хотя если освою, попутно, пару-тройку западноевропейских языков, то сильно сожалеть не буду :) .

Интересно… Никогда не изучал французский язык.

Французская грамматика – сложнее английской, там, порядка 90 форм спряжения и где-то 24 видо-временных форм. И то, это как считать?

восприятию на слух чтение книг не научит

Поэтому я и говорю о «триграмме»: обучающая программа (интерактив, озвучка и контроль), видео с двуязычными субтитрами и двуязычные книги с короткими смысловыми фразами и буквальным контекстным переводом. Можно использовать и «пентаграмму», добавив к нашей «троице» обучение с преподавателем / репетитором (непосредственно либо по их видео-лекциям) и контакты с носителями (онлайн / оффлайн).

Судя по вашим действиям вы большее время тратите на инженерию вокруг языка, а не на язык - это никак не помогает.

Может быть, потому, что от программирования я получаю большее удовольствие, чем от знания языка, как такового.

Видео с двойными субтитрами - наихудший способ учится воспринимать язык на слух и качать понимание, потому что мозг штука ленивая, если он видит понятный ему текст - он забудет про непонятную речь и не понятный текст, как бы вы не старались.

Сильное утверждение! Сделал кучу двуязычных видео, но не знал, что зря! :) Тем не менее, процесс и результат мне нравится. При этом, заметил, что некоторые французские школьники, в Париже, искажают произношение отдельных звуков и даже ударение. Например, в словах «Santé !» («Злоровья!») – https://my.mail.ru/mail/emmerald/video/_myvideo/15.html , и «Parfait !» («Превосходно!») – https://www.youtube.com/watch?v=eNGz-D3h1yg , ставят ударение не на последний слог, а на первый. Более того, и само первое слово они произносят неправильно (вместо [t], говорят [f]). А слова «Les filles !» («Девочки!»), могут в одном ролике произносить и правильно и неправильно. И т.д. и т.п. В общем, парижский школьный жаргон – это не вполне стандартный французский, но понять это можно только работая с двуязычными видео.

Для запоминания есть интервальное повторение (аля Anki)

Или, как альтернатива ей – моя программа «L’école» (а своё, естественно, всегда устраивает больше).

Транскрипция на начальном этапе ни к чему, забейте на это

У меня другой подход, к правилам произношения постепенно привыкаешь и в транскрипции уже меньше необходимости. Но, лично мне она не мешает, а я ведь данные делаю не только для себя.

вместо перевода нужно выписывать определение на изучаемом языке.

Эти данные у меня есть (огромная база данных загруженная из Гитхаба). Поэтому «выписывать» на бумагу ничего не надо, но можно делать набор руками в режиме «Конспект», в моей программе.

С таким аналитическим подходом Вам должен понравиться китайский язык.

Не-е-е! К азиатским культурам у меня лёгкое неприятие, которое возникло, наверное, еще в прошлой жизни.

Китайцы, ребята – себе на уме, японцы тоже, корейцы (южные) – чуть лучше, но не намного. Про КНДР – не удивлюсь, если они станут «третьими» в Союзном Государстве: РФ+РБ. Эти – надежные ребята!

Навеяло… В первом ВУЗе у нас был весьма начитанный парень. Даже обещал жениться на девушке, которая знает: «Кто такой Бернард Шоу?» (это было его пожелание к будущей невесте). Она ответила: «Какой-то английский писатель» (я был свидетелем этого разговора). И он женился на ней. Но невеста оказалась весьма своеобразной, на свадьбе сняла свою туфлю и лупила мужа прилюдно острым каблуком. Короче, это отдельная песня, речь сейчас не об этом. Так вот. Пришел этот парень в студенческую библиотеку и заказал по каталогу книгу, 1949 года, китайского писателя Го Мо Жо. Библиотекарша вынесла ему эту книгу из книгохранилища и расплакалась. Вы, говорит, один-единственный читатель, который заказал эту книгу за более чем 20 лет ее существования, здесь. И рассказала ему историю про этого самого Го Мо Жо. Приехал как-то этот великий китайский писатель в Сталинский СССР, с культурной программой. Повели его, непонятно зачем, в детский садик. Детям, строго настрого, наказали громко, хором сказать, когда увидят этого дядю: «Здравствуй, дядя Го Мо Жо!». Приезжает этот дядя в детский садик, но не один, а с женой. Про жену детям никаких указаний не давали. Ну, наши сорванцы и выдали: «Здравствуй, дядя Го Мо Жо и Го Мо Жопина тётя!» :) .

Я, эту историю, рассказываю ради её продолжения, уже во втором моём ВУЗе. В Московском университете, меня пригласили, как комсомольского активиста, на встречу с китайскими товарищами (по линии китайского посольства в Москве). Я присутствовал, пил вкусный китайский чай и ел китайские конфеты (которые, оказывается, надо было есть вместе с их оберткой, на чем я подкололся). Они меня, так вежливо, спрашивают: «Как вы относитесь к Хрущёву?». Я тогда был не слишком информирован о нём. Отвечаю: «Очень жаль, что его сняли с должности. Не дали человеку Коммунизм построить!» (Помните, его знаменитее: «Партия торжественно провозглашает, нынешнее поколение советских людей – будет жить при Коммунизме!»?). Смотрю, китайцы как-то внутренне напряглись и замкнулись. Не понравился им мой ответ. Но, по-видимому, вежливости ради, задали мне второй вопрос: «Какого китайского писателя вы знаете?». Естественно, отвечаю, «Го Мо Жо», других я и сейчас не знаю. О, их реакцию надо было видеть! У них и в Китае, как выяснилось, про него мало кто знает. Отношение ко мне сразу изменилось и стало чуть ли не дружеским… Расстались мы – как в красивом кино! :)

Т.е., я хочу сказать, китайцы не любят альтернативно мыслящих. А вот наши «зуммеры», с их знаменитым: «Есть только два мнения: моё и неправильное!», могли бы с ними найти общий язык.

Возможно тут проблема именно в математическом мышлении.

Скорее, в алгоритмическом. Самостоятельно полученная специальность программиста, повлияла на меня, по факту, больше.

Мы стараемся автоматически перевести иностранный язык на русский.

Иногда это работает. Вот мой пример буквального контекстного перевода (БКП) для французского языка:

Пример БКП (буквального контекстного перевода)
Пример БКП (буквального контекстного перевода)

Услышав фразу “hello everybody” наш мозг начинает ее анализировать “приветствую каждое туловище -> приветствую каждого -> привет всем”.

Вообще-то, вы неправильно переводите. «Everybody» это не «туловице». Вот, смотрим, в Гугл-траслэйте, в режиме «Текст», все значения этого слова:

• Все

• Каждый

• Всякий

Всё, других переводов нет! Однако, если вы разделите это слова на два: «every body», то да, одно из десятков значений будет «каждое туловище». При этом, Гугл-траслэйт, даёт и другие значения слова «body», причем, не только в значении существительного:

Переводы слова «body» как существительного

тело

корпус

кузов

организация

труп

туловище

масса

плоть

человек

основная часть

главная часть

остов

консистенция

фюзеляж

ствол

станина

юридическое лицо

крепость

стакан

лиф

корпорация

кроющая способность

ствольная коробка

корсаж

реторта

воинская часть

большое количество

главный корабль

перегонный куб

распар домны

сравнительная плотность

группа

большинство

группа людей

но и глаголов:

• воплощать

• придавать форму

Отсюда, следует, что реально переводить надо, все-таки, буквально, с учетом контекста, помня о десятках значений для каждого слова. Просто вы предлагаете вынести этот процесс на уровень подсознания, а я предпочитаю использовать метод БКП явно.

Я думаю вы неправильно изучаете язык.

Вполне могу согласиться. Если бы мне нужен был бы язык любой ценой, то штудировал бы учебники грамматики, самоучители, словари, выполнял бы упражнения, читал бы и переводил тексты, пытался бы общаться с носителями на форумах и в комментариях Ютуба. Т.е., не отвлекался бы на создание собственной обучающей программы, данных для нее, а также создания / пересоздания видео с двуязычными субтитрами и двуязычных книг, с короткими фразами и их буквальным контекстным переводом.

Последнее отнимает порядка 80% времени, поэтому язык я учу, как бы попутно (набором и проговариванием коротких озвученных фраз и отдельных слов в своей обучающей программе, в основном). По факту, это не учеба, а баловство. Зато, понял парадигму древних философов: «Цель – Ничто! Путь движения к Цели – это всё!». Поэтому, просто «двигаюсь» в том направлении, которое мне интересно. А выучу или не выучу, язык – уже не так важно. Понимаю, иногда, отдельные фразы в живой речи носителей и это меня радует.

У вас с автором статьи прямо баттл - кто больше раз свое приложение пропихнет

Не думаю, что мы конкурируем, скорее, взаимно дополняем друг друга. У него мобильное приложение, а у меня – десктопное, т.е., принципиально разные. А возможности программ – примерно одинаковые, с учетом специфики платформ.

То что у детей есть некое окно которое супер важно для изучения языка - верно

Мне, в одиннадцать лет, наяву, внутренний голос сказал: «Тебе, нужно поторопиться с усвоением информации, ибо скоро твой мозг – закроется!». Хорошо запомнил место и время этого события,

Несмотря, на то, что я был записан в четыре библиотеки города, информации мне катастрофически не хватало. Библиотекарша, в школе, советовала даже газеты читать, но, это было явно не то, что мне было нужно, тогда.

дети глупее взрослых

Не согласен! Меньше знают, да! Но, не глупее. Мне, до всего, приходилось доходить самому, так что учителя восхищались, но, если бы мне помогали в обучении и развитии, результатов у меня было бы больше.

Помогает говорить разговор, нужна практика - собеседник

Согласен. К нам в город, как-то, приехал американец, и мне нужно было помочь ему с временным жильем и с соответствующими документами. Мой примитивный «американский язык» он вполне понимал, а я его – редко. Тогда просто просил его писать текст письменно, который я знал явно лучше. Так и общались.

лучше всего прокачивается потреблением материалов на языке - подкасты, статьи, лекции и т.п. на изучаемом языке, часами, регулярно и навык прокачивается на глазах

А можно идти своим путем, набирать руками и проговаривать вслед, сотни озвучиваемых фраз, с транскрипцией и переводом, в собственной обучающей программе; смотреть собственные видео с двуязычными субтитрами, пересозданные и переведенные на базе оригинальных; читать, в моём случае, французскую грамматику на французском языке, представленную в виде коротких фраз с буквальным контекстным переводом, которую делаешь сам и вообще двуязычные книги, созданные другими, но адаптированные под себя. При желании, еще пообщаться на зарубежных форумах, оставляя дружелюбные комментарии носителям и носительницам, на которые они, нередко, реагируют, если не с европейцами, то с франкоговорящими африканцами. И т.д. и т.п. А то, что, при этом, много времени уходит на техническую сторону вопроса, то это хорошо по своему, поскольку и в программировании мне есть чем заняться.

если бы вы слушали с постепенным увеличением нагрузки, то давно бы научились воспринимать “быструю речь на слух”

Возможно, но, похоже, в большем приоритете у меня разработка системы обучения языку (на что уходит много времени), чем собственно его изучение. А существующие методы мне не слишком нравятся, вот и приходится изобретать собственный «велосипед», который, может быть, не нравится другим, зато нравится мне.

что реально помогло понимать/говорить это регулярно - наушники в уши слушать и при возможности повторять вслух в приложении, которому уже 14 лет

У меня это тоже есть::

Простые озвученные фразы на английском языке, с переводами
Простые озвученные фразы на английском языке, с переводами

Просто, я наушники не люблю, комфортнее воспринимать звук из настольных динамиков. Слушаем озвучку фразы (у меня в программе демо-данные на четырех языках), набираем её руками, для лучшего запоминания, делаем навигацию по данных, устанавливае нужный фильтр для отбора данных. Если нет желания набирать текст, просто жмём любую клавишу навигации. Это я говорю про режим «Конспект». В режиме «Видео» можно просто отображать текст и озвучку, с выбранными параметрами повторов и задержки, без работы с клавиатурой. А в режиме «Экзамен» делаем проверку запомненных слов и фраз со статистикой:

Проверка оригиналов запомненных слов, с озвучкой. Если не знаем правильный ответ – просим подсказку
Проверка оригиналов запомненных слов, с озвучкой. Если не знаем правильный ответ – просим подсказку
Проверка переводов запомненных слов, с озвучкой. Если не знаем правильный ответ – просим подсказку
Проверка переводов запомненных слов, с озвучкой. Если не знаем правильный ответ – просим подсказку

В итоге, мы можем интерактивно набирать, слушать и проговаривать фразы (в режиме «Конспект»), хотя бы по сто фраз в день. И одно это уже дает эффект. Иначе говоря, полностью покрывает возможности вашей программы, только десктопной, а не мобильной.

Если взрослый человек не заговорил на иностранном языке, этому есть только одна причина - ему не нужно.

Вы правы, лично мне говорить «не нужно». Нужно, просто понимать естественную устную и письменную речь. Возможно, еще больше нужно обернуть процесс изучения в оригинальную технологическую обёртку. С последним, особых проблем нет.

Кстати, а вас есть, сем похвастаться?

Когда я понял, что главная проблема большинства людей — не отсутствие способностей, а недостаток регулярного контакта с языком, я стал смотреть на изучение языков совершенно иначе.

Неправильно, вы всё поняли! «Главная проблема большинства людей» – возраст, а не «недостаток регулярного контакта с языком». Дети имеют преимущество в силу возраста, их мозг заточен на обучение и самообучение – по максимуму. У взрослых, мозг для новых языков уже «закрыт», по крайней мере, им нужно на порядок больше времени и усилий для его изучения, если, конечно, до этого, изучение иностранных языков не было вашей основной профессией, как у полиглотов.

Я это хорошо вижу по себе. Два высших образование плюс работа в НИИ, причем, второе – дневное, пятилетнее, на мехмате МГУ, по специальности «математика». Самостоятельно освоил программирование (в силу развала СССР, в результате чего, наука перестала быть востребованной, к которой я себя готовил). Написал и внедрил учетную систему для производственного предприятия, что и кормило меня более двадцати лет, пока мою любимую фирму не закрыли по политическим мотивам.

Сейчас, вот, на «вольных хлебах», «свободный художник», И, чтобы не скучать, занимаюсь изучением иностранных языков, в основном французского, уже много лет. Поэтому, времени на освоение языка уделяю – более, чем достаточно, иногда, по несколько часов в день.

Что я могу сказать?

Оказывается, проще написать собственную обучающую программу ( https://lecole.free.nf/Prg/Lecole.php ), создать или пересоздать кучу видео с двуязычными субтитрами ( https://my.mail.ru/mail/emmerald/video/_myvideo и др. мои каналы), делать двуязычную книгу для французской грамматики на французском языке, «всего», на полторы тысячи страниц (то, чем занимаюсь сейчас), чем выучить, как дети, сам язык непосредственно.

А вы говорите «регулярный контакт». Куда уж, регулярней?

Иностранные языки, я, конечно, воспринимаю, в том числе новые. Но, словарный запас и способность воспринимать быструю речь на слух – оставляет желать лучшего. В программировании, у меня, успехи явно больше, даже для новых для меня «языков».

В итоге вывод. Как говорил обергруппенфюрер Мюллер, штандартенфюреру Штирлицу: «Верить – никому нельзя! Мне – можно!» :) .

Гугл транслейт очень слабенький переводчик. Любая модель на самом дешевом тарифе порвет его как тузик грелку. При чем в том же Codex за 20 баксов можно делать это автоматически.

По крайней мере, я вижу прогресс в переводе, за последние пару лет, что меня вполне устраивает. Платить, пока, потребности нет. Мне более интересно получать максимум результата из минимума возможностей.

задача перевода учебника совсем нетривиальна, ибо нужно думать, что переводить, а что нет

Совершенно согласен! Плюс проблема представления двуязычного текста, например, для таблиц. Также, под вопросом перевод грамматических терминов. Оставлять в русском переводе французский текст, неинтересно, а общепринятого перевода терминов может и не быть либо они могут быть разными в разных источниках. ИИ дает свой вариант переводов терминов, но доверять ему полностью тоже нельзя.

Мне вот , кстати, интересно как сработает мой движок на франзузском. Можете дать десяток фраз, я сделаю разбор с переводом по блокам, правда с разбегу (для качественного анализа нужны те самые пресловутые учебники, лексические таггеры). Но для уровня А1/А2 в целом ИИ справляется и без подпорок.

Очень интересные и неожиданные находки появляются. например что немецкий и славянские языки достаточно близки по строению.

Думаю, удобно взять для анализа небольшой глобалистский документ: «Manifeste de Prague» (Пражский манифест движения за международный язык эсперанто):

Французско-русский вариант – https://bilinguator.com/ru/online?book=2901 . или Французско-немецкий вариант – https://bilinguator.com/en/online?book=2873 .

Возьмите столько фраз, сколько вам нужно и на любом языке.

Пресловутые последние несколько % ломали все.

Матчинг окончаний между русским и словацким.

На самом деле, у вас сложная задача, требующая обработки огромного количества данных, правил и исключений. При этом всегда будет иметь ненулевую неопределённость.

У меня похожая проблема. Если в моей обучающей программе изучать западноевропейский язык русскими – то, это относительно просто, а если наоборот, то, на порядок сложнее. И я до сих пор думаю, нужно ли мне реализовывать, во второй версии, возможность изучения русского языка западными европейцами?

Сам бы я не пошел вашим путём, ибо сильно муторно. Мне проще учить славянский язык, если потребуется, как в грузинской школе: «Дэти, запомныте! Тарелька и вилька пишется без мягкий знак, а сол и фасол - с мягкий знак!». Или, как в анекдоте: «У вас есть воды? – Не «воды», а «вода»! – Ну, налей мне стакан вода! – Не «вода», а «воды»! – Вы, здесь, грамматиком торгуете или водом?»

То бишь, учил бы конкретные пары фраз: оригинал / перевод и наоборот. А там, где нет шаблона, будет что-то типа: «девчик», «совсем одын» и т.п. Ну, не только же мы должны смеяться с «них», пусть и «они» посмеются с нас :) .

Но чтобы системно провести человека от нуля до С1, это легче сделать классическими учебниками, дополненными самостоятельной работой.

Да, особенно, если этому «человеку» лет, сильно меньше двадцати. Когда тебе уже под «сраку лет» и выше, то никто тебя «вести» не будет, если ты, конечно, не Константин Устинович Черненко, которому, уже, будучи секретарем обкома КПСС и обучающемуся, заочно, в учительском институте, звонит профессор и спрашивает: «Константин Устинович, не могу ли я приехать к вам в обком, чтобы поставить вам зачет? – Нет, мне сегодня некогда, приезжайте завтра!».

На самом деле, в зрелом возрасте, это метода не работает. Да, по факту, начиная изучать новый язык, есть смысл ознакомиться с его грамматикой. Тут «классика» почти «рулит». Но, чтобы она работала еще лучше, берем, в моем случае, французскую грамматику, на французском языке, «всего», на полторы тысячи страниц и делаем из нее двуязычную книгу с короткими фразами и соответствующим им переводами, без «отсебятины» и литературных изысков. Только БКП (буквальный контекстный перевод), только хардкор!

В результате мы выигрываем дважды: осваиваем язык, как таковой (по форме) и изучаем его содержание. Тем более, что грамматика от носителей, как ни странно, проще, чем излагаемая у нас. Просто, мы любим очень формализованное и компактное изложение, а они склоны к большему литературному «словоблудию», что, впрочем, в данном случае, не минус, а плюс, поскольку, большее количество материала легче переходит в новое качество его понимания.

То, что созданием подобной двуязычной книги занимаюсь я сам, то это можно воспринимать как упражнения, тем более, что классические упражнения, как в наших, так и в «ихних» учебниках, я не люблю. А этот процесс, мне более-менее, нравится. Особенно, если удается как-то привлечь сюда средства автоматизации. Однако, я бы не отказался почитать подобный двуязычный учебник, созданный другими. То ли я освою одну книгу, сделанную самим, толи несколько, сделанные другими.

Далее, опять же опытным путем получено, что вместо: «Самоучитель + Аудио» лучше использовать «Самоучитель + Видео», которые, естественно, никто делать не хочет. /Я, здесь, уже давал ссылки, на уроки, которые хотел бы видеть. Вот, образец моего первого урока (видео+pdf), для французского языка:

• 001-ФранцузскийАлфавит.mp4 : https://disk.yandex.ru/i/G4pJZ__AKhtHsw ,

• 001-ФранцузскийАлфавит.pdf : https://disk.yandex.ru/i/DwEX79lOXZlJyw .

Если бы кто-то сделал лучше, то я был бы только рад.

Ну и третий компонент в моей триграмме (программа + видео + книги) уже описывался, здесь, тоже. Это облучающая программа «L’école». Она создана, прежде всего, для моих целей и следующую её версию я собираюсь делать по себя тоже.

Так что классика классикой, но без собственных идей язык не выучишь.

Вот тот же “chel by som” переведется не пословно “хотел бы я” , а “я бы хотел” .

Ну, для меня инверсия, в пределах фразы-сегмента, допустима. В конце концов, слова тоже учить надо, чтобы понять это. А запоминать непосредственно слова (как и фразы) удобно в обучающей программе. Я ведь смотрю на язык, как минимум, с трех точек зрения: программа, видео, книги.

После кучи итераций нашел интересный механизм, который лег в основу движка , который делает сегментацию.

Подход, конечно, впечатляет. Похоже, с абстрактным мышлением, как и с математическим, у вас всё нормально. Не удивлюсь, если вы учитесь или закончили университетский мехмат.

Однако, я не сторонник сложных решений, без крайней необходимости. К счастью, западноевропейские языки не имеют той сложной системы окончаний, как в русском и языках на его основе (в котором вы подозреваете немецкий, а некоторые утверждают, что и шведский, хотя, Александр Драгункин идет еще дальше и считает мировым праязыком – исключительно русский: «В начале было слово – русское!»). Поэтому применять ваш алгоритм к «жестким» языкам (то бишь, западноевропейским) нет никакой нужды. А для работы с «гибкими» языками, вроде славянских, с которыми вы имеете дело, ваш подход, думаю, очень эффективен. По крайней мере, тянет, если не на патент, то на монетизацию. Только я бы, на вашем месте, не ограничивался бы одними картинками. Думаю, вам нужна своя собственная обучающая программа.

Я же собираюсь идти своим путем. Делать сегментацию оригинального текста, в принципе, не проблема. Перевод сегментов в Гугл-траслэйте (в режиме «текст»), процентов на 80 – меня устраивает. Толька там ограничение на 5000 символов. Целиком документы (в формате: docx, xlsx, pdf, до 10 Мб) можно переводить в том же в Гугл-траслэйте, в режиме «документ». Затем нужно просто сравнить оба варианта переводов и выбрать более подходящий. Для большей точности можно задействовать электронный словарь, типа, «Lingvo x6 Professional», с помощью которого я даже находил ошибки во французской грамматике на французском языке.

Но, даже ограничиваясь грубым сравнением переводов сегментов и их полных предложений, для выбора подходящих вариантов, можно получать приемлемый результат. Да, будут локальные ошибки и шероховатости, но, за счет массовости, их роль будет снижаться, пока, не возникнет, ощущение, что иностранные тексты можно читать непосредственно, без использования «костылей».

Еще проще вариант – взять готовые двуязычные книги, которые сопоставлены по абзацам. Установить прямое соответствие, с помощью скриптов, на уровне отдельных предложений и работать с ними. Да, БКП там не будет, но, опять же, за счет массовости просматриваемого текста – эффект от их чтения возникнет. Как говориться: «Дешево и сердито!». Это почти тот же «метод Ильи Франка», только «вид сбоку» :) .

Ваша же задача, таблица спряжений , если я ее правильно понимаю, решается морфологическими таггерами. Можно с ИИ можно без.

Получить все формы спряжений для 7000 французских глаголов, вообще не проблема. Смотрим, какой номер шаблона для каждого глагола (на базе соответствующего списка из Гитхаба) и по нему генерим все 90 форм спряжения. В итоге, получаем полную таблицу соответствий, в которой, потом, находим нужное значение простым поиском.

Однако, эта задача, скорее, академическая, чем реальная. Меня, конкретно интересует разбивка французских предложений на короткие смысловые фразы и их «Буквальный Контекстный Перевод» на русский язык (см. «Пример двуязычного текста» с «Пражским Манифестом» в https://habr.com/ru/articles/1061612/#comment_30292236 ).

При этом, первая часть алгоритма, собственно, сегментация иностранного текста – достаточно простая. В пределах предложения, разделяем слова по знакам пунктуации (точка с запятой, двоеточие, разделительное тире, запятая, кавычки) и по словам разделителям, типа, русских «и», «но», «поэтому», «так что», «где» и т.д. и т.п.

В целом, получается неплохо, а некоторые шероховатости, вроде вставки разделителей строк, после номеров с точкой или аббревиатур, подобных: «M.», «Mme.», «Mlle…», «etc.» и т.п., можно решать либо усложнением кода скрипта на Питоне либо ручной правкой.

С переводом, чуть сложнее. Его нужно делать дважды: для всего предложения и для группы сегментов, так чтобы, в конечном счете, было минимум «отсебятины» и ненужной литературности. Тут бы и развернуться ИИ, Если ограничится только Гугл-транслэйтом, то без ручной правки обойтись будет трудно. Хотя, нет худа, без добра, вынужден лучше вникать во все нюансы, что только на пользу.

Собственно вот у меня таким занимается вариатор, когда из 1 фразы делает несколько , отвечая на вопросы (а вот если тут был бы другой род/число/падеж …, как бы изменилась фраза) .

Пока у меня задача проще, разбить оригинальный текст на короткие смысловые фразы и дать их буквальный контекстный перевод. «Вариация» нужна для активного применения языка, а у меня такая задача не стоит, мне нужно, как я говорил, только понимать устную и письменную речь

Сегментация есть у меня) Собственно это основа всего процесса. Правда на уровне фразы.

изменение одной части тянет за собой изменение другой (род тянет окончание, меняем род, меняется окончание)

Ну, это примерно то, что мне нужно. Только ваш результат, в изложенном виде, – не воспроизводимый.

Например, рассмотрим такую задачу:

Дать таблицу спряжений для всех французских глаголов. Их, в современном, французском языке, порядка семи тысяч. Каждый их них имеет, примерно, 90 форм спряжения. Как их все получить?

Оказывается, что эти, под миллион, данные можно описать с помощью, всего, ста пятидесяти шаблонов (которые можно найти на Гитхабе). Далее, дело программистской техники.

Но, в данном случае меня интересует алгоритм попроще (для французских фраз). Вторая часть алгоритма – установка соответствия русского перевода для всего предложения французским фразам сегментов требует большей ручной работы.

В итоге, я хочу иметь примерно такое представление:

Примет двуязычного текста

Manifeste de Prague Пражский манифест (движения за международный язык эсперанто)

Nous, Мы,

membres du mouvement mondial участники всемирного движения

pour la promotion de la langue internationale Espéranto, за продвижение международного языка эсперанто,

adressons ce manifeste обращаем этот манифест

à tous les gouvernements, ко всем правительствам,

à toutes les organisations internationales et ко всем международным организациям и

à tous les hommes de bonne volonté, ко всем людям доброй воли,

déclarons notre inébranlable attachement заявляем о нашей непоколебимой приверженности

aux objectifs définis ci-dessous, целям, определенным ниже,

et invitons chaque organisation et и приглашаем каждую организацию и

chaque individu каждого человека

à se joindre присоединиться

à nos efforts к нашим усилиям

dans ce sens. в этом направлении.

Lancé en 1887 Созданный в 1887 году,

comme projet de langue auxiliaire как проект вспомогательного языка

pour la communication internationale, для международного общения,

l’Espéranto s’est rapidement développé эсперанто быстро развился

pour devenir une langue vivante, и стал живым языком,

riche en nuances. богатым нюансами.

Depuis plus d’un siècle, На протяжении более века

l’Espéranto fonctionne et эсперанто функционирует и

rapproche des hommes объединяет людей,

par delà les barrières linguistiques et преодолевая языковые и

culturelles. культурные барьеры.

Entre-temps, За это время,

les objectifs de ses utilisateurs цели его сторонников

n’ont rien perdu de leur importance не утратили ни своей важности,

ni de leur actualité. ни своей актуальности.

Ni l’utilisation Ни использование

au niveau mondial на глобальном уровне

de quelques langues nationales, нескольких национальных языков,

ni les avancées ни достижения

en matière в области

de techniques de communication, коммуникационных технологий,

ni même l’invention ни даже изобретение

de nouvelles methods новых методов

d’enseignement des langues обучения языкам

ne permettront de concrétiser не позволят реализовать

les principes suivants, следующие принципы,

que nous considérons comme essentiels которые мы считаем существенными

dans un ordre linguistique для языкового порядка,

juste et efficace. справедливого и эффективного.

  1. Democratie 1. Демократичность

Un système de communication qui Система общения, которая

privilégie toujours всегда предоставляет привилегии

certains citoyens, определенным гражданам,

mais exige d’autres но требует от других

qu’ils consentent des années d’effort годы усилий

pour atteindre un degré moindre de compétence, для достижения меньшей степени компетентности,

est fondamentalement antidémocratique. является принципиально недемократичной.

Bien que l’Espéranto, Хотя эсперанто,

comme toute langue, как и любой язык,

ne soit pas parfait, несовершенен,

il dépasse de loin tous ses rivaux он намного превосходит всех своих конкурентов

comme moyen de communication égalitaire как эгалитарное средство общения

à l’échelle mondiale. в международном масштабе.

1
23 ...

Информация

В рейтинге
4 173-й
Зарегистрирован
Активность