Да и с арабским та же тема: указанное طماطم таматим хоть и используется в большинстве арабских стран, но в восточном Средиземноморье говорят بندورة бандура (т.е слегка искажённое pomodoro), а в Марокко طوماطيش туматиш (т.е слегка искажённое tomates) или проще ماطيشة матиша
Здесь не лишним было бы указать произношение (тадж. гуҷа фарангӣ, хотя таджики предпочитают русизм помидор), потому что вторая часть фарангӣ буквально значит "французский" и отлично дополняет рассказ про распространение романского pomidoro по Европе и Средней Азии =) Позднее значение фарангӣ расширилось на всех европейцев (но не на всех иноземцев!)
Красивая деталь: родина кофе — Эфиопия — использует не заимствование, а своё слово ቡና (буна). Мир пьёт «арабское» (слово) кофе, а страна происхождения растения зовёт его по-своему — типичная картина, когда торговый термин вытесняет местный лишь за пределами родины.
Ещё более красивая деталь в том, что эфиопское название кофе тоже заимствовано из арабского: словом بنّ бунн по-арабски называются кофейный куст и его зёрна, но не готовый напиток. Центр кофейной торговли всегда был в Аравии; и получается, что поставщики зёрен арабам заимствовали арабское название сырья, а покупатели зёрен у арабов заимствовали арабское название готового напитка =)
Мачка с кочкой не связаны напрямую; мачка -- локальное славянское изобретение (заимствованное и некоторыми соседями), предположительно звукоподражательное (ср. каз. мысық, кырг. мышык, узб. мушук -- возникшие заведомо независимо от европейских названий)
При этом срби пишу на српском језику, и чередование подчёркнутых согласных (соответствующее фонетике!) их напрягает гораздо меньше, чем русских младшеклассников -- мудрёные правила написания русских корней с чередованиями.
Кроме случаев, когда они читаются наоборот (facade и Caesar c [s], soccer и Celtic с [k]), или когда C обозначает не [k] и не [s], а например [ʃ] (ancient, social, vicious) или [tʃ] (cello, cappuccino, ciabatta).
Ну и хотя это "частичное правило" помогает читать написанное -- писать на слух оно не помогает, потому что [k] может обозначаться как C, K, CC, CK, CH, QU и т.д; например, [tʃek] может писаться хоть check, хоть cheque, хоть Czech.
So while it feels redundant, it actually signals pronunciation patterns and helps preserve word relationships. <...> If we respelled everything phonetically, those connections would get messier.
И что полезного в том, что в читающихся по-разному родственных словах (как electric и electricity) пишется одна и та же буква, зато в одинаково читающихся родственных словах (как revoke и revocation или traffic и trafficking) приходится писать разные буквы из-за меняющегося окружения?
И приспособлена она как ни странно именно потому что приспособлена: на каждый звук в языке есть своя отдельная буква.
Ага, легко разгибать его загадки (все пять букв Г произносятся по-разному). Домашнее задание: найдите примеры с шестым произношением этой же буквы.
Кроме массы уже приведённых примеров -- например, что для большинства мягких согласных в русском алфавите нет своих отдельных букв -- попытайтесь объяснить, почему одно и то же "в тесте" произносится с твёрдым Т, когда это ошибка в тесте, и с мягким Т, когда это сосиска в тесте. Почему так? Где хоть какая-то логика?
мало того, что не имеют ничего общего с очень похожими обычными гласными, так ещё и по-разному читаются в зависимости от окружения. Ząb - почти заб, но хрен там - зОМб. Sprzątać- почти спшатач, но опять же хрен там - спшОНтач. Почему так? Где хоть какая-то логика?
Вы всерьёз спрашиваете, почему визуально похожие буквы обозначают совсем разные звуки? Это так же несерьёзно, как "enjoy -- почти эниой, но какого хрена хвостик под i так резко меняет произношение? Где хоть какая-то логика?"
Или вопрос про ассимиляцию при произношении? Русские правила ассимиляции намного сложнее, я их выше перечислял (одна и та же приставка с- шестью разными способами произносится в словах спал, стёк, сдал, сделал, сжёг, сшил) -- но вы ведь о них даже не задумываетесь.
Но очевидно, что система записи "один звук - одна буква" гораздо удобнее. Польская латиница кроме кучи диграфов для согласных
При вашей-то неприязни к диграфам -- вам нисколько не претит, что русские пары букв БЬ, ВЬ, ДЬ и т.д по алфавиту -- обозначают по одному согласному звуку каждый? Чем отвергаемые вами сербские диграфы LJ и NJ хуже равнозначных русских ЛЬ и НЬ?
Мы говорим о разных вещах. Вы перешли от фонетики (2 варианта озвучки йотированных согласных, смягчение предыдущих согласных следующими гласными и т.п.), чьи правила существуют и элементарно формулируются, к орфографии в общем.
Вам мерещится, что "смягчение предыдущих согласных следующими гласными" -- это правило фонетики, а не орфографии, именно потому, что русская орфография это смягчение обозначает выбором гласных букв, а не согласных. (Противоположный подход принят, например, в сербской кириллице, где смягчение обозначается выбором согласной буквы, а гласная остаётся неизменной: угла, углу vs. угља, угљу "угля, углю").
В английском же правил фонетики нет. Одни и те же последовательности букв могут давать разные звуки, а одни и те же звуки могут записываться разными последовательностями букв.
Так и есть -- в точности как и в русском. И в точности так же, как вы в упор не видите такие места в русской орфографии, но отлично видите в английской -- так и англичанину кажется, что разные произношения одинаковых последовательностей английских букв -- это "правила фонетики, которые существуют и элементарно формулируются" (притом что сформулировать их он, конечно, не сможет), зато он отлично видит такое в русской орфографии.
И почему так - никакой англичанин не скажет. Нет объяснения кроме патамушта.
Можно подумать, у вас есть лучшее объяснение "особенностям" русской орфографии, чем "правила вполне можно сформулировать, но делать этого я не буду".
И да, сербская латиница - это и диграфы и диакритика.
К диакритике-то у вас какие претензии? И распространяются ли они на русские Ё и Й, или только на латиницу?
Уверяю, что англичанин будет точно так же, как и вы про русскую кириллицу, рассказывать, что всё подчинено простым и понятным правилам, которые он, правда, сформулировать не сможет - как и вы вряд ли сможете сформулировать русские. Толщину розенталевского свода правил русской орфографии видели?
Но я ведь предлагаю в качестве примера, к которому стоит стремиться, вовсе не английскую латиницу, а сербскую.
Кроме одного лишь корейского, все алфавиты в мире -- чужие, и создавались для нужд одних языков, а потом приделывались к другим. И русский алфавит -- не исключение.
Кириллица прекрасно приспособлена к фонетике русского языка.
Русская кириллица была приспособлена к той фонетике, которая была тысячу лет назад; а к нынешней не приспособлена вообще -- но вы настолько привыкли к расхождениям между написанием и произношением, что не замечаете их в упор. Так же и англичанам их орфография кажется понятной и естественной, хотя изучающим английский как иностранный выносит мозг по полной программе.
буква Ъ обозначает [j], ровно как и Й;
буквы Е, Ё, Ю, Я в зависимости от положения обозначают либо [e, o, u, a] либо [je, jo, ju, ja]; в первом случае те же звуки обозначаются ещё и буквами Э, О, У, А;
буквы И, Е, Ё, Ь, Ю, Я после некоторых согласных меняют его произношение, после других (Ж, Й, Ц, Ч, Ш, Щ) -- не меняют произношение, а пишутся вместо Ы, Э, О, ∅, У, А по изощрённым правилам, которыми школьниками дрючат несколько лет;
как выше упомянул @MainEditor0, сочетания ЖЧ, ЗЧ, СЧ все одинаково читаются как Щ; кроме того, ЗШ, СШ одинаково читаются как ШШ, а ЗЖ, СЖ -- как ЖЖ;
кроме этой ассимиляции свистящих, на письме также не отражаются ассимиляция по мягкости и по звонкости (сделай [z'd'elaj), конечное оглушение (съезд [sjest]), выпадение согласных во стечениях и редукция безударных гласных (поздно [pozna]);
ну и наконец, есть "исторически сложившиеся написания" -его, -ого для [-iva, -ivo, -ava, -avo, -ova] и -тся, -ться для [-tsa], которые не следуют никаким более общим правилам.
У нас перед глазами есть примеры славянских языков с латинской письменностью, в которых черт ногу сломит. Например, польского с д графами и диакритикой.
Потому что польская орфография почти такая же древняя и консервативная, как и русская. Комментаторы ниже справедливо предложили вместо поляков смотреть на сербов: их орфографии меньше двух веков, и она идеально соответствует фонетике -- всё как слышится, так и пишется.
Так что разница между диграфами, лигатурами (вроде сербских Љ и Њ) и монографами субъективна: границы между ними можно провести где угодно, по вкусу проводящего.
Потому что это утверждение можно понимать либо "когда-то читалось так, как пишется сейчас" (например, knight как [книхт]), либо "когда-то читалось так, как писалось тогда же" (например, dett вместо нынешнего debt). Для некоторых слов верно первое, для некоторых -- второе, для остальных (например queue из первого абзаца поста) -- ни то ни другое
Но про все (?) языки можно сказать, что когда-то читалось так, как пишется.
Нет, даже про английский нельзя, о чём в посте упомянуто:
ученые добавляли буквы в некоторые слова, чтобы подчеркнуть их латинские корни (иногда ошибочно), даже если их там никогда не было. Так у слова “debt” появилась silent letter “b” (на радость нам) от латинского “debitum”.
Так, в слове debt буква b не произносилась вообще никогда: её стали писать "просто чтоб было".
"Подчеркнуть латинские корни" -- это лишь одна из мотиваций искусственно отдалять написание от произношения. Бывает, что для омофонов искусственно вводят различающиеся написания: так, в слове whole никогда не произносилась буква w -- её стали писать для отличия от hole. Бывает, что причины чисто графические: так, слово woman никогда не произносилось через [o], но в написании wuman получался "забор из палочек" wum-, так что для удобства чтения гласную стали писать другую. Бывает, что на написание слова повлияла иностранная орфография: так, слово ghost никогда не произносилось с описанным в посте звуком gh, а букву h в написание добавили под влиянием голландского gheest, в котором h означала несмягчение g перед ee. (Из современной голландской орфографии её удалили, и пишут geest; но в английском написании "бессмысленно заимствованная буква" так и осталась.)
Потому что слово бог заимствовано из церковнославянского, где правила произношения отличались от русских. Есть много пар рус-цсл когнатов, слегка различающихся по произношению и по смыслу: нёбо-небо, рожать-рождать, своротить-совратить и т.д
В соединении латинской приставки с германским корнем вы так же не находите ничего необычного, как и в превращении -марк- в -мерик- с заменой всех гласных?
А может, и Марокко названо в честь германской "марки"? Там и то больше гласных совпадает, чем в Америке.
Вероятно, тот, к кому араб так обращался, был европейцем?
Да и с арабским та же тема: указанное طماطم таматим хоть и используется в большинстве арабских стран, но в восточном Средиземноморье говорят بندورة бандура (т.е слегка искажённое pomodoro), а в Марокко طوماطيش туматиш (т.е слегка искажённое tomates) или проще ماطيشة матиша
Здесь не лишним было бы указать произношение (тадж. гуҷа фарангӣ, хотя таджики предпочитают русизм помидор), потому что вторая часть фарангӣ буквально значит "французский" и отлично дополняет рассказ про распространение романского pomidoro по Европе и Средней Азии =) Позднее значение фарангӣ расширилось на всех европейцев (но не на всех иноземцев!)
Ещё более красивая деталь в том, что эфиопское название кофе тоже заимствовано из арабского: словом بنّ бунн по-арабски называются кофейный куст и его зёрна, но не готовый напиток. Центр кофейной торговли всегда был в Аравии; и получается, что поставщики зёрен арабам заимствовали арабское название сырья, а покупатели зёрен у арабов заимствовали арабское название готового напитка =)
Дополню, что по-албански в Албании говорят domate, зато в Косове patëllxhan, хотя язык формально общий =)
Мачка с кочкой не связаны напрямую; мачка -- локальное славянское изобретение (заимствованное и некоторыми соседями), предположительно звукоподражательное (ср. каз. мысық, кырг. мышык, узб. мушук -- возникшие заведомо независимо от европейских названий)
Что в русской, что в английской орфографии есть уйма исключений из этого принципа (английские примеры см. выше, русские -- например https://gramota.ru/uchebnik/pravila/korni-s-cheredovaniem-glasnykh-vybor-kotorykh-zavisit-ot-sleduyushchikh-za-nimi-soglasnykh). Исключений что там что там -- в сумме достаточно, чтобы полагаться на этот принцип не было возможным.
При этом срби пишу на српском језику, и чередование подчёркнутых согласных (соответствующее фонетике!) их напрягает гораздо меньше, чем русских младшеклассников -- мудрёные правила написания русских корней с чередованиями.
Кроме случаев, когда они читаются наоборот (facade и Caesar c [s], soccer и Celtic с [k]), или когда C обозначает не [k] и не [s], а например [ʃ] (ancient, social, vicious) или [tʃ] (cello, cappuccino, ciabatta).
Ну и хотя это "частичное правило" помогает читать написанное -- писать на слух оно не помогает, потому что [k] может обозначаться как C, K, CC, CK, CH, QU и т.д; например, [tʃek] может писаться хоть check, хоть cheque, хоть Czech.
И что полезного в том, что в читающихся по-разному родственных словах (как electric и electricity) пишется одна и та же буква, зато в одинаково читающихся родственных словах (как revoke и revocation или traffic и trafficking) приходится писать разные буквы из-за меняющегося окружения?
Ага, легко разгибать его загадки (все пять букв Г произносятся по-разному). Домашнее задание: найдите примеры с шестым произношением этой же буквы.
Кроме массы уже приведённых примеров -- например, что для большинства мягких согласных в русском алфавите нет своих отдельных букв -- попытайтесь объяснить, почему одно и то же "в тесте" произносится с твёрдым Т, когда это ошибка в тесте, и с мягким Т, когда это сосиска в тесте. Почему так? Где хоть какая-то логика?
Вы всерьёз спрашиваете, почему визуально похожие буквы обозначают совсем разные звуки? Это так же несерьёзно, как "enjoy -- почти эниой, но какого хрена хвостик под i так резко меняет произношение? Где хоть какая-то логика?"
Или вопрос про ассимиляцию при произношении? Русские правила ассимиляции намного сложнее, я их выше перечислял (одна и та же приставка с- шестью разными способами произносится в словах спал, стёк, сдал, сделал, сжёг, сшил) -- но вы ведь о них даже не задумываетесь.
При вашей-то неприязни к диграфам -- вам нисколько не претит, что русские пары букв БЬ, ВЬ, ДЬ и т.д по алфавиту -- обозначают по одному согласному звуку каждый? Чем отвергаемые вами сербские диграфы LJ и NJ хуже равнозначных русских ЛЬ и НЬ?
Вам мерещится, что "смягчение предыдущих согласных следующими гласными" -- это правило фонетики, а не орфографии, именно потому, что русская орфография это смягчение обозначает выбором гласных букв, а не согласных. (Противоположный подход принят, например, в сербской кириллице, где смягчение обозначается выбором согласной буквы, а гласная остаётся неизменной: угла, углу vs. угља, угљу "угля, углю").
Так и есть -- в точности как и в русском. И в точности так же, как вы в упор не видите такие места в русской орфографии, но отлично видите в английской -- так и англичанину кажется, что разные произношения одинаковых последовательностей английских букв -- это "правила фонетики, которые существуют и элементарно формулируются" (притом что сформулировать их он, конечно, не сможет), зато он отлично видит такое в русской орфографии.
Можно подумать, у вас есть лучшее объяснение "особенностям" русской орфографии, чем "правила вполне можно сформулировать, но делать этого я не буду".
К диакритике-то у вас какие претензии? И распространяются ли они на русские Ё и Й, или только на латиницу?
Уверяю, что англичанин будет точно так же, как и вы про русскую кириллицу, рассказывать, что всё подчинено простым и понятным правилам, которые он, правда, сформулировать не сможет - как и вы вряд ли сможете сформулировать русские. Толщину розенталевского свода правил русской орфографии видели?
Но я ведь предлагаю в качестве примера, к которому стоит стремиться, вовсе не английскую латиницу, а сербскую.
Кроме одного лишь корейского, все алфавиты в мире -- чужие, и создавались для нужд одних языков, а потом приделывались к другим. И русский алфавит -- не исключение.
Русская кириллица была приспособлена к той фонетике, которая была тысячу лет назад; а к нынешней не приспособлена вообще -- но вы настолько привыкли к расхождениям между написанием и произношением, что не замечаете их в упор. Так же и англичанам их орфография кажется понятной и естественной, хотя изучающим английский как иностранный выносит мозг по полной программе.
буква Ъ обозначает [j], ровно как и Й;
буквы Е, Ё, Ю, Я в зависимости от положения обозначают либо [e, o, u, a] либо [je, jo, ju, ja]; в первом случае те же звуки обозначаются ещё и буквами Э, О, У, А;
буквы И, Е, Ё, Ь, Ю, Я после некоторых согласных меняют его произношение, после других (Ж, Й, Ц, Ч, Ш, Щ) -- не меняют произношение, а пишутся вместо Ы, Э, О, ∅, У, А по изощрённым правилам, которыми школьниками дрючат несколько лет;
как выше упомянул @MainEditor0, сочетания ЖЧ, ЗЧ, СЧ все одинаково читаются как Щ; кроме того, ЗШ, СШ одинаково читаются как ШШ, а ЗЖ, СЖ -- как ЖЖ;
кроме этой ассимиляции свистящих, на письме также не отражаются ассимиляция по мягкости и по звонкости (сделай [z'd'elaj), конечное оглушение (съезд [sjest]), выпадение согласных во стечениях и редукция безударных гласных (поздно [pozna]);
ну и наконец, есть "исторически сложившиеся написания" -его, -ого для [-iva, -ivo, -ava, -avo, -ova] и -тся, -ться для [-tsa], которые не следуют никаким более общим правилам.
Потому что польская орфография почти такая же древняя и консервативная, как и русская. Комментаторы ниже справедливо предложили вместо поляков смотреть на сербов: их орфографии меньше двух веков, и она идеально соответствует фонетике -- всё как слышится, так и пишется.
В русской кириллице как минимум три диграфа (Щ, Ы, Ю), которые за века употребления стали писаться безотрывно, а потом и печататься одной литерой. В юникоде предостаточно латинских диграфов единым code point: https://en.wikipedia.org/wiki/List_of_precomposed_Latin_characters_in_Unicode#Digraphs_and_ligatures -- любой из них можно считать полноценной отдельной буквой.
Так что разница между диграфами, лигатурами (вроде сербских Љ и Њ) и монографами субъективна: границы между ними можно провести где угодно, по вкусу проводящего.
70 языков перевели на латиницу, и ещё 4 задумывали перевести, но не успели: https://en.wikipedia.org/wiki/Latinisation_in_the_Soviet_Union#List_of_languages
Потому что это утверждение можно понимать либо "когда-то читалось так, как пишется сейчас" (например, knight как [книхт]), либо "когда-то читалось так, как писалось тогда же" (например, dett вместо нынешнего debt). Для некоторых слов верно первое, для некоторых -- второе, для остальных (например queue из первого абзаца поста) -- ни то ни другое
Нет, даже про английский нельзя, о чём в посте упомянуто:
Так, в слове debt буква b не произносилась вообще никогда: её стали писать "просто чтоб было".
"Подчеркнуть латинские корни" -- это лишь одна из мотиваций искусственно отдалять написание от произношения. Бывает, что для омофонов искусственно вводят различающиеся написания: так, в слове whole никогда не произносилась буква w -- её стали писать для отличия от hole. Бывает, что причины чисто графические: так, слово woman никогда не произносилось через [o], но в написании wuman получался "забор из палочек" wum-, так что для удобства чтения гласную стали писать другую. Бывает, что на написание слова повлияла иностранная орфография: так, слово ghost никогда не произносилось с описанным в посте звуком gh, а букву h в написание добавили под влиянием голландского gheest, в котором h означала несмягчение g перед ee. (Из современной голландской орфографии её удалили, и пишут geest; но в английском написании "бессмысленно заимствованная буква" так и осталась.)
Потому что слово бог заимствовано из церковнославянского, где правила произношения отличались от русских. Есть много пар рус-цсл когнатов, слегка различающихся по произношению и по смыслу: нёбо-небо, рожать-рождать, своротить-совратить и т.д
Это продолжение анекдота про "мушку спили"?
В соединении латинской приставки с германским корнем вы так же не находите ничего необычного, как и в превращении -марк- в -мерик- с заменой всех гласных?
А может, и Марокко названо в честь германской "марки"? Там и то больше гласных совпадает, чем в Америке.