Как я два года учил себя как нейросеть
Дрессировочный ошейник для собак на предплечье, провод в COM‑порт ноутбука, португальская фраза в наушниках. Ошибусь на букве — ударит током.
Я занимаюсь машинным обучением, и однажды я задал вопрос, от которого преподавателя передёрнет: чем обучение человека принципиально отличается от обучения модели? А дальше два года проверял ответ на самом живом — на собственной голове.
Половина второго ночи. На левом предплечье у меня застёгнут дрессировочный ошейник для собак — тот самый, с металлическими контактами. От него тянется провод к COM‑порту старого ноутбука. На экране — португальская фраза, я слышу её в наушниках и должен набрать вслепую. Палец висит над клавишей. Я знаю: ошибусь на букве — меня ударит током. Не сильно. Достаточно.
Зачем взрослый мужчина, инженер, отец троих детей, сидит ночью и бьёт себя током за опечатки в португальском — история длинная. Она началась с отчаяния, прошла через несколько диких экспериментов и закончилась работающей системой, на которой сейчас учится вся моя семья. Расскажу целиком.
И сразу оговорюсь, чтобы ошейник не выглядел аттракционом ради красивого начала: без этой дури не было бы всего остального. Именно он показал мне, почему сигнал вообще перестаёт работать, — а из этого выросло всё, что сегодня действительно держит и меня, и семью за столом. Так что мы к нему ещё вернёмся, и не один раз.
С чего всё началось: язык как стена
Сразу расставлю точки: я не лингвист и не преподаватель. Я занимаюсь машинным обучением. А иностранные языки всю жизнь были моей личной стеной. Английский я добивал годами и с огромным скрипом. И это не фигура речи. Дальше будут графики и таблица по всей семье — на них я нижняя линия: учусь в четыре с половиной раза медленнее собственной старшей дочери, на той же системе и том же языке.
Жена бралась за английский и испанский несколько раз — и каждый раз бросала. Не потому что ленивая, а потому что скучно, медленно и не видно результата.
А потом мы решили переезжать в Португалию. И португальский из «неплохо бы» превратился в «надо, и желательно вчера». Мы попробовали всё, что пробуют все: приложения с зелёной совой, карточки, разговорники, репетитора. Через месяц я поймал себя на знакомом ощущении — том самом, из‑за которого жена бросала испанский. Ты вроде занимаешься каждый день, а язык не приближается. Слова не липнут. Мотивация тает.
И вот в этой точке во мне включился инженер вместо ученика. Я перестал спрашивать «какое приложение выбрать» и задал другой вопрос:
А чем, собственно, обучение человека принципиально отличается от обучения нейросети?
Я умею обучать модели. Это моя работа. Так почему я не могу применить те же принципы к самому живому — к собственной голове?
Гипотеза: если мозг — это модель, то как её обучить?
Идея звучала дерзко, но, если разложить обучение нейросети на кирпичи, для каждого находится подозрительно человеческий аналог.
Почему «просто слушать подкасты» не работает?
Прежде чем модель начнёт учить язык, поток текста дробится на токены — минимальные единицы. Человек, слушающий незнакомую речь, слышит не слова, а сплошной звуковой кисель. Первое, чему надо научиться, — резать этот кисель на куски и привязывать звук к символам.
Но тут же встаёт проблема: у всех языков разные звуки и разные символы. Я ведь даже алфавита португальского не знаю. С другой стороны, мы все примерно представляем, как звучит латинская транскрипция любого языка. Так почему бы не привязывать звуки нового языка к тому звучанию, что я уже знаю?
Решение нашлось простое до глупости. Берём фразу на португальском — аудио плюс текст. Воспроизводим аудио, надо набрать текст. И мы не можем идти дальше, пока не нажмём правильный латинский символ. Мозг слышит поток незнакомой речи, понять его не может — и по‑хорошему должен пропускать как шум. Но ему нужно ввести символ. Что остаётся? Находить закономерности и систематизировать незнакомые звуки. Так рождается зародыш языка.
И здесь стоит объяснить, почему это работает — и почему «просто слушать подкасты» не работает. Мозг не запоминает то, чему не уделяет внимания: без внимания нет записи в память. А что он делает с потоком, где не понимает ни слова и от которого ничего не зависит? Помечает как шум и выбрасывает. Можно годами крутить фоном сериалы на незнакомом языке и не сдвинуться ни на миллиметр: для мозга это журчание ручья, а ручей не запоминают.
Но стоит появиться задаче — включается другой механизм. Ещё в 1996-м Саффран, Аслин и Ньюпорт показали, что восьмимесячные младенцы вычленяют «слова» из слитного потока, просто отслеживая, какие слоги чаще идут друг за другом, — чистая статистика переходов, безо всякого смысла. Эта машинерия никуда не девается и у взрослого, она просто спит, пока мозгу не дали повод её включить. Моя посимвольная диктовка и есть повод: пропустить звук нельзя, потому что прямо сейчас надо нажать нужную клавишу. Внимание принудительно приковано к потоку — и мозг из «шума» начинает лепить структуру.
Дальше — обратная связь. Нажал правильную клавишу — подкрепили: «услышал вот это — нажал вот то — получил конфетку». Ошибся — наказали. Проделай сто раз, и связь «звук → символ» становится чёткой. Потом один символ вырастает в слово, слова — в словосочетания, дальше в предложения, дальше в язык.
Где взять сигнал, который мозг не сможет проигнорировать?
Модель не сойдётся без сигнала: за верное — плюс, за неверное — минус. Причём сигнал нужно давать не как попало, а точечно — ровно в тот момент, когда нажал не то, чтобы мозг точно понимал, что именно он сделал не так. Для этого и нужна посимвольная проверка. Плюс наш мозг обожает предсказывать будущее: угадать следующий символ — это само по себе выброс дофамина. А если усилить угадывание ещё и «конфеткой» — система цепляет мозг за самый сильный его инстинкт: тягу угадывать наперёд. Вопрос только: где взять эту конфетку? Об этом ниже.
Почему слова из приложения не липнут?
Модель дообучают на данных из целевого домена, а не на всём подряд. Значит, и человеку надо учить не абстрактный «топ-1000 слов из учебника», а лексику из того контента, который он реально смотрит и реально встретит.
Мозг — штука ленивая. Всё ненужное он забывает, а неэмоциональное вообще не запоминает. И тут до меня дошло, почему сова не работает. Чему она учит? Тому, что тебя не волнует, что для тебя ничего не значит и что ты вряд ли используешь в ближайшее время. Чему я удивлялся, что слова не прилипают? Всё же ясно как день. Значит, учить надо только то, что нужно, и так, чтобы в этом были эмоции.
А что вообще значит «выучить слово»?
Тут придётся на минуту залезть под капот — и языка, и головы. Сразу условимся: дальше — моя рабочая картинка, удобная метафора для того, что происходит, а не строгая нейронаука с доказанными «облаками» и «энкодерами». Но объясняет она на удивление много, поэтому и держусь за неё.
У вас в голове нет «объектов» в виде аккуратных точек. Есть области смысла — размазанные по нейронам облака. «Дом» — это не строчка в словаре, а целое облако: стены, тепло, «идём домой», дверь, запах. А слово — это вектор, который тычет в это облако. Чем точнее слово и контекст вокруг него, тем точнее попадание. Родной язык уже намертво прошит в эти облака: слышите «дом» — облако вспыхивает само, без всякого перевода.
Теперь вопрос на миллион: что происходит, когда вы учите mesa (“стол”) по словарю? Вы связываете mesa не с облаком, а с другим словом — со «стол». Ярлык с ярлыком. Само облако смысла в этой цепочке не участвует вообще. И чтобы потом этим пользоваться, мозгу приходится гонять маршрут mesa → “стол” → облако. Каждый раз через русский костыль. Вот почему словарные слова такие скользкие: это не знание, это приклеенная сбоку таблица переводов. Она не липнет к смыслу — потому что смысла в ней и не было.
А теперь то же слово, но в контексте. Вы видите фразу на родном, понимаете её — и нужное облако уже горит. И пока оно горит, вы набираете фразу на португальском. Что делает мозг? Прошивает португальское слово прямо в это горящее облако. Не в русский ярлык — в сам смысл. Вы строите второй энкодер, второй вход к тем же областям смысла, к которым уже подключён первый язык. Не таблицу переводов — параллельный доступ к общему смыслу.
И тут появляется штука, которая сначала пугает, а потом доходит, что это и есть признак победы. Вы начинаете понимать слово, не умея его перевести. У меня так с pelo: узнаю, знаю, где и зачем оно, а скажи «переведи на русский» — зависаю. Для словарного ученика это провал. А по‑моему — наоборот. Знаешь перевод, но не чувствуешь слово в живой фразе — выучил ярлык. Чувствуешь слово, но не можешь перевести — прошил его в смысл. Носитель ровно так своими словами и владеет: он не переводит их себе, он просто попадает в облако.
Оговорка
Работает это идеально не для всех слов. Для конкретных вещей — стол, дом, яблоко — облака у всех людей нарезаны одинаково, потому что их нарезало само восприятие, а не язык. А там, где языки режут мир по‑разному (русский делит синий на «синий» и «голубой» — два облака, а у англичанина одно blue), один‑в-один не сойдётся никогда, и словарь тут бессилен. Контекстное обучение отдаёт вам облако таким, каким его режет сам язык. Поэтому вся система построена вокруг фраз, а не слов: слово в столбике — ярлык в пустоту, слово во фразе — вектор, попавший в живое облако смысла.
Так зачем мне вообще словарь?
И тут меня зацепило дальше. Хорошо, контент свой. Но я‑то всё равно продолжал думать по‑школьному: вот отдельно слова, которые надо выучить, вот отдельно правила, по которым их складывать. А мы разве так модель учим? Мы не даём ей словарь по алфавиту и свод грамматики отдельным файлом. Мы даём ей текст. Просто много текста. Всё остальное она достаёт оттуда сама.
Так а зачем мне‑то словарь и правила?
В нормальном тексте это уже лежит — всё вместе и в готовом виде. И частотность сама собой правильная: что в жизни встречается на каждом шагу, то и в тексте попадётся сто раз. И конструкции живые, никем не расставленные, — они там есть просто потому, что иначе фразу не построишь. Никто эту программу не писал, она сложилась сама из того, как люди говорят.
Раньше это была большая работа: разметить текст, подсчитать, отобрать, выстроить в последовательность — работа методиста на полгода ради одной книжки. А теперь у меня под рукой то, что делает это за минуты. Так чего я упираюсь? Беру то, что мне нужно, вытаскиваю оттуда паттерны — и вот моя программа обучения, которую никто специально для меня не составлял.
Единственное, за чем стоит следить, — чтобы источник совпадал с целью. Хочешь болтать на улице — бери живую речь, а не детективы столетней давности: грамматику они дадут любую, а вот лексику и интонацию времени — свою.
Не первопроходец
Скажу заранее, чтобы не выглядеть человеком, который изобрёл велосипед и гордится.
Учить фразами, а не словами, придумал не я: у Замяткина это «матрица», у Биркенбиль — декодированные тексты, у Glossika — прогон готовых предложений, у Пимслера — извлечение по растущим интервалам, у Refold и sentence mining — фразы из своего же контента. Про часть из этого я узнал уже после того, как построил своё.
Отдельно про Крашена: понятный ввод — это его идея, и с ней я согласен целиком. Но он же считает, что исправлять ошибки бесполезно, а у меня на мгновенной коррекции держится половина системы. Тут я скорее со Свейном: язык вылезает на выходе, а не только на входе.
Своим я считаю не детали, а то, что они замкнуты в петлю.
Контент, который вы и так смотрите, отдаёт фразы;
Фразы вводятся посимвольно под аудио;
Ошибка привязывается не к фразе, а к грамматическому свойству;
По свойствам, где ошибок больше всего, генерируются новые фразы на уже знакомых словах;
Те возвращаются по интервалам;
У перечисленных выше каждый кусок живёт сам по себе: корпус фиксирован, ошибки никуда не ведут, грамматика едет отдельной программой из учебника. Замыкания «ошибка → материал под эту ошибку» я не нашёл ни у кого.
Зоопарк: в поисках функции потерь
Мне нужен был сигнал подкрепления. Сильный. Такой, чтобы мозг не мог его проигнорировать, как игнорирует «ты потерял серию из 3 дней» в приложении. И тут инженер во мне пошёл по пути наименьшего сопротивления — то есть по пути максимального дуболомства.
Ошейник
ЭКСПЕРИМЕНТ № 1 · отрицательное подкрепление
Помните ноутбук с COM‑портом из начала? Вот мы и вернулись. Идея была дикая и прямолинейная: ошибся в диктанте — лёгкий разряд. Оно работало отлично. Ощущение как прыжок с парашютом: адреналин, кристальная концентрация, сидишь над каждой буквой как сапёр над проводом. Когда цена опечатки осязаема и мгновенна, мозг включается на полную.
Минус был ровно один, и фатальный: привыкание. Через некоторое время ты просто перестаёшь замечать разряд — тело откалибровалось, сигнал слился с фоном и упал до нуля. Чтобы удержать эффект, надо было бы постоянно повышать напряжение, а «увеличьте разряд, чтобы продолжить обучение» звучит уже не как образовательный продукт, а как начало плохого фильма. Ошейник вернулся к собаке.
Вейп
ЭКСПЕРИМЕНТ № 2 · положительное подкрепление
Дело было на фестивале, куда мы съездили перед переездом. Мне в руки попала электронная сигарета — и родилась очередная «гениальная» мысль, где брать дозированный дофамин. Правильный ответ = затяжка. Работало пугающе хорошо. И я быстро понял, почему именно пугающе: я подключил обучение к дофаминовой петле никотина, а она сильнее любой геймификации. Это уже не «учу язык», это «формирую зависимость, замаскированную под учёбу». Строить продукт на веществе — тупик. Вычёркиваем.
Но кое‑что этот тупик подсветил. И награда, и наказание в физической форме — костыли: к одному привыкаешь, на другом строить нельзя. А что если носитель сигнала должен быть вообще не физическим, а абстрактным? Тем, чему человек сам назначает цену?
Деньги
Семейные ценности, или зачем платить репетитору
ЭКСПЕРИМЕНТ № 3 · абстрактная ценность
Мысль была простая: взять деньги. А вот как её проверить — непонятно. Платить самому себе бессмысленно: перекладываешь из кармана в карман, ни азарта, ни эффекта, удовольствия никакого. Нужен был человек, для которого деньги настоящие. И тут я посмотрел на собственных детей. Их у меня трое — 4, 14 и 21; младший пока не в счёт, а вот дочери — идеальные подопытные. Старшая сейчас не с нами, но учёбу продолжает. К тому же сошлась и арифметика: я плачу репетитору, я плачу карманные. Цели, конечно, разные — репетитор за результат, карманные просто так, — но платить‑то приходится дважды. А мне ещё и нужен испытуемый. Пусть карманные зарабатываются занятиями — по‑моему, идеальная схема проверки теории.
Сделал монеты и два кошелька. С золотого можно выводить, с серебряного нельзя. Деньги я кладу на серебряный, а зарабатываются они прохождением: +10 монет за правильную фразу, −1 за каждую ошибку. И чтобы был стимул не пропускать занятия — вся система держится на регулярности — за каждый день без пропуска бонус растёт: +1, +2, +3… до максимума в +10 монет. Пропустил день — десятка снова превращается в единицу, и копи заново. Что перевели на золото — то их, а потерянное на ошибках возвращается ко мне. Потом поменял одну деталь: потерянное уходит не мне, а случайно выбранному сопернику — отдавать деньги сопернику всегда жальче, чем просто кому‑то. Написал в телеге P2P‑бота, закинул деньги на серебро — и система заработала. Никаких принуждений, никаких проверок домашки. Всё на автомате. Да и учить‑то, по сути, ничего не надо: выполнила задание — получила монетки. Всё просто.
И вот это сработало по‑настоящему. Без адреналина, без дофаминовых петель, без проводов. Просто человек не хочет терять своё — и садится заниматься. Здесь я прочувствовал на живых людях то, что психологи знают давно: неприятие потери двигает сильнее, чем предвкушение выигрыша. Страх потерять сто рублей мотивирует надёжнее, чем надежда заработать сто. Система прекрасно работает до сих пор, а деньги, которые ушли бы репетитору, остались в семье — плюс своя маленькая экономика: кто больше заработал. По‑моему, просто здорово. Из трёх испробованных мотиваторов — лучший.
Три эксперимента — три вывода. Физиология не годится (привыкание). Вещества не годятся (очевидно). А вот абстрактная ценность, которую можно потерять, — годится идеально. Функция потерь для человека — это буквально функция потери. Денег.
Постскриптум: а если бить редко?
Ошейник вернулся к собаке. Но, пока я писал эту статью, до меня дошло, что диагноз я тогда поставил неверный.
Я решил, что привык к разряду. А привык я, похоже, не к разряду, а к его частоте. Диктант — это ошибка на ошибке, и меня било раз за разом весь урок без перерыва. При таком потоке стимул рано или поздно съезжает в фон: тело калибруется под то, что происходит постоянно. Это не свойство тока, это свойство ритма.
А если бить редко? Три‑пять раз за урок — и я не знаю, когда. Тогда каждый разряд остаётся событием, а между ними чувствительность успевает вернуться. И привыкать становится не к чему: привыкают к фону, а не к тому, что случается пять раз за час.
Причём работает тут не сам разряд, а ожидание. Мозг — не автономная железка, он знает правило: ошибёшься — может прилететь. Именно это «может» и держит палец над клавишей. А раз держит ожидание, реальных ударов нужно мало — ровно столько, чтобы угроза оставалась настоящей.
Только вероятностью тут не обойтись. Поставишь 10% — и число ударов начнёт задаваться тем, сколько я сегодня наошибался: на тяжёлом уроке получу тридцать и вернусь в ту же долбёжку, из которой убежал, на лёгком — ни одного. Значит, не вероятность, а счётчик: жёстко заданное число срабатываний за урок, раскиданное случайно. И не объявлять его точно и не гарантировать, что он выберется до конца, — иначе к финалу урока начинаешь считать оставшееся и понимать, что уже безопасно.
Отдельно про то, что мне в этой схеме как раз нравится. Раз я держу вероятность в голове, я начинаю с ней играть: тут рискну, а тут соберусь. Появляется азарт — а он у меня и так самый рабочий двигатель во всей системе, на нём держатся семейные диалоги со ставками. Здесь он ложится ровно туда же.
Так что я собираюсь ещё раз забрать у собаки ошейник — уже по этой схеме. Напишу, что получилось, — независимо от того, получится или нет.
Вопрос в зал
А пока интересно, что думаете вы: редко и непредсказуемо — это спасает идею или я просто не хочу признать, что она мертва?
Чего мне не хватило
Тут надо признаться в собственном промахе, иначе дальше не понять.
Почти год я учил именно так — фразами, без единого правила. Паттерны действительно подхватились: я начал узнавать конструкции, чувствовать, где как говорят, понимать на слух. А потом попробовал сам сказать что‑то сложнее заученного — и поплыл. Понимать понимаю, а собрать свою фразу не могу. Грамматики не хватало, и глупо было это отрицать.
Сесть за учебник? Так я ровно от этого и бежал.
И я стал думать, что такое грамматика, если смотреть на неё как на задачу, а не как на школьный предмет. А это же просто способ языка дотащить смысл. Когда действие произошло. Реальное оно или желаемое. Утверждение это или вопрос. На «ты» я обращаюсь или на «вы». Смыслы у всех языков одни и те же — люди везде говорят про одно и то же. Разные только способы их выражать.
Значит, смысл фразы можно записать отдельно от языка. Не «русское предложение и его перевод», а структура смысла, которую каждый язык разворачивает по‑своему.
Так я и полез это строить. Формат — JSON: его одинаково понимают и ИИ, и я, его легко хранить, сравнивать и считать. Названия полей мои, рабочие — я не лингвист и на терминологию не претендую.
Вот фраза Vou mostrar o pão в такой записи:
{ "action_object": { "word_base_form": "mostrar", "meaning_description": "to show" }, "PROPERTY": { "ACTION_STATE": { "sentence_type": "statement", "tense": "future", "voice": "active", "modality": "real" } }, "RESULT": { "word_base_form": "pão", "meaning_description": "bread" } }
А теперь самое интересное. Убираем португальские слова:
{ "action_object": { "word_base_form": "???", "meaning_description": "to show" }, "PROPERTY": { "ACTION_STATE": { "sentence_type": "statement", "tense": "future", "voice": "active", "modality": "real" } }, "RESULT": { "word_base_form": "???", "meaning_description": "bread" } }
И остаётся чистый паттерн предложения — уже ни к какому языку не привязанный. Утверждение, будущее время, актив, реальное действие «показать», объект «хлеб». Скажи «португальский» — ИИ развернёт по‑португальски, со всеми артиклями и спряжениями, которые языку положены. Скажи «китайский» — развернёт по‑китайски. Все грамматические особенности остаются там, где им и место: в самом языке, а не в паттерне.
И вот зачем это всё было нужно.
Во‑первых, учёт. Не по словам, а по свойствам: вот это время мне попадалось полсотни раз, а такой модальности не было ни разу. Сразу видно, что уже отработано, а чего в моём материале просто не встретилось.
Во‑вторых — и это оказалось главным — из паттерна можно рендерить новые фразы. Беру фразу, которую уже знаю, меняю в структуре одно поле — время, отрицание, модальность — и получаю фразу, где всё знакомое, кроме одной грамматической детали. Слова те же, смысл почти тот же, новое ровно одно. Мозгу не надо тащить одновременно и незнакомую лексику, и незнакомую конструкцию.
И вот тут пробелы из учёта закрываются сами собой. Не попалось мне в материале нужной конструкции — не надо идти искать её по текстам. Беру свои же фразы, переключаю поле и получаю столько повторений, сколько надо, на словах, которые я и так знаю.
И тут же напрашивалось продолжение. Слова по интервалам повторять — дело нехитрое, это давно все умеют. А как же с грамматикой? Её везде дают программой: сегодня настоящее, через месяц прошедшее, к весне сослагательное — одинаково для всех, независимо от того, кто где спотыкается и у кого какие потребности.
А у меня‑то теперь ошибка привязана не к фразе, а к конкретному свойству. Значит, видно не просто «тут ошибся», а «ошибся в модальности, и уже седьмой раз за неделю». И дальше всё просто: берём те свойства, где ошибок больше всего, и рендерим фразы именно с ними. На знакомых словах, чтобы новым было только то, что не даётся.
Получается, я учу не абстрактные правила по порядку из учебника, а ровно то, что у меня хуже всего идёт. Причём заранее я этот список не составлял — его составили мои же ошибки.
И так, паттерны нужны, чтобы генерить нужные фразы и вести учёт. А проверка ответа и объяснение — целиком за ИИ. Он видит, что я написал, и говорит по‑человечески: ты сказал вот это, а хотел вот то, в португальском для этого нужно изменить вот так. Не «сегодня проходим будущее время, вот таблица окончаний», а разбор моей же фразы в тот момент, когда я сам захотел что‑то сказать и не смог.
Скажу сразу, чтобы не выглядеть первооткрывателем: свести языки к общей смысловой записи пытались задолго до меня, и упирались все примерно в одно — в детали, которые в одном языке обязательны, а в другом их просто нет. Я не берусь утверждать, что схема универсальна. Могу сказать только то, что вижу: пока мне не попалось фразы, которую не удалось бы в неё разложить.
Второй контур: где брать объём
Шесть слов в час — работа точная, но не массовая. Одной диктовкой язык не наполнишь: она открывает вход, а дальше нужен объём, которого при таком темпе взять неоткуда. Поэтому есть второй режим, и устроен он ровно наоборот — без коррекции, без ставок, без напряжения. Вы просто смотрите сериал.
Механика такая. Берём серию с родной озвучкой и субтитрами на изучаемом языке — субтитры тут не для чтения, а как исходник. По ним синтезируется дубляж: голосом это может быть кто угодно, хоть вы сами. Дальше каждая реплика собирается в сэндвич — сначала иностранный дубляж, потом родная озвучка из фильма, потом снова дубляж. Никакого текста на экране нет, вы смотрите сериал, а не читаете его.
Вторая половина механики — громкость. Система знает ваш словарь и считает долю знакомой лексики отдельно для каждой реплики; от неё зависит, насколько громко звучит родная прослойка. Реплика с незнакомыми словами — родная озвучка в полный голос. Реплика, где почти всё знакомо, — прослойка еле слышна, остаётся практически один дубляж. Словарь растёт, и родной язык уходит из фильма сам, реплика за репликой, а вы этого даже не замечаете. Работает и встречное движение: три самые частотные незнакомые леммы из вашего корпуса вшиваются в фразы, которые вы разбираете на уроках. То есть диктовка целенаправленно готовит вас к тому, что вы собираетесь смотреть.
Здесь легко поймать меня на противоречии: выше я писал, что слушать фоном бесполезно. Так и есть — пока поток остаётся шумом. Но шумом он остаётся ровно до тех пор, пока в нём не за что зацепиться. Как только половина лексики знакома, а смысл подстрахован родной дорожкой, тот же поток перестаёт быть ручьём: мозгу есть на что опереться, и остальное он достраивает. Причём внимание держит не наказание, а сюжет — не разобрал иностранную реплику, потерял нить. Так что диктовка и просмотр — не альтернативы, а очередь: первая открывает вход, второй его наполняет.
Про порог
Начинать имеет смысл, когда система показывает около 50% знакомых слов в субтитрах серии. Мне справедливо возразят, что для комфортного восприятия обычно называют 95–98% покрытия. Так и есть — но эти цифры считаются для голого входа, где смысл больше взять неоткуда. У меня недостающее закрывает родная прослойка, поэтому порог и опускается вдвое.
Что из этого выросло
Дальше было два года. Не буду делать вид, что от первой схемы до сегодняшней системы был прямой путь: каждый кусок пришлось переизобретать по несколько раз, ломать и собирать заново. Но, что забавно, сам скелет уцелел целиком. Просто с него отвалилось всё дикое и наросло всё нужное. Сейчас на этой системе учусь я, жена и обе дочери.
Средняя дочь пошла в обычную португальскую школу. Приехали мы в июле 2025, за парту она села 15 сентября, а до этого год занималась только по моей системе — без репетиторов и языковых курсов. Вот её промежуточный табель за первый период: она учится вместе с носителями языка и по когнитивным предметам получает Bom (“хорошо”), а по отношению к учёбе — Muito Bom (“очень хорошо”), с пометками учителей «организованна», «старательна», «активна и заинтересована». Три месяца в чужом языке — и вот такой табель.

«А как оно работает внутри?»
Под капотом накопилось много чего, и в одну статью это не влезет. По какому расписанию слово возвращается, чтобы не забыться, но и не надоесть. Как алгоритм решает, что фраза «созрела» и её пора убирать из повторений. Как одно слово из вашего любимого ролика цепляет за собой десяток соседних. За каждым пунктом — свои грабли и свои два года переделок; если разбирать всё сразу, получится толстый учебник, который вы закроете на третьей странице.
А теперь цифры
Сразу о том, как считалось. Точную продуктивность за все два года не получить: методика переписывалась на ходу, версии сменяли друг друга. Поэтому я не делю «два года» на «слова» и не продаю вам красивый темп — это была бы липа. Показываю сырые графики последней стабильной версии, и сразу по всем: португальский учат я, жена Наталья и обе дочери, Анастасия и школьница Олеся. Данные выгружены из статистики как есть.
Лично я за ~2 года изучения‑и-разработки дошёл примерно до 2000–3000 слов. Это уровень B1 — разговорный порог, где держишь живой разговор на знакомые темы без постоянных обвалов. Для ориентира: B1 — это как раз 2000–3000 слов, B2 — 4000–5000.
А вот скорость — уже с чистого среза последней версии, где всё однородно и посчитано. И сразу по всем четверым.


Откуда крутой подъём в июне
Излом кривой вверх — не случайность, у него есть дата. В середине июня я включил режим диалогов — тренировку свободного общения. Система генерирует диалог по ролям, и всем участникам достаётся один и тот же набор реплик. Дальше — соревнование: каждый ставит по 50 монет, ставки замораживаются в общий банк, а кто первым выучил все фразы, тот и забирает банк целиком. У нас с женой диалоги стартовали 18–19 июня, у дочерей — в июле; на графике фраз ровно с этих дат линии идут заметно круче. Азарт работает: соревнование даёт мотивацию, которой в одиночной зубрёжке просто нет.
Честная оговорка
У этого всплеска есть и вторая, менее геройская причина. В диалогах большинство слов уже знакомы — новой лексики там относительно мало, реплики во многом собраны из уже пройденного. Поэтому «строго сданных фраз» прибавляется быстро не только от азарта, но и потому, что сами фразы в среднем легче. Подчёркиваю это специально, чтобы вы не приняли скачок за чистый эффект геймификации.
Из этих двух графиков и вылезает реальный «КПД» — и считать его честно можно только по лексике: грамматические вариации собраны из уже знакомых слов и новой лексики не приносят.

Моя строка в этой таблице худшая, и это, пожалуй, главное, что в ней есть. Разброс между четырьмя людьми на одном языке, одной системе и одних правилах зачёта — впятеро.
Чего тут не хватает
И сразу назову главную дыру, пока её не назвали за меня: нас четверо, и все — одна семья, изрядно мотивированная, да ещё и под денежным прессом. Контрольной группы у меня, конечно, нет. Поэтому графики честно показывают, что система работает у нас, — но сами по себе не отделяют «работает метод» от «работают четыре человека, которые каждый день садятся заниматься». Одному мне это не развести. И вот тут я надеюсь на вас: чем больше разных людей на разных языках проверят метод на себе, тем виднее станет, что здесь от системы, а что от простого «сел и сделал». По сути, контрольной группой можете стать вы.
Много это или мало — зависит от того, что считать словом. Моё «знаю» — единица тяжёлая: узнал на слух, написал вслепую, попал в смысл без перевода. Поэтому в лоб с чужими цифрами она не сравнивается.
С чем сравнивать — и почему только с оговорками
Я взял для сравнения Anki и подготовку дипломатов FSI, для которых есть открытые данные по скорости обучения. Свести мою систему, Anki и подготовку дипломатов к одному числу нельзя без вранья: все трое меряют разное. Поэтому сначала — что у каждого считается «выученным словом», и только потом числа. Всё ниже — прикидка с допущениями, а не измерение; подставляйте свои коэффициенты.
Что считается «выученным словом»
Система | Что значит «знаю» | Грубо слов/час | Оговорка |
|---|---|---|---|
Моя | Слово во фразе: узнаю на слух, пишу вслепую, попадаю в смысл без перевода | ~8 | Тяжёлая единица: письмо + смысл + узнавание в потоке |
Anki | Узнавание карточки | 20–30 / день | Только узнавание; без письма и потока речи; растущий долг повторений |
FSI, дипломаты | Владение ILR-3 ≈ B2/C1 | ~5–8 | «600 часов» — только класс; с самоподготовкой ~1000+ |
Три оговорки, без которых таблица врёт.
Anki меряет узнавание — самую дешёвую единицу. «Знаю» там значит «карточка звякнула колокольчиком». Моё «знаю» — написал вслепую и поймал в живой фразе. За час Anki формально даёт больше слов, но это слова‑призраки, и чтобы они стали активными нужна дополнительная практика употребления.
FSI — это не 600 часов. По данным Госдепа США, португальский — «лёгкая» Категория I, 552–690 аудиторных часов до уровня ILR-3 (≈ B2/C1). Но там же сказано: типичная неделя — это 23 часа в классе плюс 17 часов самоподготовки. Реальный налёт — за тысячу часов. Мои минуты — чистая активная практика, так что честнее сравнивать их с полным налётом FSI, а не с урезанным классным.
Оба допущения — про то, что FSI работает в тепличных условиях: он учит отобранных людей с гуманитарным складом, в полном погружении, с живыми преподавателями. И меряет португальский от английского, у которого с ним общая латинская база и тысячи узнаваемых корней. Оба пункта играют им на руку, не мне.
Теперь посмотрите на таблицу выше ещё раз. Разница между четырьмя людьми одной семьи, на одном языке, в одной системе — четыре с половиной раза. Ни одна поправка на условия обучения столько не весит: «самоучка вместо класса» и «русский вместо английского» вместе дают в лучшем случае втрое. Кто учится — важнее, чем в каких условиях.
Дальше арифметика без единого множителя. Верхняя строка, 15,8 слова в час, — вдвое выше коридора FSI. Держит её не отобранный дипломат в погружении, а моя старшая дочь: дома, part‑time, без преподавателя, из русского, для которого португальский заметно дальше, чем для англичанина. Ни одного тепличного условия — и вдвое выше золотого стандарта.
И это работает не только для португальского
Для теста я месяц занимался китайским. Да, там труднее, нужно дольше привыкать. Но к концу месяца я начал уверенно различать звуки китайского и запоминать слова. Потом забросил. А недавно повторил пару уроков — слова подзабылись, но звуки различаются так же хорошо, как полгода назад, и залетают обратно быстро. В планах вернуться к китайскому всерьёз, а ещё хочу попробовать арабский.
Тот месяц я вёл день за днём, без причёсывания: что делал, где буксовал, какие цифры выходили. Вот этот журнал целиком — если хочется не верить мне на слово, а посмотреть сырьё.
Дальше — только вместе
Честно: все языки мира мне в одиночку не проверить. Я вижу, что метод держится на португальском и не разваливается на китайском, — но это два языка, а их сотни, и у каждого свои ловушки, о которых я даже не догадываюсь. Поэтому дальше интереснее проверять вместе. Возьмите язык, который учите вы, и давайте посмотрим, повторяется ли эффект — или у вашего языка своя специфика, которую я не учёл. Собираю это всё в своём журнале: там же разбираю чужие заходы и выкладываю то, что не влезло в статью. А если языка, который хочется протестировать, ещё нет в системе — напишите, добавлю.
Я не истина в последней инстанции и не гуру с горы — просто человек, который два года бился о свою стену и нашёл то, что помогло ему и его семье. Инструмент сырой, сработает ли он на вас — честно не знаю. Вопрос ведь не «верю я или нет», а «пробовал я или нет».
studyforge.pro — инструмент открыт, бесплатно и без обязательств: возьмите свой язык и посмотрите, повторяется ли эффект.
Источники
FSI / Госдеп США, сроки обучения по категориям языков — state.gov, Foreign Language Training
Объём словаря по уровням CEFR (B1 ~2–3 тыс., B2 ~4–5 тыс., C1 ~8–10 тыс.) — сводные данные экзаменационных советов и исследований
Saffran J. R., Aslin R. N., Newport E. L. “Statistical Learning by 8-Month‑Old Infants”, Science, 1996
Смежные подходы, с которыми метод пересекается: Krashen S. “Principles and Practice in Second Language Acquisition”, 1982 (comprehensible input); матричный метод Замяткина; декодированные тексты Биркенбиль; Glossika

