Дрессировочный ошейник для собак на предплечье, провод в COM‑порт ноутбука, португальская фраза в наушниках. Ошибусь на букве — ударит током.
Я занимаюсь машинным обучением, и однажды я задал вопрос, от которого преподавателя передёрнет: чем обучение человека принципиально отличается от обучения модели? А дальше два года проверял ответ на самом живом — на собственной голове.
Половина второго ночи. На левом предплечье у меня застёгнут дрессировочный ошейник для собак — тот самый, с металлическими контактами. От него тянется провод к COM‑порту старого ноутбука. На экране — португальская фраза, я слышу её в наушниках и должен набрать вслепую. Палец висит над клавишей. Я знаю: ошибусь на букве — меня ударит током. Не сильно. Достаточно.
Зачем взрослый мужчина, инженер, отец троих детей, сидит ночью и бьёт себя током за опечатки в португальском — история длинная. Она началась с отчаяния, прошла через несколько диких экспериментов и закончилась работающей системой, на которой сейчас учится вся моя семья. Расскажу целиком.
И сразу оговорюсь, чтобы ошейник не выглядел аттракционом ради красивого начала: без этой дури не было бы всего остального. Именно он показал мне, почему сигнал вообще перестаёт работать, — а из этого выросло всё, что сегодня действительно держит и меня, и семью за столом. Так что мы к нему ещё вернёмся, и не один раз.
Сразу расставлю точки: я не лингвист и не преподаватель. Я занимаюсь машинным обучением. А иностранные языки всю жизнь были моей личной стеной. Английский я добивал годами и с огромным скрипом. И это не фигура речи. Дальше будут графики и таблица по всей семье — на них я нижняя линия: учусь в четыре с половиной раза медленнее собственной старшей дочери, на той же системе и том же языке.
Жена бралась за английский и испанский несколько раз — и каждый раз бросала. Не потому что ленивая, а потому что скучно, медленно и не видно результата.
А потом мы решили переезжать в Португалию. И португальский из «неплохо бы» превратился в «надо, и желательно вчера». Мы попробовали всё, что пробуют все: приложения с зелёной совой, карточки, разговорники, репетитора. Через месяц я поймал себя на знакомом ощущении — том самом, из‑за которого жена бросала испанский. Ты вроде занимаешься каждый день, а язык не приближается. Слова не липнут. Мотивация тает.
И вот в этой точке во мне включился инженер вместо ученика. Я перестал спрашивать «какое приложение выбрать» и задал другой вопрос:
А чем, собственно, обучение человека принципиально отличается от обучения нейросети?
Я умею обучать модели. Это моя работа. Так почему я не могу применить те же принципы к самому живому — к собственной голове?
Идея звучала дерзко, но, если разложить обучение нейросети на кирпичи, для каждого находится подозрительно человеческий аналог.
Прежде чем модель начнёт учить язык, поток текста дробится на токены — минимальные единицы. Человек, слушающий незнакомую речь, слышит не слова, а сплошной звуковой кисель. Первое, чему надо научиться, — резать этот кисель на куски и привязывать звук к символам.
Но тут же встаёт проблема: у всех языков разные звуки и разные символы. Я ведь даже алфавита португальского не знаю. С другой стороны, мы все примерно представляем, как звучит латинская транскрипция любого языка. Так почему бы не привязывать звуки нового языка к тому звучанию, что я уже знаю?
Решение нашлось простое до глупости. Берём фразу на португальском — аудио плюс текст. Воспроизводим аудио, надо набрать текст. И мы не можем идти дальше, пока не нажмём правильный латинский символ. Мозг слышит поток незнакомой речи, понять его не может — и по‑хорошему должен пропускать как шум. Но ему нужно ввести символ. Что остаётся? Находить закономерности и систематизировать незнакомые звуки. Так рождается зародыш языка.
И здесь стоит объяснить, почему это работает — и почему «просто слушать подкасты» не работает. Мозг не запоминает то, чему не уделяет внимания: без внимания нет записи в память. А что он делает с потоком, где не понимает ни слова и от которого ничего не зависит? Помечает как шум и выбрасывает. Можно годами крутить фоном сериалы на незнакомом языке и не сдвинуться ни на миллиметр: для мозга это журчание ручья, а ручей не запоминают.
Но стоит появиться задаче — включается другой механизм. Ещё в 1996-м Саффран, Аслин и Ньюпорт показали, что восьмимесячные младенцы вычленяют «слова» из слитного потока, просто отслеживая, какие слоги чаще идут друг за другом, — чистая статистика переходов, безо всякого смысла. Эта машинерия никуда не девается и у взрослого, она просто спит, пока мозгу не дали повод её включить. Моя посимвольная диктовка и есть повод: пропустить звук нельзя, потому что прямо сейчас надо нажать нужную клавишу. Внимание принудительно приковано к потоку — и мозг из «шума» начинает лепить структуру.
Дальше — обратная связь. Нажал правильную клавишу — подкрепили: «услышал вот это — нажал вот то — получил конфетку». Ошибся — наказали. Проделай сто раз, и связь «звук → символ» становится чёткой. Потом один символ вырастает в слово, слова — в словосочетания, дальше в предложения, дальше в язык.
Модель не сойдётся без сигнала: за верное — плюс, за неверное — минус. Причём сигнал нужно давать не как попало, а точечно — ровно в тот момент, когда нажал не то, чтобы мозг точно понимал, что именно он сделал не так. Для этого и нужна посимвольная проверка. Плюс наш мозг обожает предсказывать будущее: угадать следующий символ — это само по себе выброс дофамина. А если усилить угадывание ещё и «конфеткой» — система цепляет мозг за самый сильный его инстинкт: тягу угадывать наперёд. Вопрос только: где взять эту конфетку? Об этом ниже.
Модель дообучают на данных из целевого домена, а не на всём подряд. Значит, и человеку надо учить не абстрактный «топ-1000 слов из учебника», а лексику из того контента, который он реально смотрит и реально встретит.
Мозг — штука ленивая. Всё ненужное он забывает, а неэмоциональное вообще не запоминает. И тут до меня дошло, почему сова не работает. Чему она учит? Тому, что тебя не волнует, что для тебя ничего не значит и что ты вряд ли используешь в ближайшее время. Чему я удивлялся, что слова не прилипают? Всё же ясно как день. Значит, учить надо только то, что нужно, и так, чтобы в этом были эмоции.
Тут придётся на минуту залезть под капот — и языка, и головы. Сразу условимся: дальше — моя рабочая картинка, удобная метафора для того, что происходит, а не строгая нейронаука с доказанными «облаками» и «энкодерами». Но объясняет она на удивление много, поэтому и держусь за неё.
У вас в голове нет «объектов» в виде аккуратных точек. Есть области смысла — размазанные по нейронам облака. «Дом» — это не строчка в словаре, а целое облако: стены, тепло, «идём домой», дверь, запах. А слово — это вектор, который тычет в это облако. Чем точнее слово и контекст вокруг него, тем точнее попадание. Родной язык уже намертво прошит в эти облака: слышите «дом» — облако вспыхивает само, без всякого перевода.
Теперь вопрос на миллион: что происходит, когда вы учите mesa (“стол”) по словарю? Вы связываете mesa не с облаком, а с другим словом — со «стол». Ярлык с ярлыком. Само облако смысла в этой цепочке не участвует вообще. И чтобы потом этим пользоваться, мозгу приходится гонять маршрут mesa → “стол” → облако. Каждый раз через русский костыль. Вот почему словарные слова такие скользкие: это не знание, это приклеенная сбоку таблица переводов. Она не липнет к смыслу — потому что смысла в ней и не было.
А теперь то же слово, но в контексте. Вы видите фразу на родном, понимаете её — и нужное облако уже горит. И пока оно горит, вы набираете фразу на португальском. Что делает мозг? Прошивает португальское слово прямо в это горящее облако. Не в русский ярлык — в сам смысл. Вы строите второй энкодер, второй вход к тем же областям смысла, к которым уже подключён первый язык. Не таблицу переводов — параллельный доступ к общему смыслу.
И тут появляется штука, которая сначала пугает, а потом доходит, что это и есть признак победы. Вы начинаете понимать слово, не умея его перевести. У меня так с pelo: узнаю, знаю, где и зачем оно, а скажи «переведи на русский» — зависаю. Для словарного ученика это провал. А по‑моему — наоборот. Знаешь перевод, но не чувствуешь слово в живой фразе — выучил ярлык. Чувствуешь слово, но не можешь перевести — прошил его в смысл. Носитель ровно так своими словами и владеет: он не переводит их себе, он просто попадает в облако.
Оговорка
Работает это идеально не для всех слов. Для конкретных вещей — стол, дом, яблоко — облака у всех людей нарезаны одинаково, потому что их нарезало само восприятие, а не язык. А там, где языки режут мир по‑разному (русский делит синий на «синий» и «голубой» — два облака, а у англичанина одно blue), один‑в-один не сойдётся никогда, и словарь тут бессилен. Контекстное обучение отдаёт вам облако таким, каким его режет сам язык. Поэтому вся система построена вокруг фраз, а не слов: слово в столбике — ярлык в пустоту, слово во фразе — вектор, попавший в живое облако смысла.
И тут меня зацепило дальше. Хорошо, контент свой. Но я‑то всё равно продолжал думать по‑школьному: вот отдельно слова, которые надо выучить, вот отдельно правила, по которым их складывать. А мы разве так модель учим? Мы не даём ей словарь по алфавиту и свод грамматики отдельным файлом. Мы даём ей текст. Просто много текста. Всё остальное она достаёт оттуда сама.
Так а зачем мне‑то словарь и правила?
В нормальном тексте это уже лежит — всё вместе и в готовом виде. И частотность сама собой правильная: что в жизни встречается на каждом шагу, то и в тексте попадётся сто раз. И конструкции живые, никем не расставленные, — они там есть просто потому, что иначе фразу не построишь. Никто эту программу не писал, она сложилась сама из того, как люди говорят.
Раньше это была большая работа: разметить текст, подсчитать, отобрать, выстроить в последовательность — работа методиста на полгода ради одной книжки. А теперь у меня под рукой то, что делает это за минуты. Так чего я упираюсь? Беру то, что мне нужно, вытаскиваю оттуда паттерны — и вот моя программа обучения, которую никто специально для меня не составлял.
Единственное, за чем стоит следить, — чтобы источник совпадал с целью. Хочешь болтать на улице — бери живую речь, а не детективы столетней давности: грамматику они дадут любую, а вот лексику и интонацию времени — свою.
Не первопроходец
Скажу заранее, чтобы не выглядеть человеком, который изобрёл велосипед и гордится.
Учить фразами, а не словами, придумал не я: у Замяткина это «матрица», у Биркенбиль — декодированные тексты, у Glossika — прогон готовых предложений, у Пимслера — извлечение по растущим интервалам, у Refold и sentence mining — фразы из своего же контента. Про часть из этого я узнал уже после того, как построил своё.
Отдельно про Крашена: понятный ввод — это его идея, и с ней я согласен целиком. Но он же считает, что исправлять ошибки бесполезно, а у меня на мгновенной коррекции держится половина системы. Тут я скорее со Свейном: язык вылезает на выходе, а не только на входе.
Своим я считаю не детали, а то, что они замкнуты в петлю.
Контент, который вы и так смотрите, отдаёт фразы;
Фразы вводятся посимвольно под аудио;
Ошибка привязывается не к фразе, а к грамматическому свойству;
По свойствам, где ошибок больше всего, генерируются новые фразы на уже знакомых словах;
Те возвращаются по интервалам;
У перечисленных выше каждый кусок живёт сам по себе: корпус фиксирован, ошибки никуда не ведут, грамматика едет отдельной программой из учебника. Замыкания «ошибка → материал под эту ошибку» я не нашёл ни у кого.
Мне нужен был сигнал подкрепления. Сильный. Такой, чтобы мозг не мог его проигнорировать, как игнорирует «ты потерял серию из 3 дней» в приложении. И тут инженер во мне пошёл по пути наименьшего сопротивления — то есть по пути максимального дуболомства.
ЭКСПЕРИМЕНТ № 1 · отрицательное подкрепление
Помните ноутбук с COM‑портом из начала? Вот мы и вернулись. Идея была дикая и прямолинейная: ошибся в диктанте — лёгкий разряд. Оно работало отлично. Ощущение как прыжок с парашютом: адреналин, кристальная концентрация, сидишь над каждой буквой как сапёр над проводом. Когда цена опечатки осязаема и мгновенна, мозг включается на полную.
Минус был ровно один, и фатальный: привыкание. Через некоторое время ты просто перестаёшь замечать разряд — тело откалибровалось, сигнал слился с фоном и упал до нуля. Чтобы удержать эффект, надо было бы постоянно повышать напряжение, а «увеличьте разряд, чтобы продолжить обучение» звучит уже не как образовательный продукт, а как начало плохого фильма. Ошейник вернулся к собаке.
ЭКСПЕРИМЕНТ № 2 · положительное подкрепление
Дело было на фестивале, куда мы съездили перед переездом. Мне в руки попала электронная сигарета — и родилась очередная «гениальная» мысль, где брать дозированный дофамин. Правильный ответ = затяжка. Работало пугающе хорошо. И я быстро понял, почему именно пугающе: я подключил обучение к дофаминовой петле никотина, а она сильнее любой геймификации. Это уже не «учу язык», это «формирую зависимость, замаскированную под учёбу». Строить продукт на веществе — тупик. Вычёркиваем.
Но кое‑что этот тупик подсветил. И награда, и наказание в физической форме — костыли: к одному привыкаешь, на другом строить нельзя. А что если носитель сигнала должен быть вообще не физическим, а абстрактным? Тем, чему человек сам назначает цену?
Семейные ценности, или зачем платить репетитору
ЭКСПЕРИМЕНТ № 3 · абстрактная ценность
Мысль была простая: взять деньги. А вот как её проверить — непонятно. Платить самому себе бессмысленно: перекладываешь из кармана в карман, ни азарта, ни эффекта, удовольствия никакого. Нужен был человек, для которого деньги настоящие. И тут я посмотрел на собственных детей. Их у меня трое — 4, 14 и 21; младший пока не в счёт, а вот дочери — идеальные подопытные. Старшая сейчас не с нами, но учёбу продолжает. К тому же сошлась и арифметика: я плачу репетитору, я плачу карманные. Цели, конечно, разные — репетитор за результат, карманные просто так, — но платить‑то приходится дважды. А мне ещё и нужен испытуемый. Пусть карманные зарабатываются занятиями — по‑моему, идеальная схема проверки теории.
Сделал монеты и два кошелька. С золотого можно выводить, с серебряного нельзя. Деньги я кладу на серебряный, а зарабатываются они прохождением: +10 монет за правильную фразу, −1 за каждую ошибку. И чтобы был стимул не пропускать занятия — вся система держится на регулярности — за каждый день без пропуска бонус растёт: +1, +2, +3… до максимума в +10 монет. Пропустил день — десятка снова превращается в единицу, и копи заново. Что перевели на золото — то их, а потерянное на ошибках возвращается ко мне. Потом поменял одну деталь: потерянное уходит не мне, а случайно выбранному сопернику — отдавать деньги сопернику всегда жальче, чем просто кому‑то. Написал в телеге P2P‑бота, закинул деньги на серебро — и система заработала. Никаких принуждений, никаких проверок домашки. Всё на автомате. Да и учить‑то, по сути, ничего не надо: выполнила задание — получила монетки. Всё просто.
И вот это сработало по‑настоящему. Без адреналина, без дофаминовых петель, без проводов. Просто человек не хочет терять своё — и садится заниматься. Здесь я прочувствовал на живых людях то, что психологи знают давно: неприятие потери двигает сильнее, чем предвкушение выигрыша. Страх потерять сто рублей мотивирует надёжнее, чем надежда заработать сто. Система прекрасно работает до сих пор, а деньги, которые ушли бы репетитору, остались в семье — плюс своя маленькая экономика: кто больше заработал. По‑моему, просто здорово. Из трёх испробованных мотиваторов — лучший.
Три эксперимента — три вывода. Физиология не годится (привыкание). Вещества не годятся (очевидно). А вот абстрактная ценность, которую можно потерять, — годится идеально. Функция потерь для человека — это буквально функция потери. Денег.
Ошейник вернулся к собаке. Но, пока я писал эту статью, до меня дошло, что диагноз я тогда поставил неверный.
Я решил, что привык к разряду. А привык я, похоже, не к разряду, а к его частоте. Диктант — это ошибка на ошибке, и меня било раз за разом весь урок без перерыва. При таком потоке стимул рано или поздно съезжает в фон: тело калибруется под то, что происходит постоянно. Это не свойство тока, это свойство ритма.
А если бить редко? Три‑пять раз за урок — и я не знаю, когда. Тогда каждый разряд остаётся событием, а между ними чувствительность успевает вернуться. И привыкать становится не к чему: привыкают к фону, а не к тому, что случается пять раз за час.
Причём работает тут не сам разряд, а ожидание. Мозг — не автономная железка, он знает правило: ошибёшься — может прилететь. Именно это «может» и держит палец над клавишей. А раз держит ожидание, реальных ударов нужно мало — ровно столько, чтобы угроза оставалась настоящей.
Только вероятностью тут не обойтись. Поставишь 10% — и число ударов начнёт задаваться тем, сколько я сегодня наошибался: на тяжёлом уроке получу тридцать и вернусь в ту же долбёжку, из которой убежал, на лёгком — ни одного. Значит, не вероятность, а счётчик: жёстко заданное число срабатываний за урок, раскиданное случайно. И не объявлять его точно и не гарантировать, что он выберется до конца, — иначе к финалу урока начинаешь считать оставшееся и понимать, что уже безопасно.
Отдельно про то, что мне в этой схеме как раз нравится. Раз я держу вероятность в голове, я начинаю с ней играть: тут рискну, а тут соберусь. Появляется азарт — а он у меня и так самый рабочий двигатель во всей системе, на нём держатся семейные диалоги со ставками. Здесь он ложится ровно туда же.
Так что я собираюсь ещё раз забрать у собаки ошейник — уже по этой схеме. Напишу, что получилось, — независимо от того, получится или нет.
Вопрос в зал
А пока интересно, что думаете вы: редко и непредсказуемо — это спасает идею или я просто не хочу признать, что она мертва?
Тут надо признаться в собственном промахе, иначе дальше не понять.
Почти год я учил именно так — фразами, без единого правила. Паттерны действительно подхватились: я начал узнавать конструкции, чувствовать, где как говорят, понимать на слух. А потом попробовал сам сказать что‑то сложнее заученного — и поплыл. Понимать понимаю, а собрать свою фразу не могу. Грамматики не хватало, и глупо было это отрицать.
Сесть за учебник? Так я ровно от этого и бежал.
И я стал думать, что такое грамматика, если смотреть на неё как на задачу, а не как на школьный предмет. А это же просто способ языка дотащить смысл. Когда действие произошло. Реальное оно или желаемое. Утверждение это или вопрос. На «ты» я обращаюсь или на «вы». Смыслы у всех языков одни и те же — люди везде говорят про одно и то же. Разные только способы их выражать.
Значит, смысл фразы можно записать отдельно от языка. Не «русское предложение и его перевод», а структура смысла, которую каждый язык разворачивает по‑своему.
Так я и полез это строить. Формат — JSON: его одинаково понимают и ИИ, и я, его легко хранить, сравнивать и считать. Названия полей мои, рабочие — я не лингвист и на терминологию не претендую.
Вот фраза Vou mostrar o pão в такой записи:
{
"action_object": {
"word_base_form": "mostrar",
"meaning_description": "to show"
},
"PROPERTY": {
"ACTION_STATE": {
"sentence_type": "statement",
"tense": "future",
"voice": "active",
"modality": "real"
}
},
"RESULT": {
"word_base_form": "pão",
"meaning_description": "bread"
}
}
А теперь самое интересное. Убираем португальские слова:
{
"action_object": {
"word_base_form": "???",
"meaning_description": "to show"
},
"PROPERTY": {
"ACTION_STATE": {
"sentence_type": "statement",
"tense": "future",
"voice": "active",
"modality": "real"
}
},
"RESULT": {
"word_base_form": "???",
"meaning_description": "bread"
}
}
И остаётся чистый паттерн предложения — уже ни к какому языку не привязанный. Утверждение, будущее время, актив, реальное действие «показать», объект «хлеб». Скажи «португальский» — ИИ развернёт по‑португальски, со всеми артиклями и спряжениями, которые языку положены. Скажи «китайский» — развернёт по‑китайски. Все грамматические особенности остаются там, где им и место: в самом языке, а не в паттерне.
Во‑первых, учёт. Не по словам, а по свойствам: вот это время мне попадалось полсотни раз, а такой модальности не было ни разу. Сразу видно, что уже отработано, а чего в моём материале просто не встретилось.
Во‑вторых — и это оказалось главным — из паттерна можно рендерить новые фразы. Беру фразу, которую уже знаю, меняю в структуре одно поле — время, отрицание, модальность — и получаю фразу, где всё знакомое, кроме одной грамматической детали. Слова те же, смысл почти тот же, новое ровно одно. Мозгу не надо тащить одновременно и незнакомую лексику, и незнакомую конструкцию.
И вот тут пробелы из учёта закрываются сами собой. Не попалось мне в материале нужной конструкции — не надо идти искать её по текстам. Беру свои же фразы, переключаю поле и получаю столько повторений, сколько надо, на словах, которые я и так знаю.
И тут же напрашивалось продолжение. Слова по интервалам повторять — дело нехитрое, это давно все умеют. А как же с грамматикой? Её везде дают программой: сегодня настоящее, через месяц прошедшее, к весне сослагательное — одинаково для всех, независимо от того, кто где спотыкается и у кого какие потребности.
А у меня‑то теперь ошибка привязана не к фразе, а к конкретному свойству. Значит, видно не просто «тут ошибся», а «ошибся в модальности, и уже седьмой раз за неделю». И дальше всё просто: берём те свойства, где ошибок больше всего, и рендерим фразы именно с ними. На знакомых словах, чтобы новым было только то, что не даётся.
Получается, я учу не абстрактные правила по порядку из учебника, а ровно то, что у меня хуже всего идёт. Причём заранее я этот список не составлял — его составили мои же ошибки.
И так, паттерны нужны, чтобы генерить нужные фразы и вести учёт. А проверка ответа и объяснение — целиком за ИИ. Он видит, что я написал, и говорит по‑человечески: ты сказал вот это, а хотел вот то, в португальском для этого нужно изменить вот так. Не «сегодня проходим будущее время, вот таблица окончаний», а разбор моей же фразы в тот момент, когда я сам захотел что‑то сказать и не смог.
Скажу сразу, чтобы не выглядеть первооткрывателем: свести языки к общей смысловой записи пытались задолго до меня, и упирались все примерно в одно — в детали, которые в одном языке обязательны, а в другом их просто нет. Я не берусь утверждать, что схема универсальна. Могу сказать только то, что вижу: пока мне не попалось фразы, которую не удалось бы в неё разложить.
Шесть слов в час — работа точная, но не массовая. Одной диктовкой язык не наполнишь: она открывает вход, а дальше нужен объём, которого при таком темпе взять неоткуда. Поэтому есть второй режим, и устроен он ровно наоборот — без коррекции, без ставок, без напряжения. Вы просто смотрите сериал.
Механика такая. Берём серию с родной озвучкой и субтитрами на изучаемом языке — субтитры тут не для чтения, а как исходник. По ним синтезируется дубляж: голосом это может быть кто угодно, хоть вы сами. Дальше каждая реплика собирается в сэндвич — сначала иностранный дубляж, потом родная озвучка из фильма, потом снова дубляж. Никакого текста на экране нет, вы смотрите сериал, а не читаете его.
Вторая половина механики — громкость. Система знает ваш словарь и считает долю знакомой лексики отдельно для каждой реплики; от неё зависит, насколько громко звучит родная прослойка. Реплика с незнакомыми словами — родная озвучка в полный голос. Реплика, где почти всё знакомо, — прослойка еле слышна, остаётся практически один дубляж. Словарь растёт, и родной язык уходит из фильма сам, реплика за репликой, а вы этого даже не замечаете. Работает и встречное движение: три самые частотные незнакомые леммы из вашего корпуса вшиваются в фразы, которые вы разбираете на уроках. То есть диктовка целенаправленно готовит вас к тому, что вы собираетесь смотреть.
Здесь легко поймать меня на противоречии: выше я писал, что слушать фоном бесполезно. Так и есть — пока поток остаётся шумом. Но шумом он остаётся ровно до тех пор, пока в нём не за что зацепиться. Как только половина лексики знакома, а смысл подстрахован родной дорожкой, тот же поток перестаёт быть ручьём: мозгу есть на что опереться, и остальное он достраивает. Причём внимание держит не наказание, а сюжет — не разобрал иностранную реплику, потерял нить. Так что диктовка и просмотр — не альтернативы, а очередь: первая открывает вход, второй его наполняет.
Про порог
Начинать имеет смысл, когда система показывает около 50% знакомых слов в субтитрах серии. Мне справедливо возразят, что для комфортного восприятия обычно называют 95–98% покрытия. Так и есть — но эти цифры считаются для голого входа, где смысл больше взять неоткуда. У меня недостающее закрывает родная прослойка, поэтому порог и опускается вдвое.
Дальше было два года. Не буду делать вид, что от первой схемы до сегодняшней системы был прямой путь: каждый кусок пришлось переизобретать по несколько раз, ломать и собирать заново. Но, что забавно, сам скелет уцелел целиком. Просто с него отвалилось всё дикое и наросло всё нужное. Сейчас на этой системе учусь я, жена и обе дочери.
Средняя дочь пошла в обычную португальскую школу. Приехали мы в июле 2025, за парту она села 15 сентября, а до этого год занималась только по моей системе — без репетиторов и языковых курсов. Вот её промежуточный табель за первый период: она учится вместе с носителями языка и по когнитивным предметам получает Bom (“хорошо”), а по отношению к учёбе — Muito Bom (“очень хорошо”), с пометками учителей «организованна», «старательна», «активна и заинтересована». Три месяца в чужом языке — и вот такой табель.

Под капотом накопилось много чего, и в одну статью это не влезет. По какому расписанию слово возвращается, чтобы не забыться, но и не надоесть. Как алгоритм решает, что фраза «созрела» и её пора убирать из повторений. Как одно слово из вашего любимого ролика цепляет за собой десяток соседних. За каждым пунктом — свои грабли и свои два года переделок; если разбирать всё сразу, получится толстый учебник, который вы закроете на третьей странице.
Сразу о том, как считалось. Точную продуктивность за все два года не получить: методика переписывалась на ходу, версии сменяли друг друга. Поэтому я не делю «два года» на «слова» и не продаю вам красивый темп — это была бы липа. Показываю сырые графики последней стабильной версии, и сразу по всем: португальский учат я, жена Наталья и обе дочери, Анастасия и школьница Олеся. Данные выгружены из статистики как есть.
Лично я за ~2 года изучения‑и-разработки дошёл примерно до 2000–3000 слов. Это уровень B1 — разговорный порог, где держишь живой разговор на знакомые темы без постоянных обвалов. Для ориентира: B1 — это как раз 2000–3000 слов, B2 — 4000–5000.
А вот скорость — уже с чистого среза последней версии, где всё однородно и посчитано. И сразу по всем четверым.


Излом кривой вверх — не случайность, у него есть дата. В середине июня я включил режим диалогов — тренировку свободного общения. Система генерирует диалог по ролям, и всем участникам достаётся один и тот же набор реплик. Дальше — соревнование: каждый ставит по 50 монет, ставки замораживаются в общий банк, а кто первым выучил все фразы, тот и забирает банк целиком. У нас с женой диалоги стартовали 18–19 июня, у дочерей — в июле; на графике фраз ровно с этих дат линии идут заметно круче. Азарт работает: соревнование даёт мотивацию, которой в одиночной зубрёжке просто нет.
Честная оговорка
У этого всплеска есть и вторая, менее геройская причина. В диалогах большинство слов уже знакомы — новой лексики там относительно мало, реплики во многом собраны из уже пройденного. Поэтому «строго сданных фраз» прибавляется быстро не только от азарта, но и потому, что сами фразы в среднем легче. Подчёркиваю это специально, чтобы вы не приняли скачок за чистый эффект геймификации.
Из этих двух графиков и вылезает реальный «КПД» — и считать его честно можно только по лексике: грамматические вариации собраны из уже знакомых слов и новой лексики не приносят.

Моя строка в этой таблице худшая, и это, пожалуй, главное, что в ней есть. Разброс между четырьмя людьми на одном языке, одной системе и одних правилах зачёта — впятеро.
Чего тут не хватает
И сразу назову главную дыру, пока её не назвали за меня: нас четверо, и все — одна семья, изрядно мотивированная, да ещё и под денежным прессом. Контрольной группы у меня, конечно, нет. Поэтому графики честно показывают, что система работает у нас, — но сами по себе не отделяют «работает метод» от «работают четыре человека, которые каждый день садятся заниматься». Одному мне это не развести. И вот тут я надеюсь на вас: чем больше разных людей на разных языках проверят метод на себе, тем виднее станет, что здесь от системы, а что от простого «сел и сделал». По сути, контрольной группой можете стать вы.
Много это или мало — зависит от того, что считать словом. Моё «знаю» — единица тяжёлая: узнал на слух, написал вслепую, попал в смысл без перевода. Поэтому в лоб с чужими цифрами она не сравнивается.
Я взял для сравнения Anki и подготовку дипломатов FSI, для которых есть открытые данные по скорости обучения. Свести мою систему, Anki и подготовку дипломатов к одному числу нельзя без вранья: все трое меряют разное. Поэтому сначала — что у каждого считается «выученным словом», и только потом числа. Всё ниже — прикидка с допущениями, а не измерение; подставляйте свои коэффициенты.
Что считается «выученным словом»
Система | Что значит «знаю» | Грубо слов/час | Оговорка |
|---|---|---|---|
Моя | Слово во фразе: узнаю на слух, пишу вслепую, попадаю в смысл без перевода | ~8 | Тяжёлая единица: письмо + смысл + узнавание в потоке |
Anki | Узнавание карточки | 20–30 / день | Только узнавание; без письма и потока речи; растущий долг повторений |
FSI, дипломаты | Владение ILR-3 ≈ B2/C1 | ~5–8 | «600 часов» — только класс; с самоподготовкой ~1000+ |
Три оговорки, без которых таблица врёт.
Anki меряет узнавание — самую дешёвую единицу. «Знаю» там значит «карточка звякнула колокольчиком». Моё «знаю» — написал вслепую и поймал в живой фразе. За час Anki формально даёт больше слов, но это слова‑призраки, и чтобы они стали активными нужна дополнительная практика употребления.
FSI — это не 600 часов. По данным Госдепа США, португальский — «лёгкая» Категория I, 552–690 аудиторных часов до уровня ILR-3 (≈ B2/C1). Но там же сказано: типичная неделя — это 23 часа в классе плюс 17 часов самоподготовки. Реальный налёт — за тысячу часов. Мои минуты — чистая активная практика, так что честнее сравнивать их с полным налётом FSI, а не с урезанным классным.
Оба допущения — про то, что FSI работает в тепличных условиях: он учит отобранных людей с гуманитарным складом, в полном погружении, с живыми преподавателями. И меряет португальский от английского, у которого с ним общая латинская база и тысячи узнаваемых корней. Оба пункта играют им на руку, не мне.
Теперь посмотрите на таблицу выше ещё раз. Разница между четырьмя людьми одной семьи, на одном языке, в одной системе — четыре с половиной раза. Ни одна поправка на условия обучения столько не весит: «самоучка вместо класса» и «русский вместо английского» вместе дают в лучшем случае втрое. Кто учится — важнее, чем в каких условиях.
Дальше арифметика без единого множителя. Верхняя строка, 15,8 слова в час, — вдвое выше коридора FSI. Держит её не отобранный дипломат в погружении, а моя старшая дочь: дома, part‑time, без преподавателя, из русского, для которого португальский заметно дальше, чем для англичанина. Ни одного тепличного условия — и вдвое выше золотого стандарта.
Для теста я месяц занимался китайским. Да, там труднее, нужно дольше привыкать. Но к концу месяца я начал уверенно различать звуки китайского и запоминать слова. Потом забросил. А недавно повторил пару уроков — слова подзабылись, но звуки различаются так же хорошо, как полгода назад, и залетают обратно быстро. В планах вернуться к китайскому всерьёз, а ещё хочу попробовать арабский.
Тот месяц я вёл день за днём, без причёсывания: что делал, где буксовал, какие цифры выходили. Вот этот журнал целиком — если хочется не верить мне на слово, а посмотреть сырьё.
Честно: все языки мира мне в одиночку не проверить. Я вижу, что метод держится на португальском и не разваливается на китайском, — но это два языка, а их сотни, и у каждого свои ловушки, о которых я даже не догадываюсь. Поэтому дальше интереснее проверять вместе. Возьмите язык, который учите вы, и давайте посмотрим, повторяется ли эффект — или у вашего языка своя специфика, которую я не учёл. Собираю это всё в своём журнале: там же разбираю чужие заходы и выкладываю то, что не влезло в статью. А если языка, который хочется протестировать, ещё нет в системе — напишите, добавлю.
Я не истина в последней инстанции и не гуру с горы — просто человек, который два года бился о свою стену и нашёл то, что помогло ему и его семье. Инструмент сырой, сработает ли он на вас — честно не знаю. Вопрос ведь не «верю я или нет», а «пробовал я или нет».
studyforge.pro — инструмент открыт, бесплатно и без обязательств: возьмите свой язык и посмотрите, повторяется ли эффект.
FSI / Госдеп США, сроки обучения по категориям языков — state.gov, Foreign Language Training
Объём словаря по уровням CEFR (B1 ~2–3 тыс., B2 ~4–5 тыс., C1 ~8–10 тыс.) — сводные данные экзаменационных советов и исследований
Saffran J. R., Aslin R. N., Newport E. L. “Statistical Learning by 8-Month‑Old Infants”, Science, 1996
Смежные подходы, с которыми метод пересекается: Krashen S. “Principles and Practice in Second Language Acquisition”, 1982 (comprehensible input); матричный метод Замяткина; декодированные тексты Биркенбиль; Glossika