Полгода назад я выпустил видео про Yomitan и Anki и с полной уверенностью объяснял, как правильно учить немецкие слова: брать их из живого текста и делать богатые карточки. Инструменты там были хорошие. А вот два тезиса под ними, как выяснилось, не выдерживают проверки наукой.
В этой статье я честно разбираю, где ошибался, и показываю исследования, которые изменили моё мнение: сколько раз нужно встретить слово, чтобы оно запомнилось, почему первые две тысячи слов важнее всех остальных и как должна выглядеть карточка, которая работает.
Два постулата, в которые я верил
За последнее время я перечитал очень много научных работ о том, как люди учат иностранные слова, и, честно говоря, сбился со счёта, сколько раз ловил себя на ощущении «ага, вот как это на самом деле работает». Некоторые из этих озарений были приятными. Некоторые не очень, потому что оказалось, что я довольно долго исповедовал два постулата о пополнении словарного запаса, которые научной критики не выдерживают.
Первый постулат звучал так: учить слова по частотным колодам не нужно. Объяснение я себе давал очень логичное. Самые частотные слова на то и самые частотные, что встречаются постоянно. Если я регулярно читаю и слушаю на немецком, они сами будут попадаться мне снова и снова и сами выучатся. Зачем зубрить то, что и так придёт? Мне казалось, это очевидно.
Второй постулат касался формы карточки. Раз уж мы достаём слова из контента, который потребляем, то карточка в Anki должна быть максимально богатой: полная словарная статья, несколько значений, много примеров, картинка. Чем больше контекста, тем глубже проработка, тем лучше запоминание.

Оба постулата прекрасно упаковываются в концепцию, которую вы наверняка слышали: sentence mining, добыча предложений из контекста. Мы читаем и слушаем, встречаем слово, которое нравится, вытаскиваем его вместе с предложением, делаем из него мощную карточку и повторяем. Именно об этом было моё февральское видео, и именно так я сам учил японский: за время изучения намайнил из разных контекстов без малого тысячу таких карточек.
Читайте также!
Звучит прогрессивно и очень технологично. И вы вправе спросить: Евгений, в чём же здесь ошибка? Отвечу по порядку, через конкретные исследования. Сразу оговорюсь, чтобы не было недопонимания: сами инструменты, Yomitan и Anki, великолепны, и настройка из того видео по-прежнему работает. Проблема не в инструментах, а в двух тезисах, ради которых я их тогда советовал.
Стоит подчеркнуть: с одной стороны, грустно осознавать, что столько лет был в чём-то неправ. С другой стороны, гораздо хуже закостенеть в собственных ошибках. Учиться на них и двигаться дальше приятнее, чем защищать старую позицию.
Слова из контекста не приходят сами
Первое исследование, которое разбило мой первый постулат, провела Батья Лауфер из Хайфского университета вместе с Бэллой Розовски-Ройтблат. Что мне в нём особенно нравится: это не лабораторный эксперимент на полчаса, а настоящий учебный курс. Тринадцать недель, пятьдесят два академических часа, живые студенты, которые просто ходили на занятия по английскому и не знали, что участвуют в эксперименте.
Исследователи взяли шестьдесят слов, которых студенты точно не знали, и разделили их на две группы. Первые тридцать слов встречались только в текстах для чтения: одни два-три раза, другие четыре-пять, третьи шесть-семь. Встретил, если непонятно, посмотрел в словаре, читаешь дальше. По сути, это тот самый comprehensible input, понятный ввод, который так много проповедуется на ютубе и главный популяризатор которого американский лингвист Стивен Крашен. Вторые тридцать слов встречались в текстах учебника только один раз, а все остальные встречи получали в упражнениях: соотнести с определением, вставить в предложение, подобрать синоним. Количество встреч в обеих группах было уравнено: если слово встречалось шесть раз, то в первой группе это шесть раз в текстах, а во второй один раз в тексте и пять раз в упражнениях.
Читайте также!
Тринадцать недель курс идёт своим чередом, а потом внезапный тест именно на эти шестьдесят слов. Результат по словам из текстов выглядел так: два-три встречи дали 1,3 балла из десяти, четыре-пять встреч 1,4, шесть-семь встреч 1,8. То есть, грубо говоря, 13, 14 и 18 процентов. Пять дополнительных встреч со словом в живом контексте почти ничего не добавили, и авторы прямо пишут, что статистически эта разница незначима. А вот во второй группе рост был абсолютно линейный: один раз в тексте плюс пара упражнений дали 1,55, плюс три-четыре упражнения 2,55, плюс шесть упражнений 3,4. Слова из второй группы запоминались в среднем в два раза лучше. Полный текст исследования: Laufer, B., & Rozovski-Roitblat, B. (2011). Incidental vocabulary acquisition: The effects of task type, word occurrence and their combination. Language Teaching Research, 15(4), 391–411, https://doi.org/10.1177/1362168811412019.

Пятнадцать встреч и 3,6 процента. Хорошо, скажете вы, шесть-семь встреч мало. А если больше? В обзорной части той же статьи Лауфер приводит результат Уоринга и Такаки: студенты читали адаптированную книгу, в которой некоторые слова встречались от пятнадцати до восемнадцати раз, причём перевод им подсказывали. По всем ютубным меркам такое слово должно быть выучено намертво. Тест провели не сразу, а через три месяца. Значение слова смогли вспомнить в 3,6% случаев. Три и шесть десятых процента после пятнадцати встреч. Источник: Waring, R., & Takaki, M. (2003). At what rate do learners learn and retain new vocabulary from reading a graded reader? Reading in a Foreign Language, 15(2), 130–163, https://nflrc.hawaii.edu/rfl/item/56.
И ещё одну цифру я не могу не привести. Пол Нейшн, наверное, самый авторитетный исследователь того, как мы пополняем словарный запас, сделал простое сравнение: если человек тратит час на чтение адаптированной книги, у него есть шанс выучить примерно четыре новых слова из контекста. Если тот же час он намеренно учит незнакомые слова, он способен выучить около тридцати пяти. В четыре раза и больше. Источник: Nation, P. (2007). The Four Strands. Innovation in Language Learning and Teaching, 1(1), 2–13, https://doi.org/10.2167/illt039.0.

Случай из практики: я почувствовал это на собственном опыте раньше, чем прочитал. У меня был период с японским, месяца четыре, когда я старался учить его исключительно через погружение: никаких карточек, никакого Anki, только слушать и читать. Результат меня разочаровал, и теперь совершенно очевидно, почему.
Здесь я обязан сделать оговорку, которую делаю всегда. Чтение и слушание на немецком не являются чем-то плохим. Наоборот, восприятие языка в его живом виде, когда он просто течёт потоком, это невероятно важная и полезная вещь, у которой масса преимуществ. Учить слова по карточкам и при этом ничего не читать и не слушать это другая крайность, которой нужно обязательно избегать. Но, как мы теперь видим, к преимуществам живого языка не относится быстрое запоминание новых слов. Когда мы только начинаем учить немецкий, нам критически важно как можно быстрее поднять словарный запас, потому что без него ни читать, ни слушать, ни участвовать в осмысленной беседе невозможно. И от простого погружения этот запас растёт очень медленно.
Невидимый параметр слова, который решает всё
Теперь ещё одно исследование Нейшна, которое объясняет, почему нельзя учить слова по принципу «вот понравилось слово, дай-ка я его выучу». Дело в том, что у любого слова в языке есть невидимый параметр, который мы никак не можем почувствовать, если нам на него не укажут. Этот параметр частотность: насколько часто слово вообще встречается в языке, если проанализировать огромный корпус текстов. И частотность напрямую связана с тем, насколько это слово полезно нам как изучающим язык.
Вот здесь, по-моему, кроется просто бездна непонимания. Люди не осознают, насколько неэффективно учить относительно редкие слова. Нейшн показал это очень простым способом. Он взял два детских мультфильма одного жанра и одной аудитории, «Шрек» и «История игрушек», и сравнил в них редкие слова, те, которые не входят в пять тысяч самых частотных слов английского языка. Сколько редких слов совпало у двух детских мультиков? Восемь. У «Шрека» своё болото, огр и турнир, у «Истории игрушек» свои сплав, катапультировать и подиум. И половина всех слов «Шрека» встречается в нём ровно один раз.

О чём это говорит? Чем реже слово, тем более дикая лотерея его учить. Если мы выходим за первые три, четыре, пять тысяч действительно частотных слов, коэффициент полезного действия от изучения слова становится если не нулевым, то настолько микроскопическим, что прогресса в языке мы не ощутим. Вы собираете лексику именно этого мультика, именно этого сериала, которая больше нигде вам не встретится.
Кривая, которая становится плоской. Подтверждает это ещё один потрясающе интересный график из той же работы. Нейшн взял роман для взрослых, «Любовника леди Чаттерли», и посмотрел, какой процент слов в этом романе покрывает первая тысяча самых частотных английских слов. Оказалось, 81%. Выучили две тысячи самых частотных слов, и нам знакомо уже 88% слов в романе. А потом кривая становится практически плоской: если вторая тысяча добавляет семь процентов, то третья максимум три, а дальше прибавка мизерная. Причём это цифры для достаточно сложного романа. Если мы говорим о бытовом языке, то, по другим исследованиям, две тысячи самых частотных слов покрывают до 95% всего, что люди говорят друг другу в обычной жизни. Источники: Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? The Canadian Modern Language Review, 63(1), 59–82, https://doi.org/10.3138/cmlr.63.1.59; Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438, https://doi.org/10.1093/applin/24.4.425.

Интересный факт: это не только про английский. Я проверил ту же кривую на восемнадцати немецких текстах общим объёмом 4,3 миллиона слов, от Библии Лютера и Кафки до сериала Dark, Гарри Поттера и учебного сериала Nicos Weg. Одна и та же первая тысяча немецких слов покрывает примерно три четверти любого из них, две тысячи около 80%, пять тысяч 85%. Проценты чуть ниже, чем у Нейшна, потому что он считал семьями слов, а я отдельными леммами. Кривая та же самая.

Читайте также!
Но что это за две тысячи магических слов, которые нужно выучить? Здесь и кроется цена ошибки. Это должны быть очень тщательно отобранные слова. Если мы соберём колоду из двух тысяч слов, которые не являются по-настоящему частотными, мы потратим огромное количество сил зря, потому что в реальных диалогах и реальном бытовом общении этих слов не будет. И когда мы занимаемся моим доселе любимым sentence mining, мы абсолютно закономерно и невольно собираем себе индивидуальную колоду, которая приносит гораздо меньше пользы, чем качественно собранная колода по-настоящему частотных слов. Я сполна ощутил это на собственной японской колоде из тысячи намайненных слов.
Это не значит, что sentence mining плох сам по себе. Это значит, что начинать с него изучение языка или переходить к нему, пока не набрано частотное ядро, не нужно. Сначала ядро, потом всё остальное. И уже после этого сериалы, книги и Yomitan начинают работать по-настоящему, потому что вам есть на что нанизывать новые слова.
Богатая карточка мешает запоминать
Теперь про второй мой косяк, про то, что карточка должна быть богатой. Сейчас я понимаю, что карточка, какая была у меня раньше, с полной словарной статьёй и десятком примеров, абсолютно отвратительна, и такие карточки в Anki себе делать нельзя. Утвердил меня в этой мысли эксперимент Джо Баркрофта из Вашингтонского университета в Сент-Луисе.
Баркрофт проверял так называемую глубокую проработку слова. За ней стоит целая теория: чем глубже мы слово обработали, тем лучше запомнили. Студенты учили двадцать четыре испанских существительных с картинками, слова типа ножовка, воронка, отвёртка. Половину слов каждый участник учил просто: слово с картинкой показывается четыре раза по шесть секунд, смотри и запоминай. Вторую половину прорабатывали глубоко: слово показывается один раз, но на сорок восемь секунд, и за это время нужно написать с ним своё предложение. Обратите внимание, на глубокую проработку времени давалось в два раза больше: четыре по шесть это двадцать четыре секунды против сорока восьми.
Результат: простой прогон оказался эффективнее примерно в два раза. Не на десять процентов, а в два раза, и это при вдвое меньшем времени. Во втором эксперименте Баркрофт уравнял время, и эффект сохранился. Источник: Barcroft, J. (2004). Effects of sentence writing in second language lexical acquisition. Second Language Research, 20(4), 303–334, https://doi.org/10.1191/0267658304sr233oa.

Вывод из эксперимента такой: наш ресурс внимания конечен. Когда вы сочиняете предложение, или разглядываете картинку, или читаете на карточке кучу примеров и объяснений, ваша голова занята чем угодно, кроме самого слова, его формы и его значения. Картинка, кстати, тоже очень сильно оттягивает внимание на себя, хотя многие любят учить слова именно с картинками. И непосредственное запоминание слова статистически идёт хуже, чем если бы вы просто его учили.
Важный нюанс: семантическая работа со словом очень важная вещь, и она крайне полезна для слов, которые вам давно знакомы и которые вы хотите вывести из пассива в актив. Но для запоминания новых слов она менее полезна, чем простое повторение. Не путайте эти две задачи.
Другая крайность. При этом слишком тощая карточка, где просто слово и перевод, это тоже путь в никуда. Виной всему банальная полисемия и то, что слова в двух языках никогда не совпадают по переводу один в один. Пример, который пришёл мне в голову буквально накануне съёмки, когда я обсуждал эту тему со студентами: как по-немецки будет чайник? На самом деле в немецком нет одного варианта для нашего русского чайника. Если мы имеем в виду чайничек, в котором завариваем чай и из которого разливаем гостям, то это die Teekanne. А если чайник, который мы ставим, чтобы вскипятить воду, то это der Wasserkocher.
Теперь представьте, что у вас на карточке написано просто «чайник». Вы отвечаете Teekanne, переворачиваете, а там Wasserkocher. Вас это раздражает, и у вас возникает ложное ощущение, что вы слова не знаете. Хотя на самом деле вы его прекрасно знаете, просто вам не дали достаточно контекста, чтобы вспомнить именно то слово, которое от вас требуют. Решение великолепное в своей простоте: добавить одно короткое предложение, которое подсветит нужное значение. «Завари мне, пожалуйста, в чайнике зелёный чай» и всем понятно, что это Teekanne. «Поставь, пожалуйста, чайник, мне нужен кипяток» и очевидно, что Wasserkocher.

Как выглядит карточка, которая работает
Чтобы было понятно, о чём я говорю, покажу, как выглядит карточка из японской колоды, которую я сейчас повторяю. По сути, там слово, перевод, пример со словом, перевод примера и всё. Ровно так же устроена карточка моей авторской колоды по немецкому языку, которую я теперь отправляю всем своим ученикам. Основной принцип тот же: слово, перевод, простой пример со словом, перевод примера. Плюс качественная озвучка примера, транскрипция международным фонетическим алфавитом, чтобы было понятно, как слово читается, и сверху номер слова в частотном списке.
Кстати, знаете, какое существительное в немецком языке самое частотное? Der Tag. Это первое существительное, которое встречается в моей колоде, а среди всех слов немецкого языка оно на тридцать шестом месте. Не Haus, не Mann, не Frau, а именно Tag. Вот такие вещи и есть та самая невидимая частотность, которую без списка почувствовать невозможно.
Итак, если собрать всё в одну формулу. Карточка: слово, перевод, один короткий пример, перевод примера, озвучка. Больше ничего. Одно значение на карточку: если у слова два разных значения, это две карточки. А порядок слов в колоде по частотности, а не по темам из учебника и не по тому, что попалось в сериале. Первые две тысячи слов это не «база, которую можно пропустить, потому что и так придёт». Это 88% любого текста и 95% любого разговора, и ни из какого сериала целиком вы их не соберёте. А из колоды соберёте за несколько месяцев по полчаса в день.

Полезный совет: прежде чем что-то учить, измерьте, где вы находитесь. Тест словарного запаса по частотным слоям занимает пять минут и показывает не «молодец», а конкретное место в частотном списке, с которого стоит начинать.
Именно для этого я сделал сайт slova.erosheve.ru. Там есть бесплатный тест по немецкому, который отвечает на вопрос, сколько реально частотных слов вы знаете. Только очень прошу: отвечайте честно, помните вы слово или нет. В тесте попадаются слова, которые похожи на немецкие, но в немецком языке их не существует. Это стандартная практика в подобных тестах, чтобы люди не давили бездумно на кнопку «помню». А если вы только начинаете учить немецкий, можете не проходить тест, а сразу начать учить по моей частотной колоде с первого слова: первые триста самых частотных слов открыты бесплатно. По функционалу это то же самое, что Anki, но без головной боли с установкой программы, скачиванием колод и синхронизацией с телефоном, потому что я заметил, что многие ученики на этом этапе просто сходили с дистанции.
Если же вы хотите заниматься немецким со мной лично, то мой конёк это подготовка к международным экзаменам вроде Goethe B1, но в последнее время я много разрабатывал и для новичков, потому что запрос на изучение немецкого с нуля очень большой. Подробности и анкета на goetheb1.erosheve.ru. А колода, о которой я рассказал, это лишь вершина айсберга.
Часто задаваемые вопросы
Сколько немецких слов нужно знать, чтобы понимать речь и тексты?
Первая тысяча самых частотных слов покрывает около 80% любого текста, две тысячи около 88%, а в бытовой разговорной речи две тысячи частотных слов дают до 95% покрытия. Именно 95% считается порогом, с которого человек начинает уверенно понимать речь на слух. Поэтому две-три тысячи правильно отобранных слов это реальная цель для уровней A2 и B1, после которой немецкий вокруг становится понятным.
Можно ли выучить немецкие слова только из сериалов и книг, без карточек?
Можно, но очень медленно. По исследованию Лауфер, слова, встреченные только в текстах, запоминались вдвое хуже, чем слова с упражнениями, а по данным Уоринга и Такаки после пятнадцати-восемнадцати встреч в книге через три месяца помнили лишь 3,6% слов. Чтение и слушание необходимы, но не как способ быстро набрать словарный запас, а как способ закрепить и активировать уже выученное.
Что такое sentence mining и почему он не подходит новичкам?
Sentence mining это добыча слов вместе с предложениями из текстов и видео, которые вы потребляете, с последующим повторением в Anki. Проблема в том, что вы невольно собираете редкую лексику именно этого сериала или книги, а частотное ядро получаете вразнобой. Пока это ядро из первых двух тысяч слов не набрано, эффективнее учить готовую частотную колоду, а sentence mining подключать позже.
Как должна выглядеть карточка для запоминания немецких слов?
Слово, перевод, одно короткое предложение с этим словом, перевод предложения и озвучка. Одно значение на карточку. Полная словарная статья, несколько примеров и картинка мешают: эксперимент Баркрофта показал, что простой прогон слов запоминается вдвое лучше, чем глубокая проработка. Но и совсем голая пара «слово и перевод» не подходит из-за многозначности: пример нужен, чтобы отличить Teekanne от Wasserkocher.
Чем плохи списки слов по темам из учебника?
Тематические списки вроде «одежда» или «фрукты» собраны не по частотности, а по смыслу, поэтому в них перемешаны нужные и почти бесполезные слова, а похожие по значению слова путаются между собой. Частотная колода даёт слова в порядке их реальной полезности, и соседние слова в ней не связаны по смыслу, что для запоминания только лучше.
Как проверить, сколько частотных немецких слов я знаю?
Пройти бесплатный тест словарного запаса по частотным слоям на slova.erosheve.ru. Он занимает около пяти минут, не требует регистрации и содержит псевдослова, чтобы результат был честным. По итогам тест показывает, с какого места частотного списка вам стоит начинать, а первые триста слов колоды можно учить бесплатно.
