Как учит ConvoLive и какие исследования за этим стоят

Обновлено

ConvoLive учит одним способом. Вы открываете приложение, персонаж начинает с вами разговор на языке, который вы учите, и вы отвечаете вслух, пока не сделаете три вещи, которых требует сцена. Заказать напиток, спросить про аллерген, попросить счёт. На этом всё. Завтра будет следующая.

Это узкий замысел, и нас спрашивают, почему он такой узкий. Где таблицы грамматики, списки слов, тесты с вариантами ответов? Честный ответ: мы начинали именно с них, посмотрели, что из этого вышло, а потом пошли читать, что говорят исследования о том, как люди на самом деле начинают говорить. Эта страница и есть вторая половина ответа.

Каждый раздел ниже описывает одно решение, то, что мы сделали в приложении из-за него, и исследования, на которые оно опирается. Коротко:

  1. Погружение работает потому, что заставляет говорить, а не потому, что окружает языком
  2. Говорить значит извлекать из памяти, а извлечение улучшается только практикой
  3. Разговор с целью учит больше, чем упражнение
  4. Помощь должна приходить после первой попытки, а не до неё
  5. Повторение сцены строит беглость, но повторять нужно завтра, а не сейчас
  6. У дневной практики есть конец, и завтрашний день уже запланирован
  7. Серия с днями отдыха живёт дольше строгой
  8. Разговор с ИИ снижает страх, который мешает людям говорить
  9. Награды за само участие вредят мотивации, честная обратная связь не вредит

Полный список источников находится внизу, и каждая ссылка на странице ведёт к своей записи в нём.

Погружение работает, но не по той причине, о которой все думают

Самая распространённая история про изучение языка звучит так: я учил годами, ничего не запоминалось, потом переехал туда, и всё встало на место. Обычное объяснение: вас окружал язык. Речь повсюду.

Исследования говорят, что окружение необходимо, но недостаточно.

В 1980-е Меррилл Свейн изучала детей в канадских школах с погружением во французский. Их годами учили на французском, тысячи часов понятной речи, и понимали они её очень хорошо. Но их устный французский был всё ещё далёк от того, что должен был дать такой объём. Вывод Свейн, ставший гипотезой выхода (output hypothesis), состоял в том, что понимание и порождение речи это разные навыки, и одна входящая речь не строит второй. Нужно, чтобы вас подталкивали к тому, чтобы говорить, чтобы вы замечали пробелы, когда не получается, и пробовали снова1.

Более чистая проверка появилась в 2004 году. Фрид, Сегаловиц и Дьюи сравнили три группы изучающих французский: обычные занятия дома, семестр во Франции и семинедельная интенсивная программа дома, где студенты обещали говорить только по-французски. Больше всех в устной беглости продвинулась не группа во Франции. Это была группа домашнего погружения, которая к тому же сообщала, что говорит и пишет по-французски вне занятий гораздо больше, чем обе другие2. Двадцать восемь студентов это небольшое исследование, а единственным статистическим предиктором роста беглости оказались, как ни странно, часы, потраченные на письмо вне занятий, так что честное прочтение уже, чем заголовок: группы различало то, сколько они пользовались языком, а не то, где они находились. Жить где-то и быть вынужденным говорить не одно и то же.

Поэтому мы не пытались имитировать жизнь за границей. Мы пытались воспроизвести ту её часть, которая работает: обычная жизнь подкидывает вам маленькую задачу с целью, и решить её нельзя иначе, чем что-то сказав.

В приложении: каждый урок это разговор вслух, в котором нужно чего-то добиться. Нет отдельного режима чтения и отдельного режима аудирования. Даже настройка происходит голосом: ведущий спрашивает, что вы хотите выучить, и вы отвечаете вслух, так что привычка начинается в первые тридцать секунд.

Говорить значит извлекать из памяти, и это нужно тренировать

Знать слово, когда вы его видите, и находить слово, когда оно вам нужно, это разные способности, и держатся они с разной прочностью. Чтение и карточки тренируют первую. Речи нужна вторая. Я написал отдельную статью о том, откуда берётся этот разрыв (на английском), но если коротко, путь от смысла к слову ускоряется только от использования.

Доказательства того, что вытащить что-то из памяти полезнее, чем посмотреть на это ещё раз, одни из самых надёжных во всей науке об обучении. Рёдигер и Карпик давали студентам либо перечитать текст, либо пройти по нему тест; через неделю группа с тестом помнила намного больше, хотя группа с перечитыванием чувствовала себя увереннее3. Затем Карпик и Рёдигер показали на иностранной лексике, что именно повторное извлечение, а не повторное изучение, даёт прочный результат: через неделю припоминание было примерно вдвое лучше4.

Для приложения, где нужно говорить, важнее всего исследование Кана, Голлан и Пашлера 2013 года. Большинство языковых программ просят повторять за носителем. Команда Кана сравнила это с условием, где ученики сначала должны были сами попытаться произнести слово и только потом слышали образец. Попытка вначале давала лучшее понимание и лучшее воспроизведение слов, и, что беспокоит всех, без потери качества произношения5. Чтобы сказать хорошо, не обязательно сначала услышать. Нужно потянуться за словом. В исследовании Кана были отдельные слова и картинки, а не предложения в разговоре, так что для приложения вроде нашего это смежное свидетельство, а не прямая проверка.

Теория усвоения навыков объясняет механизм. Декейзер описывает, как знание языка переходит из декларативного (вы можете сформулировать правило) в процедурное (вы пользуетесь им не задумываясь) только через практику самого навыка в условиях, близких к тем, в которых вы будете его применять6. Практика чтения делает вас лучше в чтении. Практика построения предложений в реальном времени делает вас лучше в этом.

В приложении: вы говорите на каждом ходу. В итогах урока реплики своими словами считаются отдельно от реплик, прочитанных с подсказки, потому что именно они были извлечением из памяти.

Разговор, а не упражнения

Если цель в том, чтобы говорить, почему не упражнения? Скажите это предложение. Теперь вот это. Такое было бы проще построить.

Потому что исследования взаимодействия говорят, что значительная часть обучения происходит именно в обмене репликами. Гипотеза взаимодействия Лонга предполагала, что когда вам с собеседником приходится согласовывать смысл (он не понял, вы переформулировали, он уточнил, вы подтвердили), само это согласование делает нужный язык заметным так, как упражнение не может7. Метаанализ Макки и Гу по этим исследованиям показал, что взаимодействие даёт большой прирост и на немедленных, и на отложенных тестах, и, что примечательно, эффект для лексики оставался сильным спустя недели8.

Задачно-ориентированное обучение идёт дальше: дайте ученикам реальную задачу с результатом, который можно оценить, а язык пусть будет любым, лишь бы привёл к цели. Брифонски и Маккей объединили 52 исследования таких программ и нашли сильный общий эффект (d = 0,93); более поздний повторный анализ дал g = 0,61, а обзор 2023 года утверждает, что исследования слишком разнородны, чтобы их вообще объединять9. Так что размер эффекта спорен. Не спорно, ни там, ни в исследованиях взаимодействия выше, то, что ученикам нужно использовать язык для чего-то, а задача с результатом даёт разговору причину существовать.

Ключевое слово здесь: задача. У открытого чата нет ничего, в чём можно преуспеть, и нет способа понять, хорошо ли прошло, и именно здесь большинство продуктов из серии «просто поговорите с ИИ» теряют людей. У задачи есть конец.

В приложении: у каждой сцены три цели, показанные списком. Они отмечаются, когда вы действительно это сказали, и разговор заканчивается, когда они выполнены. Если персонаж вас не понял, он говорит об этом и спрашивает снова, как сделал бы человек, а не показывает красный крестик; вы узнаёте, сработала ли реплика, по тому, что приходит в ответ, и исправляете её в следующей. Целый разговор занимает несколько минут.

Помощь приходит после того, как вы попробовали

Каждый ученик доходит до момента, когда у него ничего нет. Приложение для речи обязано справляться с этим моментом, иначе люди уходят. Вопрос в том, когда помогать.

Ответ исследований: после попытки, а не до. Корнелл, Хейс и Бьорк показали, что попытаться ответить и не справиться, а потом увидеть ответ, учит лучше, чем сразу получить ответ, даже если попытка была безнадёжной10. Более широкая работа Бьорка о «желательных трудностях» собирает множество результатов той же формы: условия, в которых практика кажется труднее и медленнее, часто закрепляют лучше, а условия, в которых она кажется гладкой, часто нет11. Результат Кана выше это тот же вывод в контексте речи: потянуться за словом лучше, чем получить его в руки.

Строить так неудобно, потому что подсказка, предложенная заранее, кажется добрее и лучше проходит тесты в первую минуту. Но подсказка до попытки превращает практику извлечения обратно в практику чтения.

В приложении: когда ваш ход, есть подсказки, по которым можно нажать и услышать, как фраза звучит правильно, и способ спросить «как сказать...» на своём языке. И то и другое существует, чтобы вы продолжали говорить, а не смотрели в экран, и то и другое необязательно: разговор не ждёт, пока вы ими воспользуетесь. В итогах урока реплики своими словами считаются отдельно от реплик, прочитанных с подсказки, потому что обучение происходит в момент, когда вы тянетесь за словом, и именно это число стоит стараться поднять.

Повторяйте сцену, но завтра

Вы заметите, что в ConvoLive одни и те же ситуации возвращаются. Это намеренно, и расписание тоже намеренно.

Де Йонг и Перфетти просили студентов, изучающих английский, произнести четырёхминутную речь, затем трёхминутную, затем двухминутную. Половина повторяла одну и ту же тему, половина каждый раз получала новую. Обе группы ускорились за время тренировки; только группа с повторением сохранила прирост на последующих тестах, и её скорость переносилась на новые темы, которые она никогда не отрабатывала12. Повторение задания учит не только этому заданию. Оно делает язык внутри него автоматическим. Более ранняя работа Байгейта нашла то же: повторение речевого задания улучшало и беглость, и сложность речи13.

Дальше вопрос, когда повторять. Судзуки и Хандзава сравнили выполнение одного задания шесть раз за одно занятие с распределением его по нескольким занятиям или по неделе. Плотное повторение быстрее всего убирало паузы, но при этом замедляло артикуляцию и давало больше дословных повторов: ученики декламировали, а не говорили14. Затем Какитани и Кормос проверили интервалы в один день против семи дней между занятиями по беглости и через месяц нашли одинаковый прирост в обоих случаях15. Дня перерыва достаточно. Повторять сразу же, вот единственное расписание, которого стоит избегать.

Распределение во времени вообще одно из самых старых открытий в исследованиях памяти; обзор Сепеды и коллег охватывает более 250 исследований16. Собственный производственный эксперимент Duolingo на 3,3 миллиона учеников показал, что более удачная модель интервалов подняла ежедневное удержание на 12% для любой активности17.

В приложении: курс состоит из ста сцен, поэтому одни и те же функции (заказать, спросить дорогу, описать проблему) возвращаются в новых обстоятельствах, а не как повтор того же сценария. Когда вы завершаете сцену, приложение записывает ваш лучший результат и предлагает побить его завтра, а не сейчас.

У дневной практики есть конец

Сколько заниматься в день, это тоже вопрос дизайна, и здесь свидетельства наши собственные, а не из статьи. Это корреляция, а не эксперимент, и относиться к ней нужно соответственно.

Из 461 человека, зарегистрировавшихся с 18 по 25 августа 2026 года, те, кто в первый день завершил четыре и более разговора, возвращались в другой день в 48% случаев против 14% у тех, кто не завершил ни одного. Но медианная первая сессия в этой группе длилась 24 минуты, и большинство из них всё равно так и не вернулись. Большая первая сессия это энтузиазм, а не привычка. Три это продуктовое решение, а не число из исследования: достаточно, чтобы получилось настоящее занятие, и достаточно мало, чтобы закончить и остановиться.

Лучше всего подтверждённый дешёвый инструмент, превращающий одно занятие во второе, это намерение реализации (implementation intention): конкретное решение, когда вы займётесь этим в следующий раз. Метаанализ Гольвицера и Ширана по 94 исследованиям оценивает эффект в d = 0,65, что много для вещи, которая требует одного вопроса18. Нунес и Дрез обнаружили, что люди гораздо охотнее доводят до конца цель, в которой уже виден прогресс, чем ту, что начинается с нуля19.

В приложении: дневная практика это три разговора. Когда третий заканчивается, приложение говорит об этом, показывает уже готовую завтрашнюю сцену и задаёт один вопрос: когда завтра? Напоминание придёт в это время и назовёт эту сцену. Можно сделать и четвёртый, если хотите, но экран уже сказал вам, что день закончен.

Серия, которую можно пропустить

Серии работают; но они хрупкие. Сильверман и Бараш обнаружили, что человек, увидевший прерванную серию, продолжает реже, чем увидевший целую, и что ущерб гораздо меньше, если серию можно восстановить20. Шариф и Шу нашли, что цели с небольшим встроенным запасом («пять дней из семи») и предпочтительнее, и достигаются лучше, чем строгие, и что люди, пропустившие день, при запасе восстанавливаются гораздо чаще21. Самым крупным задокументированным улучшением серий в Duolingo стало то, что серию продлевало одно небольшое действие вместо полной дневной нормы22.

В приложении: серия это счётчик дней с двумя днями отдыха в каждой скользящей неделе. Пропустите два дня, и ничего не случится. Один разговор поддерживает её. А когда она всё же заканчивается, приложение не устраивает из этого драмы.

Разговор с тем, кто вас не судит

Говорение вызывает больше всего тревоги из четырёх навыков, и эта тревога измеримо подавляет и результат, и готовность говорить вообще23. Модель готовности к общению Макинтайра рассматривает эту готовность как последний шаг перед речью, а значит, то, на что в итоге должны влиять все остальные переменные24.

Одно из устойчивых наблюдений последних лет: разговор с машиной снижает планку. Башори и коллеги провели квазиэксперимент с 232 индонезийскими школьниками: группы, занимавшиеся на сайтах с распознаванием речи, в итоге испытывали меньше тревоги при говорении, чем группа на обычных уроках, а в интервью ученики говорили, что говорить с сайтом им было спокойнее, чем с людьми25. Тай и Чэнь обнаружили, что подростки, занимавшиеся с голосовым помощником, стали значительно охотнее общаться на английском, с меньшей тревогой и большей уверенностью, потому что эта среда была менее угрожающей, чем класс26.

Это единственное преимущество ИИ-собеседника перед человеком, и мы на него опираемся. У персонажа нет мнения о вас. Можно три раза подряд провалиться в кафе, и никто, кроме вас, об этом не узнает.

В приложении: начать заново можно в любой момент, ничего не оценивается на глазах у других, а первая попытка в любой сцене имеет право быть ужасной.

Чего мы намеренно не делаем

Некоторых вещей нет, потому что свидетельства против них, а не потому, что мы до них не дошли.

Здесь нет сердечек, нет энергии, нет магазина кристаллов и нет витрины со значками. Отчасти это свидетельства, отчасти вкус, и вот что есть что.

Свидетельства касаются ожидаемых наград и соревнования. Метаанализ Деси, Кёстнера и Райана по 128 исследованиям показал, что ожидаемые материальные награды за интересное занятие снижают внутреннюю мотивацию к нему, а информация о том, как у вас получается, нет27. Меклер и коллеги обнаружили, что очки, уровни и таблицы лидеров повышали то, сколько люди делают, не меняя ни того, насколько хорошо они это делают, ни того, насколько им этого хочется28. Ханус и Фокс провели семестровое испытание значков и таблиц лидеров в классе и нашли в геймифицированной группе более низкую мотивацию и более низкие оценки на экзамене29.

Сердечки и энергия это другое: не награда, а штраф за ошибки, а раздел о помощи выше это довод в пользу того, чтобы ошибки были дешёвыми. Не делать их это дизайнерское решение, согласующееся с этим доводом, а не вывод исследования.

Поэтому экран в конце урока рассказывает, что произошло: какие цели вы выполнили, сколько реплик сказали, сколько из них своими словами, сколько персонаж понял с первого раза, и ваш лучший результат в этой сцене. Информация о компетентности, которая, по тем же исследованиям, помогает. XP есть, как тихое число. И всё.

Нет и режима свободного чата, по причине из раздела о разговоре: у него нет конца и нет способа провалиться, а задача, которую нельзя провалить, не может ощущаться как прогресс.

Заключение

Говорите вслух, в ситуации с целью, как можно чаще сами дотягиваясь до слов. Узнавайте, сработало ли, по тому, что приходит в ответ. Завтра, а не сейчас, делайте что-то похожее снова. Три в день, потом стоп. Держите серию, прощайте пропуск. Никаких наград за само участие, только честный отчёт о том, что вы сказали.

Ничего из этого не ново. Это то, что исследования давно говорят о том, как люди учатся говорить, применённое без тех частей, которые делают приложение приятнее в первую минуту и пустее в первый месяц. Если хотите почувствовать, как это, приложение бесплатно, а первый разговор и должен быть трудным.

Цифры ConvoLive взяты из нашей собственной аналитики по регистрациям с 18 по 25 августа 2026 года, тестовые аккаунты исключены. «Вернулся» означает любую активность в любой последующий календарный день; наблюдение велось не менее пяти дней после регистрации.

Источники

  1. Swain, M. (1985). Communicative competence: Some roles of comprehensible input and comprehensible output in its development. In S. Gass & C. Madden (Eds.), Input in Second Language Acquisition (pp. 235–253). Newbury House.

  2. Freed, B. F., Segalowitz, N., & Dewey, D. P. (2004). Context of learning and second language fluency in French: Comparing regular classroom, study abroad, and intensive domestic immersion programs. Studies in Second Language Acquisition, 26(2), 275–301. doi:10.1017/S0272263104262064

  3. Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255. doi:10.1111/j.1467-9280.2006.01693.x

  4. Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968. doi:10.1126/science.1152408

  5. Kang, S. H. K., Gollan, T. H., & Pashler, H. (2013). Don't just repeat after me: Retrieval practice is better than imitation for foreign vocabulary learning. Psychonomic Bulletin & Review, 20(6), 1259–1265. doi:10.3758/s13423-013-0450-z

  6. DeKeyser, R. (2007). Skill acquisition theory. In B. VanPatten & J. Williams (Eds.), Theories in Second Language Acquisition: An Introduction (pp. 97–112). Lawrence Erlbaum.

  7. Long, M. H. (1996). The role of the linguistic environment in second language acquisition. In W. C. Ritchie & T. K. Bhatia (Eds.), Handbook of Second Language Acquisition (pp. 413–468). Academic Press. doi:10.1016/B978-012589042-7/50015-3

  8. Mackey, A., & Goo, J. (2007). Interaction research in SLA: A meta-analysis and research synthesis. In A. Mackey (Ed.), Conversational Interaction in Second Language Acquisition (pp. 407–452). Oxford University Press. eprints.lancs.ac.uk

  9. Bryfonski, L., & McKay, T. H. (2019). TBLT implementation and evaluation: A meta-analysis. Language Teaching Research, 23(5), 603–632. doi:10.1177/1362168817744389. Re-analysis: Xuan, Q., Cheung, A., & Liu, J. (2025). Language Teaching Research. doi:10.1177/13621688221131127. Review: Boers, F., & Faez, F. (2023). Meta-analysis to estimate the relative effectiveness of TBLT programs: Are we there yet? Language Teaching Research. doi:10.1177/13621688231167573

  10. Kornell, N., Hays, M. J., & Bjork, R. A. (2009). Unsuccessful retrieval attempts enhance subsequent learning. Journal of Experimental Psychology: Learning, Memory, and Cognition, 35(4), 989–998. doi:10.1037/a0015729

  11. Bjork, E. L., & Bjork, R. A. (2011). Making things hard on yourself, but in a good way: Creating desirable difficulties to enhance learning. In M. A. Gernsbacher et al. (Eds.), Psychology and the Real World (pp. 56–64). Worth. bjorklab.psych.ucla.edu

  12. de Jong, N., & Perfetti, C. A. (2011). Fluency training in the ESL classroom: An experimental study of fluency development and proceduralization. Language Learning, 61(2), 533–568. doi:10.1111/j.1467-9922.2010.00620.x

  13. Bygate, M. (2001). Effects of task repetition on the structure and control of oral language. In M. Bygate, P. Skehan & M. Swain (Eds.), Researching Pedagogic Tasks: Second Language Learning, Teaching and Testing (pp. 23–48). Longman. routledge.com

  14. Suzuki, Y., & Hanzawa, K. (2022). Massed task repetition is a double-edged sword for fluency development: An EFL classroom study. Studies in Second Language Acquisition, 44(2), 536–561. doi:10.1017/S0272263121000358

  15. Kakitani, J., & Kormos, J. (2024). The effects of distributed practice on second language fluency development. Studies in Second Language Acquisition, 46(3), 770–794. doi:10.1017/S0272263124000251

  16. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380. doi:10.1037/0033-2909.132.3.354

  17. Settles, B., & Meeder, B. (2016). A trainable spaced repetition model for language learning. Proceedings of ACL 2016, 1848–1858. research.duolingo.com

  18. Gollwitzer, P. M., & Sheeran, P. (2006). Implementation intentions and goal achievement: A meta-analysis of effects and processes. Advances in Experimental Social Psychology, 38, 69–119. doi:10.1016/S0065-2601(06)38002-1

  19. Nunes, J. C., & Drèze, X. (2006). The endowed progress effect: How artificial advancement increases effort. Journal of Consumer Research, 32(4), 504–512. doi:10.1086/500480

  20. Silverman, J., & Barasch, A. (2023). On or off track: How (broken) streaks affect consumer decisions. Journal of Consumer Research, 49(6), 1095–1117. doi:10.1093/jcr/ucac029

  21. Sharif, M. A., & Shu, S. B. (2017). The benefits of emergency reserves: Greater preference and persistence for goals that have slack with a cost. Journal of Marketing Research, 54(3), 495–509. doi:10.1509/jmr.15.0231

  22. Duolingo (2020). Improving the streak. blog.duolingo.com

  23. Horwitz, E. K., Horwitz, M. B., & Cope, J. (1986). Foreign language classroom anxiety. The Modern Language Journal, 70(2), 125–132. doi:10.1111/j.1540-4781.1986.tb05256.x

  24. MacIntyre, P. D., Clément, R., Dörnyei, Z., & Noels, K. A. (1998). Conceptualizing willingness to communicate in a L2: A situational model of L2 confidence and affiliation. The Modern Language Journal, 82(4), 545–562. doi:10.1111/j.1540-4781.1998.tb05543.x

  25. Bashori, M., van Hout, R., Strik, H., & Cucchiarini, C. (2021). Effects of ASR-based websites on EFL learners' vocabulary, speaking anxiety, and language enjoyment. System, 99, 102496. doi:10.1016/j.system.2021.102496

  26. Tai, T.-Y., & Chen, H. H.-J. (2023). The impact of Google Assistant on adolescent EFL learners' willingness to communicate. Interactive Learning Environments, 31(3), 1485–1502. doi:10.1080/10494820.2020.1841801

  27. Deci, E. L., Koestner, R., & Ryan, R. M. (1999). A meta-analytic review of experiments examining the effects of extrinsic rewards on intrinsic motivation. Psychological Bulletin, 125(6), 627–668. doi:10.1037/0033-2909.125.6.627

  28. Mekler, E. D., Brühlmann, F., Tuch, A. N., & Opwis, K. (2017). Towards understanding the effects of individual gamification elements on intrinsic motivation and performance. Computers in Human Behavior, 71, 525–534. doi:10.1016/j.chb.2015.08.048

  29. Hanus, M. D., & Fox, J. (2015). Assessing the effects of gamification in the classroom: A longitudinal study on intrinsic motivation, social comparison, satisfaction, effort, and academic performance. Computers & Education, 80, 152–161. doi:10.1016/j.compedu.2014.08.019