Момент маленький, но вы наверняка через него проходили. Вы наводите телефон на список слов этой недели, нажимаете спуск и ждёте — а половина слов возвращается искорёженной. «красивый» превращается в «крлсивый», целая строка теряется, и вот вы уже щуритесь в экран, поправляя всё вручную. Та экономия, что должна была сберечь вам десять минут, только что отняла пять.
Вот что почти никто не объясняет: когда вы фотографируете список, чтобы приложение прочитало его вслух, приложение читает вовсе не список вашего ребёнка — оно читает ваш снимок. Этот этап называется OCR (оптическое распознавание текста), и он ровно настолько хорош, насколько хороша картинка, которую вы ему дали. Чёткий, ровный, хорошо освещённый кадр распознаётся идеально с первого раза. Снимок под наклоном, с тенями и наполовину обрезанный заставляет приложение гадать — а из догадок и рождаются искорёженные слова.
Хорошая новость: вам не нужен ни сканер, ни штатив, ни какой-то особый навык. Достаточно знать четыре вещи, которые действительно решают дело. Сделайте их правильно — и всё это обещание «просто сфотографируй» наконец заработает так, как должно.
Первое: дайте свет, чтобы текст выделялся
OCR работает, отделяя тёмные чернила от светлой бумаги. Всё, что размывает этот контраст — тень, блик, жёлтый свет лампы, — затрудняет распознавание букв.
Лучший источник света — тот, что у вас уже есть: дневной свет от окна. Положите список на стол у окна (но не в жаркую полосу прямого солнца, которая засветит страницу) — и вы получите мягкий, ровный свет без всяких сложностей.
Если же это обычная ситуация «после ужина, при включённом свете», помогут две маленькие привычки:
- Выключите вспышку. На глянцевом листе или странице учебника вспышка отражается прямо назад ярко-белым пятном, которое стирает всё, что было под ним. Комнатный свет для этого почти всегда лучше вспышки.
- Не давайте собственной тени падать на страницу. Самая частая вечерняя ошибка — наклониться над списком так, что голова и телефон загораживают свет с потолка. Сместитесь вбок или держите телефон под углом сбоку, чтобы страница оставалась освещённой равномерно.
Ещё один тихий вредитель, о котором стоит знать: бледный карандаш на не белой бумаге. Если ребёнок пишет слабо, а лист кремового цвета, контраста, за который мог бы зацепиться алгоритм, почти нет. Чуть больше света поможет, а для собственных тренировочных листов ребёнка обычный карандаш с нормальным нажимом распознаётся куда лучше, чем еле заметные пёрышки.
Второе: снимайте прямо, а не под наклоном
Вот это многих удивляет. Вы инстинктивно фотографируете страницу под небольшим углом — так, как вы на неё смотрите сверху, — и этого лёгкого наклона достаточно, чтобы растянуть буквы в формы, которые приложение прочитает неправильно.
Решение — держать телефон плоско и параллельно странице, прямо над ней, чтобы список выглядел на экране прямоугольником, а не трапецией. Представьте, что вы — крышка ксерокса, опускающаяся ровно вниз. Чем ровнее кадр, тем меньше приложению приходится «исправлять» и тем меньше ошибок проскакивает.
Маленькая хитрость, если руки дрожат: обопритесь локтями о стол или прислоните телефон к стопке книг и подложите список снизу. Штатив не нужен — нужно просто убрать тот лёгкий наклон, который превращает чистый кадр в перекошенный.
Третье: сначала разгладьте страницу
Свёрнутый список слов или толстый учебник, который не хочет лежать раскрытым, создаёт маленькие тени во впадинах и изгибах — а для приложения тень может выглядеть как случайный штрих или буква.
Перед съёмкой потратьте две секунды, чтобы всё разгладить:
- Разгладьте сложенный лист рукой.
- Для толстой книги придавите корешок, чтобы она раскрылась, или прижмите уголки страницы чем-нибудь под рукой — парой монет, прищепкой, большим пальцем второй руки.
Ровная страница освещается равномерно и фотографируется чисто. Это самый незрелищный шаг — и один из самых действенных.
Четвёртое: заполните кадр списком — и только списком
Две ошибки кадрирования, в противоположных направлениях:
- Слишком далеко. Список — крошечный островок в море стола, буквы высотой всего в несколько пикселей, и приложению не с чем работать. Подойдите достаточно близко, чтобы слова заполняли большую часть экрана.
- Слишком много лишнего в кадре. Если вы захватываете весь лист — инструкции, рисунки, задачу по математике рядом, — приложение может попытаться прочитать всё это и выдать кашу. Кадрируйте только те слова, которые действительно нужно прочитать вслух.
Золотая середина: список слов заполняет кадр, весь он внутри границ (ничего не обрезано), и вокруг есть лишь небольшой запас. Близко, целиком и без лишнего.
Быстрый чек-лист перед спуском
Прежде чем нажать, пробегитесь по нему — это занимает три секунды и спасает от пересъёмки:
- Свет — яркий и равномерный, без вспышки, без тени на странице.
- Угол — телефон плоско и прямо над страницей, страница выглядит прямоугольником.
- Ровно — никаких загибов, складок и теневых впадин.
- Кадр — список заполняет экран, ничего не обрезано, ничего лишнего.
После нескольких раз это входит в привычку, и вы вообще перестаёте об этом думать.
Почему это важнее, чем кажется
Именно этот момент мы держали в голове, создавая LoroBuddy. Вся идея в том, что вы делаете один снимок списка слов — и приложение читает каждое слово вслух, чётко, по одному, — чтобы ребёнок мог слушать, писать и проверять себя сам, без вас в роли живого диктофона. Трудные слова можно даже разобрать по слогам, и всё это работает более чем на 40 языках для двуязычных семей.
Но это волшебство «руки прочь» включается только если снимок распознаётся чисто с первого раза. Хороший кадр — это значит снять один раз, отдать телефон ребёнку и уйти. Плохой кадр — это значит снова оказаться в процессе: поправлять слова и переснимать, ровно там, где вы быть не хотели.
Так что эти четыре привычки на самом деле не про фотографию. Они про то, чтобы полностью выйти из середины — чтобы инструмент делал свою работу, а ребёнок вёл свою тренировку сам. Тридцать секунд на чистый снимок покупают вам двадцать минут на диване с чашкой чая. Такой обмен стоит того.
Источники и материалы по съёмке текста для OCR: University of Pittsburgh OCR Best Practices, University of Illinois OCR Best Practices и LocalKit’s OCR lighting tips.