Почти все технологии доступности для чтения исходят из того, что где-то в цепочке пользователю всё равно понадобится экран — хотя бы чтобы выбрать файл. Этот книжный сканер на Raspberry Pi выбрасывает такое допущение в окно. Он фотографирует раскрытую бумажную книгу, превращает текст в речь и отдаёт управление горстке тактильных кнопок: ни дисплея, ни меню, ни единого элемента, который нужно увидеть, потому что видеть здесь ничего не требуется.
Две камеры на 16 мегапикселей с широкоугольной оптикой расположены под книгой — по одной на страницу, так что весь разворот снимается за один проход. По бокам стоят самодельные светодиодные платы, освещающие бумагу под малым углом, а не сверху: небольшое оптическое решение, которое даёт равномерную засветку и одновременно убирает блики со стеклянных панелей, прижимающих книгу снизу.
Автор: Ludwin (lhm0)
Стекло здесь значит больше, чем кажется. Печатные книги редко ложатся идеально плоско, и любой изгиб у корешка способен размыть или скрыть текст ровно там, где сходятся две страницы. Конструкция учитывает это требованием, чтобы текст отстоял от корешка не менее чем на 0,35 дюйма (около 9 мм). Для туго переплетённых покетбуков это реальное ограничение, но именно оно удерживает высокую точность распознавания на обычных книгах, которые у людей стоят на полках.
После съёмки страницы система OCR превращает изображение в текст, а синтезатор речи немедленно читает его вслух, почти мгновенно замыкая путь от печатной страницы к произнесённому слову. Но самое интересное решение проявляется в том, как устройство работает с длинными сессиями чтения. Страницы группируются блоками примерно по 10–20 штук, причём блок, как правило, заканчивается там, где естественно проходит граница главы, и каждый такой блок автоматически резюмируется.
Это резюмирование открывает то, чего прямолинейная «читалка страниц» дать не может: устный пересказ прочитанного по запросу, в любой момент, когда человек возвращается к книге после нескольких дней перерыва. Вместо того чтобы заново прослушивать предыдущие страницы ради восстановления контекста, устройство просто рассказывает, на чём сейчас стоит сюжет, — обращаясь с памятью так же практично, как это делают метки глав в приложении для аудиокниг.
Несколько книг уживаются в одном устройстве благодаря на удивление простому приёму: на каждую наклеена NFC-метка. Считали метку — и система точно знает, к какой внутренней записи прикреплять новые страницы. Стопка недочитанных книг может стоять на полке сколь угодно долго, и отсканированные страницы никогда не перепутаются между собой. Возьмите любую спустя месяцы, приложите метку — и продолжите ровно с того места, где остановились.
Вся документация проекта — перечень компонентов, разводка печатных плат, файлы напечатанного на 3D-принтере корпуса и полный программный стек — опубликована открыто: повторяй или улучшай. Эта открытость превращает единичное устройство доступности в шаблон, который другие сборщики могут адаптировать под собственные задачи. Для СНГ это особенно значимо: коммерческие читающие машины стоят как подержанный автомобиль и почти не поставляются, тогда как повторить такую конструкцию можно из компонентов, доступных на любом маркетплейсе, а поддержку нужного языка обеспечивают открытые движки OCR и синтеза речи.






















