Скан документа, страница книги, рукопись, таблица на фото. Нейросеть вытаскивает текст в редактируемый вид за секунды. Разберём, чем распознавать бесплатно, что она читает, а что путает.
Распознать текст нейросетью это превратить картинку с текстом, фото, скан, скриншот или рукопись, в редактируемый текст, который можно копировать и править. Бесплатно это делают Яндекс и Google по фото, а из чат-моделей читают текст с изображений Gemini и ChatGPT. Печатный текст на чётком фото разбирается уверенно, рукопись хуже. Важно не путать распознавание с переводом: здесь речь про извлечь текст в том же языке, а если его надо ещё и переложить на русский, это отдельная задача перевода с фото.
Что узнаешь из гайда
Часть 1 · Выбор
Главное
Просто и бесплатно, Яндекс и Google по фото. Для сложных случаев и таблиц, мультимодальные Gemini и ChatGPT, читающие изображения.
Для быстрой оцифровки хватает поиска по картинке в Яндексе или Google: они распознают текст с фото прямо на телефоне. Когда нужен точный формат, таблица или разбор сложного документа, удобнее чат-модели, которые видят изображение. Как пользоваться такой моделью, разобрано в гайде про Gemini. Если распознать нужно многостраничный PDF, посмотрите разбор про скиллы Claude для работы с PDF.
Часть 2 · Форматы
Разные материалы даются нейросети по-разному. Чёткий печатный текст она читает почти без ошибок, а рукопись и мятые сканы, наоборот, требуют проверки. Понимание этой разницы экономит время: где-то можно доверять, а где-то обязательно вычитывать.
Как распознаётся разное
Приём
Для таблицы с фото прямо просите вернуть её в виде таблицы со строками и столбцами. Тогда данные не слипнутся в сплошной текст, и их сразу можно вставить в Excel или Google Таблицы. А распознанный текст удобно тут же сжать в конспект, если материал длинный.
Часть 3 · Практика
Качество распознавания решается ещё на этапе фото. Чем чище картинка, тем меньше правок потом:
Распознай текст с этого фото документа.
ЗАДАЧА: извлеки весь текст без изменений, ничего не переводи
ФОРМАТ: сохрани абзацы и списки как в оригинале
ЕСЛИ таблица — верни её строками и столбцами
ОТМЕТЬ места, где не уверен в символах, знаком вопроса.Хорошее фото решает половину задачи, остальное проверка цифр и имён руками.
Часть 4 · Развод задач
Две задачи часто путают, а они разные. Распознавание это извлечь текст с картинки в том же языке и сделать его редактируемым. Перевод это ещё и переложить его на другой язык. Если вам нужно просто оцифровать документ на русском, хватит распознавания, о котором этот гайд.
Когда нужен перевод
Если текст на фото на иностранном языке и нужен на русском, это задача перевода с фото. Как распознать и сразу перевести, сохранив в Word, разобрано в отдельном гайде про перевод текста с фото.
Часть 5 · Честно
Чего ждать не стоит
Идеального распознавания рукописи и плохих фото. Беглый почерк, блеклый текст, блики и наклон приводят к ошибкам в символах. Цифры, фамилии, артикулы и суммы модель иногда путает, поэтому важные данные всегда сверяйте с оригиналом, а не доверяйте вслепую.
Коротко
распознавание, а не перевод: нужен другой язык, смотрите гайд про перевод с фото.Вопросы
Чтобы распознать текст с картинки, загрузите фото или скан в нейросеть с распознаванием и попросите извлечь текст без изменений. Подойдут мультимодальные модели вроде Gemini и ChatGPT, а из простого и бесплатного, Яндекс и Google по фото. Уточните нужный формат: сплошной текст, список или таблица. Готовый текст сверьте с оригиналом и скопируйте в редактор, где его можно править.
Бесплатно распознать текст с фото помогают Яндекс и Google прямо в поиске по картинке, а из чат-моделей это умеют Gemini и ChatGPT, читающие изображения. Печатный текст на чётком фото они разбирают уверенно и на русском, и на других языках. Для сканов документов и PDF удобны инструменты, которые вытаскивают текст постранично. Качество зависит от фото: чем оно резче и ровнее, тем меньше ошибок.
Рукописный текст нейросеть распознаёт, но заметно хуже печатного: аккуратный разборчивый почерк она читает неплохо, а беглый и мелкий часто путает. Помогает хорошее фото при ровном свете и просьба показать неуверенные места. Результат обязательно вычитывайте, особенно цифры, фамилии и подписи. Для важных рукописных документов на нейросеть полагаться полностью не стоит.
Распознавание это извлечь текст с картинки в том же языке и сделать его редактируемым, а перевод это ещё и переложить его на другой язык. Если вам нужно просто оцифровать документ, скан или рукопись, хватит распознавания. Если текст на иностранном и нужен на русском, это уже задача перевода с фото, и для неё у нас есть отдельный разбор.
Читать дальше
Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.
Посмотреть, что внутриtelegram
Канал с полезными материалами про нейросети
Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.