Открытый гайд · ИИ-офис

Документы и нейросеть: что правда работает

Разбираем работу с документами по существу: какие задачи снимаются сегодня, какие форматы и объёмы принимают сервисы, где модель врёт и что в неё нельзя загружать.

Кирилл СандаковКирилл СандаковВайбкодер, предприниматель, продюсерОпубликовано 24.08.202610 мин чтения

Нейросеть для документов — это не редактор и не хранилище, а читатель: вы загружаете файл, а модель отвечает по его содержимому. Надёжно снимаются четыре типа задач — пересказать длинное, найти нужный пункт, сравнить две версии и вытащить данные в таблицу. Ненадёжно всё, где нужна юридическая или бухгалтерская ответственность: там вывод модели остаётся черновиком, который сверяют с исходником.

Что узнаешь из гайда

  • Пять задач, которые реально снимаются
  • Какие форматы и какой объём принимают сервисы
  • Что делать со сканом и фотографией страницы
  • Где модель уверенно врёт и как это ловить
  • Что нельзя загружать ни в какой сервис

Часть 1 · Постановка

Что нейросеть делает с документом

Главное

Модель читает файл и отвечает по нему. Она не редактирует ваш документ и не хранит его вместо диска.

Из этого следует практическая рамка. Всё, что формулируется как «найди, объясни, перескажи, сравни, вытащи», работает хорошо: у модели есть текст перед глазами, и она отвечает по нему. Всё, что формулируется как «исправь в файле и верни как было, только лучше», работает плохо: нейросеть отдаёт новый текст отдельно от вашей вёрстки, и переносить его в файл придётся руками.

Отдельно стоит развести два похожих запроса. «Работа с документами» — это чтение и разбор содержимого. «Оформление документа» — это стили, оглавление, нумерация и шаблоны, и там задача решается внутри редактора; про эту сторону есть отдельный разбор про нейросеть для Word. Смешивать их не стоит: у них разные инструменты и разный результат.

Почему это вообще стало возможно

Современные модели читают документ не как строку текста, а как страницу: видят вёрстку, колонки и таблицы. В документации Claude прямо сказано, что поддержка PDF опирается на зрение модели и наследует его ограничения. Отсюда сильная сторона — понимание структуры. И отсюда же слабая: то, что плохо видно человеку, плохо видно и модели.


Часть 2 · Практика

Пять задач, которые снимаются сегодня

Главное

Общая формула запроса одна: задача плюс требование ссылаться на место в документе. Без второй части проверять ответ невозможно.

ЗадачаКак проситьЧем проверять
1. Разобрать длинное«Кратко: о чём документ, кто стороны, какие сроки и суммы, что требуется от меня»Открыть названные страницы и сверить
2. Найти пункт«Найди всё про расторжение и штрафы, процитируй дословно и укажи номер пункта»Поиск по цитате прямо в файле
3. Сравнить версии«Вот две редакции. Что изменилось по смыслу, а не по формулировкам»Сравнение версий в самом редакторе
4. Вытащить данные«Собери из этих актов таблицу: дата, номер, сумма, контрагент»Сверить итоговую сумму с исходником
5. Черновик по образцу«Вот наш типовой документ. Сделай такой же под эти вводные»Вычитка человеком до отправки

Требование цитировать дословно и указывать номер пункта — не вежливость, а рабочий приём. Пока ответ выглядит как пересказ своими словами, проверить его можно только прочитав документ целиком, то есть выигрыш времени пропадает. Как только в ответе стоит цитата, проверка занимает секунды: поиск по строке.

У краткого содержания есть свои тонкости: что делать с текстом, который не влезает целиком, и как не потерять смысл на длинной дистанции. Это разобрано отдельно, в гайде про пересказ и краткое содержание. Таблицы и расчёты, наоборот, лучше уводить в работу с Excel: модель хорошо собирает данные, но считать их лучше формулой.


Часть 3 · Ограничения

Форматы и объём: во что упирается загрузка

Главное

Лимит считается по всему запросу, включая всё, что вы отправили вместе с файлом. Отсюда и знакомое «файл маленький, а запрос не проходит».

У GigaChat в документации, обновлённой 17 июля 2026 года, перечислены восемь текстовых форматов: txt, doc, docx, pdf, epub, ppt, pptx и xlsx. Отдельно принимаются изображения (jpeg, png, tiff, bmp) и аудио. Ограничения по размеру заданы прямо: один текстовый файл — не более 40 мегабайт, одно изображение — не более 15, один аудиофайл — не более 35, а весь запрос с картинками и звуком должен быть меньше 80 мегабайт.

У Claude рамка другая и она жёстче по объёму: максимальный размер запроса — 32 мегабайта, максимум страниц — 600, и всего 100, если окно контекста меньше миллиона токенов. PDF должен быть обычным, без пароля и шифрования. Важная деталь из той же документации: оба лимита считаются по всей полезной нагрузке запроса, включая текст и всё остальное, что уехало вместе с файлом.

Что сравниваемGigaChatClaude
Текстовые форматыtxt, doc, docx, pdf, epub, ppt, pptx, xlsxPDF без пароля и шифрования
РазмерТекстовый файл до 40 Мб, запрос до 80 МбВесь запрос до 32 Мб
СтраницыОграничение задано в мегабайтах600, и 100 при контексте меньше миллиона токенов
Доступ из РоссииНапрямуюЧерез обходные пути

Плотный PDF падает раньше номинального предела

В документации Claude сказано прямо: документы с мелким шрифтом, сложными таблицами и тяжёлой графикой заполняют окно контекста ещё до того, как упрётся лимит страниц, и запрос может не пройти, даже если формально страниц меньше разрешённого. Лечится это разбивкой файла на части по разделам; механическое деление пополам обычно рвёт смысл посередине.

Есть ещё одна ловушка, о которой документация GigaChat предупреждает отдельно: при загрузке файла нужно передавать назначение purpose="general", иначе загруженный файл нельзя будет использовать в запросах на генерацию. Это касается работы через API — в обычном чате параметр проставляется сам. Практическая часть работы через интерфейс разобрана в гайде про GigaChat.


Часть 4 · Бумага

Скан, фото страницы и рукопись

Главное

Скан — это картинка со страницей внутри. Разница вылезает там, где нужен точный поиск и точные цифры.

PDF бывает двух совершенно разных видов. В одном лежит настоящий текст, который выделяется мышкой и ищется поиском. В другом лежит фотография страницы, и текста внутри файла нет вообще. Внешне они неотличимы, и именно поэтому одинаковые на вид документы ведут себя в нейросети по-разному.

С фотографией страницы модель справляется через зрение: описывает, что видит, и пересказывает содержание. Но чем хуже качество съёмки — блик, перекос, тень от руки — тем выше шанс, что цифра прочитается неверно, а вы этого не заметите, потому что ответ будет выглядеть уверенно. Для задач, где цена ошибки в цифре высока, порядок другой: сначала распознать текст, проверить распознанное, и только потом отдавать в работу. Про этот шаг есть отдельный гайд — как распознать текст со скана и фото.

Ещё одно место, где ломаются именно сканы, — таблицы. Модель видит сетку и цифры, но связь «эта цифра относится к этой строке и этому столбцу» на кривом скане собирается ненадёжно. Проверять такие таблицы нужно по контрольной сумме: если итог сходится, скорее всего сошлось и остальное.


Часть 5 · Границы

Где модель врёт и как это ловить

Главное

Опасен не отказ, а уверенный ответ про пункт, которого в документе нет.

  • Несуществующие пункты и статьи. Модель достраивает то, чего в файле не было, в той же стилистике, что и настоящие пункты. Лечится требованием дословной цитаты и поиском этой цитаты в документе. Механика самого явления разобрана в гайде про галлюцинации нейросетей.
  • Цифры, которые «примерно правильные». Суммы, проценты и даты часто оказываются близкими к истине, но не равными ей. Проверяются контрольной сверкой итогов.
  • Пропуск того, чего нет. Модель хорошо отвечает про то, что в документе есть, и заметно хуже замечает отсутствие: нет пункта об ответственности, не указан срок. Такие вопросы задают прямо и по списку.
  • Уверенность вместо оговорок. Формулировка ответа не зависит от того, насколько модель права. Тон одинаковый и там, где всё точно, и там, где выдумано.

Отсюда правило для документов с последствиями: вывод нейросети — это список мест, куда посмотреть, а не решение. Для договоров это развёрнуто в отдельном разборе про проверку договора нейросетью, где разложено, что ИИ действительно находит, а где он не заменяет юриста. Для многостраничных PDF в рабочем контуре удобнее не чат, а готовые скилы Claude под PDF: чтение, извлечение таблиц и форм, разбивка файлов.


Часть 6 · Гигиена

Что не загружать ни в какой сервис

Главное

Вопрос решается составом файла, а не выбором сервиса.

Персональные данные людей, коммерческая тайна, всё, что закрыто соглашением о неразглашении, и документы, которые вам передали под конкретную задачу, — за пределами внешнего сервиса. Это не про недоверие к конкретному вендору: загрузка чужих данных в стороннюю систему обычно нарушает договорённость с тем, кто их вам передал, и это уже ваша ответственность.

Практический выход простой. Если разбор нужен, а данные чувствительные, из документа убирают идентифицирующие куски: фамилии заменяют на «сторона А» и «сторона Б», номера и адреса — на заглушки. Смысловая структура при этом сохраняется, а утекать становится нечему. Второй путь — работать на своём контуре, но это уже отдельная задача с другой ценой.

Что оговорка про доступ значит на самом деле

В документации GigaChat сказано, что использовать загруженный файл для генерации может только тот пользователь, который его загрузил. Это про разграничение доступа между пользователями. Что происходит с файлом на стороне сервиса, строка не описывает — читать её как гарантию конфиденциальности нельзя.


Коротко

  • Нейросеть документ читает: сильна в «найди, объясни, сравни, вытащи», слаба в правке внутри файла.
  • В запрос всегда добавляют требование цитировать дословно и указывать пункт — иначе проверить ответ нечем.
  • GigaChat принимает txt, doc, docx, pdf, epub, ppt, pptx и xlsx; текстовый файл до 40 Мб, весь запрос до 80 Мб.
  • У Claude запрос ограничен 32 Мб и 600 страницами, а при контексте меньше миллиона токенов — сотней.
  • Плотный PDF съедает контекст раньше лимита страниц, поэтому его режут по разделам.
  • Скан — это картинка: перед точной работой текст сначала распознают и проверяют.
  • Персональные данные и коммерческую тайну обезличивают до загрузки, а не после.

Вопросы

Частые вопросы

Какая нейросеть лучше работает с документами?

Единственного победителя нет, выбор упирается в размер файла и в то, откуда вы работаете. GigaChat принимает восемь текстовых форматов и текстовый файл до 40 мегабайт, работает из России без обходных путей. Claude сильнее на длинных PDF со сложной вёрсткой, но весь запрос у него ограничен 32 мегабайтами и шестьюстами страницами.

Можно ли работать с документами в нейросети бесплатно?

Да, для разовых задач бесплатных тарифов хватает. Загрузка файла, пересказ, поиск нужного пункта и черновик по образцу доступны на бесплатных планах основных сервисов. Упирается всё обычно не в деньги, а в объём: длинный договор или отчёт на сотни страниц съедает лимит запроса быстрее, чем лимит тарифа.

Какие форматы документов можно загрузить в нейросеть?

У GigaChat в документации перечислены txt, doc, docx, pdf, epub, ppt, pptx и xlsx, плюс отдельно изображения и аудио. Claude принимает обычный PDF без пароля и шифрования. Файл, защищённый паролем, не примет никто: сначала снимают защиту, потом загружают.

Может ли нейросеть проверить документ на ошибки?

Может найти нестыковки, пропуски и странные формулировки, но её вывод — это черновик проверки, а не заключение. Модель способна уверенно сослаться на пункт, которого в файле нет. Поэтому каждую ссылку на номер пункта или на цифру сверяют с исходным документом вручную, особенно если речь про договор или отчётность.

Безопасно ли загружать рабочие документы в нейросеть?

Решается это не доверием к сервису, а составом файла. Персональные данные людей, коммерческую тайну и всё, что закрыто соглашением о неразглашении, в чужой сервис не загружают. У GigaChat в документации оговорено, что использовать загруженный файл может только тот, кто его загрузил, но это про доступ других пользователей, а не про обработку на стороне сервиса.

Читать дальше

Соседние гайды

ИИ-офис
Собери свой ИИ-офис и перестань делать руками то, что делает нейросеть

Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.

Посмотреть, что внутри

telegram

Канал с полезными материалами про нейросети

Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.

Перейти в канал
Кирилл Сандаков

Об авторе

Кирилл Сандаков

Вайбкодер, предприниматель, продюсер

Завайбкодил контент-ферму на США в Instagram (более 300 тыс. подписчиков, среди читателей Дональд Трамп Младший), создатель платформы и сообщества ИИ-офис, автор блога о нейросетях «Выжимаем из ИИ Максимум».

Все статьи автора