Разбираем работу с документами по существу: какие задачи снимаются сегодня, какие форматы и объёмы принимают сервисы, где модель врёт и что в неё нельзя загружать.
Нейросеть для документов — это не редактор и не хранилище, а читатель: вы загружаете файл, а модель отвечает по его содержимому. Надёжно снимаются четыре типа задач — пересказать длинное, найти нужный пункт, сравнить две версии и вытащить данные в таблицу. Ненадёжно всё, где нужна юридическая или бухгалтерская ответственность: там вывод модели остаётся черновиком, который сверяют с исходником.
Что узнаешь из гайда
Часть 1 · Постановка
Главное
Модель читает файл и отвечает по нему. Она не редактирует ваш документ и не хранит его вместо диска.
Из этого следует практическая рамка. Всё, что формулируется как «найди, объясни, перескажи, сравни, вытащи», работает хорошо: у модели есть текст перед глазами, и она отвечает по нему. Всё, что формулируется как «исправь в файле и верни как было, только лучше», работает плохо: нейросеть отдаёт новый текст отдельно от вашей вёрстки, и переносить его в файл придётся руками.
Отдельно стоит развести два похожих запроса. «Работа с документами» — это чтение и разбор содержимого. «Оформление документа» — это стили, оглавление, нумерация и шаблоны, и там задача решается внутри редактора; про эту сторону есть отдельный разбор про нейросеть для Word. Смешивать их не стоит: у них разные инструменты и разный результат.
Почему это вообще стало возможно
Современные модели читают документ не как строку текста, а как страницу: видят вёрстку, колонки и таблицы. В документации Claude прямо сказано, что поддержка PDF опирается на зрение модели и наследует его ограничения. Отсюда сильная сторона — понимание структуры. И отсюда же слабая: то, что плохо видно человеку, плохо видно и модели.
Часть 2 · Практика
Главное
Общая формула запроса одна: задача плюс требование ссылаться на место в документе. Без второй части проверять ответ невозможно.
| Задача | Как просить | Чем проверять |
|---|---|---|
| 1. Разобрать длинное | «Кратко: о чём документ, кто стороны, какие сроки и суммы, что требуется от меня» | Открыть названные страницы и сверить |
| 2. Найти пункт | «Найди всё про расторжение и штрафы, процитируй дословно и укажи номер пункта» | Поиск по цитате прямо в файле |
| 3. Сравнить версии | «Вот две редакции. Что изменилось по смыслу, а не по формулировкам» | Сравнение версий в самом редакторе |
| 4. Вытащить данные | «Собери из этих актов таблицу: дата, номер, сумма, контрагент» | Сверить итоговую сумму с исходником |
| 5. Черновик по образцу | «Вот наш типовой документ. Сделай такой же под эти вводные» | Вычитка человеком до отправки |
Требование цитировать дословно и указывать номер пункта — не вежливость, а рабочий приём. Пока ответ выглядит как пересказ своими словами, проверить его можно только прочитав документ целиком, то есть выигрыш времени пропадает. Как только в ответе стоит цитата, проверка занимает секунды: поиск по строке.
У краткого содержания есть свои тонкости: что делать с текстом, который не влезает целиком, и как не потерять смысл на длинной дистанции. Это разобрано отдельно, в гайде про пересказ и краткое содержание. Таблицы и расчёты, наоборот, лучше уводить в работу с Excel: модель хорошо собирает данные, но считать их лучше формулой.
Часть 3 · Ограничения
Главное
Лимит считается по всему запросу, включая всё, что вы отправили вместе с файлом. Отсюда и знакомое «файл маленький, а запрос не проходит».
У GigaChat в документации, обновлённой 17 июля 2026 года, перечислены восемь текстовых форматов: txt, doc, docx, pdf, epub, ppt, pptx и xlsx. Отдельно принимаются изображения (jpeg, png, tiff, bmp) и аудио. Ограничения по размеру заданы прямо: один текстовый файл — не более 40 мегабайт, одно изображение — не более 15, один аудиофайл — не более 35, а весь запрос с картинками и звуком должен быть меньше 80 мегабайт.
У Claude рамка другая и она жёстче по объёму: максимальный размер запроса — 32 мегабайта, максимум страниц — 600, и всего 100, если окно контекста меньше миллиона токенов. PDF должен быть обычным, без пароля и шифрования. Важная деталь из той же документации: оба лимита считаются по всей полезной нагрузке запроса, включая текст и всё остальное, что уехало вместе с файлом.
| Что сравниваем | GigaChat | Claude |
|---|---|---|
| Текстовые форматы | txt, doc, docx, pdf, epub, ppt, pptx, xlsx | PDF без пароля и шифрования |
| Размер | Текстовый файл до 40 Мб, запрос до 80 Мб | Весь запрос до 32 Мб |
| Страницы | Ограничение задано в мегабайтах | 600, и 100 при контексте меньше миллиона токенов |
| Доступ из России | Напрямую | Через обходные пути |
Плотный PDF падает раньше номинального предела
В документации Claude сказано прямо: документы с мелким шрифтом, сложными таблицами и тяжёлой графикой заполняют окно контекста ещё до того, как упрётся лимит страниц, и запрос может не пройти, даже если формально страниц меньше разрешённого. Лечится это разбивкой файла на части по разделам; механическое деление пополам обычно рвёт смысл посередине.
Есть ещё одна ловушка, о которой документация GigaChat предупреждает отдельно: при загрузке файла нужно передавать назначение purpose="general", иначе загруженный файл нельзя будет использовать в запросах на генерацию. Это касается работы через API — в обычном чате параметр проставляется сам. Практическая часть работы через интерфейс разобрана в гайде про GigaChat.
Часть 4 · Бумага
Главное
Скан — это картинка со страницей внутри. Разница вылезает там, где нужен точный поиск и точные цифры.
PDF бывает двух совершенно разных видов. В одном лежит настоящий текст, который выделяется мышкой и ищется поиском. В другом лежит фотография страницы, и текста внутри файла нет вообще. Внешне они неотличимы, и именно поэтому одинаковые на вид документы ведут себя в нейросети по-разному.
С фотографией страницы модель справляется через зрение: описывает, что видит, и пересказывает содержание. Но чем хуже качество съёмки — блик, перекос, тень от руки — тем выше шанс, что цифра прочитается неверно, а вы этого не заметите, потому что ответ будет выглядеть уверенно. Для задач, где цена ошибки в цифре высока, порядок другой: сначала распознать текст, проверить распознанное, и только потом отдавать в работу. Про этот шаг есть отдельный гайд — как распознать текст со скана и фото.
Ещё одно место, где ломаются именно сканы, — таблицы. Модель видит сетку и цифры, но связь «эта цифра относится к этой строке и этому столбцу» на кривом скане собирается ненадёжно. Проверять такие таблицы нужно по контрольной сумме: если итог сходится, скорее всего сошлось и остальное.
Часть 5 · Границы
Главное
Опасен не отказ, а уверенный ответ про пункт, которого в документе нет.
Отсюда правило для документов с последствиями: вывод нейросети — это список мест, куда посмотреть, а не решение. Для договоров это развёрнуто в отдельном разборе про проверку договора нейросетью, где разложено, что ИИ действительно находит, а где он не заменяет юриста. Для многостраничных PDF в рабочем контуре удобнее не чат, а готовые скилы Claude под PDF: чтение, извлечение таблиц и форм, разбивка файлов.
Часть 6 · Гигиена
Главное
Вопрос решается составом файла, а не выбором сервиса.
Персональные данные людей, коммерческая тайна, всё, что закрыто соглашением о неразглашении, и документы, которые вам передали под конкретную задачу, — за пределами внешнего сервиса. Это не про недоверие к конкретному вендору: загрузка чужих данных в стороннюю систему обычно нарушает договорённость с тем, кто их вам передал, и это уже ваша ответственность.
Практический выход простой. Если разбор нужен, а данные чувствительные, из документа убирают идентифицирующие куски: фамилии заменяют на «сторона А» и «сторона Б», номера и адреса — на заглушки. Смысловая структура при этом сохраняется, а утекать становится нечему. Второй путь — работать на своём контуре, но это уже отдельная задача с другой ценой.
Что оговорка про доступ значит на самом деле
В документации GigaChat сказано, что использовать загруженный файл для генерации может только тот пользователь, который его загрузил. Это про разграничение доступа между пользователями. Что происходит с файлом на стороне сервиса, строка не описывает — читать её как гарантию конфиденциальности нельзя.
Коротко
Вопросы
Единственного победителя нет, выбор упирается в размер файла и в то, откуда вы работаете. GigaChat принимает восемь текстовых форматов и текстовый файл до 40 мегабайт, работает из России без обходных путей. Claude сильнее на длинных PDF со сложной вёрсткой, но весь запрос у него ограничен 32 мегабайтами и шестьюстами страницами.
Да, для разовых задач бесплатных тарифов хватает. Загрузка файла, пересказ, поиск нужного пункта и черновик по образцу доступны на бесплатных планах основных сервисов. Упирается всё обычно не в деньги, а в объём: длинный договор или отчёт на сотни страниц съедает лимит запроса быстрее, чем лимит тарифа.
У GigaChat в документации перечислены txt, doc, docx, pdf, epub, ppt, pptx и xlsx, плюс отдельно изображения и аудио. Claude принимает обычный PDF без пароля и шифрования. Файл, защищённый паролем, не примет никто: сначала снимают защиту, потом загружают.
Может найти нестыковки, пропуски и странные формулировки, но её вывод — это черновик проверки, а не заключение. Модель способна уверенно сослаться на пункт, которого в файле нет. Поэтому каждую ссылку на номер пункта или на цифру сверяют с исходным документом вручную, особенно если речь про договор или отчётность.
Решается это не доверием к сервису, а составом файла. Персональные данные людей, коммерческую тайну и всё, что закрыто соглашением о неразглашении, в чужой сервис не загружают. У GigaChat в документации оговорено, что использовать загруженный файл может только тот, кто его загрузил, но это про доступ других пользователей, а не про обработку на стороне сервиса.
Читать дальше
Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.
Посмотреть, что внутриtelegram
Канал с полезными материалами про нейросети
Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.