Как сжать PDF без потери читаемости
Коротко: Чтобы сжать PDF без потери читаемости, загрузите файл в инструмент сжатия и подберите уровень компрессии под задачу, затем проверьте, что текст остался чётким, а сканы — разборчивыми.
Кластер
пошаговое руководство
Пошаговые инструкции, которые помогают довести PDF-задачу от входа до результата.
Основной инструмент
Сжать PDF онлайн
Откройте инструмент из материала и выполните операцию в текущей локали.
Открыть инструментОглавление
Форма приёма показывает предел в сорок мегабайт, а у вас пятьдесят два. Сжатие решает это за минуту, но у него есть настройки, и по умолчанию выбраны не самые очевидные.
Сразу стоит понять, за счёт чего вообще уменьшается вес. Текст в PDF почти ничего не весит. Тяжёлыми документ делают картинки: сканы, фотографии, скриншоты, логотипы в исходном разрешении. Поэтому сжатие работает в основном с изображениями, а на договоре из чистого текста даст мало.
Уровень сжатия и профиль, который его меняет
Уровней три, и по умолчанию стоит самый сильный.
| Уровень | Что делает |
|---|---|
| Низкий | Осторожная оптимизация, картинки почти не трогает |
| Средний | Компромисс, заметное уменьшение при сохранении вида |
| Высокий | Максимальное уменьшение, на сканах может стать видно |
Рядом стоит вторая настройка, профиль обработки, и вот она ведёт себя неочевидно. Профилей тоже три: быстрый, сбалансированный и качественный. По умолчанию сбалансированный.
Неочевидность в том, что качественный профиль не просто аккуратнее обрабатывает, он понижает выбранный уровень сжатия на ступень. То есть высокий уровень вместе с качественным профилем на деле сработает как средний. Это не ошибка, а осознанная защита от того, чтобы человек одновременно попросил и максимум сжатия, и максимум качества.
Быстрый профиль устроен иначе: он пропускает основной проход обработки. Файл готовится заметно быстрее, но и уменьшается меньше. Для срочной отправки это разумный размен, для архива нет.
Целевой DPI
Отдельно задаётся целевое разрешение картинок внутри документа, от 72 до 600, по умолчанию 150.
Это то разрешение, до которого будут пересчитаны изображения. Полторы-две сотни считаются рабочим диапазоном для документов, которые смотрят на экране: текст на скане остаётся читаемым, а вес падает в разы. Ниже сотни мелкий шрифт начинает разваливаться.
Есть нюанс со связкой настроек. Целевой DPI применяется в основном проходе обработки, а быстрый профиль этот проход пропускает. То есть при быстром профиле выставленный DPI просто не сработает, если только не включена оптимизация изображений — она пересчитывает картинки отдельно.
Оптимизация изображений выключена по умолчанию
Эта настройка перекодирует встроенные картинки заново и даёт дополнительный выигрыш там, где изображения сохранены неэффективно.
Выключена она по умолчанию не случайно: перекодирование меняет сами пиксели. Для документа, который пойдёт на проверку подлинности, в суд или на экспертизу, это может оказаться недопустимым. Если точность изображений принципиальна, оставьте её выключенной.
Во всех остальных случаях включать её стоит. На пакете сканов она обычно даёт самый заметный прирост, потому что сканеры и телефоны сохраняют картинки с большим запасом.
Порядок действий
1. Откройте compress-pdf и загрузите документ. 2. Оставьте высокий уровень, если не знаете точно, что нужен щадящий. 3. Не ставьте одновременно высокий уровень и качественный профиль: они гасят друг друга. 4. Для сканов включите оптимизацию изображений. 5. Скачайте результат и откройте самую насыщенную страницу, а не первую: ту, где мелкий шрифт, печать или таблица.
Пятый шаг важнее, чем кажется. Титульный лист почти всегда переживает сжатие хорошо, а разваливается обычно мелкая подпись под таблицей на восьмой странице.
Когда файл не уменьшается
Такое бывает, и это не сбой.
Если ни один проход не дал файла меньше исходного, сервис возвращает оригинал без изменений и прямо сообщает об этом, называя оба размера. Логика простая: отдать файл, который стал тяжелее или не изменился, но при этом потерял в качестве, было бы хуже, чем честно сказать, что сжимать тут нечего.
Причин обычно две. Документ уже сжат: его выгрузили из системы, которая оптимизирует на выходе, или прогнали через сжатие раньше. Либо в документе просто нет картинок, а текст и векторная графика ужимаются плохо.
Если вес всё равно надо снизить, дальше помогает не сжатие, а уменьшение содержимого: убрать лишние страницы через remove-pages или разделить документ на части через split-pdf и отправить их по отдельности.
Почему результат никогда не бывает тяжелее исходника
Это устроено не само собой, а специально, и знать об этом полезно.
Сжатие не делает один проход. Оно пробует несколько вариантов обработки и в конце сравнивает их между собой и с исходным файлом. На выход идёт самый маленький из всех. Если ни один вариант не оказался легче оригинала, выигрывает оригинал.
Отсюда следует практический вывод: попробовать сжатие ничем не рискованно. Худшее, что случится, это возврат исходного файла с честным сообщением. Ситуации, когда «сжал, а стало больше», здесь не бывает по устройству.
Отсюда же следует, что перебирать настройки в надежде на чудо смысла мало. Если высокий уровень с включённой оптимизацией изображений ничего не дал, то низкий тем более не даст: сервис уже перебрал варианты внутри одного запуска. Менять стоит не настройки, а подход, то есть сокращать содержимое.
Несколько файлов за один заход
Сжимать можно сразу пачку документов, и настройки применятся ко всем одинаково. Это удобно для однородного набора: десять сканов одного типа обработаются одним движением.
На выходе приходит архив, внутри которого файлы названы по вашим исходным именам с приставкой `compressed_`. Если в загрузке оказались два файла с одинаковым именем, к именам добавятся номера, так что ничего не перезапишется.
Отчёт о результате при этом не общий: сервис называет поимённо те файлы, которые уменьшить не удалось. Это важно для пачки, потому что общий вес архива может упасть за счёт удачных файлов и скрыть тот единственный, который не поддался и всё ещё не проходит по лимиту.
Если набор разнородный, лучше разделить его на группы. Тексту и сканам нужны разные настройки: на первых оптимизация изображений бесполезна, на вторых она и даёт весь выигрыш.
Ещё один способ снять вес: убрать цвет
Если сжатие выжало всё, что могло, а файл всё равно тяжёлый, остаётся приём, о котором забывают.
Цветной скан чёрно-белого документа хранит цвет, которого в нём по сути нет: сероватый фон бумаги, желтизну от лампы, синеватые тени сгиба. Всё это занимает место наравне с содержательными данными. Перевод в оттенки серого через pdf-to-grayscale убирает этот балласт целиком, и на пакете сканов выигрыш обычно больше, чем от самого сжатия.
Есть три профиля обесцвечивания, и по умолчанию стоит стандартный, безопасный для смешанных офисных документов. Осторожность нужна там, где цвет несёт смысл: синяя печать, цветная подпись, выделенная маркером строка. После обесцвечивания они останутся читаемыми, но перестанут быть цветными, и если принимающая сторона этого ждёт, приём не подходит.
Порядок операций тут важен: сначала обесцветить, потом сжать. Обратный порядок работает хуже, потому что сжатие потратит усилия на цветовые данные, которые вы всё равно собирались выбросить.
Что сжимать бесполезно
Документ, состоящий из текста и таблиц, ужимается на единицы процентов. Ощутимого выигрыша там ждать не стоит, и если такой файл не проходит по весу, дело скорее всего не в картинках, а в количестве страниц.
Отдельный случай — файл, который уже сжимали. Повторное сжатие почти не уменьшает вес, зато качество падает второй раз, потому что артефакты предыдущего прохода накладываются на новые. Если результат не устроил, лучше вернуться к исходнику и сжать его один раз с другими настройками, чем прогонять готовый файл ещё раз.
Скан, сделанный с изначально низким качеством, тоже сжимать почти нечем: там и так мало данных. Такой документ проще переснять, чем оптимизировать.
Частые вопросы
Ещё из этого кластера
пошаговое руководство
Как конвертировать PDF в редактируемый Word
Файл открылся в Word, а курсор в текст не ставится? Почему по умолчанию получается картинка, чем поточный режим отличается от точного и куда исчезают колонтитулы.
пошаговое руководство
Как извлечь таблицы из PDF в Excel
PDF в Excel: что за листы оказываются в скачанной книге, чем три режима распознавания отличаются на практике и почему мягкий режим находит больше таблиц, но ломает слова.
пошаговое руководство
Как извлечь страницы из PDF в отдельный файл
Как вытащить из PDF нужные листы отдельным файлом: чем два режима вывода отличаются, почему файлы в архиве названы исходными номерами страниц и что делает выключение сохранения размера.
Связанные инструменты
Сжать PDF онлайн
Сожмите PDF онлайн, чтобы уменьшить размер файла для почты, Госуслуг, портала банка, CRM или формы на сайте. Загрузите документ, выберите уровень сжатия и скачайте готовый файл. Регистрация не требуется, файлы автоматически удаляются.
Разделить PDF онлайн
Разделите PDF двумя способами: разложите на отдельные страницы или вырежьте нужный диапазон, например страницы с 3 по 7.
Удалить страницы из PDF
Выберите лишние страницы PDF по миниатюрам, удалите их и скачайте новый файл, сохранив исходный документ без изменений. Практический сценарий: убрать пустые листы, черновики или ненужные приложения из документа.
PDF в оттенки серого онлайн
Преобразуйте цветные страницы PDF в оттенки серого и скачайте отдельный файл, подготовленный для экономичной чёрно-белой печати. Практический сценарий: подготовить цветной отчёт или скан для чёрно-белой печати.
Что делать дальше
Все инструменты
Каталог PDF-инструментов: объединить, сжать, разделить, конвертировать, повернуть, защитить и разблокировать PDF онлайн.
FAQ
Ответы на частые вопросы об iHatePDF: нужна ли регистрация, как обрабатываются файлы, где смотреть лимиты и безопасно ли загружать документы.
Контакты
Свяжитесь с iHatePDF по вопросам ошибок обработки, выбора инструмента, безопасности, деловых запросов и предложений по новым функциям.