PDF в Excel

Создавайте редактируемую книгу из строк текста, определяемых по их положению.

Выберите файлы PDF

Перетащите файлы сюда или используйте кнопку ниже.

До 100 МБ всего · Файлы остаются на вашем устройстве

СодержаниеРазделов: 13

Что можно восстановить из таблицы PDF в Excel?

Создайте редактируемую книгу из текста PDF, сгруппированного в строки и разделённого на столбцы по расстояниям. Каждая выбранная страница PDF становится отдельным листом. Это помогает получить табличный текст для тщательной очистки и анализа.

Алгоритм группирует текстовые фрагменты по вертикальному положению и разделяет широкие горизонтальные промежутки на ячейки. Он не распознаёт произвольный смысл таблицы. Значения сохраняются как текст, чтобы сохранить извлечённое содержимое и не интерпретировать его незаметно как формулы.

Возможности преобразования PDF в Excel

Отдельный лист для каждой страницы

Каждая выбранная исходная страница становится отдельным листом скачанного XLSX, что упрощает постраничную проверку.

Настраиваемое определение столбцов

Изменяйте «Порог расстояния между столбцами», чтобы разделять соседние значения или сохранять длинное описание в одной ячейке.

Исключение верхних и нижних колонтитулов

Исключайте верхние и нижние поля в пунктах PDF, чтобы уменьшить число повторяющихся служебных элементов отчёта в извлечённых строках.

Значения ячеек безопасно сохраняются как текст

Значения хранятся в виде текста. Начальные нули могут оставаться видимыми, а формулировки PDF не превращаются в исполняемые формулы.

Зачем переносить значения таблицы PDF в Excel?

Выписка или ведомость PDF может содержать полезные строки, но не предоставлять редактируемую книгу. Извлечение этих строк уменьшает объём ручного набора, когда нужен лист сверки или рабочая таблица данных. Экспорт является отправной точкой для проверки: он определяет выравнивание по печатным позициям, а не по исходным определениям электронной таблицы. Проверяйте идентификаторы и суммы, осознанно назначайте числовые типы и самостоятельно создавайте нужные вычисления. Исходные формулы, диаграммы, смысл объединённых ячеек и логику книги нельзя восстановить лишь потому, что когда-то они послужили основой PDF.

Кто использует PDF в Excel?

Сотрудники банковской сверки

Получите разрешённую таблицу выписки для контролируемого листа сверки. Перед вычислением разниц сверьте даты операций, столбцы дебета и кредита и итоги с PDF.

Команды складского учёта

Извлеките список запасов, чтобы подготовить редактируемую ведомость пересчёта. Сохраняйте коды деталей как текст, проверяйте пустые ячейки количества и удаляйте повторяющиеся заголовки страниц перед добавлением столбцов фактического подсчёта.

Помощники исследователей

Перенесите опубликованную числовую таблицу в книгу для проверяемого анализа. Построчно сравните десятичные разделители и единицы измерения, затем задокументируйте ручные исправления ячеек, определённых алгоритмом.

Как преобразовать таблицы PDF в Excel?

  1. Выберите PDF с выделяемым текстом таблицы. Начните с одной типичной страницы, а не со всего отчёта.
  2. Задайте «Страницы», исключаемые поля, «Допуск выравнивания строк» и «Порог расстояния между столбцами». Вносите небольшие изменения и сравнивайте образец с предварительным просмотром.
  3. Создайте и скачайте XLSX, затем откройте каждый лист в совместимом приложении электронных таблиц.
  4. Проверьте столбцы и количество строк, сохраняйте идентификаторы как текст и назначайте числовые типы только после проверки значений. Сверьте итоги перед использованием новых формул.

Выберите исходный файл

Выберите PDF с выделяемыми значениями таблицы.

Нажмите на снимок экрана, чтобы увеличить его.
PDF в Excel, шаг 1: Выберите PDF с выделяемыми значениями таблицы.

Проверьте настройки инструмента

Выберите пробные страницы и уточните настройки строк, столбцов и полей.

Нажмите на снимок экрана, чтобы увеличить его.
PDF в Excel, шаг 2: Выберите пробные страницы и уточните настройки строк, столбцов и полей.

Скачайте и проверьте результат

Скачайте XLSX и проверьте ячейки перед вычислением итогов.

Нажмите на снимок экрана, чтобы увеличить его.
PDF в Excel, шаг 3: Скачайте XLSX и проверьте ячейки перед вычислением итогов.

Снимки экрана показывают этот набор инструментов с безопасными примерными файлами. Имя вашего файла, количество страниц и настройки могут отличаться.

Перенос подписи создаёт лишнюю строку

Название последней позиции продолжается на второй строке текста. При экспорте это продолжение попадает в отдельную строку таблицы, которую нужно проверить перед использованием как записи.

Источник: три позиции и итог

В исходной таблице три позиции с итогом 65.00. Название одной позиции занимает две строки.

Реальная исходная таблица с названием в две строки и пустыми ячейками в строке итога.

Результат: фактически экспортированные ячейки

Эти ячейки прочитаны из скачанного файла. Продолжение последнего названия занимает отдельную строку.

Фактически экспортированные ячейки, включая лишнюю строку из-за переноса названия.
Строки, включая заголовок
6
Экспортированные столбцы
4
Итоговое значение
65.00

Использованные настройки: Страница 1; исключить 170 pt сверху и 340 pt снизу; допуск строки 3 pt; промежуток столбцов 18 pt. В CSV используются запятые.

Извлечение по расположению не воссоздаёт объединённые записи или формулы. В арабском образце выравнивание также создаёт лишние столбцы. Перед вычислениями сравните каждую строку с PDF.

Проверено . Собственные образцы без конфиденциальных данных обработаны локально в Chromium версией 3.16.0; это не тест производительности рабочего хостинга.

Настройки и проверка результата

НастройкаЧего ожидать
Поддерживаемые входные данныеPDF
Место обработкиВаш браузер
Выбор файловОдин исходный файл
Размер исходных данныхВсего 100 МБ; для декодированных изображений и страниц также действуют ограничения по числу пикселей
Выбор страницДо 200 выбранных страниц за одну операцию. Пустое поле «Страницы» означает все страницы только для PDF, содержащего не более 200 страниц; для более длинного документа используйте отдельные диапазоны.

Для отсканированных таблиц сначала добавьте проверенный текстовый слой OCR. После этого столбцы определяются по положениям распознанного текста, что может потребовать большей доработки, чем для таблицы, созданной в цифровом виде.

Уточните таблицу перед экспортом

Начните со страницы, содержащей как короткие, так и длинные описания в ячейках. Открыв её лист, сравните одну из первых строк, описание с переносом и последнюю строку итогов с PDF. Если заголовок страницы стал лишней строкой, исключите его верхнее поле в пунктах PDF; 72 пункта равны одному дюйму. Осторожно увеличивайте допуск выравнивания строк, если одна печатная строка разбивается по вертикали. Меняйте порог расстояния между столбцами только после определения границ исходника, которые должны стать границами ячеек. Повторяйте пробный экспорт, пока макет не станет пригодным, затем включите оставшиеся страницы.

Отделяйте извлечённые значения от логики электронной таблицы

Напечатанная надпись «Итого» и соседнее значение не становятся формулой SUM в экспортированном листе. Проверив нужные строки, осознанно преобразуйте суммы в числа и запишите действительно необходимое вычисление. Сохраняйте коды счетов, длинные идентификаторы и значения с начальными нулями как текст. Сравните заново вычисленный итог с исходником и выясните причину расхождения перед изменением данных. Страницу PDF с несколькими не связанными друг с другом таблицами может потребоваться вручную разделить на отдельные проверенные таблицы.

Решение проблем при преобразовании PDF в Excel

СитуацияЧто делать
Два столбца объединились в одинУменьшите порог расстояния между столбцами и сравните пробную строку с PDF.
Длинное описание разделилось на несколько ячеекУвеличьте порог расстояния. Таблицы с разной шириной столбцов или многострочными записями всё равно могут потребовать ручной доработки.
Итог не вычисляется в ExcelИсходный PDF содержит значения, а не повторно используемые формулы. Осознанно преобразуйте проверенные числовые ячейки и при необходимости создайте формулы заново.

Практический пример и итоговая проверка

Для таблицы счёта построчно сравните описания позиций, количество, цены за единицу, коды с начальными нулями и итоги. Проверьте расположение пустых ячеек. Даже успешно открывающаяся книга может содержать значение не в том столбце, поэтому проверка таблицы является частью задачи преобразования.

Частые вопросы

Назначаются ли числам и датам типы автоматически?

Извлечённые ячейки записываются как текст. Проверьте их и явно задайте числовые типы или типы дат в приложении электронных таблиц.

Почему у некоторых строк разное количество столбцов?

Расстояния в PDF не всегда определяют реальные столбцы таблицы. Объединённые заголовки, пропорциональный текст и нерегулярное выравнивание требуют ручной доработки.

Как проверять импортированные данные электронной таблицы?

Сравните количество строк и важные ячейки с PDF. Рассматривайте идентификаторы как текст, явно выбирайте числовые типы и сверяйте итоги перед вычислениями.

Может ли конвертер восстановить формулы или объединить таблицы с разных страниц?

Нет. Он создаёт лист для каждой выбранной страницы, используя текстовые ячейки на основе положения. Заново создайте проверенные формулы и осознанно объедините таблицы после согласования заголовков. Исходные формулы электронной таблицы и смысл объединённых ячеек не хранятся в обычном печатном тексте PDF.

Почему из отсканированной таблицы не получаются редактируемые ячейки?

Скан может содержать только изображение таблицы. Сначала добавьте проверенный текстовый слой OCR, затем экспортируйте типичную страницу. Распознавание может внести неверные цифры или неравномерные промежутки, поэтому сравните полученные ячейки со сканом перед вычислениями.

Связанные инструменты и руководства

Далее: PDF в CSV, Excel в PDF, Распознать текст в PDF (OCR).