Linnk AI Logo

Извлечение таблиц из PDF

Нужно вытащить таблицу из PDF, не перепечатывая её вручную, даже если PDF — это скан? Загрузите файл: Linnk прочитает каждую страницу, найдёт все таблицы и запишет их в книгу Excel — каждую на отдельный лист с названием страницы, откуда она взята, с сохранением объединённых ячеек заголовка. CSV для каждой таблицы, таблица с макетом страницы и PDF с поиском получаются из того же запуска, а текст остаётся на языке оригинала.
Формат вывода
Вы также получите CSV · Таблица (макет страницы) · PDF с поиском
Язык вывода
Шифрование и конфиденциальность 154 языка и диалекта Таблицы остаются таблицами Файлы удаляются через 72ч

Как извлечь таблицу из PDF, даже если это скан?

Загрузите файл в инструмент Linnk для извлечения таблиц, и он запишет все найденные таблицы в книгу Excel — неважно, экспортирован PDF из программы или отсканирован на копире. Второй случай — самый трудный. Многие инструменты для таблиц в PDF читают скрытый текстовый слой файла, а у отсканированной страницы его нет: это просто картинка. Linnk читает само изображение страницы: модели ИИ (Linnk использует модели ChatGPT, Claude и Gemini) восстанавливают каждую страницу как структурированный текст, выделяют таблицы и записывают их в книгу — по листу на таблицу, листы названы по страницам, объединённые ячейки заголовка сохраняются как настоящие объединения. Тот же запуск даёт отдельный CSV на каждую таблицу, таблицу с макетом, повторяющим страницу, и PDF с поиском. Суммы, даты и номера счетов переносятся цифра в цифру, а цифру, которую модели не могут разобрать, помечают вопросительным знаком, а не угадывают. Стоит знать два ограничения: таблица, занимающая несколько страниц, выходит отдельными листами по страницам, а не одним общим листом, а для PDF без таблиц вы получите пометку об этом, а не выдуманные строки. Лучше всего обычно читается ровный, хорошо освещённый скан; бледные или перекошенные страницы могут потребовать быстрой проверки.

1 лист на таблицукнига Excel, листы по страницам
Скан или цифровойPDF читается по изображению страницы
CSV в комплектепо файлу на таблицу, UTF-8
Бесплатнопросмотр без регистрации

Last updated: октябрь 2026 г.

Как извлечь таблицу из PDF в Excel

Извлечение таблиц из PDF онлайн в три шага — ничего не нужно устанавливать.

1

Загрузите PDF

Перетащите отсканированный или цифровой PDF. Excel уже выбран как формат вывода, а язык вывода установлен на «Оставить оригинал». Каждая страница читается как изображение, поэтому скан с копира обрабатывается так же, как отчёт, экспортированный из программы.

2

Проверьте первую таблицу

Обычно не дольше минуты на страницу — и в предпросмотре появляется первая таблица в виде сетки (до ограничения по числу строк); копирование распознанного текста бесплатно. Остальные таблицы — в скачанном файле. Сначала посмотрите на ячейки с вопросительным знаком: это цифры, которые на скане видны неясно.

3

Скачайте книгу Excel

Для скачивания войдите с бесплатным аккаунтом. Файлы CSV (по одному на таблицу, архивом, если их несколько), таблица с макетом страницы и PDF с поиском получаются из той же конвертации, как и Markdown с обычным текстом. Если нужен файл Word, он собирается по запросу за несколько дополнительных минут.

Извлечение таблиц из PDF-сканов, а не только из чистых экспортов

Банковские выписки, счета, годовые отчёты, результаты анализов и архивные страницы, которые когда-то были бумагой.

Лист на каждую таблицу, названный по странице

Годовой отчёт с балансом на странице 12 и отчётом о движении денежных средств на странице 14 даст два листа, каждый назван по своей странице, так что, если цифра вызывает сомнения, к источнику можно вернуться сразу. Объединённые ячейки заголовка остаются настоящими объединениями, и двухуровневая шапка выглядит так же, как в PDF.

Скан PDF в Excel, а не только цифровой файл

Многие инструменты для таблиц опираются на текстовый слой, которого у скана нет. Linnk читает изображение страницы, поэтому выписки, пришедшие по факсу, сканы с копира и старые архивные страницы попадают с бумаги в Excel так же, как экспортированный отчёт. Лучше всего читается ровный, чистый скан.

Цифры переносятся, а не угадываются

Суммы, номера счетов, даты и количества переносятся цифра в цифру. Слишком бледная цифра помечается вопросительным знаком, а нечитаемый фрагмент — пометкой [illegible], поэтому ещё до подсчёта итогов по столбцу вы знаете, какие ячейки проверить.

Никаких выдуманных таблиц

Если в PDF нет таблиц, книга Excel и CSV сообщают об этом, а не придумывают строки. Из той же загрузки вы всё равно получите таблицу с макетом страницы, PDF с поиском, Markdown и обычный текст.

Язык оригинала или перевод

Оставьте язык оригинала или переведите документ в том же запуске. По умолчанию прайс-лист китайского поставщика остаётся на китайском, а таблицы на арабском, иврите, японском и корейском тоже читаются в своей письменности.

CSV и копия макета из той же загрузки

Вместе с файлом Excel вы получаете CSV на каждую таблицу в кодировке UTF-8, чтобы кириллица и другие алфавиты открывались корректно, таблицу с макетом страницы — по листу на страницу, как в оригинале, — и PDF с поиском, заново собранный из настоящего текста.

Извлечение таблиц из PDF: главное

Что нужно знать перед загрузкой PDF.

Входные файлы

PDF
Сканы или цифровые
Изображения
JPG, PNG, WEBP, HEIC, HEIF
Не принимаются
Word, PowerPoint, Excel
Язык
По умолчанию сохраняется

Результат

Excel (таблицы)
Лист на таблицу, назван по странице
CSV
Файл на таблицу, UTF-8
Таблица (макет страницы)
Лист на страницу, как в оригинале
Таблица на нескольких страницах
Лист на страницу, без объединения

Точность

Числа и даты
Переносятся цифра в цифру
Нечитаемые цифры
Помечаются ?, не угадываются
Объединённые ячейки
Сохраняются как настоящие
PDF без таблиц
Сообщается, ничего не выдумывается

Скорость и доступ

Скорость
Обычно меньше минуты на страницу
Предпросмотр
Бесплатно, без аккаунта
Скачивание
Бесплатный аккаунт
Длинные документы
Платные тарифы, см. linnk.ai/pricing

Способы извлечь таблицу из PDF: сравнение

Как Linnk выглядит на фоне привычных способов перенести таблицу из PDF в Excel.

FeatureLinnk, извлечение таблицКопирование вручнуюИнструменты на основе текстового слояИмпорт PDF в табличном редакторе
Сканированные PDFЧитаются по изображению страницыОбычно нечего выделитьОбычно сначала нужен OCRОбычно нужен PDF с текстом
Несколько таблиц в одном PDFЛист на таблицу, назван по страницеПо одной, вручнуюОбычно выбираются по однойВыбор из списка найденных таблиц
Объединённые ячейки заголовкаСохраняются как настоящие объединенияОбычно теряютсяПо-разномуПо-разному
Неясные или нечитаемые цифрыПомечаются вопросительным знакомНа ваше усмотрениеБерутся из текстового слоя цифровых PDFБерутся из текстового слоя цифровых PDF
Таблица на нескольких страницахЛист на страницу, без объединенияСклеивается вручнуюПо-разномуПо-разному
Язык таблицыСохраняется или переводится в том же запускеСохраняетсяСохраняетсяСохраняется
Другие форматы из того же файлаCSV, таблица с макетом, PDF с поиском, Markdown, текстНетПо-разному, часто CSVТолько книга

Сравнение по состоянию на сентябрь 2026 года. Возможности других инструментов зависят от версии и настроек; актуальные функции уточняйте у каждого из них.

Кто извлекает таблицы из PDF с помощью Linnk

Те, у кого цифры заперты в PDF, а электронная таблица уже ждёт их.

Бухгалтеры

Вытаскивают таблицы операций из отсканированных банковских выписок и выписок по картам для сверки. Каждая страница выписки ложится на отдельный лист, готовый к вставке в общий реестр.

Финансовые аналитики

Переносят баланс и отчёт о прибылях и убытках из годового отчёта в PDF в модель, не перепечатывая цифры, а затем проверяют помеченные ячейки.

Отделы закупок и расчётов с поставщиками

Превращают счета и прайс-листы поставщиков, пришедшие отсканированными PDF, в строки для сверки с заказами.

Исследователи и студенты

Достают таблицы данных из старых статей и диссертаций, которые существуют только в виде сканов, чтобы перенести цифры в электронную таблицу или статистический пакет.

Аудиторы и специалисты по комплаенсу

Копируют таблицы из отсканированной отчётности, разрешений и журналов проверок в книгу для выборки, а в названии каждого листа указана исходная страница.

Импортёры и логисты

Переносят упаковочные листы, тарифные сетки и таможенные документы, присланные в PDF, в Excel на языке оригинала, чтобы названия товаров совпадали с тем, что написал поставщик.

Извлечение таблиц из PDF: частые вопросы

Как извлечь таблицу из PDF с помощью Linnk?
Загрузите PDF — отсканированный или цифровой. Excel выбран заранее, поэтому Linnk читает каждую страницу, показывает первую таблицу сеткой в бесплатном предпросмотре, а полную книгу можно скачать после входа с бесплатным аккаунтом. Каждая таблица попадает на отдельный лист с названием страницы, откуда она взята.
Работает ли конвертация PDF в Excel с OCR для сканов?
Да. Вместо того чтобы полагаться на текстовый слой PDF, модели ИИ читают изображение каждой страницы, поэтому сканированный PDF переносится в Excel так же, как цифровой. Если таблицы ещё на бумаге, сначала отсканируйте их в PDF и загрузите этот файл. Лучше всего обычно читается ровный, хорошо освещённый скан; бледные, изогнутые или перекошенные страницы могут потребовать быстрой проверки.
Зачем Linnk, если таблицу можно скопировать вручную?
При копировании таблицы из программы просмотра PDF столбцы часто слипаются, а на скане обычно вообще нечего выделить. Перепечатка трёхстраничной выписки может занять час, а одну ошибочную цифру легко пропустить. Linnk обычно читает страницу примерно за полминуты, сохраняет объединённые заголовки и язык таблицы и помечает каждую нечитаемую цифру — вам остаётся проверить, а не перепечатывать.
Что происходит с таблицей, которая занимает несколько страниц?
Она не объединяется. Часть таблицы с каждой страницы выходит отдельным листом и отдельным CSV, названными по странице. Длинная выписка даёт по листу на страницу; чтобы собрать таблицу целиком, вставьте листы в Excel друг под другом и удалите повторяющиеся строки заголовка.
Что, если в моём PDF нет таблиц?
Таблицы никогда не выдумываются. Если в PDF нет таблиц, строки Excel и CSV на странице результата сообщат об этом, а из той же загрузки вы всё равно получите таблицу с макетом страницы, PDF с поиском, Markdown и обычный текст.
Насколько точны цифры?
Суммы, идентификаторы, даты и номера счетов переносятся со страницы цифра в цифру. Цифра, которую невозможно прочитать, помечается вопросительным знаком, а нечитаемый фрагмент — пометкой [illegible], без догадок. Результат всё же зависит от скана, поэтому просмотрите помеченные ячейки и сверьте итог по столбцу с PDF, прежде чем опираться на данные.
Какие файлы можно загрузить?
Эта страница рассчитана на PDF — отсканированные или цифровые. Изображения JPG, PNG, WEBP, HEIC и HEIF тоже принимаются и читаются как скан одной страницы; для фото с телефона и скриншотов лучше подходит инструмент Image to Excel. Файлы Word, PowerPoint и Excel не принимаются: текст в них уже есть.
Получу ли я также файл CSV?
Да. Тот же запуск записывает по одному CSV на каждую таблицу (архивом, если их несколько) в кодировке UTF-8, так что кириллица и другие алфавиты открываются корректно. Вы также получаете таблицу с макетом страницы — по листу на страницу, как в оригинале, — что удобно для бланков, где таблица занимает лишь часть страницы.
Будут ли таблицы переведены?
Только если вы этого захотите. Язык вывода установлен на «Оставить оригинал», поэтому французский счёт останется на французском. Чтобы получить таблицы на другом языке, перед запуском переключите настройку на «Перевести на…» — извлечение и перевод пройдут одновременно. Инструмент читает самые распространённые языки и системы письма, включая арабский, иврит, китайский, японский и корейский.
Сколько времени это занимает?
Обычно меньше минуты на страницу, а на типичном скане — около полуминуты. Во время работы страница показывает примерное время в минутах. Файл Word, если он нужен, занимает несколько дополнительных минут, потому что собирается после конвертации.
Извлечение таблиц из PDF бесплатное?
Предпросмотр бесплатен без аккаунта, первые страницы документа конвертируются бесплатно, а копирование распознанного текста бесплатно всегда. Для скачивания файла Excel и других форматов нужен бесплатный аккаунт. Длинные документы доступны на платных тарифах; актуальные варианты — на linnk.ai/pricing.
Что происходит с моим PDF после конвертации?
Сконвертированные файлы автоматически удаляются через 72 часа, о чём сообщает страница результата. Если выписка или отчёт конфиденциальны, скачайте нужное в этот срок и перед загрузкой сверьтесь с правилами вашей организации.

Извлечение таблиц из PDF — сканов и цифровых файлов

Загрузите PDF и посмотрите на первую таблицу в виде сетки, прежде чем что-либо скачивать.