Проблема: токены уходят на мусор
Каждый раз когда ты загружаешь сырой PDF в Claude — модель получает не только текст. Она получает форматирование, метаданные, битые таблицы, пустые строки и прочий мусор, который занимает токены но не несёт смысла.

Страница A4 с нормальным текстом: 1 500–3 000 токенов в сыром PDF. Та же страница после конвертации в Markdown: 400–900 токенов. Умножь на 20 страниц — и поймёшь масштаб.
Что такое MarkItDown
MarkItDown — библиотека с открытым кодом от Microsoft. Конвертирует файлы любого формата в чистый Markdown — именно тот формат, под который обучали Claude.
Репозиторий: github.com/microsoft/markitdown — 110 000+ звёзд, MIT License, активная разработка.
Как это работает
Claude обучали на миллионах Markdown-файлов — это основной формат на GitHub, Stack Overflow, документации. Модель понимает его лучше чем любой другой формат.
Когда ты даёшь Claude чистый Markdown вместо сырого PDF — модель тратит меньше "внимания" на разбор структуры и больше — на смысл.

Установка за 2 минуты
Требуется Python 3.10+. Устанавливается одной командой через pip:
pip install markitdownПроверь установку:
markitdown --versionКонвертация первого файла:
# PDF → Markdown
markitdown document.pdf > document.md
# Excel → Markdown
markitdown report.xlsx > report.md
# PowerPoint → Markdown
markitdown presentation.pptx > presentation.mdwinget install Python.Python.3.12 (Windows) или brew install python@3.12 (Mac). Займёт 2 минуты.Воркфлоу с Claude
После конвертации — вставляй Markdown прямо в запрос к Claude. Вот готовые промпты для частых задач:
Анализ документа
Вот документ в формате Markdown:
[вставь содержимое .md файла]
Задача: [что нужно сделать с документом]
Формат ответа: [список / таблица / краткий вывод / развёрнутый анализ]Выжимка из отчёта
Вот финансовый/аналитический отчёт в Markdown:
[вставь содержимое .md файла]
Сделай выжимку в 5-7 пунктах: ключевые цифры, выводы, риски.
Формат: маркированный список, максимум 2 строки на пункт.Вопросы по документу
Контекст (Markdown):
[вставь содержимое .md файла]
Вопрос: [твой конкретный вопрос по документу]
Отвечай строго на основе документа. Если ответа нет — скажи об этом.Главное правило: сначала конвертируй, потом загружай. Никогда не тащи сырой PDF напрямую — это деньги в мусор.
MCP-сервер: полный автомат
В MarkItDown встроен MCP-сервер. Подключаешь к Claude Desktop — и он конвертирует каждый файл автоматически, без ручной работы. Ты просто кидаешь файл в диалог — Claude сам разберётся.
Шаг 1: Установи MCP-пакет
pip install markitdown-mcpШаг 2: Добавь в конфиг Claude Desktop
Файл конфига:
~/Library/Application Support/Claude/claude_desktop_config.json%APPDATA%\Claude\claude_desktop_config.json{
"mcpServers": {
"markitdown": {
"command": "python",
"args": ["-m", "markitdown_mcp"]
}
}
}Шаг 3: Перезапусти Claude Desktop
После перезапуска Claude Desktop будет автоматически конвертировать каждый файл который ты прикрепляешь. PDF, Excel, PPT — всё превращается в Markdown до того как модель начинает обработку.
Мини-план на вечер
Три шага — и MarkItDown работает. Занимает меньше 10 минут.
pip install markitdownmarkitdown твой-документ.pdf > результат.md# Скопируй содержимое .md и вставь в запрос к Claudepip install markitdown-mcp
MarkItDown — одна из тех утилит которую ставишь один раз и забываешь. Просто знаешь что токены теперь идут на работу, а не на мусор.
Репозиторий: github.com/microsoft/markitdown
Ресурсы и ссылки
Все инструменты из гайда — официальные ссылки и репозитории: