В каком формате загружать документы в LLM-сервисы
Все современные LLM-сервисы (ChatGPT / Claude / Gemini) умеют работать с файлами.
Как узнать, с какими именно
(1) В интерфейсе загрузки.
Нужно нажать «Загрузить файл». Сервис обычно показывает, какие форматы можно добавить.
(2) В документации сервиса.
(3) Спросить у самого сервиса, что в него можно загружать. LLM могут приукрашать свои возможности. Поэтому используйте кнопку «Интернет», чтобы он нашел информацию о своих возможностях в сети.
Какие форматы обычно поддерживаются
(1) Изображения (JPG / JPEG / PNG / WebP, HEIC)
Читаются через распознавание текста: сначала текст с картинки распознает OCR-модуль, а уже потом извлеченный текст обрабатывает модель. Поэтому качество изображения напрямую влияет на результат.
(2) PDF
• с текстовым слоем (где текст можно выделить мышкой и скопировать) — оптимальный вариант;
• со сканом внутри — это те же картинки, только собранные в файл.
(3) Текстовые файлы (DOCX / TXT / RTF / MD)
Хороший вариант для анализа — модель сразу работает с текстом.
(4) Таблицы (XLSX / CSV)
На что влияет выбор формата файла
Когда вы отправляете файл в нейросеть, он становится частью контекстного окна — того объема информации, который модель видит и использует в работе.
Это окно не бесконечное. Любой файл занимает место, и разные форматы занимают его по-разному.
Например, Word-файл для нас выглядит как обычный текст. Но внутри документа есть верстка, служебные элементы и другие данные, которые для задачи не нужны, но все равно занимают место.
Поэтому лучше использовать экономичные форматы:
• TXT — чистый текст без верстки;
• MD (Markdown) — текст + базовая структура (заголовки, списки);
• CSV — для таблиц.
Как преобразовать в экономичный формат
• воспользоваться конвертером от Семёна Мошкина;
• прочитать о вариантах в нашей базе знаний.
Другие лайфхаки можно оставить в комментариях⭣
_________________________________
Сообщество юристов, которые покоряют нейросети
Канал | Курс
Все современные LLM-сервисы (ChatGPT / Claude / Gemini) умеют работать с файлами.
Как узнать, с какими именно
(1) В интерфейсе загрузки.
Нужно нажать «Загрузить файл». Сервис обычно показывает, какие форматы можно добавить.
(2) В документации сервиса.
(3) Спросить у самого сервиса, что в него можно загружать. LLM могут приукрашать свои возможности. Поэтому используйте кнопку «Интернет», чтобы он нашел информацию о своих возможностях в сети.
Какие форматы обычно поддерживаются
(1) Изображения (JPG / JPEG / PNG / WebP, HEIC)
Читаются через распознавание текста: сначала текст с картинки распознает OCR-модуль, а уже потом извлеченный текст обрабатывает модель. Поэтому качество изображения напрямую влияет на результат.
(2) PDF
• с текстовым слоем (где текст можно выделить мышкой и скопировать) — оптимальный вариант;
• со сканом внутри — это те же картинки, только собранные в файл.
(3) Текстовые файлы (DOCX / TXT / RTF / MD)
Хороший вариант для анализа — модель сразу работает с текстом.
(4) Таблицы (XLSX / CSV)
На что влияет выбор формата файла
Когда вы отправляете файл в нейросеть, он становится частью контекстного окна — того объема информации, который модель видит и использует в работе.
Это окно не бесконечное. Любой файл занимает место, и разные форматы занимают его по-разному.
Например, Word-файл для нас выглядит как обычный текст. Но внутри документа есть верстка, служебные элементы и другие данные, которые для задачи не нужны, но все равно занимают место.
Поэтому лучше использовать экономичные форматы:
• TXT — чистый текст без верстки;
• MD (Markdown) — текст + базовая структура (заголовки, списки);
• CSV — для таблиц.
Как преобразовать в экономичный формат
• воспользоваться конвертером от Семёна Мошкина;
• прочитать о вариантах в нашей базе знаний.
Другие лайфхаки можно оставить в комментариях⭣
_________________________________
Сообщество юристов, которые покоряют нейросети
Канал | Курс