Перейти к основному содержимому

Возможность

Обработка файлов и документов в ClawAI

Как ClawAI принимает файлы — загрузка, разбиение на части, OCR, проверки загрузки — и выдаёт их обратно как изображения, документы и исследования с указанными источниками.

Все возможности · Последняя проверка:

Загрузка, разбиение на части и доставка под каждую модель

ClawAI принимает PDF, DOCX, электронные таблицы, CSV, JSON, Markdown, обычный текст, файлы кода и изображения. Файл разбивается на фрагменты и индексируется, так что в запрос попадают только релевантные вопросу части, а каждая модель получает форму, которую обрабатывает наиболее надёжно — нативное изображение, нативный PDF или извлечённый текст, — и каждое сообщение показывает, какую форму реально получила каждая модель. Файлы можно прикреплять к каждому сообщению, в том числе в запусках Compare, так что несколько моделей можно опросить об одном документе одновременно.

OCR для отсканированных документов и проверки при каждой загрузке

Отсканированный PDF без текстового слоя проходит через OCR, прежде чем достичь модели, и помечается при низкой уверенности распознавания. Каждая загрузка проверяется на вирусы, сверяется с заявленным типом файла, проверяется на опасные имена файлов и отклоняется, если архив оказывается декомпрессионной бомбой — загрузки учитываются в лимитах размера файлов и хранилища плана, а файлы удаляются по графику хранения либо могут быть удалены самостоятельно в любой момент.

Генерация изображений, документов и исследований с источниками

На выходе ClawAI может создать изображение по описанию, экспортировать любой ответ или весь разговор как отформатированный файл в PDF, DOCX, CSV, HTML, Markdown, TXT или JSON, а также выполнить исследовательскую задачу, которая ищет в интернете, получает и читает страницы и отвечает с указанием реально использованных источников. Генерация изображений, генерация файлов и исследования измеряются каждая отдельно (IMAGE, FILE_GENERATION и квоты RESEARCH_MODE / WEB_SEARCH / WEB_FETCH / WEB_EXTRACT), отдельно от расхода токенов обычного чата. См. «как работают вызовы инструментов ИИ» и «что такое структурированные выводы ИИ», обе ссылки ниже, о механизме, стоящем за заданной формой вывода.

Частые вопросы

Какие типы файлов можно загружать?
PDF, DOCX, электронные таблицы, CSV, JSON, Markdown, обычный текст, файлы кода и изображения. Каждая модель получает форму, которую обрабатывает наиболее надёжно, а сообщение показывает, какую форму реально получила каждая модель.
Может ли ClawAI прочитать отсканированный документ без текстового слоя?
Да — отсканированный PDF проходит через OCR, прежде чем достичь модели, и помечается при низкой уверенности распознавания.
В каких форматах можно экспортировать документ?
PDF, DOCX, CSV, HTML, Markdown, TXT и JSON. Экспорт документов — отдельная измеряемая поверхность, отделённая от обычного чата и от использования исследований.

Попробуйте сами, а не верьте нам на слово

Загрузка, разбиение на части, OCR и проверки загрузки на входе; генерация изображений, экспорт документов и исследования с источниками на выходе — реальные, реализованные и раздельно измеряемые функции, а не единый смешанный файловый режим.