MCP
Extraction
Извлечение текста и структуры из файлов рабочего пространства
Внутренний сервер: доступен AI-агентам платформы, на mcp.legalstack.ru не публикуется.
Имя сервера: legalstack-extraction. Инструментов: 2.
extract_document
Извлечь текст, заголовки, таблицы и списки из PDF/DOCX в workspace. Только чтение файла. Для машинной обработки структуры — extract_document_json. Возвращает: текст (markdown-подобный) с метаданными и контентом.
{
"type": "object",
"properties": {
"filePath": {
"type": "string",
"description": "Путь к файлу (.pdf или .docx) внутри workspace, относительный или абсолютный"
}
},
"required": [
"filePath"
],
"$schema": "http://json-schema.org/draft-07/schema#"
}extract_document_json
Извлечь структуру PDF/DOCX в JSON (метаданные + типизированный контент). Только чтение файла. Для текстового вывода — extract_document. Возвращает: JSON-объект { metadata, content[] }.
{
"type": "object",
"properties": {
"filePath": {
"type": "string",
"description": "Путь к файлу (.pdf или .docx) внутри workspace, относительный или абсолютный"
}
},
"required": [
"filePath"
],
"$schema": "http://json-schema.org/draft-07/schema#"
}