SKILLEMALL.ai

BC byted-las-pdf-parse-doubao

Анализирует и считывает PDF-документы в структурированный текст Markdown с использованием моделей Volcengine LAS Doubao AI. Парсинг PDF, OCR PDF и распознавание документов — извлекает текст, заголовки, абзацы, таблицы, диаграммы и структуру макета из PDF-файлов с высокой точностью. Выполняет анализ макета, включая распознавание многоколоночных документов и извлечение сложных таблиц. Два режима: обычный (быстрый, экономичный повседневный парсинг) и детальный (глубокий анализ для сложных таблиц, диаграмм и многоколоночных макетов). Преобразует PDF в Markdown, PDF в текст и структурированные данные. Оцифровывает отсканированные PDF-документы и отсканированные изображения с помощью OCR. Поддерживает пути TOS, URL-адреса HTTP и загрузку локальных файлов. Асинхронный рабочий процесс отправки-опроса с поддержкой пакетной обработки. Используйте этот навык, когда пользователь хочет разобрать PDF-файлы в Markdown/текст, извлечь текст/таблицы/диаграммы из PDF, преобразовать PDF в формат Markdown, выполнить OCR на отсканированных документах, распознать структуру макета PDF, оцифровать бумажные документы, обрабатывать PDF в пакетном режиме или извлекать структурированные данные из PDF-документов.

машинный переводПоказать оригиналСкрыть оригинал«Parses and reads PDF documents into structured Markdown text using Vol…»

Parses and reads PDF documents into structured Markdown text using Volcengine LAS Doubao AI models. PDF parsing, PDF OCR, and document recognition — extracts text, headings, paragraphs, tables, charts, and layout structure from PDF files with high fidelity. Performs layout analysis including multi-column recognition and complex table extraction. Two modes: normal (fast, cost-effective everyday parsing) and detail (deep analysis for complex tables, charts, and multi-column layouts). Converts PDF to Markdown, PDF to text, and structured data. Digitizes scanned PDF documents and scanned images via OCR. Supports TOS paths, HTTP URLs, and local file upload. Async submit-poll workflow with batch processing support. Use this skill when the user wants to parse PDF files into Markdown/text, extract text/tables/charts from PDFs, convert PDF to Markdown format, do OCR on scanned documents, recognize PDF layout structure, digitize paper documents, process PDFs in batch, or extract structured data from PDF documents.

Не рекомендуетсяесть критические или высокие находки безопасности
ClawHub Agent Skills автор: volcengine-skills v1.0.1 MIT-0 10 файлов · 4 скрипта тело ≈ 932 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Анализирует и считывает PDF-документы в структурированный текст Markdown с использованием моделей Volcengine LAS Doubao AI.

Как процесс C 59/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, ошибки и развилки

АнализаторPDFИнфраструктуратип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
82/100
безопасность, качество, тесты
Безопасность 60%
82
Качество 40%
82
Прогон на моделях
не было
Процессный рейтинг
C
59/100
Есть пробелы
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
три самых слабых из десяти параметров · все десять

Чем это грозит

Скилл содержит фрагменты, которые в чужих руках стоят денег или данных. Ниже, что рискует потерять тот, кто установит, и что должен сделать автор.

Опасные команды
Если установить

Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.

Автору

Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.

Как улучшить

  1. Разберите находки высокой серьёзности: каждая стоит 18 баллов безопасности. Если это ложное срабатывание, добавьте код правила в guard.allow в spec.yaml.
Для прогона на моделях — необязательно
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 1

  • высокая Опасные команды cmd-install-from-url scripts/env_init.sh:41
    Установка пакета по недоверенному URL / из архива
    pip install --quiet --upgrade https://las-ai-cn-beijing-online.tos-cn-beijing.volces.com/operator_cards_serving/public/skills/sdk/las_…whl

Просканировано файлов: 9. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

✓ По спецификации Agent Skills замечаний нет

Процессный рейтинг: все десять параметров 59/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 0Ошибки и развилки. Линейный процесс без обработки сбоев
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
  • 100Инструменты и файлы. Внешние инструменты не нужны
  • 100Шаги. Шагов: 33
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Стоимость исполнения. Тело инструкции 932 токенов
  • 100Повторный запуск. Изменяющих операций нет
  • medium Тестов 3, и все положительные: нет ни одного случая «должен отказать» или «должен переспросить»

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Длина description 1019: рекомендуется 120–800 символов
  • +3Формат ответа не описан: модель каждый раз решает сама
  • -33 из 4 скриптов не упомянуты в SKILL.md
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +4Структура: 12 заголовков
  • +3Пошаговые инструкции: 33 пунктов
  • +4Есть примеры (9 блоков кода)
  • +4Справочные файлы упоминаются в инструкциях (2 из 2)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 82.

Внешние проверки

ClawHub: suspicious
This PDF parsing skill does what it claims, but it automatically installs remote executable SDK code and can run unbounded polling, so it needs user review before installation.
LLM: suspicious (high) · VirusTotal: · 29 мая 2026 г.