cf-crawl — Обход веб-сайтов через Cloudflare API
cf-crawl – это CLI-инструмент, предназначенный для обхода веб-сайтов с использованием Cloudflare Browser Rendering API. Он решает проблему получения структурированного контента с сайтов, использующих JavaScript и динамическую загрузку, позволяя извлекать данные в удобных форматах. Инструмент особенно полезен для анализа и извлечения информации из современных веб-приложений.
Работает на основе Bash и использует Clawhub API и Cloudflare API для асинхронного обхода и рендеринга страниц. Предоставляет широкие возможности настройки, включая ограничение глубины обхода и выбор формата вывода: markdown, HTML или JSON. Управление заданиями осуществляется через командную строку, что обеспечивает гибкость и автоматизацию процессов.
Для запуска и управления заданиями используется терминальная утилита с простым синтаксисом. Необходимые учетные данные Cloudflare хранятся в файле конфигурации, что упрощает настройку и обеспечивает безопасность. CLI-инструмент позволяет как запустить задание и отслеживать его статус, так и получить результаты в выбранном формате.
$ ls -R related_skills/
vision-analysis — Интегрированный анализ изображений для IDE
fda-database — Инструмент для анализа данных FDA.
hmdb-database — База данных метаболитов человека для метаболомики
metabolomics-workbench-database — Доступ к данным метаболомических исследований
npx skills add https://github.com/openclaw/skills/tree/main/skills/bill492/cf-crawl
[HINT] Скачивает всю директорию скилла с GitHub: SKILL.md и все связанные файлы