服务与工具
Apify
Apify 网页抓取与自动化平台:调用 Actor、运行任务、获取数据集
8 个可用工具
apify-slash-rag-web-browser
This tool calls the Actor "apify/rag-web-browser" and retrieves its output results. Use this tool instead of the "call-actor" if user requests this specific Actor. Actor description: Web browser for O…
fetch-actor-details
通过 ID 或完整名称(格式:username/name,例如 apify/rag-web-browser)获取 Actor 的详细信息。使用 output 参数的布尔标志控制返回的信息:默认除 mcpTools 外所有字段为 true;选择性将所需字段设置为 true(例如 output: { inputSchema: true });常见模式包括仅 inputSchema、descriptio…
search-actors
在Apify商店中搜索和发现适用于特定平台或用例的爬虫工具/Actor。 此工具提供有关可用Actor的信息,不检索实际数据或执行任何爬取任务。 不要在运行Actor之前使用此工具进行辅助名称解析,而应使用search-actors-instead。 Apify商店包含数千个预构建的Actor(爬虫、爬取工具、AI代理和MCP服务器),涵盖所有平台和服务,包括社交媒体、搜索引擎、地图、电子商务、…
search-apify-docs
使用全文搜索Apify和Crawlee文档。必须使用docSource参数明确选择要搜索的文档源:docSource="apify"-Apify平台文档包括:平台功能、SDK(JS、Python)、CLI、REST API、Academy(网页抓取基础)、Actor开发与部署;docSource="crawlee-js"-Crawlee(JavaScript):JavaScript网页抓取库,处理…
apify--rag-web-browser
此工具调用Actor "apify/rag-web-browser"并获取其输出结果。 当用户请求此特定Actor时,请使用此工具而非"call-actor"。 Actor描述:适用于OpenAI助手、RAG管道或AI代理的网页浏览器,类似于ChatGPT中的网页浏览器。它查询Google搜索、抓取前N个页面,并将其内容返回为Markdown以供LLM进一步处理。也可以抓取单个URL。 当用户需要…
call-actor
从Apify Store调用任何Actor。 工作流程: 1. 使用fetch-actor-details获取Actor的输入模式 2. 根据模式使用正确的输入调用此工具 如果actor名称不是"username/name"格式,请先使用search-actors解析正确的Actor。 对于MCP server Actor: - 使用fetch-actor-details并设置output=…
fetch-apify-docs
通过URL获取Apify或Crawlee文档页面的完整内容。在使用search-apify-docs工具找到相关页面后使用此工具。适用于需要特定文档页面完整内容以获取详细答案的场景。
get-actor-output
使用数据集ID检索特定Actor运行的输出数据集项。 可以选择要返回的特定字段(支持点号表示法,如"crawl.statusCode"),并使用offset和limit进行分页。 这是get-dataset-items工具的简化版本,专注于Actor运行输出。 结果将包含指定数据集的数据集项。如果提供字段,则仅包含这些字段(支持使用点号表示法的嵌套字段)。 您可以从Actor运行获取数据集ID…
get-actor-run
通过runId获取特定Actor运行的详细信息。 结果将包含运行元数据(状态、时间戳)、性能统计和资源ID(datasetId、keyValueStoreId、requestQueueId)。 重要警告:切勿在UI模式下call-actor后立即调用此工具。call-actor响应包含一个自动轮询更新的小部件。在UI模式下call-actor后调用此工具是被禁止的且不必要的。 - 仅在用户明确询…