“读取”、“获取页面”、“URL 内容”?
read_page(JS 渲染)或 fetch_light(静态)
此技能教授的内容
MCP 服务器告诉代理可用的操作。技能为这些操作添加判断:如何识别任务,遵循哪个顺序,避免什么,以及如何判断结果已完成。
编排浏览器操作 — 获取网页、提取内容、截图、与元素交互及抓取结构化数据。适用于阅读网页、从网站提取数据、截图、检查 URL 是否可用或与网页表单交互。
架构
技能保持可读和可移植,因为它包含说明而非服务凭证或业务数据。ADK-Rust 将其提供给代理,代理从审核过的工具边界中选择,连接的 MCP 服务器执行经过身份验证的操作。
代理接收以普通语言表达的目标。
匹配意图,提供决策指南,并缩小工具边界。
规划工作流,并通过运行时流式传输每个关键步骤。
对拥有该能力的系统执行经过身份验证的操作。
技能的完成规则决定返回给用户的证据。
决策指南
这些路由直接来自技能说明。它们帮助模型识别意图并选择专注的工具或工作流,而不是在整个能力范围内即兴发挥。
“读取”、“获取页面”、“URL 内容”?
read_page(JS 渲染)或 fetch_light(静态)
“截图”、“捕获”、“视觉”?
screenshot / screenshot_element
“链接”、“提取链接”?
extract_links
“点击”、“填写表单”、“交互”?
click / type_text / wait_for
“是否可用”、“状态”、“检查 URL”?
check_status
“PDF”、“保存页面”?
save_pdf
“结构化数据”、“抓取字段”?
extract_structured / query_selector
经过验证的工作流
工作流将多个工具调用组合成用户实际识别的任务。技能解释顺序和预期结果,而 ADK-Rust 通过共享运行时实时传输代理的进度。
从任意 URL 获取干净文本
从页面获取结构化字段
视觉捕获(整页或元素)
填写表单,点击按钮
验证 URL 是否可访问
工具边界
此允许列表由技能声明。它使代理专注于完成此任务所需的操作,而 mcp-browser 保留身份验证、验证和连接系统的责任。
工作规则
操作边界
安装并连接
安装仓库,使您的 ADK-Rust 技能加载器能发现它,连接 mcp-browser,并确认声明的工具可用后,再让代理使用工作流。
git clone https://github.com/zavora-ai/skill-browser-automation.git ~/.skills/skills/browser-automationlet skills = SkillLoader::from_dir("~/.skills/skills").await?;
let skill = skills.load("browser-automation").await?;
let agent = LlmAgentBuilder::new("agent")
.instruction(skill.instructions())
.tools(skill.allowed_tools(toolset)?)
.build()?;仓库的兼容性声明:需要连接 mcp-browser 服务器(基于 Chromium,无头模式)。
官方文档
仓库对其确切指令、示例、辅助脚本、资源、MCP 要求、许可证和后续更新保持权威。
继续探索
源记录
此技能条目的仓库元数据。