"lire", "obtenir la page", "contenu de l'URL" ?
read_page (rendu JS) ou fetch_light (statique)
Opérations web pour agents IA — lire des pages, extraire des données, prendre des captures d'écran, interagir avec des formulaires et scraper du contenu structuré via Chromium sans interface.
Ce que cette compétence enseigne
Un serveur MCP indique à un agent quelles actions sont disponibles. Une compétence ajoute le jugement autour de ces actions : comment reconnaître la tâche, quelle séquence suivre, quoi éviter, et comment décider que le résultat est complet.
Orchestrez les opérations de navigateur — récupérez des pages web, extrayez du contenu, capturez des captures d’écran, interagissez avec des éléments et scrapez des données structurées. Utilisez-le pour lire des pages web, extraire des données de sites, prendre des captures d’écran, vérifier la disponibilité d’URLs ou interagir avec des formulaires web.
Architecture
La compétence reste lisible et portable car elle contient des instructions plutôt que des identifiants de service ou des données métier. ADK-Rust la fournit à l'agent, l'agent choisit dans sa limite d'outil examinée, et le serveur MCP connecté exécute l'opération authentifiée.
L'agent reçoit un objectif exprimé en langage courant.
Correspond à l'intention, fournit le guide de décision, et restreint la limite d'outil.
Planifie le flux de travail et diffuse chaque étape significative via le runtime.
Exécute des opérations authentifiées contre le système propriétaire de la capacité.
Les règles de complétion de la compétence façonnent les preuves retournées à l'utilisateur.
Guide de décision
Ces routes proviennent directement des instructions de la compétence. Elles aident le modèle à reconnaître l'intention et à sélectionner un outil ou un flux de travail ciblé au lieu d'improviser sur toute la surface de capacité.
"lire", "obtenir la page", "contenu de l'URL" ?
read_page (rendu JS) ou fetch_light (statique)
"capture d'écran", "prendre", "visuel" ?
screenshot / screenshot_element
"liens", "extraire les liens" ?
extract_links
"cliquer", "remplir formulaire", "interagir" ?
click / type_text / wait_for
"est-ce accessible", "statut", "vérifier URL" ?
check_status
"PDF", "enregistrer la page" ?
save_pdf
"données structurées", "scraper champs" ?
extract_structured / query_selector
Flux de travail éprouvés
Un flux de travail regroupe plusieurs appels d'outils en une tâche que l'utilisateur reconnaît réellement. La compétence explique la séquence et le résultat attendu tandis qu'ADK-Rust diffuse la progression de l'agent via le runtime partagé.
Texte propre de n'importe quelle URL
Champs structurés depuis les pages
Capture visuelle (page complète ou élément)
Remplir formulaires, cliquer sur boutons
Vérifier que l'URL est accessible
Limite d'outil
Cette liste blanche est déclarée par la compétence. Elle maintient l'agent concentré sur les actions nécessaires pour ce travail tandis que mcp-browser conserve la responsabilité de l'authentification, de la validation et du système connecté.
Règles de travail
Limites opérationnelles
Installer et connecter
Installez le dépôt où votre chargeur de compétences ADK-Rust peut le découvrir, connectez mcp-browser, et confirmez que les outils déclarés sont disponibles avant de demander à l'agent d'utiliser le flux de travail.
git clone https://github.com/zavora-ai/skill-browser-automation.git ~/.skills/skills/browser-automationlet skills = SkillLoader::from_dir("~/.skills/skills").await?;
let skill = skills.load("browser-automation").await?;
let agent = LlmAgentBuilder::new("agent")
.instruction(skill.instructions())
.tools(skill.allowed_tools(toolset)?)
.build()?;La déclaration de compatibilité du dépôt : Nécessite un serveur mcp-browser connecté (basé sur Chromium, headless).
Documentation officielle
Le dépôt reste la référence pour ses instructions exactes, exemples, scripts d'aide, ressources, exigences MCP, licence et mises à jour ultérieures.
Continuez à explorer
Enregistrement source
Métadonnées du dépôt pour cette entrée de compétence.