系列文章/
浏览器自动化 Agent 实战指南
本系列共 3 篇文章
如果你想让 Agent 真正进入浏览器里完成任务,而不是只停留在对话层,这个系列会更合适。它会从页面控制、选择器、重试机制,一路讲到稳定的网页任务执行。
浏览器控制Playwright网页自动化Computer Use
1
Browser Agent 是什么?AI 为什么开始自己操作浏览器
讲清 Browser Agent 是什么,以及它和传统爬虫、RPA、Selenium/Playwright 脚本、Computer Use 的区别。用一张技术栈地图解释模型、浏览器工具、托管运行时、状态验证和人工审批,并给出 Browser Use、Stagehand、Playwright MCP、Browserbase 的入门路线。
AI与智能

2
Browser Use 入门教程:用 AI 自动打开网页、点击按钮和提取信息
用 Browser Use 开源 Python 库跑通第一个 AI 浏览器 Agent:安装 browser-use、配置模型 API key、写出打开网页、点击按钮和提取信息的任务,并用 history、allowed_domains、截图和错误记录排查失败。
AI与智能

3
Playwright MCP 实战:让 Claude、Codex、Cursor 直接控制浏览器
用官方 Playwright MCP 把浏览器自动化接入 Claude Code、Codex 和 Cursor:配置 @playwright/mcp@latest,跑通第一次页面点击、截图和 console 检查,并理解 accessibility snapshot、profile、storage state、审批和 browser_run_code_unsafe 的安全边界。
AI与智能

