ブラウザ自動化 Agent 実践ガイド: Playwright、browser-use、Computer Use
このシリーズは全3記事
Agent に実際のブラウザ作業を任せたいときの入口です。ページ操作、selector、retry、安定した web task 実行まで順番に追えます。
ブラウザ制御Playwrightweb automationComputer Use
1
Browser Agent とは何か?AI がブラウザを自分で操作し始めた理由
Browser Agent の意味を、従来のクローラー、RPA、Selenium/Playwright スクリプト、Computer Use との違いまで整理します。五層スタック、使う場面・使わない場面、Browser Use / Stagehand / Playwright MCP / Browserbase の入口まで一気に把握できます。
AI・インテリジェンス

2
Browser Use 入門:AI で Web ページを開き、ボタンをクリックし、情報を抽出する
Browser Use のオープンソース Python ライブラリで最初の AI ブラウザ Agent を動かす入門ガイドです。browser-use のインストール、モデル API key の設定、ページを開く・クリックする・情報を抽出する task の書き方、history、allowed_domains、スクリーンショット、エラーによる切り分けを扱います。
AI・インテリジェンス

3
Playwright MCP 実践ガイド:Claude、Codex、Cursor からブラウザを直接操作する
公式 Playwright MCP を使って Claude Code、Codex、Cursor にブラウザ自動化を接続する方法を解説します。@playwright/mcp@latest の設定、最初のクリック・スクリーンショット・console 確認、accessibility snapshot、profile、storage state、承認、browser_run_code_unsafe の安全境界まで扱います。
AI・インテリジェンス

