尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Browser-Use AI浏览器自动化入门指南:从0到跑通你的第一个任务

Browser-Use AI浏览器自动化入门指南:从0到跑通你的第一个任务 Browser-Use AI浏览器自动化入门指南从0到跑通你的第一个任务【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use早上 8 点你打开 5 个后台系统登录、导出报表、改名、存网盘同样的流程重做了一遍耗时 40 分钟。把这件事交给 Browser-Use 之后同样的流程大约 2 分钟自动跑完你只需要看一眼结果。Browser-Use 是一个开源的 AI 浏览器自动化框架你用自然语言描述网页任务它驱动真实浏览器替你把点击、输入、下载全部做完。Browser-Use 如何看懂网页并执行任务它的核心是一个循环先观察当前页面状态再让大模型决策下一步动作接着在真实浏览器里执行最后把执行结果和页面反馈喂回去继续下一轮直到任务完成。自动识别页面上的按钮、链接和表单元素用自然语言定位元素不依赖写死的 CSS 选择器支持多标签页切换和跨页面任务把页面内容提取成结构化数据导出Browser-Use 安装步骤和最小可运行示例环境要求只有一条Python 3.11 以上。这段命令克隆仓库并安装依赖git clone https://gitcode.com/GitHub_Trending/br/browser-use cd browser-use pip install browser-useAPI 密钥写进.env文件即可比如BROWSER_USE_API_KEYyour-key。这段脚本让 Agent 替你查一个真实数据import asyncio from browser_use import Agent, ChatBrowserUse async def main(): agent Agent( task查找 browser-use 项目在 GitHub 上的星标数, llmChatBrowserUse(modelopenai/gpt-5.5), ) history await agent.run() print(history) asyncio.run(main())运行后你会看到一个真实的浏览器窗口自己打开、导航到项目页面、读出数字最后把答案打印出来。把task换成你自己的任务描述它就是你的自动化助手。三个拿来就用的 Browser-Use 任务模板它接受的是任务描述字符串不是代码。下面三个场景覆盖数据采集、批量表单和定时巡检直接复制改参数就能用。电商比价你以前每天手动抄竞品价格。访问京东、天猫、拼多多查询 iPhone 15 的当前售价和评价数量整理成一份 CSV 文件列包含商品名、平台、价格、评价数。预期产出一份可直接发给同事的 CSV 比价表。批量入职申请你以前逐个复制粘贴填表、核对必填项。登录公司招聘系统为以下候选人填写入职申请表张三前端开发、李四后端开发。确保必填项全部正确填写后再提交提交后截图留档。预期产出两份已提交申请外加提交成功截图。定时站点巡检你以前每天打开首页确认它还活着。每 10 分钟检查一次公司官网首页如果返回 404、加载超过 10 秒或出现报错页面立即给运维群发消息并把每次检查的时间戳和结果写入日志。预期产出持续巡检加异常即时通知日志可追溯。更复杂的活它也能接。仓库里有个演示应用Agent 访问官网、抓取品牌信息和卖点再自动生成广告图和落地页给 Browser-Use 添加自定义工具和调参这段代码注册一个自定义工具AI 执行任务到需要求和的步骤会自动调用而不是自己心算from browser_use import Agent, Tools tools Tools() tools.action(description计算两个数字的和) def add_numbers(a: int, b: int) - int: return a b agent Agent(task..., llmyour_llm, toolstools)浏览器行为同样可以调常见的几个抓手代理地址用于切换出口或走内网是否禁用图片加载大站点提速明显页面加载超时时间可访问的域名白名单浏览器会话内部是一套事件系统页面加载完成、弹窗出现、下载结束这些时机都能挂上你自己的回调逻辑。Browser-Use 模型选择对比与选型建议同一个任务换不同模型成功率差别很大。下面是官方在 100 个真实浏览器任务上的基准测试性能优先选官方优化模型成功率明显领先适合跑批量任务。预算优先选 GPT-5.5、Gemini Flash 这类通用模型成本低成功率仍在 65% 上下。本地部署接 Ollama 跑本地模型数据不出内网适合敏感业务。Browser-Use 上生产前的检查清单稳定性任务描述里写清可验证的完成标准用最大步数参数兜底防止死循环网络类错误配置重试而不是直接失败。安全密钥只放环境变量不写进代码敏感网站的账号密码走 2FA 集成不经过模型明文传递给 Agent 限制可访问域名范围。性能并发 Agent 先控制在 3 个以内每个都会占浏览器内存大站点任务关闭图片加载给导航设短超时让失败更快暴露。社区规模也能说明问题项目已经拿到 6.9 万星Browser-Use 高频问题快答它收费吗框架本身开源免费MIT 协议。你只为大模型的 API 调用付费接 Ollama 本地模型可以把这部分也省掉。不会写代码能用吗能。最小示例十几行照抄后把任务描述换成自己的话就行复杂场景参考 examples 目录的现成脚本。支持哪些浏览器基于 Chromium 内核Chrome、Edge 等现代浏览器都能用。登录态怎么保持支持保存 Cookie 和会话状态首次登录后后续任务自动保持登录。会被网站检测出来吗内置拟人操作和随机延迟来降低风险。高安全级别的站点建议先小规模试跑再谈放量。你的下一步跑通星标数查询任务挑一个最贴近日常的示例改跑加上自定义工具或本地模型资源入口完整文档见 README.md各场景示例在 examples/边界情况测试在 tests/。重复的网页操作交给 Browser-Use整块时间还给你。现在打开终端跑通你的第一个任务。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表