Stagehand
目标受众为开发者和自动化测试工程师,他们需要一个可靠、灵活的工具来自动化网页交互和测试。Stagehand通过提供简洁的API和强大的功能,使得开发者可以快速构建和部署自动化脚本,提高工作效率。
总访问量: 492,133,528
占比最多地区: US(19.34%)
720
简介
Stagehand是一个AI驱动的网页浏览框架,旨在简化和扩展网页自动化的可能性。它提供了三个简单的API(act、extract、observe),这些API构成了自然语言驱动的网络自动化的基础。Stagehand的目标是提供一个轻量级、可配置的框架,没有过于复杂的抽象概念,并且支持不同的模型和模型提供者。它不会为您订购披萨,但它将帮助您可靠地自动化网络。
截图
产品特色
- 通过简单的API实现复杂的网页交互:只需提供原子指令,如`act('点击登录按钮')`或`extract('找到红色鞋子')`,Stagehand将生成并执行相应的Playwright代码。
- 支持多种语言模型:Stagehand支持OpenAI和Anthropic提供的不同模型,可以根据任务需求选择最适合的模型。
- 自然语言处理:通过自然语言指令,用户可以更直观地控制网页自动化流程,无需深入了解背后的技术细节。
- 强大的灵活性和可扩展性:Stagehand的设计允许开发者轻松地添加新的功能和模型,以适应不断变化的网络环境。
- 社区支持:作为开源项目,Stagehand拥有活跃的社区支持,用户可以通过Slack社区获取最新的开发动态和提供反馈。
- 缓存机制:Stagehand支持LLM响应的缓存,可以提高重复任务的执行效率。
- 视觉辅助:对于复杂的DOM结构,Stagehand可以提供标注的屏幕截图,帮助LLM更准确地识别和操作页面元素。
使用教程
1. 安装Stagehand包:使用npm安装Stagehand及其依赖。
2. 配置模型提供者:根据需要使用的模型提供者,设置相应的API密钥。
3. 创建Stagehand实例:根据运行环境(本地或Browserbase),创建并配置Stagehand实例。
4. 运行第一个自动化脚本:使用Stagehand提供的API编写并执行您的第一个自动化脚本。
5. 监控和调试:利用Stagehand的日志功能监控自动化过程,并根据需要进行调试。
流量来源
直接访问51.61%外链引荐33.46%邮件0.04%
自然搜索12.58%社交媒体2.19%展示广告0.11%
最新流量情况
月访问量
4.92m
平均访问时长
393.01
每次访问页数
6.11
跳出率
36.20%
总流量趋势图
地理流量分布情况
美国
19.34%
中国
13.25%
印度
9.32%
俄罗斯
4.28%
德国
3.63%
地理流量分布全球图
同类开源产品
Propolis
Propoliskey是一款自动化QA工具,利用智能代理模拟真实用户操作,通过探索学习如何使用产品,发现并报告错误和建议。
自动化工作流#智能代理
Magentic UI
Magentic-UI 是一个基于多代理系统的研究原型,允许用户通过透明且可控的界面进行网络浏览和任务自动化。
自动化工作流#人机交互
Dropflow
Dropflow是一款能够从转发的电子邮件中提取数据并将其发送到Slack、Trello、Google Sheets、Notion或您自己的API的工具。
自动化工作流#自动化
Minion Agent
优质新品
Minion Agent 是一个简单而强大的代理框架,能够与浏览器交互,支持深度研究、自动规划等功能,适用于需要进行复杂任务和研究的用户。
开发与工具#深度研究
Scrapybara
Scrapybara为开发者提供统一的API,以执行任何模型的代理,并访问浏览器、文件系统和代码沙箱等低级控制。
开发与工具#AI代理
Vetzi.io
Vetzi.io是一款专为兽医诊所设计的自动化文档记录工具,可以帮助兽医诊所节省时间,并提高患者护理的效率。
自动化工作流#兽医
Velin
Velin是一种AI动力集成产品营销环境(IPME),为现代产品团队提供无缝的产品和客户洞察数据合并,创建顺序广告活动和对齐内容的能力。
自动化工作流#AI
Tokenomy.ai
Tokenomy是一款高级AI令牌计算器和成本估算工具,可用于LLMs。
开发与工具#令牌管理
Getinvoice
GetInvoice是一款利用AI技术实现发票和收据自动处理的软件。
自动化工作流#收据提取
替代品
Magentic UI
Magentic-UI 是一个基于多代理系统的研究原型,允许用户通过透明且可控的界面进行网络浏览和任务自动化。
自动化工作流#人机交互
Minion Agent
优质新品
Minion Agent 是一个简单而强大的代理框架,能够与浏览器交互,支持深度研究、自动规划等功能,适用于需要进行复杂任务和研究的用户。
开发与工具#深度研究
Agent As A Judge
Agent-as-a-Judge 是一种新型的自动化评估系统,旨在通过代理系统的互相评估来提高工作效率和质量。
开发与工具#奖励信号
Firecrawl MCP Server
Firecrawl MCP Server 是一款集成了强大网页抓取功能的插件,支持多种 LLM 客户端如 Cursor 和 Claude。
开发与工具#数据提取
MCP SuperAssistant
MCP SuperAssistant 是一个 Chrome 扩展,集成了模型上下文协议(MCP)工具,使用户能够直接从 AI 平台执行 MCP 工具,并将结果插入对话中。
开发与工具#AI 助手
Xcodebuildmcp
XcodeBuildMCP 是一个实现模型上下文协议(MCP)的服务器,旨在通过标准化接口与 Xcode 项目进行程序化交互。
开发与工具#开发工具
Easevoice Trainer
EaseVoice Trainer 是一个后端项目,旨在简化和增强语音合成与转换训练过程。
开发与工具#机器学习
Fastapi MCP
FastAPI-MCP是一个专为FastAPI设计的工具,旨在无缝集成模型上下文协议(MCP)。
开发与工具#MCP
MCP Gateway
MCP Gateway 是一个高级的中介解决方案,用于管理和增强模型上下文协议(MCP)服务器。
开发与工具#安全