相关项目
SeeAct
SeeAct采用多模态GPT模型(如GPT-4V(ision)),提供网页任务自动化的解决方案,支持OpenAI和Google的多种语言模型,并与Playwright浏览器无缝集成。适用于网页代理测试与评估,支持多种配置和自定义任务,实现安全操作和实时监控。Multimodal-Mind2Web数据集提供丰富的网页截图和HTML文本,便于实验和评估。
Mind2Web
Mind2Web是一个开创性的AI项目,旨在开发能在任何网站上执行复杂任务的通用网页交互代理。该项目构建了包含2,000多个开放式任务的数据集,覆盖137个网站和31个领域。Mind2Web的特点是任务多样性、真实网站环境和广泛的用户交互模式,为AI在网络环境中的应用提供了坚实基础。