Open Issues Need Help
View All on GitHub bug help wanted
Open-source benchmark for browser AI agents on daily tasks.
Python
#agent-evaluation#agentic-ai#ai-agent-benchmark#ai-agents#benchmark#browser-agent#browser-automation#browser-use#chrome-agent#chrome-extension#computer-use#dataset#evaluation#everyday-tasks#llm#llm-evaluation#online-tasks#real-world-benchmark#web-agent#web-agents
enhancement help wanted
Open-source benchmark for browser AI agents on daily tasks.
Python
#agent-evaluation#agentic-ai#ai-agent-benchmark#ai-agents#benchmark#browser-agent#browser-automation#browser-use#chrome-agent#chrome-extension#computer-use#dataset#evaluation#everyday-tasks#llm#llm-evaluation#online-tasks#real-world-benchmark#web-agent#web-agents
enhancement help wanted
Open-source benchmark for browser AI agents on daily tasks.
Python
#agent-evaluation#agentic-ai#ai-agent-benchmark#ai-agents#benchmark#browser-agent#browser-automation#browser-use#chrome-agent#chrome-extension#computer-use#dataset#evaluation#everyday-tasks#llm#llm-evaluation#online-tasks#real-world-benchmark#web-agent#web-agents
bug help wanted
Open-source benchmark for browser AI agents on daily tasks.
Python
#agent-evaluation#agentic-ai#ai-agent-benchmark#ai-agents#benchmark#browser-agent#browser-automation#browser-use#chrome-agent#chrome-extension#computer-use#dataset#evaluation#everyday-tasks#llm#llm-evaluation#online-tasks#real-world-benchmark#web-agent#web-agents