Session Sharing, Usage Analytics & X402 PricingSessions get sharing and management upgrades, a redesigned Usage page, and cheaper X402 top-ups. 评论点赞收藏6 天前
基准测试的裁判,才是决定分数的关键AI Agent 评测分数的 45% 来自裁判模型差异而非模型能力差异。Browser Use 团队实测发现,同一组 104 个完成任务用不同裁判模型打分,最高 83.7%、最低 62.5%,相差 21 分。他们把裁判升级为能访问完整工作区的 agent,用百分比替代 pass/fail,三次运行取中位数。最终对比显示 Luna xhigh 以 1/16 成本仅落后 Opus 5 两个任务。 评论点赞收藏9 天前
Browser Agents Can Now Pay With Crypto: Coinbase x Browser UseBrowser Use Cloud now accepts payment in USDC over the x402 protocol. No signup, no credit card, and no API key are needed. Your crypto wallet is your account. 评论点赞收藏10 天前
Browser Harness API v4 更新:新增模型与更低充值门槛Browser Use 发布 v4 API 更新,引入 Grok 4.5、Kimi K3 等新模型,优化分页与状态逻辑。最低充值门槛降至 5 美元,降低试用成本。修复了运行状态显示及验证码自动处理等 Bug。 评论点赞收藏30 天前
我们如何用 AWS Bedrock AgentCore 构建安全可扩展的 Agent 基础设施分享基于 AWS Bedrock AgentCore 构建安全且可扩展的 Agent 基础设施的经验,核心原则是让 Agent 无数据可偷、无价值可留。涉及企业级 AI 应用的安全架构设计,适合关注 Agent 规模化落地及云原生安全的开发者参考。 评论点赞收藏35 天前
Browser Use CLI 3.0 发布:用 Python Harness 取代固定动作,提升 Agent 自主操作能力Browser Use CLI 3.0 发布,核心变化是用可编辑的 Python Harness 替代了固定的动作菜单。这允许 AI Agent 在浏览器内自由执行 Python 代码,利用其擅长的编码循环进行自我检查和恢复,而非受限于预设的点击或输入指令。对于正在探索 Agent 自主控制能力的开发者,这是一个重要的工程实践参考,展示了如何通过赋予模型更多自由度来提升在线操作的准确率。 评论点赞收藏46 天前
如何利用 AI Agent 实现 QA 自动化介绍使用 AI Agent(支持 Claude Code、Codex、Cursor)自动化 QA 测试的方法:将技能指向网站,模拟用户行为进行测试并打分,最后给出修复建议。对于正在探索 AI 辅助测试落地、希望提升回归测试效率的工程团队有直接参考价值。 评论点赞收藏46 天前
我们在 EC2 内部运行 Firecracker 虚拟机并在 1 秒内启动浏览器的实践Browser Use 团队分享如何在常规 EC2 实例中嵌套运行 Firecracker MicroVM,通过内存页面优化、CPU 调度策略及无头浏览器指纹伪装等技术,将云浏览器启动时间压缩至 1 秒以内,同时保持低成本和高隐蔽性。文章包含大量工程细节和性能数据。 评论点赞收藏60 天前
Claude Fable 在 BU Bench 上创下高分纪录Claude Fable 5在BU Bench上得分80%,超越所有其他模型,使用开源Browser Use库运行。 评论点赞收藏67 天前
BUX:配备浏览器控制器的全天候远程代理推出BUX,一款预装Claude Code和Browser Harness的24/7远程虚拟机,可通过Telegram、网页或SSH控制。 评论点赞收藏113 天前