sim-use - 给 agent 装上眼睛和手,让 mobile 开发跟上 AI 时代
最近在公司捣鼓了一个工具,叫 sim-use:一个跨平台 CLI,让 agent 能在 iOS 和 Android 上高效且准确地”看见画面、点按元素、验证结果”。前段时间它正式开源了,日文版的介绍文章也发在了公司的 Tech Blog 上。不过说来有趣,那篇文章的初稿其实是用中文写的,后来才翻译成日文发表;现在再把它从日文”翻译”回中文、发在自己的博客上,多少有点出口转内销的行为艺术。趁着记忆还新鲜,用母语把里面的技术细节好好聊一遍。 如果你最近半年用 agent 写代码,大概经历过这个循环: 1 2 3 写 prompt → agent 出活 → 自己跑 app → 验证 / 截图 / 找 agent 抱怨 → agent 改 → 再跑 → 再截图 … “写代码”这部分工作,在很大程度上已经被 agent 承担并接手了,但是“验证”正确性对 UI app 来说尤为困难。agent 已经能在几分钟内吐出一大段像模像样的 Swift 或 Kotlin,但写完最多跑跑单元测试,然后就停在那儿了——它等你来运行、来看、来告诉它哪不对,它再根据反馈进行修改。这是相当低效...
评论
?
参与讨论