岗位职责
我们是 Accio Work,一个行动式 AI 产品,一个可以执行任务、调用工具、操作工作空间的生产力伙伴。我们致力于突破 Agent 技术的边界,让每个人都能拥有属于自己的 Agent Team。目前产品已覆盖 Desktop、App、Web 三个版本,Agent 架构还支撑国际站多种业务场景。加入我们,共同打造真正"动手"的 AI。
岗位职责:
- 负责 Accio Work 核心功能测试,覆盖会话交互、任务执行引擎、工具调用、Skill/Plugin、记忆系统、工作空间与虚拟机(VM)控制、多 Agent 协同及多端(Desktop/App/Web)等模块。
- 主导 Agent 自动化测试框架从 0 到 1 的设计与落地,构建 UI/API/端到端(E2E)三层自动化能力,并嵌入 CI/CD,提供快速、低误报、可信的发布信号。
- 构建 Agent 性能与 AI 能力评测体系,建设 Golden Dataset、LLM-as-a-Judge 等手段,检测提示词漂移、幻觉、工具调用失败等问题,量化模型/Prompt/Skill 变更的质量影响。
- 推进执行策略优化与容错降级机制的测试验证,覆盖并发、断流、权限越界、沙箱隔离等边界与对抗场景,并测试提示注入、越狱等 AI 特有安全风险,保障系统可靠性。
- 建立缺陷分级与质量度量机制,推动测试左移;协同产品、算法及业务团队,推动 Agent 技术高质量落地。
任职要求
- 本科及以上学历,计算机相关专业优先;具备扎实的软件工程基础与丰富的测试/测试开发(SDET)经验。
- 精通自动化测试框架设计与落地,熟悉 Playwright/Selenium/PyTest,掌握 API(REST/GraphQL)测试;精通至少一门语言(Python/TypeScript/Java/Go 等)。
- 理解 Agent 应用范式,熟悉 ReAct、Prompt、ToolCall、Memory、Skill 等模块;理解 WebSocket、异步事件流、权限控制、沙箱隔离等设计。
- 深入理解 CI/CD 与质量门禁,具备分布式系统排障与可观测性(日志、trace、metrics)能力;有 AI/LLM/Agent 系统测试经验者优先。
- 具备 Vibe Coding 能力,能高效利用 Claude Code、Cursor 等 AI 工具完成测试开发并做好质量把控;自驱力强,能适应快速迭代和从 0 到 1 的节奏。