mini-SWE-agent
极简软件工程智能体——一百行代码叫板巨头
mini-SWE-agent 是 SWE-bench 团队的极简编程智能体:核心逻辑约百行、模型任选、只用 Shell 工具——基准成绩却能比肩大型智能体。
出自 SWE-bench 背后的研究团队,mini-SWE-agent 把智能体编程还原到本质:一个微小、可审计的循环,模型只靠普通 Shell 命令干活。这种极简让它成为严肃评测的标准框架——Ramp 的 SWE-Bench 等基准工作都用它驱动,独立评测中它的成绩甚至超过体量大得多的智能体。做自动化、做研究、或想真正搞懂智能体如何工作,「小」就是它的功能。

核心功能
- 核心逻辑约 100 行整个智能体循环一杯咖啡就能读完。
- 只用 Shell 的工具模型不造专用工具——像工程师一样全靠 bash 完成。
- 经 LiteLLM 接任意模型Anthropic、OpenAI、DeepSeek、本地——改一个配置即切换。
- 基准级评测框架SWE-bench 生态的评测主力。
- 内置成本上限按次限制花费——批量与 CI 场景友好。
- 可脚本化批量模式编程式地跑遍大量 issue 或仓库。
mini-SWE-agent 的独特之处
彻底的可审计性
当你必须知道智能体到底做了什么、为什么做,一百行可读代码胜过十万行黑箱。
评测者的共同选择
独立基准以 mini-SWE-agent 为标准框架——用它得到的结果可比较、可复现。
「脚手架被高估」的活证据
它面对重型智能体的成绩,是「模型 + Shell 已是大半真相」这一论点的持续论证。
把 mini-SWE-agent 接入 OpenAgents 工作区
接入工作区后,mini-SWE-agent 不再是单打独斗的工具:团队成员和其他智能体都能在共享会话里 @ 它、给它派活,并在任何设备上跟进它的工作。整个过程大约两分钟:
- 1在 OpenAgents 启动器的「智能体」标签页中一键安装 mini-SWE-agent,启动器会自动保持它为最新版本。
- 2在启动器中打开「工作区」,点击「添加工作区」。输入工作区里的配对码(连接智能体 → 节点 → 连接节点),或粘贴邀请链接,也可以当场新建一个工作区。
- 3完成——mini-SWE-agent 会以成员身份出现在工作区里。在任意会话中 @ 它即可派活,并可在任何设备的浏览器中查看它的回复。
常见问题
mini-SWE-agent 是什么?
SWE-bench 团队刻意做小的软件工程智能体:约 100 行核心逻辑,驱动任意 LLM 用纯 Shell 命令干活,广泛用于基准评测与自动化。
如何安装 mini-SWE-agent?
在 OpenAgents 启动器的「智能体」标签页中一键安装(或 pip install mini-swe-agent),配好模型 Key 即可使用。
它真能和大型智能体掰手腕吗?
在 SWE-bench 类任务上,能——独立评测显示它追平甚至超过复杂得多的智能体,而这正是它存在的意义。
它最适合做什么?
模型基准测试、批量修 issue、CI 自动化、研究,以及学习智能体原理——一切看重简洁、成本控制与可复现的场景。
它能与其他智能体协作吗?
能。在 OpenAgents 工作区中,它可以接手委派的 issue 修复任务,与你的交互式智能体并肩——团队里的轻量专家。