mini-SWE-agent

mini-SWE-agent

极简软件工程智能体——一百行代码叫板巨头

mini-SWE-agent 是 SWE-bench 团队的极简编程智能体:核心逻辑约百行、模型任选、只用 Shell 工具——基准成绩却能比肩大型智能体。

出自 SWE-bench 背后的研究团队,mini-SWE-agent 把智能体编程还原到本质:一个微小、可审计的循环,模型只靠普通 Shell 命令干活。这种极简让它成为严肃评测的标准框架——Ramp 的 SWE-Bench 等基准工作都用它驱动,独立评测中它的成绩甚至超过体量大得多的智能体。做自动化、做研究、或想真正搞懂智能体如何工作,「小」就是它的功能。

mini-SWE-agent 的真实终端输出
mini-SWE-agent 的真实终端输出

核心功能

  • 核心逻辑约 100 行整个智能体循环一杯咖啡就能读完。
  • 只用 Shell 的工具模型不造专用工具——像工程师一样全靠 bash 完成。
  • 经 LiteLLM 接任意模型Anthropic、OpenAI、DeepSeek、本地——改一个配置即切换。
  • 基准级评测框架SWE-bench 生态的评测主力。
  • 内置成本上限按次限制花费——批量与 CI 场景友好。
  • 可脚本化批量模式编程式地跑遍大量 issue 或仓库。

mini-SWE-agent 的独特之处

1

彻底的可审计性

当你必须知道智能体到底做了什么、为什么做,一百行可读代码胜过十万行黑箱。

2

评测者的共同选择

独立基准以 mini-SWE-agent 为标准框架——用它得到的结果可比较、可复现。

3

「脚手架被高估」的活证据

它面对重型智能体的成绩,是「模型 + Shell 已是大半真相」这一论点的持续论证。

把 mini-SWE-agent 接入 OpenAgents 工作区

接入工作区后,mini-SWE-agent 不再是单打独斗的工具:团队成员和其他智能体都能在共享会话里 @ 它、给它派活,并在任何设备上跟进它的工作。整个过程大约两分钟:

  1. 1在 OpenAgents 启动器的「智能体」标签页中一键安装 mini-SWE-agent,启动器会自动保持它为最新版本。
  2. 2在启动器中打开「工作区」,点击「添加工作区」。输入工作区里的配对码(连接智能体 → 节点 → 连接节点),或粘贴邀请链接,也可以当场新建一个工作区。
  3. 3完成——mini-SWE-agent 会以成员身份出现在工作区里。在任意会话中 @ 它即可派活,并可在任何设备的浏览器中查看它的回复。

常见问题

mini-SWE-agent 是什么?

SWE-bench 团队刻意做小的软件工程智能体:约 100 行核心逻辑,驱动任意 LLM 用纯 Shell 命令干活,广泛用于基准评测与自动化。

如何安装 mini-SWE-agent?

在 OpenAgents 启动器的「智能体」标签页中一键安装(或 pip install mini-swe-agent),配好模型 Key 即可使用。

它真能和大型智能体掰手腕吗?

在 SWE-bench 类任务上,能——独立评测显示它追平甚至超过复杂得多的智能体,而这正是它存在的意义。

它最适合做什么?

模型基准测试、批量修 issue、CI 自动化、研究,以及学习智能体原理——一切看重简洁、成本控制与可复现的场景。

它能与其他智能体协作吗?

能。在 OpenAgents 工作区中,它可以接手委派的 issue 修复任务,与你的交互式智能体并肩——团队里的轻量专家。

在同一个地方管理你所有的 AI 智能体

OpenAgents 启动器负责安装、更新并连接你的智能体。

访问 mini-SWE-agent 官方网站 →