普林斯顿开源的编程代理,12% 成功率独立解决真实 issue,是 AI 自主编程能力的重要验证。
我们的当前开发重点是 mini-swe-agent,它已经取代了 SWE-agent。它与 SWE-agent 的性能相当,但要简单得多。有关差异的更多详情,请参阅常见问题。我们的总体建议是今后使用 mini-SWE-agent 而不是 SWE-agent。
SWE-agent 使你选择的语言模型(如 GPT-4o 或 Claude Sonnet 4)能够自主使用工具来修复实际 GitHub 仓库中的问题、发现网络安全漏洞或执行任何自定义任务。
✅ 在开源项目中 SWE-bench 性能最佳
✅ 自由流动与可泛化:赋予语言模型最大的自主权
✅ 可配置且充分文档化:由单个 yaml 文件管理
✅ 为研究而生:设计简洁且易于改进
SWE-agent 由普林斯顿大学和斯坦福大学的研究人员构建和维护。
👉 在浏览器中尝试 SWE-agent:(更多信息)
阅读我们的文档了解更多:
SWE-agent: EnIGMA 是一个用于解决攻防性网络安全(夺旗)挑战的模式。EnIGMA 在多个网络安全基准测试中获得最佳成绩(见排行榜)。在我们为 1.0 更新 EnIGMA 之前,请使用 SWE-agent 0.7。
此外,你可能还对我们的其他项目感兴趣。
如果你想为代码库做出贡献,我们欢迎 issue 和 pull request!对于较大的代码更改,我们始终鼓励先在 issue 中进行讨论。
SWE-agent 是普林斯顿大学由 John Yang、Carlos E. Jimenez、Alexander Wettig、Kilian Lieret、Shunyu Yao、Karthik Narasimhan 和 Ofir Press 开启的学术项目。联系人:John Yang、Carlos E. Jimenez 和 Kilian Lieret (电子邮件:johnby@stanford.edu, carlosej@cs.princeton.edu, kl5675@princeton.edu)。
如果你觉得这项工作有帮助,请考虑使用以下方式引用:
@inproceedings{yang2024sweagent,
title={{SWE}-agent: Agent-Computer Interfaces Enable Automated Software Engineering},
author={John Yang and Carlos E Jimenez and Alexander Wettig and Kilian Lieret and Shunyu Yao and Karthik R Narasimhan and Ofir Press},
booktitle={The Thirty-eighth Annual Conference on Neural Information Processing Systems},
year={2024},
url={https://arxiv.org/abs/2405.15793}
}
如果你使用了 SWE-agent 中的总结器、交互式命令或攻防性网络安全能力,请同时考虑引用:
@misc{abramovich2024enigmaenhancedinteractivegenerative,
title={EnIGMA: Enhanced Interactive Generative Model Agent for CTF Challenges},
author={Talor Abramovich and Meet Udeshi and Minghao Shao and Kilian Lieret and Haoran Xi and Kimberly Milner and Sofija Jancheska and John Yang and Carlos E. Jimenez and Farshad Khorrami and Prashanth Krishnamurthy and Brendan Dolan-Gavitt and Muhammad Shafique and Karthik Narasimhan and Ramesh Karri and Ofir Press},
year={2024},
eprint={2409.16165},
archivePrefix={arXiv},
primaryClass={cs.AI},
url={https://arxiv.org/abs/2409.16165},
}