跳至内容
FindOpenSource

SWE-agent

接收一个 GitHub issue,自主尝试用你选择的 LLM 修复它;也可用于攻击性网络安全研究和竞技编程挑战(NeurIPS 2024)。

概述

SWE-agent 为 LLM 提供了一个定制的智能体-计算机接口,用于浏览和编辑代码仓库,然后让它面对一个真实的 GitHub issue,尝试自动修复——生成一个可直接用于 pull request 的补丁。它源自 SWE-bench 基准测试背后的学术团队,该基准现已被业界广泛用于衡量编程智能体的性能。

SWE-agent 适合希望使用经过严格基准测试、研究级别的自主 issue 解决智能体的团队和研究人员,或者希望将同一套智能体-计算机接口复用于安全研究、竞技编程等相邻任务的人。

分类
AI 智能体与智能体工具
关键词
coding-agentissue-resolutionswe-benchautonomous-agent
编程语言
Python
许可证
MIT

发现信息有误?在 GitHub 上提出修改建议