Zum Inhalt springen
FindOpenSource

SWE-agent

Nimmt ein GitHub-Issue entgegen und versucht autonom, es mit dem LLM deiner Wahl zu beheben; auch für offensive Cybersicherheit und Programmierwettbewerbe nutzbar (NeurIPS 2024).

Überblick

SWE-agent stattet ein LLM mit einer speziellen Agent-Computer-Schnittstelle zum Navigieren und Bearbeiten von Code-Repositories aus und lässt es dann an einem echten GitHub-Issue einen automatischen Fix versuchen -- inklusive eines pull-request-fertigen Patches. Es stammt vom akademischen Team hinter dem SWE-bench-Benchmark, der inzwischen branchenweit zur Messung der Leistung von Coding-Agenten verwendet wird.

SWE-agent passt zu Teams und Forschenden, die einen rigoros benchmarkten, forschungsnahen autonomen Issue-Lösungsagenten wollen, oder die dieselbe Agent-Computer-Schnittstelle für angrenzende Aufgaben wie Sicherheitsforschung und Wettbewerbsprogrammierung wiederverwenden möchten.

Kategorien
KI-Agenten & Agenten-Tools
Schlagwörter
coding-agentissue-resolutionswe-benchautonomous-agent
Sprachen
Python
Lizenz
MIT

Einen Fehler entdeckt? Änderung auf GitHub vorschlagen.