Saltar al contenido
FindOpenSource

SWE-agent

Toma un issue de GitHub e intenta arreglarlo de forma autónoma con el LLM que elijas; también se puede usar para ciberseguridad ofensiva y desafíos de programación competitiva (NeurIPS 2024).

Descripción general

SWE-agent le da a un LLM una interfaz agente-computadora personalizada para navegar y editar repositorios de código, y luego lo dirige a un issue real de GitHub para que intente una corrección automática -- generando un parche listo para un pull request. Proviene del equipo académico detrás del benchmark SWE-bench, ahora ampliamente usado en la industria para medir el rendimiento de agentes de codificación.

SWE-agent encaja en equipos e investigadores que quieren un agente de resolución autónoma de issues con evaluación rigurosa y nivel de investigación, o que quieren reutilizar la misma interfaz agente-computadora para tareas afines como investigación de seguridad y programación competitiva.

Categorías
Agentes de IA y herramientas para agentes
Palabras clave
coding-agentissue-resolutionswe-benchautonomous-agent
Lenguajes
Python
Licencia
MIT

¿Encontraste un error? Sugiere una edición en GitHub.