SWE-agentはGitHub issueから修正候補を作る研究用エージェント
SWE エージェントは GitHub の問題を受け取り、選択した LM を使用して自動的に修正しようとします。また、攻撃的なサイバーセキュリティや競争力のあるコーディングの課題にも使用できます。 [NeurIPS 2024]。
ひと目でわかる
- これは何?
- 指定した言語モデルにツールを使わせ、実際のGitHubリポジトリのissue修正、サイバーセキュリティ課題、競技プログラミングを試みます。現在のREADMEは後継のmini-SWE-agentを推奨しています。
- 誰に向いている?
- 研究や隔離された評価環境で、issueから編集、テストまでのエージェント軌跡を調べたい人に向きます。現行開発の中心はmini-SWE-agentなので、新規導入でSWE-agentを固定する理由は慎重に記録すべきです。
- 商用利用できる?
- できます。MIT は寛容なライセンスで、著作権表示とライセンス表示を残せば、使用・改変・販売が可能です。
- 今もメンテナンスされている?
- されています。最後のコミットは 8 日前です。
- 何の言語で書かれている?
- 主に Python です(GitHub の言語統計による)。
回答はプロジェクトの GitHub データ(最終同期:2026年9月14日)と当サイトの分析に基づくもので、法的助言ではありません。
オープンソース詳細解説
READMEが示す現在地
SWE-agentはGitHub issueを受け取り、利用者が選んだLMで自動修正を試すプロジェクトです。READMEはSWE-bench、一般的な開発、EnIGMAによる攻撃的サイバーセキュリティ課題を用途として挙げます。一方で最も強い注意書きは、現在の開発努力がmini-SWE-agentに移り、同プロジェクトがSWE-agentを置き換えたという点です。SWE-agentの新機能継続を前提に計画しません。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第1章では、READMEが示す現在地に関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
issueから編集までの境界
エージェントはissueの説明、リポジトリ、利用可能なツールをもとに作業します。READMEは最大限の自由度と一般化可能性、単一yamlによる設定を特徴として挙げています。自由度が高いほど、誤ったファイル編集や不要な依存変更を検出する責任は実行側に残ります。作業用ブランチ、ネットワーク、書き込み可能なディレクトリを分離し、最終差分を自動マージしない運用から始めます。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第2章では、issueから編集までの境界に関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
評価指標を広告と分ける
READMEはオープンソースのSWE-benchでstate of the artと記載しますが、モデル、データセット、プロンプト、評価時点で結果は変わります。自分の課題群では、修正が適用されたか、テストが通ったか、余計な変更がないか、実行時間とトークン量はいくつかを別々に数えます。成功率だけでなく、同じissueを複数回実行した差分のばらつきも保存します。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第3章では、評価指標を広告と分けるに関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
導入前に後継を比較する
READMEにはSWE-agentの導入詳細から公式ドキュメントへ進む入口がありますが、現在の推奨はmini-SWE-agentです。新規の検証では両リポジトリのFAQとusageを読み、課題の入力形式、ツール呼び出し、ログ、ライセンス、Pythonやモデルの条件を一致させます。SWE-agent側に自動インストール手順がない場合、コマンドを推測せず、公式ドキュメントに記載された手順をそのまま再現します。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第4章では、導入前に後継を比較するに関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
セキュリティ課題での扱い
EnIGMAは攻撃的サイバーセキュリティのcapture the flag課題を解くモードとしてREADMEに説明されています。実ネットワークや第三者システムへ向けた権限を暗黙に与えるものではありません。検証は所有するローカル課題、無害なfixture、制限したコンテナで行い、外部通信、シェル実行、資格情報へのアクセス、生成された成果物を監査します。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第5章では、セキュリティ課題での扱いに関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
MITと研究運用の責任
ライセンスはMITですが、READMEやライセンスは安全性、正答率、サポート、保証を約束しません。研究用途では実行軌跡、使用モデル、issue、commit、テストコマンドを記録し、結果を再現できる形にします。コードベースへの大きな変更はissueで先に議論する方針が示され、現在は現行アプリへのpull requestが適切かも確認が必要です。
SWE-agentでは、所有する小さなGitリポジトリと再現可能なissueだけを使います。実行ごとにモデル名、設定yaml、許可ツール、変更前後のcommit、シェル履歴、テスト結果を保存し、生成された修正を人手でレビューします。mini-SWE-agentとの差分と移行理由も同じ記録に残します。 第6章では、MITと研究運用の責任に関係する入力、出力、エラーを分けて記録します。READMEが説明していない挙動は未確認として残し、成功した一回だけを互換性の根拠にはしません。
編集部の結論
研究や隔離された評価環境で、issueから編集、テストまでのエージェント軌跡を調べたい人に向きます。現行開発の中心はmini-SWE-agentなので、新規導入でSWE-agentを固定する理由は慎重に記録すべきです。まず公開された小さなリポジトリを複製し、変更差分、実行コマンド、テスト結果、モデル入力を人手で承認する流れを作ります。
コミュニティノート