オープンソースプロジェクト
ultralytics/ultralytics avatar
ultralytics/ultralytics

Ultralytics YOLOのタスク別モデル運用

Ultralytics YOLO26、YOLO11、YOLOv8 : オブジェクト検出、インスタンス セグメンテーション、セマンティック セグメンテーション、画像分類、姿勢推定、オブジェクト トラッキング

スター 61,631フォーク 11,763PythonAGPL-3.0

ひと目でわかる

これは何?
検出から姿勢推定、追跡までを扱うultralyticsリポジトリの導入とライセンス
誰に向いている?
画像の検出、分類、セグメンテーション、姿勢推定、追跡を一つのAPIで試したい開発者向けです。商用配布ではAGPL-3.0とエンタープライズライセンスの選択が先に必要になります。
商用利用できる?
厳しい条件付きでできます。AGPL-3.0 はネットワーク型コピーレフトのライセンスで、改変版をホスティングサービスなどとしてネットワーク越しに利用させる場合、その利用者にソースコードを同じライセンスで提供する必要があります。
今もメンテナンスされている?
されています。直近 1 日以内に新しいコミットがあります。
何の言語で書かれている?
主に Python です(GitHub の言語統計による)。

回答はプロジェクトの GitHub データ(最終同期:2026年9月15日)と当サイトの分析に基づくもので、法的助言ではありません。

オープンソース詳細解説

YOLOリポジトリが扱うタスク

READMEはUltralytics YOLO26、YOLO11、YOLOv8を挙げ、物体検出、インスタンスセグメンテーション、セマンティックセグメンテーション、画像分類、姿勢推定、物体追跡を対象にしています。版とタスクが複数あるため、YOLOという名前だけで同じ入出力を想定できません。

日本語を含む各言語のドキュメントリンクもREADMEにあります。実験ではモデル名、タスク、入力画像、信頼度設定を記録し、対象版の文書に示された使い方と結果を対応させます。

CLIとPython APIを使い分ける

READMEはCLIとPython APIの入口を示しています。コマンドラインは学習や推論の反復をスクリプト化しやすく、Python APIは前後処理やアプリケーションとの接続を組み込みやすい構成です。具体的な引数や必要な重みは対象タスクの公式文書で確認します。

最初は同じ画像と重みをCLI、Pythonの両方で処理し、検出枠、クラス、スコア、処理時間が一致するかを比べます。GPUの有無、画像サイズ、バッチ数を変えた結果を混ぜずに保存します。

YOLO26から過去版までの選択

READMEのモデル一覧にはYOLO26、YOLO11、YOLOv8が含まれ、それぞれの用途や重みへの入口が用意されています。新しい番号が常に自分のデータに最適だとは限りません。速度、精度、利用可能な事前学習重み、推論環境の条件で候補を絞ります。

評価用データを固定し、検出なら適合率と再現率、セグメンテーションならマスク品質、追跡ならIDの継続性を測ります。READMEは特定データセットでの自社環境の性能を保証していないため、公開表の数値をそのまま移植しません。

学習と事前学習データの関係

READMEは事前学習済みウェイトと、それらが使うデータセットを説明しています。ウェイトは試行開始の材料になりますが、自社画像の撮影条件、ラベル定義、対象クラスが同じとは限りません。学習を行うならデータ準備、分割、アノテーションの品質を独立した工程として管理します。

推論だけを使う場合も、重みの取得元、版、利用条件を記録します。再学習したモデルでは、元のウェイト、設定ファイル、データセット版、評価結果を一緒に保管し、再現できるようにします。

コミュニティと統合先

READMEは公式Discord、Community、Redditに加え、ColabやPaperspaceなどの実行入口をリンクしています。これらは学習例や質問先を探すための窓口です。コミュニティ投稿を公式仕様の代わりに扱わず、最終的な引数とライセンスはリポジトリや公式文書で確認します。

既存のパイプラインへ組み込む前に、画像形式、動画入力、GPUメモリ、推論結果の保存形式を試します。追跡や姿勢推定のように状態を持つ処理では、フレーム順序と再起動時の状態も観測します。

AGPL-3.0と商用利用の分岐

UltralyticsはAGPL-3.0とエンタープライズライセンスを案内しています。モデル重み、ライブラリ、アプリへの組み込み方によって確認すべき条件が変わるため、商用利用を予定する場合はLICENSE本文と公式のライセンス案内を法務と読み合わせます。性能評価が終わっても配布条件は別に残ります。

向いているのは複数の視覚タスクを実装し、モデルとデータの評価を継続できるチームです。採用前に対象リポジトリのリリース、モデル表、データセット、ライセンス条件を固定し、CLIとPython APIの同一入力結果を確認してください。

評価セットは撮影条件とクラス分布を固定し、モデル版、ウェイト、画像サイズ、GPU、信頼度閾値を記録します。CLIとPython APIで同じ画像を処理し、枠やマスク、姿勢点、追跡IDの差を比較します。動画ではフレーム順序と遮蔽後のIDを確認し、再起動後に追跡状態がどうなるかを測ります。学習済みウェイトを配布するなら、データセットの利用条件とAGPL-3.0またはエンタープライズライセンスの選択を、推論精度とは別の承認項目として残します。

検出結果は画像ごとの正解ラベルと突き合わせ、クラス別の見逃しと誤検出を残します。セグメンテーションではマスクの境界、姿勢推定では関節点、追跡では連続フレームのIDを個別に評価します。推論の速さだけを採用理由にせず、ウェイトの利用条件、再学習データ、運用時の誤検出を承認記録へ含めます。

この確認では、使った版、入力、設定、実行日時、終了状態を一つの記録にまとめます。結果がREADMEの記述と一致しない場合は、環境差として具体的に残し、未確認の機能や数値を記事へ足しません。小さな再現を先に完成させてから、対象範囲を広げる判断ができます。

編集部の結論

画像の検出、分類、セグメンテーション、姿勢推定、追跡を一つのAPIで試したい開発者向けです。商用配布ではAGPL-3.0とエンタープライズライセンスの選択が先に必要になります。対象モデルとデータセットを固定し、推論結果、速度、ライセンス条件を個別に確認してください。

公式情報源

  1. Official documentation
  2. Official README
  3. Project repository
  4. Release notes
コミュニティノート

コミュニティノート