Maxun:オープンソースのノーコードWebスクレイピング・AIデータ抽出プラットフォーム
🔥 Web スクレイピング、クローリング、検索、AI データ抽出のためのオープンソースのノーコード プラットフォーム • 数分で Web サイトを構造化 API に変換します 🔥
ひと目でわかる
- これは何?
- Maxunは、Webスクレイピング、クロール、検索、AI抽出のためのオープンソースのノーコードプラットフォームです。この記事では、4つのロボットタイプ、デプロイオプション、機能の主張、AGPL-3.0ライセンスについて解説します。
- 誰に向いている?
- Maxunは、AGPL-3.0ライセンスの下にある初期段階のオープンソースTypeScriptプロジェクトであり、ノーコードでのWebデータ収集のための4つのロボットタイプを提供しています。READMEはホステッド版とセルフホスト版の両方のデプロイ経路を示し、ベンチマークなしの幅広い機能リストを提示し、フィードバックを求めるとともに、商用利用者に開発への支援を求めています。
- 商用利用できる?
- 厳しい条件付きでできます。AGPL-3.0 はネットワーク型コピーレフトのライセンスで、改変版をホスティングサービスなどとしてネットワーク越しに利用させる場合、その利用者にソースコードを同じライセンスで提供する必要があります。
- 今もメンテナンスされている?
- されています。最後のコミットは 1 日前です。
- 何の言語で書かれている?
- 主に TypeScript です(GitHub の言語統計による)。
回答はプロジェクトの GitHub データ(最終同期:2026年9月15日)と当サイトの分析に基づくもので、法的助言ではありません。
オープンソース詳細解説
getmaxun-maxun:Webサイトを構造化データに変えるノーコードプラットフォーム
Maxunは、Webを構造化された信頼できるデータに変えるためのオープンソースのノーコードWebデータプラットフォームであると自己紹介しています。リポジトリのタグラインは「あらゆるWebサイトを構造化APIに変える」というもので、プロジェクトの説明にはWebスクレイピング、クロール、検索、AIデータ抽出が含まれています。READMEはこれを統一プラットフォームとして位置づけ、単純なユースケースから複雑な自動化ワークフローまで拡張できると主張しています。プロジェクトはTypeScriptで書かれ、github.com/getmaxun/maxunでホストされ、公式サイトはmaxun.dev、ドキュメントはdocs.maxun.devにあります。READMEにはDiscordコミュニティ、YouTubeチュートリアル、デモ動画へのリンクも含まれています。READMEにはプロジェクトの歴史や作成日時に関する情報はありません。
getmaxun-maxun:4つのロボットタイプが異なるデータ収集タスクをカバー
READMEはプラットフォームを4つのロボットタイプに整理しています。Extract(抽出)は実際のユーザー行動をエミュレートし、Webサイトから構造化データを取得します。Scrape(スクレイプ)は完全なWebページをクリーンなMarkdownまたはHTMLに変換し、スクリーンショットを撮ることもできます。READMEはこれをAIワークフロー、エージェント、ドキュメント処理に理想的だと述べています。Crawl(クロール)はWebサイト全体をカバーし、範囲と発見を制御しながら関連するすべてのページからコンテンツを抽出します。Search(検索)は自動化されたWeb検索を実行して結果を発見またはスクレイプし、時間ベースのフィルターをサポートします。各ロボットタイプにはREADMEからリンクされた専用のドキュメントページがあり、ユーザーはそれぞれについて詳しく読むことができます。
getmaxun-maxun:Extractの2つのモード
ExtractはREADMEで最も詳細に説明されているロボットタイプです。Recorderモードでは、ブラウジング中に操作を記録すると、Maxunがそれらの操作を再利用可能な抽出ロボットに変換します。READMEはAirbnbから10件の物件リストを抽出するデモ動画にリンクしています。AIモードでは、必要なものを自然言語で説明すると、LLM駆動の抽出が残りの作業を処理します。デモではIMDbから上位50本の映画の名前、評価、所要時間を抽出する様子が示されています。どちらのモードもドキュメントのExtractカテゴリに詳しく説明されており、ユーザーは手動で操作をデモするかどうかに応じてモードを選択できます。READMEはExtractが実際のユーザー行動をエミュレートすると強調しており、ログイン、スクロール、ページネーションが必要なサイト向けに設計されていることを示しています。
getmaxun-maxun:ホステッド版、ローカルインストール、セルフホスティング
READMEによると、最も簡単で最速の開始方法は、ホステッド版(app.maxun.dev)を使用することです。自分でMaxunを実行したいユーザーのために、READMEはDocker Composeでのセットアップ手順、Dockerなしのローカルセットアップ、環境変数に関するページへのリンクを提供しています。Dockerでのセルフホスティングと、既存のDocker Composeまたは非Dockerインストールのアップグレードに関する個別のセクションもあります。README自体には実際のインストールコマンドは含まれておらず、ドキュメントサイトを参照しているため、具体的なコマンドライン手順はドキュメントで確認する必要があります。READMEはSDKの存在に言及し、別のnode-sdkリポジトリにリンクしていますが、README内でコード例を提供しているわけではありません。
getmaxun-maxun:提示されている機能リスト
READMEは実装の詳細やベンチマークなしで一連の機能をリストしています。主張には、ノーコード抽出のためのポイントアンドクリックインターフェース、LLM駆動の抽出、開発者SDK、ページネーションとスクロールの自動処理、スケジュールされたロボット実行、任意のサイトからのRESTfulエンドポイント、Google SheetsとAirtableへのエクスポート、Webサイトのレイアウト変更からの自動回復、ログイン後の抽出、他のツールとの統合、Model Context Protocol(MCP)サポート、AIアプリケーション向けのクリーンなMarkdown出力が含まれます。プロジェクトはセルフホスト可能でオープンソースであるとも主張しています。READMEはこれらを検証済みのパフォーマンス結果ではなく、プラットフォームの意図された機能として提示しており、パフォーマンス指標やユーザーの声は提供されていません。
getmaxun-maxun:開発段階とAGPL-3.0ライセンス
READMEはプロジェクトが開発の初期段階にあると述べ、フィードバックを求めています。プロジェクトはAGPL-3.0ライセンスの下で提供されており、ライセンステキストはこれをネットワークサーバーソフトウェアのために設計された自由なコピーレフトライセンスと説明しています。AGPL-3.0の重要な要件は、ネットワーク経由でアクセス可能なサーバー上で修正版を実行する場合、そのサーバーのユーザーに修正されたソースコードを提供しなければならないというものです。ライセンスはまた、ソフトウェアには保証がないと述べており、セキュリティ体制、サポートサービス、メンテナンスの約束については何も述べていません。READMEのプロジェクト価値観セクションは、商用利用者に貢献または開発支援を検討するよう求めています。リポジトリのメタデータはこのプロジェクトが17,000以上のスターを持っていることを示していますが、README自体はユーザー数や本番環境での採用状況に関する具体的なデータを提供していません。
編集部の結論
Maxunは、AGPL-3.0ライセンスの下にある初期段階のオープンソースTypeScriptプロジェクトであり、ノーコードでのWebデータ収集のための4つのロボットタイプを提供しています。READMEはホステッド版とセルフホスト版の両方のデプロイ経路を示し、ベンチマークなしの幅広い機能リストを提示し、フィードバックを求めるとともに、商用利用者に開発への支援を求めています。
コミュニティノート