Service auto-hébergé
getmaxun/maxun avatar
getmaxun/maxun

Maxun : plateforme open source sans code pour le scraping web et l'extraction de données par IA

🔥 La plateforme open source sans code pour le web scraping, l'exploration, la recherche et l'extraction de données IA • Transformez les sites Web en API structurées en quelques minutes 🔥

17 458 étoiles1 509 forksTypeScriptAGPL-3.0

En bref

De quoi s’agit-il ?
Maxun est une plateforme open source sans code pour le scraping web, le crawl, la recherche et l'extraction par IA. Cet article couvre les quatre types de robots, les options de déploiement, les fonctionnalités annoncées et la licence AGPL-3.0.
À qui s’adresse-t-il ?
Maxun est un projet TypeScript open source à un stade précoce, sous licence AGPL-3.0, offrant quatre types de robots pour la collecte de données web sans code. Le README indique des parcours de déploiement hébergé et auto-hébergé, liste un large ensemble de fonctionnalités sans benchmarks, et demande des retours tout en sollicitant le soutien des utilisateurs commerciaux.
Puis-je l’utiliser commercialement ?
Oui, sous conditions strictes. AGPL-3.0 est une licence à copyleft réseau : si des personnes utilisent une version modifiée via un réseau, par exemple comme service hébergé, vous devez leur proposer son code source sous la même licence.
Est-il encore maintenu ?
Oui. Les derniers commits datent d’il y a 1 jour.
En quel langage est-il écrit ?
Principalement TypeScript, d’après les statistiques de langage de GitHub.

Ces réponses reposent sur les données GitHub du projet (dernière synchronisation le 15 septembre 2026) et sur notre analyse. Elles ne constituent pas un avis juridique.

ANALYSE OPEN SOURCE APPROFONDIE

Une plateforme sans code qui transforme les sites web en données structurées · maxun

Maxun se présente comme une plateforme open source sans code de données web, destinée à transformer le web en données structurées et fiables. Le slogan du dépôt affirme que l'on peut transformer n'importe quel site web en API structurée, et la description du projet mentionne le scraping web, le crawl, la recherche et l'extraction de données par IA. Le README positionne la plateforme comme une solution unifiée qui va des cas d'usage simples aux workflows automatisés complexes. Le projet est écrit en TypeScript, hébergé sur github.com/getmaxun/maxun, avec un site web à maxun.dev, une documentation à docs.maxun.dev, et des liens vers une communauté Discord, des tutoriels YouTube et des vidéos de démonstration dans le README. Le README ne fournit aucune information sur l'historique du projet ou sa date de création.

Quatre types de robots pour différentes tâches de collecte de données · maxun

Le README organise la plateforme autour de quatre types de robots. Extract émule le comportement réel d'un utilisateur et capture des données structurées depuis les sites web. Scrape convertit des pages web complètes en Markdown ou HTML propre et peut prendre des captures d'écran ; le README le présente comme idéal pour les workflows d'IA, les agents et le traitement de documents. Crawl couvre des sites web entiers, extrayant le contenu de chaque page pertinente avec un contrôle sur le périmètre et la découverte. Search exécute des recherches web automatisées pour découvrir ou scraper des résultats, avec prise en charge de filtres temporels. Chaque type de robot possède sa propre page de documentation liée depuis le README, permettant aux utilisateurs d'approfondir chaque sujet.

Extract propose deux modes · maxun

Extract est le type de robot le plus détaillé dans le README. Le mode Recorder vous permet d'enregistrer vos actions pendant que vous naviguez, et Maxun les transforme en robot d'extraction réutilisable. Le README lie une vidéo de démonstration montrant l'extraction de dix annonces depuis Airbnb. Le mode IA accepte une description en langage naturel de ce que vous voulez et laisse l'extraction pilotée par LLM faire le reste, avec une démo montrant les noms, notes et durées des 50 meilleurs films sur IMDb. Les deux modes sont documentés dans la catégorie Extract de la documentation, et le README oriente les utilisateurs vers ces pages pour plus de détails. Le README souligne qu'Extract émule le comportement réel d'un utilisateur, ce qui indique qu'il est conçu pour les sites nécessitant connexion, défilement ou pagination.

Application hébergée, installation locale et auto-hébergement · maxun

Selon le README, le moyen le plus simple et le plus rapide de commencer est la version hébergée sur app.maxun.dev. Pour les utilisateurs qui souhaitent exécuter Maxun eux-mêmes, le README renvoie vers des instructions d'installation avec Docker Compose, une installation locale sans Docker, et une page sur les variables d'environnement. Il existe une section distincte pour l'auto-hébergement avec Docker et pour la mise à niveau d'une installation Docker Compose ou non Docker existante. Le README lui-même ne contient pas de commandes d'installation concrètes ; il renvoie vers le site de documentation, donc toute instruction de ligne de commande spécifique doit être vérifiée dans la documentation. Le README mentionne également un SDK et renvoie vers un dépôt node-sdk séparé, mais ne fournit pas d'exemples de code dans le README lui-même.

La liste des fonctionnalités telle que présentée · maxun

Le README liste un ensemble de fonctionnalités sans détails d'implémentation ni benchmarks. Les affirmations incluent une interface pointer-cliquer pour l'extraction sans code, l'extraction pilotée par LLM, un SDK développeur, la gestion automatique de la pagination et du défilement, l'exécution planifiée de robots, des endpoints RESTful depuis n'importe quel site, l'export vers Google Sheets et Airtable, la récupération automatique face aux changements de mise en page des sites, l'extraction derrière une authentification, des intégrations avec d'autres outils, le support du Model Context Protocol (MCP), et une sortie Markdown propre pour les applications d'IA. Le projet revendique également l'auto-hébergement et l'open source. Le README présente ces éléments comme des capacités prévues de la plateforme, non comme des résultats de performance vérifiés ; aucune métrique de performance ni témoignage d'utilisateur n'est fourni.

Stade précoce de développement et licence AGPL-3.0 · maxun

Le README indique que le projet en est à un stade précoce de développement et demande des retours. Le projet est sous licence AGPL-3.0, que le texte de licence décrit comme une licence copyleft libre conçue spécifiquement pour les logiciels serveur en réseau. L'exigence clé de l'AGPL-3.0 est que si vous exécutez une version modifiée sur un serveur accessible via un réseau, vous devez fournir le code source modifié aux utilisateurs de ce serveur. La licence précise également qu'il n'y a aucune garantie pour le logiciel, et elle ne dit rien sur la posture de sécurité, les services de support ou les engagements de maintenance. La section des valeurs du projet dans le README demande aux utilisateurs commerciaux d'envisager de contribuer ou de soutenir le développement. Les métadonnées du dépôt montrent plus de 17 000 étoiles, mais le README lui-même ne fournit pas de données spécifiques sur le nombre d'utilisateurs ou l'adoption en production.

Conclusion éditoriale

Maxun est un projet TypeScript open source à un stade précoce, sous licence AGPL-3.0, offrant quatre types de robots pour la collecte de données web sans code. Le README indique des parcours de déploiement hébergé et auto-hébergé, liste un large ensemble de fonctionnalités sans benchmarks, et demande des retours tout en sollicitant le soutien des utilisateurs commerciaux.

Sources officielles

  1. Official documentation
  2. Official README
  3. Project repository
  4. Release notes
Notes de la communauté

Notes de la communauté