MinerU
MinerU convertit PDF, documents Office et images en Markdown ou JSON prêts pour les LLM, grâce à un double moteur VLM+OCR couvrant 109 langues, formules et mises en page complexes.
C’est le groupe le plus large : interfaces de chat, SDK et frameworks, outils de prompts et d’évaluation, et applications reposant sur des grands modèles de langage. Beaucoup fonctionnent avec les modèles de plusieurs fournisseurs, et certains peuvent faire tourner des modèles sur votre propre matériel.
Pour tout ce que vous comptez mettre en production, vérifiez d’abord trois faits : la licence, car certains projets populaires restreignent l’usage commercial ; la prise en charge du fournisseur de modèles que vous utilisez déjà ; et la maintenance du projet. L’encadré « En bref » de chaque page projet répond aux questions de licence et de maintenance à partir des données GitHub.
MinerU convertit PDF, documents Office et images en Markdown ou JSON prêts pour les LLM, grâce à un double moteur VLM+OCR couvrant 109 langues, formules et mises en page complexes.
Tutoriel pratique qui construit de zéro un harness d'agent minimal façon Claude Code autour de Bash, pour comprendre comment modèle et harness forment un produit d'agent fonctionnel.
Unsloth est une interface utilisateur locale pour entraîner et exécuter Gemma 4, Qwen3.6, DeepSeek, Kimi, GLM et d'autres modèles.
Réglage fin et efficace unifié de plus de 100 LLM et VLM (ACL 2024). **Ressources évolutives** : réglage complet 16 bits, réglage gelé, LoRA et QLoRA 2/3/4/5/6/8 bits via AQLM/AWQ/GPTQ/LLM.int8/HQQ/EETQ.
MiroFish est un moteur d'intelligence en essaim qui bâtit un monde numérique parallèle à partir de données amorces pour simuler l'avenir avec des milliers d'agents.
Ruflo est un méta-harnais d'agents pour Claude Code et Codex, ajoutant plus de 100 agents spécialisés, des essaims coordonnés, une mémoire auto-apprenante et la fédération entre machines.
Compressez les sorties de l'outil, les journaux, les fichiers et les morceaux RAG avant qu'ils n'atteignent le LLM. 20 % de jetons en moins pour les agents de codage, 60 à 95 % de jetons en moins pour JSON, mêmes réponses. Bibliothèque, proxy, serveur MCP.
career-ops transforme les CLI de codage IA comme Claude Code en centre de recherche d'emploi : il scanne les portails, note les offres selon une grille A–F et adapte les CV.
Open Interpreter est un agent de code en terminal optimisé pour les modèles ouverts à faible coût comme Kimi K3, réécrit en Rust avec une interface à la Codex et des harnais interchangeables.
Application IA de bureau tout-en-un et local-first pour discuter avec vos documents et exécuter des agents IA, avec prise en charge multi-utilisateurs et une prise en main sans configuration.
Mem0 stocke et récupère les mémoires des utilisateurs, des sessions et des agents afin que les applications d'IA puissent transmettre les préférences et le contexte dans les conversations.
LLM多源行情、实时新闻、决策看板与自动推送,支持零成本定时运行。 Système d'analyse boursière multi-marchés alimenté par LLM avec données de marché multi-sources, actualités en temps réel, tableau de bord de décision, notifications automatisées et exécutions planifiées gratuites.
Preuve de concept éducative où une équipe d'agents IA inspirés d'investisseurs comme Ben Graham et Bill Ackman prend des décisions de trading — non destinée au trading réel.
Agents autonomes de test d'intrusion IA qui exécutent votre code, détectent les vulnérabilités et les valident par de vraies preuves de concept, intégrables aux pipelines CI/CD.
Moniteur d'opinion publique et de tendances basé sur l'IA avec agrégation multiplateforme, RSS et alertes intelligentes. 告别信息过载,你的 AI 舆情监控助手与热点筛选工具!聚合多平台热点 + RSS订阅,支持关键词精准筛选。AI 智能筛选新闻 + AI 翻译 + AI 分析简报直推手机,也支持接入 MCP Il s'agit d'une application AI pour les applications Docker. ,数据本地/云端自持。集成微信/飞书/钉钉/Telegram/邮件/ntfy/bark/slack 等渠道智能推送。.
Context7 injecte via MCP une documentation à jour, propre à chaque version, et des exemples de code dans les prompts LLM, réduisant les réponses obsolètes et les API hallucinées.
GPT-SoVITS est une WebUI de clonage vocal et de synthèse TTS few-shot qui affine une voix à partir d'une minute d'audio et offre une synthèse zero-shot depuis un échantillon de cinq secondes.
Le système de mémoire IA open source le mieux comparé. Et c'est gratuit.
Modèles cloud prêts à l'emploi pour RAG, pipelines IA et recherche d'entreprise avec données en direct. Compatible avec Docker.Toujours synchronisé avec Sharepoint, Google Drive, S3, Kafka, PostgreSQL, les API de données en temps réel, et bien plus encore.
Passerelle IA auto-hébergée avec cœur Rust et SDK Python, qui appelle plus de 100 fournisseurs de LLM au format OpenAI avec suivi des coûts, garde-fous et répartition de charge.
CrewAI coordonne les agents d'IA basés sur les rôles en équipes et en flux événementiels, avec des outils pour les tâches, la mémoire, le traçage et le déploiement.
Flowise permet de construire visuellement des agents IA et des workflows LLM : chatbots, RAG et systèmes multi-agents par glisser-déposer, sans écrire de code.
PPT Master transforme des documents ou des sujets en diaporamas PowerPoint nativement modifiables, avec transitions, graphiques de données et narration audio issue des notes.
whisper.cpp est un portage C/C++ sans dépendances du modèle de reconnaissance vocale Whisper d'OpenAI, optimisé pour Apple Silicon, avec inférence CPU seule sur de nombreuses plateformes.