dify
开源 LLM 应用开发平台,在同一工作区中组合智能体工作流、RAG 管道与模型管理,可部署于云端、VPC 或自托管环境。
检索增强生成(RAG)让大模型根据你自己的文档回答问题:文本先被切成小块、转成向量、存进索引,提问时把最相关的几块加进提示词。这里的项目覆盖整条管线,或其中一环:文档解析、向量检索,或者完整的问答应用。
RAG 的回答质量主要取决于检索,而不是模型。比较时看:它怎么处理 PDF、表格、扫描件这类难文档;是否支持关键词加向量的混合检索和重排序;以及能不能显示答案出自哪些来源。
开源 LLM 应用开发平台,在同一工作区中组合智能体工作流、RAG 管道与模型管理,可部署于云端、VPC 或自托管环境。
LangChain 为代理构建者提供了模型、工具、检索和多步骤执行的公共层。
将任何代码库及其文档、SQL 架构、配置和 PDF 转换为可查询的知识图。适用于 Claude Code、Cursor、Codex 和 Gemini CLI 的 /graphify 技能:本地确定性 AST 解析,每条边均已解释,无向量存储。
每个代理跨会话的持久上下文,捕获代理在会话期间所做的所有操作,使用人工智能对其进行压缩,并将相关上下文注入到未来的会话中。适用于 Claude Code、OpenClaw、Codex、Gemini、Hermes、Copilot、OpenCode 等。
RAGFlow 是一款领先的开源检索增强生成 (RAG) 引擎,它将可靠的 RAG 与代理功能融合在一起,为法学硕士创建卓越的上下文层。
将任何 PDF 或图像文档转换为 AI 的结构化数据。一款功能强大、轻量级的 OCR 工具包,可弥合图像/PDF 和法学硕士之间的差距。支持 100 多种语言。
一个开源的长期 SuperAgent 工具,用于研究、编码和创建。借助沙箱、内存、工具、技能、子代理和消息网关,它可以处理可能需要几分钟到几小时的不同级别的任务。
在工具输出、日志、文件和 RAG 块到达 LLM 之前对其进行压缩。编码代理的标记减少了 20%,JSON 的标记减少了 60-95%,答案相同。库、代理、MCP 服务器。
本地优先的一体化 AI 桌面应用,可与自己的文档对话、运行 AI 智能体,支持多用户且几乎零配置即可上手。
Mem0 存储和检索用户、会话和代理记忆,以便 AI 应用程序可以在对话中携带偏好和上下文。
适用于 RAG、AI 管道和带有实时数据的企业搜索的可立即运行的云模板。 Docker 友好。始终与 Sharepoint、Google Drive、S3、Kafka、PostgreSQL、实时数据 API 等同步。
用于构建文档智能体和检索应用的框架。
Milvus 是一个云原生向量数据库,用 Go 和 C++ 编写,可在数十亿向量上进行可扩展的近似最近邻搜索,支持 CPU/GPU 加速与实时流式更新。
[EMNLP2025]“LightRAG:简单快速的检索增强生成。
有关法学硕士、RAG 和现实世界人工智能代理应用程序的深入教程。
人工智能代理的自我进化上下文数据库。统一代理记忆、知识 RAG 和技能。
你的人工智能第二大脑。可自行托管。从网络或文档中获取答案。构建自定义代理、安排自动化、进行深入研究。将任何在线或本地法学硕士转变为您个人的自主人工智能(gpt、claude、gemini、llama、qwen、mistral)。开始使用 - 免费。
PageIndex:无矢量、基于推理的 RAG 的文档索引。受 AlphaGo 的启发,我们提出 **PageIndex**,这是一个 **无向量**、**基于推理的 RAG** 系统,它从长文档构建 **分层树索引**,并使用 LLM 来 **推理** *对该索引* 进行 **代理、上下文感知检索**。
对于 4KB 对象负载,比 MinIO 快 2.3 倍。 RustFS 是一个开源的、S3 兼容的高性能对象存储系统,支持与其他 S3 兼容平台(例如 MinIO 和 Ceph)迁移和共存。
Open Source AI Platform - AI Chat with advanced features that works with every LLM
MCP 和 CLI 的本地优先代码智能图。构建代码库的持久地图,以便 AI 编码工具仅读取重要内容,并在评论和大型存储库工作流程上进行基准上下文缩减。
Python scraper based on AI
Cognee 是面向代理的开源人工智能记忆平台。通过自托管知识图引擎,为您的人工智能代理提供跨会话的持久长期记忆。
FastGPT is a knowledge-based platform built on the LLMs, offers a comprehensive suite of out-of-the-box capabilities such as data processing, RAG retrieval, and visual AI workflow orchestration, letting you easily develop and deploy complex question-answering systems without the need for extensive setup or configuration.