NemoClaw
Exécutez des agents comme Hermes, LangChain Deep Agents et OpenClaw de manière plus sécurisée dans NVIDIA OpenShell grâce à l'inférence gérée.
RÉPERTOIRE HYSEN LABS
Dépôts vérifiés, classifications et analyses de l’organisation NVIDIA.
Exécutez des agents comme Hermes, LangChain Deep Agents et OpenClaw de manière plus sécurisée dans NVIDIA OpenShell grâce à l'inférence gérée.
Scanner de sécurité pour les compétences des agents IA. Détectez les vulnérabilités, les modèles malveillants et les risques de sécurité.
TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs. TensorRT LLM also contains components to create Python and C++ runtimes that orchestrate the inference execution in a performant way.
NVIDIA® TensorRT™ is an SDK for high-performance deep learning inference on NVIDIA GPUs. This repository contains the open source components of TensorRT.
CUDA Templates and Python DSLs for High-Performance Linear Algebra
the LLM vulnerability scanner
OpenShell is the safe, private runtime for autonomous AI agents.
Un framework Python pour la simulation, la robotique et l'apprentissage automatique accélérés par GPU.
A GPU-accelerated library containing highly optimized building blocks and an execution engine for data processing to accelerate deep learning training and inference applications.
NVIDIA cuML: GPU-Accelerated Machine Learning
Optimized primitives for collective multi-GPU communication
Generative AI reference workflows optimized for accelerated infrastructure and microservice architecture.
Une bibliothèque unifiée de techniques d'optimisation de modèles SOTA telles que la quantification, la distillation, l'élagage, la recherche d'architecture neuronale, le décodage spéculatif, etc. Elle compresse les modèles d'apprentissage en profondeur pour les cadres de déploiement en aval tels que TensorRT-LLM, TensorRT, vLLM, etc. afin d'optimiser la vitesse d'inférence.
A library for accelerating Transformer models on NVIDIA GPUs, including using 8-bit and 4-bit floating point (FP8 and FP4) precision on Hopper, Ada and Blackwell GPUs, to provide better performance with lower memory utilization in both training and inference.
Aperçu du projet : Compétences d'agent pour les produits NVIDIA, à installer dans Claude Code, Codex et d'autres agents de codage pour exécuter les flux de travail d'IA physique, de robotique, de simulation, CUDA et RAG de bout en bout. Produit du catalogue de compétences | Descriptif | Compétences | IQA | NVIDIA AI-Q Blueprint : déployez des services AI-Q locaux et exécutez des workflows de recherche superficiels ou approfondis en tant que compétences d'agent.
Open-source deep-learning framework for building, training, and fine-tuning deep learning models using state-of-the-art Physics-ML methods
The NVIDIA NeMo Agent toolkit is an open-source library for efficiently connecting and optimizing teams of AI agents.
LLM KV cache compression made easy
Cadre d'apprentissage profond open source pour explorer, créer et déployer des flux de travail météorologiques/climatiques d'IA.
RAFT contains fundamental widely-used algorithms and primitives for machine learning and information retrieval. The algorithms are CUDA-accelerated and form building blocks for more easily writing high performance applications.