NVIDIA améliore les agents d'IA locaux sur les PC RTX et DGX Spark

RTX Spark — un nouveau départ pour les PC — annoncé à la GTC Taipei au COMPUTEX, ainsi que NVIDIA OpenShell apportant des agents sécurisés à Windows avec 2x les performances d'inférence sur llama.cpp ; de plus, Adobe reconstruit ses applications avec des améliorations de performance et de mémoire, et Blender ajoute la reconstruction de rayons NVIDIA DLSS 4.5.

Les agents personnels gagnent en popularité, avec des projets open source comme OpenClaw et Hermes qui sont rapidement adoptés par les communautés de développeurs d'IA sur GitHub. Conçus pour s'adapter aux préférences et aux flux de travail individuels, ces agents peuvent interagir avec des applications, générer du contenu, automatiser des processus répétitifs et gérer des tâches en plusieurs étapes — le tout en s'exécutant localement sur l'appareil.

Aujourd'hui, à la NVIDIA GTC Taipei au COMPUTEX, NVIDIA a dévoilé NVIDIA RTX Spark — une nouvelle catégorie de PC Windows spécialement conçus pour les agents personnels — ainsi qu'une vague de mises à jour qui étendent les agents locaux à l'ensemble des écosystèmes NVIDIA RTX et DGX.

L'exécution d'agents de manière sécurisée et privée nécessite un matériel à la hauteur de la tâche. Les 1 pétaflop de puissance de calcul d'IA et les 128 Go de mémoire unifiée de RTX Spark peuvent répondre à la demande de calcul des agents sur appareil, offrant une nouvelle catégorie d'ordinateurs qui passent d'outil à coéquipier. Conçu pour l'IA, la création et le jeu, RTX Spark apporte les 30 ans d'innovation technologique de NVIDIA aux ordinateurs portables Windows minces avec une autonomie de batterie toute la journée et des PC de bureau ultra-efficaces.

Le partenariat de NVIDIA avec Windows s'étend des solutions personnelles aux solutions d'entreprise. Également présentée lors de l'événement, la NVIDIA DGX Station pour Windows, le superordinateur de bureau IA ultime pour les professionnels, apportant un GPU et un CPU de classe centre de données pour l'inférence dans un système de bureau équipé de Windows pour la gérabilité, la sécurité et la compatibilité.

Les autres annonces incluent:

  • L'environnement d'exécution NVIDIA OpenShell arrive sur Windows, basé sur les nouvelles primitives de sécurité de Microsoft pour les agents — offrant aux développeurs un package facile à déployer pour des agents sécurisés sur appareil. Hermes Agent et OpenClaw intégreront également OpenShell et les primitives de sécurité de Microsoft dans leurs nouvelles applications Windows.
  • Le blueprint NVIDIA NemoClaw s'étend à l'ensemble de la gamme IA locale de NVIDIA — GeForce RTX, RTX PRO, RTX et DGX Spark, et DGX Station — avec de nouveaux installateurs simplifiés et la prise en charge d'Hermes Agent.
  • Des performances d'inférence 2x sur les modèles agentiques supérieurs avec prédiction multi-jetons dans llama.cpp et vLLM, ainsi que de nouvelles optimisations multi-GPU pour llama.cpp et ComfyUI.
  • H Company publie des outils d'utilisation informatique — y compris de nouveaux modèles et un futur harnais d'agent de bureau — optimisés pour les PC RTX et DGX.
  • Adobe restructure ses applications Photoshop et Premiere, Blender ajoute la reconstruction de rayons NVIDIA DLSS 4.5, et NVIDIA a dévoilé RTX Video Frame Generation, qui sera intégré à ComfyUI. Toutes ces mises à jour arrivent cet automne avec RTX Spark.
  • La mise à jour de NVIDIA Broadcast 2.2 apporte des optimisations de la fonction Studio Voice et la prise en charge d'Elgato Stream Deck. NVIDIA Project G-Assist ajoute également l'intégration de Stream Deck.

IA agentique locale : personnelle, privée et rapide sur les PC Windows RTX

L'adoption généralisée des agents a été limitée par l'incapacité d'exécuter des agents de manière sécurisée et privée sur les PC principaux des utilisateurs.

NVIDIA et Microsoft s'associent pour relever ce défi en fournissant une plateforme Windows robuste et sécurisée pour les agents sur appareil.

La collaboration commence par une base solide — de nouvelles primitives de sécurité Windows et l'environnement d'exécution NVIDIA OpenShell — pour garantir que les agents fonctionnent en toute sécurité et sous le contrôle total de l'utilisateur.

Les nouvelles primitives Windows offrent des capacités d'identité, de confinement, de politique et de sécurité de bout en bout pour construire et exécuter des agents nativement. NVIDIA OpenShell offre des capacités de politique supplémentaires permettant à l'utilisateur de définir ce que les agents peuvent et ne peuvent pas faire, la capacité de router intelligemment les requêtes vers des modèles locaux en fonction des politiques de confidentialité de l'utilisateur, et la capacité de masquer les informations personnelles dans les requêtes envoyées aux modèles cloud.

Cette couche de sécurité et de confidentialité robuste est adoptée par les principaux développeurs d'agents tels que Hermes Agent et OpenClaw dans leurs nouvelles applications Windows. Ces nouvelles applications faciliteront et sécuriseront l'accès des utilisateurs à de puissants agents sur appareil capables d'exécuter des tâches dans les applications Windows, de raisonner à travers des flux de travail multi-applications, de générer des images et des vidéos, de coder des plug-ins et des applications, et de rechercher sémantiquement des fichiers locaux.

L'alimentation des agents sur les appareils locaux nécessite à la fois une sécurité robuste et un matériel performant. RTX Spark offre jusqu'à 1 pétaflop de calcul d'IA et 128 Go de mémoire unifiée pour répondre aux exigences de traitement des agents sur appareil.

NVIDIA accélère également l'écosystème de modèles ouverts locaux sur lesquels ces agents s'appuient.

NVIDIA a collaboré avec la communauté llama.cpp pour activer des fonctionnalités et des optimisations telles que la prédiction multi-jetons (MTP) — une technique de décodage spéculatif où un modèle de brouillon plus petit propose plusieurs jetons à la fois que le modèle cible vérifie en un seul passage. Ceci, couplé à d'autres optimisations telles que le lancement programmatique dépendant, offre des performances 2x sur Qwen 3.6 et 3.5 27B, et un gain de performances de 1,6x sur Qwen 3.6 et 3.5 35B. Ces mises à jour sont disponibles via l'interface web llama.cpp et LM Studio.

Gains de performance illustrés avec les dernières optimisations NVIDIA pour llama.cpp : Qwen3.6-27B offre un débit jusqu'à 2x supérieur et Qwen3.6-35B jusqu'à 1,6x sur GeForce RTX 5090, accélérant les charges de travail d'IA agentique locale grâce à la collaboration de la communauté open source.

Pour les passionnés d'IA qui utilisent des configurations multi-GPU, NVIDIA a collaboré avec la communauté open source pour améliorer deux des outils d'IA locale les plus populaires :

  • llama.cpp ajoute le parallélisme tensoriel pour jusqu'à 2x la mémoire et 1,8x le calcul sur deux GPU équivalents.
  • ComfyUI gagne une nouvelle méthode de guidage sans classifieur pour jusqu'à 2x les performances sur deux GPU équivalents, ainsi que l'option de diviser les chaînes de modèles entre les GPU pour tirer parti de la mémoire combinée.
Affiche les améliorations de performance de la génération de jetons pour la technique multi-GPU à parallélisme tensoriel par rapport au parallélisme pipeline et à l'inférence mono-GPU sur llama.cpp.
Affiche les améliorations de performance du temps de génération pour les techniques multi-GPU sur ComfyUI.

NVIDIA étend également les capacités des agents avec H Company. Le harnais d'utilisation informatique de H Company permet aux agents de naviguer sur un PC en voyant l'écran et en utilisant une souris et un clavier comme un utilisateur, même dans les applications sans interfaces de programmation d'applications, et sera bientôt disponible sur les PC RTX et DGX avec prise en charge des modèles locaux.

NVIDIA a collaboré avec H Company pour quantifier ses modèles Holo Computer Use de pointe, ainsi que pour accélérer son harnais — ce qui a permis d'accélérer les GPU NVIDIA de 2x tout en réduisant la consommation de mémoire de 35 %. Les modèles sont disponibles en téléchargement dès maintenant, et l'application Holo Desktop sera bientôt disponible.

Optimisations des agents pour Linux

Pour les développeurs qui ont besoin d'agents locaux toujours accessibles, NVIDIA DGX Spark est l'ordinateur IA d'agent personnel le plus performant pour les développeurs qui ont besoin d'un environnement Linux — unifiant une grande mémoire, un calcul rapide et la compatibilité avec l'écosystème NVIDIA CUDA.

La version de DGX Spark OS de ce mois-ci offre l'expérience la plus rationalisée avec un installateur NemoClaw simplifié, ainsi qu'une inférence plus rapide sur les principaux modèles d'agents.

NemoClaw est désormais disponible pour tous les PC NVIDIA RTX et DGX sous Linux et le sous-système Windows pour Linux. Déployez en toute sécurité des agents locaux sous Linux avec de nouveaux installateurs simplifiés, offrant une mise en bac à sable automatique et une prise en charge supplémentaire d'Hermes Agent.

NVIDIA a collaboré avec vLLM pour optimiser l'inférence pour les agents, avec des optimisations dans vLLM et de nouveaux points de contrôle NVFP4 optimisés pour Qwen 3.6 35B. Les mises à jour offrent des performances 2,6x sur DGX Spark par rapport aux points de contrôle NVFP4 précédemment disponibles d'Unsloth, et incluent des améliorations de noyau ainsi que la précision mixte et la prise en charge de CUDA Graph pour MTP.

Lisez le blog vLLM pour une présentation complète de la diffusion des modèles mélange-d'experts NVFP4 sur DGX Spark — du réglage de la mémoire unifiée à une configuration de référence NVIDIA Nemotron 3 Super fonctionnelle.

Offrir des expériences créatives puissantes avec Adobe

NVIDIA s'associe à Adobe pour réarchitecturer Adobe Premiere et Photoshop pour RTX Spark. Le remplissage génératif alimenté par Firefly dans Photoshop et l'extension générative dans Premiere font partie des centaines d'outils accélérés qui offrent puissance créative, précision et contrôle. RTX Spark pousse ces capacités plus loin, offrant une IA, une édition, une colorimétrie et des effets jusqu'à 2x plus rapides sur les flux de travail créatifs.

Adobe Premiere proposera un nouveau pipeline vidéo qui exploitera la mémoire unifiée, le GPU Blackwell et le logiciel TensorRT de RTX Spark, offrant des performances en temps réel pour l'édition et la correction des couleurs, des performances d'IA accélérées par le GPU et un rendu plus efficace des chronologies complexes. De plus, Substance 3D Painter et Stager d'Adobe fonctionneront nativement sur RTX Spark pour des flux de travail de texturation 3D et de création de scènes plus fluides et plus réactifs.

Le moteur Photoshop de nouvelle génération d'Adobe sera optimisé pour le compositing accéléré par GPU, permettant des filtres en direct, une plage dynamique élevée et un brossage naturel moderne. Le pipeline natif d'IA est conçu pour exploiter toute la puissance de RTX Spark, y compris TensorRT.

Adobe étendra également Premiere et Photoshop pour permettre aux utilisateurs de créer, modifier et concevoir avec des agents Windows, offrant aux créateurs un coéquipier collaboratif pour accélérer leurs flux de travail.

Les mises à jour des applications créatives d'Adobe comme Premiere, Photoshop et Substance devraient commencer à être déployées parallèlement à la disponibilité de RTX Spark.

Nouveaux outils et mises à jour d'applications pour les créateurs

De nouvelles mises à jour de la plateforme NVIDIA et des optimisations d'applications partenaires sont en cours de déploiement dans l'ensemble de l'écosystème RTX — certaines étant livrées dès aujourd'hui et d'autres arrivant avec RTX Spark cet automne.

NVIDIA Broadcast 2.2 met fin à la version bêta de Studio Voice — une fonction d'IA qui rend n'importe quel microphone de qualité studio — à partir d'aujourd'hui. Studio Voice fonctionne désormais sur les GPU GeForce RTX 3060 et supérieurs avec des performances améliorées. L'application bénéficie également de l'intégration d'Elgato Stream Deck et de raccourcis clavier configurables.

Project G-Assist ajoute également la prise en charge du Stream Deck via le serveur Elgato MCP, permettant aux utilisateurs d'activer les capacités d'assistant IA pour leur configuration de streaming.

De plus, Blender Cycles intègre la reconstruction de rayons DLSS 4.5 comme nouveau dénoiseur, transformant la fenêtre d'affichage de traçage de chemins en un visualiseur interactif en temps réel. Cela permet aux artistes 3D de naviguer dans une scène tout en voyant une qualité de rendu quasi finale, transformant le flux de travail d'éclairage et de développement de l'apparence. La mise à jour sera publiée avec Blender 5.3 cet automne, parallèlement à RTX Spark.