На IFA 2026 NVIDIA разом із Microsoft і партнерами представила набір оновлень для локального AI. Головна ідея — зробити запуск агентів на власному комп’ютері простішим, швидшим і приватнішим.[1]

Hermes Agent — без ручного підбору моделі

На Windows Hermes Agent зможе автоматично визначати NVIDIA GPU, підбирати відповідну модель і конфігурацію та запускати її через інтегрований llama.cpp з оптимізаціями NVIDIA. Це прибирає ручне завантаження моделей і налаштування параметрів. Підтримку Linux обіцяють додати пізніше.[1]

Після локального запуску Hermes зберігає звичні можливості: працює з інструментами, пам’ятає контекст між задачами та створює повторно використовувані навички. При цьому дані й inference можуть залишатися на комп’ютері користувача.

До 1,9 раза швидший inference

NVIDIA повідомляє про прискорення llama.cpp до 1,9 раза на GeForce RTX 5090 завдяки оптимізованим ядрам, speculative decoding і швидшому prefill. Для vLLM заявлено приріст до 1,2 раза на RTX PRO 6000 Blackwell і до 1,4 раза на двох DGX Spark. Оновлення вже доступні у відповідних inference-бекендах, а також через LM Studio та Ollama.[1]

PAIR об’єднує ресурси кількох комп’ютерів

NVIDIA PAIR — безкоштовний інструмент із відкритим кодом, який знаходить сумісні комп’ютери в локальній мережі й направляє незалежні AI-запити туди, де є вільні ресурси. Для агентів із кількома паралельними підзадачами це означає менше черг на одному GPU. Бета-версія доступна для Windows, macOS і Linux та працює з Ollama і LM Studio.[1]

Наступний крок — RTX Spark

У жовтні NVIDIA планує випустити компактні Windows-ПК RTX Spark від партнерів, зокрема Lenovo та Acer. Платформа орієнтована на постійно активних локальних агентів, творчі задачі та ігри. Це ще один сигнал, що персональний AI рухається ближче до користувача — з хмари на власний пристрій.[1]

Kyiv IT

Допоможемо оцінити локальний AI для вашої задачі

Порівняємо локальний і хмарний запуск, вимоги до обладнання, приватність даних та реальну вартість автоматизації.

Обговорити задачу

Джерело

Матеріал підготовлено за офіційним анонсом NVIDIA, перевіреним 22 вересня 2026 року.

  1. NVIDIA Blog: Sparks Fly — NVIDIA Accelerates Local AI at IFA 2026.