Момент агентного ИИ настал, но реализация его потенциала требует не только хороших моделей. Также необходимы быстрое оборудование, безопасные среды выполнения, отзывчивый уровень данных и модели, оптимизированные для длительных рассуждений. NVIDIA и Microsoft предоставляют полный стек разработчикам на устройствах Windows, в облаке Azure и локальных развертываниях.
На конференции Microsoft Build основатель и генеральный директор NVIDIA Дженсен Хуанг присоединился к программному выступлению председателя и генерального директора Microsoft Сатьи Наделлы по видеосвязи из Тайбэя, чтобы обсудить расширенное партнерство: NVIDIA RTX Spark и DGX Station для Windows, NVIDIA GPU-ускоренный Microsoft Fabric, открытые модели NVIDIA на Microsoft Foundry, безопасную среду выполнения NVIDIA OpenShell в GitHub Copilot и следующее поколение ИИ-фабрик на базе NVIDIA.
Переосмысление Windows для агентов: от RTX Spark до DGX Station для Windows
NVIDIA и Microsoft переосмысливают ПК с Windows для эпохи ИИ-агентов. С ноутбуками и небольшими десктопами RTX Spark, а также настольными ИИ-суперкомпьютерами DGX Station для Windows разработчики могут создавать, настраивать и запускать агентов нативно на Windows.
RTX Spark — это новое начало, обеспечивающее работу первых в мире ПК с Windows, созданных специально для персональных агентов, с производительностью ИИ в 1 петафлоп, до 128 ГБ унифицированной памяти, временем автономной работы на весь день и полной производительностью ИИ и графики без подключения к сети. Объединяя более 30 лет инноваций NVIDIA, включая CUDA, RTX, DLSS и TensorRT, системы появятся этой осенью от Microsoft Surface, ASUS, Dell, HP, Lenovo и MSI.
DGX Station для Windows — это самый мощный настольный ИИ-суперкомпьютер для создания и запуска агентов в корпоративных приложениях и рабочих процессах Windows. Работая на базе NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip с объемом когерентной памяти до 748 ГБ и производительностью FP4 до 20 петафлоп, он запускает передовые модели с числом параметров до 1 триллиона для круглосуточных корпоративных агентов. Системы ожидаются от ASUS, Dell, GIGABYTE, HP, MSI и Supermicro в четвертом квартале. Оба продукта работают под управлением NVIDIA OpenShell — безопасной по дизайну среды выполнения для автономных агентов.
Подробнее в блоге Microsoft: «Представляем новую мощную главу для ПК с Windows, ускоренную с помощью NVIDIA RTX Spark»
Обеспечение агентных рабочих процессов в корпоративном масштабе с помощью открытых моделей NVIDIA на Microsoft Foundry
Агентный ИИ работает на системе моделей. С моделями NVIDIA, Anthropic и OpenAI — плюс специальными агентами Hermes — теперь в размещенных агентах Foundry Agent Service предприятия могут оживлять агентные системы в Azure со встроенной идентификацией и управлением. Модели Anthropic Claude теперь работают нативно на системах NVIDIA GB300 Blackwell Ultra в Azure, их доступность для клиентов ожидается в ближайшие недели.
NVIDIA Nemotron 3 Ultra, новая открытая передовая модель рассуждений для долго работающих агентов в сферах программирования, исследований и корпоративных рабочих процессов, доступна в этом месяце в управляемых вычислениях Foundry, наряду с Nemotron 3.5 ASR для распознавания речи и Nemotron 3.5 Content Safety. Разработчики могут комбинировать Nemotron с передовыми и локальными моделями, оптимизируя стоимость и качество для каждого рабочего процесса.
Открытый портфель моделей NVIDIA в Foundry теперь охватывает агентный, физический и научный ИИ. NVIDIA Cosmos 3 — первая полностью открытая омнимодель для физического ИИ — обеспечивает рассуждения на основе зрения, симуляцию мира и генерацию действий. Модели погоды NVIDIA Earth-2 AI доступны через Microsoft Planetary Computer Pro и Foundry для корпоративного прогнозирования и анализа рисков.
NVIDIA Agent Toolkit и шаблоны NVIDIA NemoClaw предоставляют разработчикам открытую платформу для создания production-агентов в Foundry. Библиотеки NVIDIA CUDA-X, включая cuDF, cuOpt, AI-Q и NeMo, теперь доступны агентам как специализированные навыки.
Узнайте больше в этом сеансе на Build: «Оркестрация специальных агентов с моделями NVIDIA Nemotron на Microsoft Foundry»
Ускорение корпоративных хранилищ данных для эпохи ИИ
Данные питают агентный ИИ, и быстрый доступ к ним критически важен.
Ускоренные вычисления NVIDIA теперь встроены в Microsoft Fabric Data Warehouse, и внутреннее бенчмаркинг Microsoft показывает выполнение SQL до 6 раз быстрее, чем базовый показатель на CPU, и до 7 раз быстрее, чем у трех других ведущих облачных провайдеров хранилищ данных для высококонкурентных нагрузок.
Корпоративный уровень данных теперь может успевать за ИИ-агентами, которые непрерывно запрашивают и анализируют данные — результат многолетней глубокой инженерной коллаборации NVIDIA и Microsoft, от исследований до производства.
Подробнее в блоге Microsoft: «Microsoft Build 2026: Создание агентных приложений с Microsoft Fabric и Microsoft Databases»
Развитие физического ИИ и автономных систем
Физический ИИ — следующий рубеж для агентов.
Microsoft интегрирует открытые навыки и инструменты физического ИИ NVIDIA с Azure и своим Physical AI Toolchain. Разработчики получают единую платформу на базе архитектуры смеси трансформаторов Cosmos 3 для симуляции, обучения и развертывания автономных систем, включая роботов, автономные транспортные средства и промышленные системы, которые могут воспринимать, рассуждать, планировать и действовать в физическом мире. Cosmos 3 занимает первое место среди открытых моделей по ключевым бенчмаркам для рассуждений на основе зрения, генерации миров и генерации действий.
Улучшение Azure Local и Foundry Local с помощью NVIDIA RTX PRO 6000 Blackwell Server Edition и моделей Nemotron
Агентный ИИ выходит за пределы облака.
Microsoft внедряет Foundry Local на Azure Local на платформе NVIDIA RTX PRO 6000 Blackwell Server Edition. В паре с семейством открытых моделей NVIDIA Nemotron предприятия могут запускать высокопроизводительные ИИ-нагрузки там, где находятся их данные — в локальных, гибридных или суверенных средах — без потери производительности или управляемости.
Foundry Local на Azure Local теперь поддерживает многотузловые развертывания и среду выполнения vLLM, масштабируя инференс для производственных, энергетических, суверенных центров обработки данных и других сценариев с чувствительностью к задержкам.
Подробнее в этих блогах Microsoft: «Раскрывая возможности физического ИИ с Foundry Local и Azure Local», «Масштабируйте локальный ИИ с Foundry Local на Azure Local»
Обеспечение безопасной разработки агентов в GitHub Copilot с помощью NVIDIA OpenShell
По мере того как агенты переходят от помощи в написании кода к автономному выполнению, им нужны реальные возможности без реальных учетных данных.
NVIDIA OpenShell, теперь интегрированная в GitHub Copilot, решает эту задачу: каждый агент работает изолированно в своем собственном контейнере-песочнице, и каждый исходящий вызов оценивается на соответствие политике, прежде чем он сможет получить доступ к файлам, сетям или учетным данным. Политики пишутся как код, версионируются в репозитории и могут обновляться на лету. OpenShell имеет открытый исходный код под лицензией Apache 2.0, не зависит от модели и работает в локальных, гибридных и облачных средах.
Узнайте больше на этом блиц-сеансе Build: «Безопасные агентные рабочие процессы с GitHub Copilot и NVIDIA OpenShell»
Fairwater Wisconsin введена в эксплуатацию, валидирована для NVIDIA Vera Rubin
ИИ-фабрика Microsoft Fairwater Wisconsin теперь работает с опережением графика, запуская сотни тысяч систем NVIDIA Grace Blackwell как единую ИИ-фабрику и соединяясь с аналогичной ИИ-фабрикой в Джорджии для обеспечения масштабируемой и распределенной ИИ-системы для самых требовательных передовых моделей. Благодаря совместной инженерии в области энергопитания, охлаждения, NVIDIA Spectrum-X Ethernet и нового транспортного протокола Multipath Reliable Connection (MRC), проекты ИИ-центров обработки данных Microsoft Fairwater оптимизируют токен-экономику.
Кроме того, Microsoft уже валидировала платформу NVIDIA Vera Rubin, которая сейчас находится в полном производстве, для развертывания в центрах обработки данных Azure.
Vera Rubin встраивается вместе с Blackwell без доработок, обеспечивая до 10-кратной пропускной способности инференса на мегаватт и снижая стоимость на один агентный токен на порядок. Встроенная NVIDIA Confidential Computing защищает модели и данные, пока агенты рассуждают в масштабе. Фреймворк инференса NVIDIA Dynamo расширяет эти преимущества на программный уровень, ускоряя холодный запуск моделей в AKS и обеспечивая Kubernetes-нативную оркестрацию распределенного инференса через NVIDIA Grove.
Подробнее в блоге Microsoft: «Масштабирование многоузлового LLM-инференса с NVIDIA Dynamo-Grove на AKS (часть 4)»
Изучите полную программу сеансов, демо и практических лабораторий NVIDIA на Microsoft Build.