NVIDIA ускорила локальный ИИ на видеокартах RTX и системах DGX: новые модели и крупные оптимизации
Компания NVIDIA выпустила набор обновлений для платформ RTX и DGX, представив оптимизации для новых открытых моделей искусственного интеллекта. В число официально поддерживаемых решений вошли Cosmos 3 Edge, MiniMax-H3, Laguna S 2.1, DeepSeek V4-Flash, Wan-Animate-2 и Inkling-Small, а также открытое приложение Unsloth Desktop, предназначенное для локального запуска, дообучения и анализа моделей.
Одной из ключевых новинок стала оптимизация под представленную компанией Meta модель Muse Glimmer (30B). Она разработана для работы с локальными AI-агентами и задачами программирования. В сочетании с видеокартой GeForce RTX 5090 эта модель позволяет генерировать текст со скоростью более 200 токенов в секунду, обеспечивая при этом локальную обработку конфиденциальных данных без их отправки в облако.
Изменения также затронули генерацию видео с помощью модели LTX 2.5 с открытым исходным кодом. Благодаря новым оптимизациям и использованию стандарта NVFP4, пользователи видеокарт серии RTX и станций DGX могут рассчитывать на двукратный рост производительности при одновременном снижении потребления памяти VRAM до 40%. Эта модель также получила поддержку генерации множественных кадров и генеративного редактирования.
Поддержку получила и платформа DGX Spark. NVIDIA выпустила инструмент «Sync Cluster Assistant», который упрощает объединение двух или более устройств в быстрый вычислительный кластер под управлением Windows и macOS. Набор новшеств для этой платформы дополняют нативная версия браузера Google Chrome для архитектуры ARM64 (на Linux) и панель «Sync Resource Monitor» для мониторинга нагрузки на процессоры и графические чипы в реальном времени.
* Meta, Facebook и Instagram запрещены в России.


0 комментариев