Издание · проверено редакцией

NVIDIA Developer Blog

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

56 материалов в Hamidun·Последний: 17 июля· Активен·developer.nvidia.com ↗

Последние публикации

KRAFTON встроила в PUBG голосового AI-напарника Ally на базе NVIDIA ACE
LLMNVIDIA Developer Blog

KRAFTON встроила в PUBG голосового AI-напарника Ally на базе NVIDIA ACE

PUBG Ally — AI-тиммейт в PUBG: BATTLEGROUNDS, который слышит голосовые команды, принимает тактические решения и отвечает синтезированным голосом на базе NVIDIA ACE.

29 июн. 2026 г.·2 мин
NVIDIA TensorRT теперь масштабирует инференс генеративного AI на несколько GPU
LLMNVIDIA Developer Blog

NVIDIA TensorRT теперь масштабирует инференс генеративного AI на несколько GPU

NVIDIA добавила в TensorRT нативную поддержку нескольких GPU — модели для генерации медиаконтента масштабируются в продакшне без потери ключевых оптимизаций движка.

29 июн. 2026 г.·2 мин
Нейросети на 15 раз быстрее: оптимизация инференса от NVIDIA
LLMNVIDIA Developer Blog

Нейросети на 15 раз быстрее: оптимизация инференса от NVIDIA

NVIDIA опубликовала технику DFlash Speculative Decoding для архитектуры Blackwell: скорость инференса языковых моделей выросла в 15 раз при той же точности.

28 июн. 2026 г.·3 мин
NVIDIA объясняет разницу между VLA и WAM — двумя подходами к управлению роботами
LLMNVIDIA Developer Blog

NVIDIA объясняет разницу между VLA и WAM — двумя подходами к управлению роботами

NVIDIA разграничивает VLA и WAM — два класса роботных моделей: первые учатся на языке, вторые — на предсказании физики мира. Разница определит архитектуру физического AI.

15 июн. 2026 г.·3 мин
ИИ-агенты для бизнеса: результаты теста
LLMNVIDIA Developer Blog

ИИ-агенты для бизнеса: результаты теста

Artificial Analysis выпустила AA-AgentPerf — первый открытый многовендорный стандарт для оценки агентного кодирования. NVIDIA заняла лидирующую позицию по ключевым метрикам.

15 июн. 2026 г.·2 мин
DiffusionGemma: нейросеть для быстрой генерации текста
LLMNVIDIA Developer Blog

DiffusionGemma: нейросеть для быстрой генерации текста

Google DeepMind оптимизировала новую модель DiffusionGemma для NVIDIA платформ, чтобы ускорить real-time генерацию текста в чатах, копилотах и агентах.

11 июн. 2026 г.·3 мин
NVIDIA MCG Toolkit автоматизирует документацию AI-моделей под новые регуляции
LLMNVIDIA Developer Blog

NVIDIA MCG Toolkit автоматизирует документацию AI-моделей под новые регуляции

NVIDIA представляет инструмент для автоматизации документации AI-моделей, который помогает командам соответствовать требованиям регуляторов вроде EU AI Act и создавать проверяемые model cards без ручного труда.

31 мая 2026 г.·2 мин
NVIDIA представила DynoSim для оптимизации параметров LLM serving
LLMNVIDIA Developer Blog

NVIDIA представила DynoSim для оптимизации параметров LLM serving

NVIDIA представила DynoSim — инструмент для автоматической оптимизации конфигурации обслуживания больших языковых моделей через симуляцию Pareto frontier.

31 мая 2026 г.·3 мин
NVIDIA RTX представила DLSS 4.5 и многоязычных AI-персонажей для игр
LLMNVIDIA Developer Blog

NVIDIA RTX представила DLSS 4.5 и многоязычных AI-персонажей для игр

NVIDIA представила обновление RTX с поддержкой многоязычных AI-персонажей через ACE и новый DLSS 4.5 для Unreal Engine, упрощая разработку игр с ИИ.

29 мая 2026 г.·3 мин
NVIDIA RTX PRO 4500 Blackwell: ускорение геномики и моделирования белков
LLMNVIDIA Developer Blog

NVIDIA RTX PRO 4500 Blackwell: ускорение геномики и моделирования белков

NVIDIA выпустила видеокарту RTX PRO 4500 Blackwell для ускорения геномных вычислений и моделирования белков — ключевых компонентов точной медицины.

29 мая 2026 г.·3 мин
Новый CompileIQ NVIDIA находит скрытый потенциал GPU-ядер через подбор параметров компилятора
LLMNVIDIA Developer Blog

Новый CompileIQ NVIDIA находит скрытый потенциал GPU-ядер через подбор параметров компилятора

NVIDIA представила CompileIQ — инструмент с AI, который автоматически подбирает оптимальные параметры компилятора для максимальной производительности GPU-ядер, находя ускорения там, где ручная оптимизация уже исчерпана.

29 мая 2026 г.·3 мин
NVIDIA CUDA 13.3 упрощает разработку на GPU с Tile programming в C++
LLMNVIDIA Developer Blog

NVIDIA CUDA 13.3 упрощает разработку на GPU с Tile programming в C++

NVIDIA выпустила CUDA 13.3 с Tile programming в C++, который автоматизирует оптимизацию низкоуровневых операций с памятью GPU для разработчиков.

29 мая 2026 г.·2 мин
NVIDIA Blackwell установила рекорд STAC-AI в финансовом AI-трейдинге
LLMNVIDIA Developer Blog

NVIDIA Blackwell установила рекорд STAC-AI в финансовом AI-трейдинге

Архитектура NVIDIA Blackwell показала лучшую производительность в тесте STAC-AI для финансового AI, обработав больший объём данных быстрее всех конкурентов.

29 мая 2026 г.·2 мин
NVIDIA добавила CUDA Tile для оптимизации GPU-ядер на C++
LLMNVIDIA Developer Blog

NVIDIA добавила CUDA Tile для оптимизации GPU-ядер на C++

NVIDIA представила встроенную в C++ технологию CUDA Tile для разработки высокопроизводительных GPU-ядер на основе тайл-ориентированного подхода.

29 мая 2026 г.·2 мин
NVIDIA Dynamo Snapshot: ускорение запуска моделей на Kubernetes
LLMNVIDIA Developer Blog

NVIDIA Dynamo Snapshot: ускорение запуска моделей на Kubernetes

NVIDIA представила инструмент для сокращения времени загрузки моделей вывода на Kubernetes с минут до секунд — решение для избежания потерь GPU при скачках трафика.

29 мая 2026 г.·2 мин
Нейросеть Step 3.7 Flash для видео, текста и картинок
LLMNVIDIA Developer Blog

Нейросеть Step 3.7 Flash для видео, текста и картинок

StepFun запустила Step 3.7 Flash — мультимодальную AI-модель на 198 млрд параметров, которая одновременно работает с текстом, изображениями, видео и документами на NVIDIA-ускорителях.

29 мая 2026 г.·2 мин
Внедрение ИИ в компании: как запустить собственное облачное решение
LLMNVIDIA Developer Blog

Внедрение ИИ в компании: как запустить собственное облачное решение

Телеком-компании строят суверенные AI-инфраструктуры на архитектуре NVIDIA Cloud Partner, используя token-metering для контролируемого доступа — подход к масштабируемым, высокомаржинальным сервисам для правительств и пре

25 мая 2026 г.·3 мин
Оптимизация ИИ-вычислений: как масштабировать инфраструктуру на NVIDIA
LLMNVIDIA Developer Blog

Оптимизация ИИ-вычислений: как масштабировать инфраструктуру на NVIDIA

NVIDIA показала, как максимизировать производительность GB200 NVL72 через Slurm с учётом топологии сети — результаты демонстрируют экзасфальные вычисления на одной стойке.

25 мая 2026 г.·3 мин
Оптимизация ИИ-проектов: мониторинг GPU в Kubernetes (NVIDIA)
LLMNVIDIA Developer Blog

Оптимизация ИИ-проектов: мониторинг GPU в Kubernetes (NVIDIA)

Большинство команд недоиспользуют GPU в Kubernetes-кластерах, потому что просто не видят, кто ими пользуется, сколько памяти занято и зависают ли контейнеры.

25 мая 2026 г.·2 мин
ИИ для финансов: как многоагентные системы находят торговые сигналы
LLMNVIDIA Developer Blog

ИИ для финансов: как многоагентные системы находят торговые сигналы

Многоагентные системы ИИ помогают исследователям автоматизировать поиск торговых сигналов в рыночных данных, анализируя цены, экономические показатели и альтернативные источники для выявления скрытых паттернов.

25 мая 2026 г.·3 мин
Нейросеть для медицины: NVIDIA создала генератор 3D снимков
LLMNVIDIA Developer Blog

Нейросеть для медицины: NVIDIA создала генератор 3D снимков

NVIDIA представила фреймворк NV-Generate-CTMR для автоматического синтеза реалистичных 3D медицинских изображений, решая дефицит данных в радиологии и ускоряя обучение обобщённых AI-моделей.

25 мая 2026 г.·3 мин
NVIDIA Vera Rubin: как разработчики будут масштабировать агентский ИИ без задержек
LLMNVIDIA Developer Blog

NVIDIA Vera Rubin: как разработчики будут масштабировать агентский ИИ без задержек

NVIDIA представила Vera Rubin — платформу для масштабирования агентского ИИ, которая комбинирует GPU Vera Rubin NVL72 и ускоритель Groq 3 LPX для достижения 400 токенов в секунду на триллион-параметрных моделях.

21 мая 2026 г.·3 мин
NVIDIA показала различие между оценкой моделей и оценкой AI-агентов
LLMNVIDIA Developer Blog

NVIDIA показала различие между оценкой моделей и оценкой AI-агентов

Бенчмарки моделей и оценка агентов решают разные задачи: первые тестируют понимание языка, вторые — реальное поведение системы в действии.

21 мая 2026 г.·2 мин
NVIDIA разработала систему верификации skills для управления AI-агентами
LLMNVIDIA Developer Blog

NVIDIA разработала систему верификации skills для управления AI-агентами

NVIDIA представила подход к верификации и управлению skills — инструкциями, которые использует AI-агент. Это позволяет организациям безопасно масштабировать автономные системы.

21 мая 2026 г.·2 мин
NVIDIA выпустила AI-Q для глубоких исследований в агентских фреймворках
LLMNVIDIA Developer Blog

NVIDIA выпустила AI-Q для глубоких исследований в агентских фреймворках

NVIDIA представила AI-Q — специализированный компонент для делегирования сложных исследований отдельному backend. Поддерживает корпоративные данные через MCP и работает с Claude Code, Codex и другими агентами.

21 мая 2026 г.·3 мин
Как NVIDIA рекомендует адаптировать AI-агентов под специфические задачи
LLMNVIDIA Developer Blog

Как NVIDIA рекомендует адаптировать AI-агентов под специфические задачи

Публикация от NVIDIA разбирает 9 техник кастомизации: универсальную модель нужно адаптировать под логистику, поддержку клиентов, кодогенерацию. Правильная настройка снижает галлюцинации и стоимость.

21 мая 2026 г.·3 мин