Источник · NVIDIA Technical Blog
lab NVIDIA Technical Blog · 13 д назад · 5 просмотров

NVIDIA Nemotron 3 Ultra лидирует среди открытых моделей по точности и эффективности в агентном RTL-кодировании

Компания NVIDIA выпустила модель Nemotron 3 Ultra, которая лидирует среди открытых моделей как по точности, так и по эффективности в задачах агентного проектирования на языке переноса регистров (RTL).

lab NVIDIA Technical Blog · 24 д назад · 2 просмотра

NVIDIA предлагает со-проектирование BlueField для масштабирования фабрик Agentic AI

NVIDIA описывает, как экстремальное со-проектирование с её процессорами BlueField может решить инфраструктурные проблемы, вызванные рабочими нагрузками Agentic AI. Компания утверждает, что по мере того как агентные системы запускают сложные цепочки вызовов моделей, взаимодействий с инструментами и поиска данных, традиционные инфраструктурные паттерны становятся недостаточными для поддержания производительности.

lab NVIDIA Technical Blog · 24 д назад

NVIDIA обсуждает интеграцию контекстно-зависимых видео-AI агентов в корпоративные рабочие процессы

Видеоаналитический AI-агент, способный воспринимать, рассуждать и действовать на основе огромных объемов видеоматериалов, должен быть интегрирован с существующими рабочими процессами, чтобы быть полезным. Эти рабочие процессы включают системы управления контентом, платформы обмена сообщениями, базы данных, очереди заявок и пути эскалации.

lab NVIDIA Technical Blog · 24 д назад

NVIDIA представляет AI-агентов для разработки легких исполняющих сред USD

NVIDIA представила метод с использованием AI-агентов для ускорения разработки легких исполняющих сред OpenUSD. Этот подход решает традиционную проблему адаптации крупных существующих кодовых баз для команд, которым требуются специфические объемы памяти.

lab NVIDIA Technical Blog · 24 д назад

NVIDIA DeepStream 9.1 обеспечивает многокамерное 3D-отслеживание

Разработчикам, создающим приложения для видеодиагностики в больших пространствах, необходимо отслеживать один и тот же объект при его перемещении между камерами. Однокамерное 2D-отслеживание не имеет надежной информации о глубине и обычно теряет объект при выходе из кадра, что ограничивает применение в таких областях, как безопасность складов, ритейл-аналитика и мониторинг умных зданий.

lab NVIDIA Technical Blog · 24 д назад

NVIDIA CUDA 13.3 добавляет нативную поддержку умножения без переноса

NVIDIA ввела новую инструкцию PTX для умножения без переноса в CUDA 13.3, устраняя давний пробел: несмотря на наличие этой операции на процессорах x86 уже более пятнадцати лет, графические процессоры не имели нативной поддержки.

lab NVIDIA Technical Blog · 25 д назад · 3 просмотра

NVIDIA NeMo поддерживает автономные исследовательские процессы с навыками RL-агентов

NVIDIA NeMo предоставляет возможности для создания кода AI-агентов, способных выполнять длительные рабочие процессы машинного обучения, в частности ориентированные на исследования в области обучения с подкреплением.

lab NVIDIA Technical Blog · 25 д назад

Постобучение NVIDIA Cosmos 3 с навыками агентов достигает точности более 90%

NVIDIA демонстрирует, что использование автономных AI-агентов для написания кода при постобучении модели зрительного рассуждения Cosmos 3 может повысить точность выше 90% при минимальных ручных усилиях.

lab NVIDIA Technical Blog · 25 д назад · 3 просмотра

NVIDIA анализирует более 5000 работ с Kaggle для выявления методов улучшения рассуждений ИИ

Вызов NVIDIA Nemotron Model Reasoning Challenge призвал сообщество Kaggle исследовать методы, повышающие точность рассуждений в рамках общих ограничений: открытые модели, бенчмарки и инфраструктура. К завершению конкурса более 5000 активных участников из 4000 команд подготовили тысячи заявок.

lab NVIDIA Technical Blog · 26 д назад

Декодирование Изинга от NVIDIA снижает частоту логических ошибок кода цвета более чем в 300 раз

Исследователи NVIDIA разработали метод декодирования Изинга, который снижает частоту логических ошибок для коррекции квантовых ошибок с использованием цветового кода более чем в 300 раз.

lab NVIDIA Technical Blog · 27 д назад

NVIDIA предлагает управляемые генеративные модели для оценки вероятности экстремальных событий

Оценка вероятности маловероятных, но высокоэффектных событий в науке, инженерии и финансах является сложной задачей, поскольку метод грубой силы Монте-Карло требует чрезмерного объема итераций модели.

lab NVIDIA Technical Blog · 28 д назад · 1 просмотр

NVIDIA представляет метод оценки универсальных политик роботов

NVIDIA решает задачу строгой оценки фундаментальных моделей робототехники, которые теперь могут выполнять инструкции на естественном языке для манипуляции объектами. Компания определяет оценку как критическую нерешенную проблему и представляет новый метод для решения этих задач.

lab NVIDIA Technical Blog · 29 д назад

NVIDIA объясняет выгрузку на хост для устранения узких мест HBM при обучении LLM в JAX

Рабочие нагрузки по обучению больших языковых моделей (LLM) всё чаще упираются в ограничения памяти GPU до полной загрузки вычислительных ресурсов. Веса модели, градиенты, состояния оптимизатора, буферы коммуникации и промежуточные активации конкурируют за ограниченную высокоскоростную память GPU (HBM). По мере увеличения размера модели, длины последовательности и размера батка ёмкость HBM часто становится основным ограничивающим фактором масштабирования.

lab NVIDIA Technical Blog · 30 д назад

NVIDIA объясняет аппаратно-ориентированный дизайн LLM, балансирующий между точностью, пропускной способностью и интерактивностью

NVIDIA описывает, как производительность ИИ зависит от трёх измерений: точности, пропускной способности и интерактивности. Компания подчёркивает, что практические системы должны оптимизировать эти факторы совместно, а не фокусироваться на одном показателе.

lab NVIDIA Technical Blog · 30 д назад

NVIDIA объясняет, как слияние ядер оптимизирует трафик памяти CUDA и накладные расходы на запуск

Эта статья из блога разработчиков NVIDIA объясняет, как слияние ядер (kernel fusion) может улучшить пропускную способность памяти и снизить накладные расходы на запуск ядер в коде GPU. Она рассматривает распространенную проблему, когда быстрые вычисления GPU опережают память устройства, не позволяя ядрам использоваться полностью.

lab NVIDIA Technical Blog · 30 д назад

Инструментарий агентов NVIDIA BioNeMo ускоряет производительность сквозного совместного фолдинга

NVIDIA представила инструментальный пакет BioNeMo Agent Toolkit для ускорения задач предсказания структуры биомолекул и совместного фолдинга, управляемых ИИ-агентами. Этот набор инструментов решает задачу скорости и масштабируемости на ключевых этапах конвейера, включая генерацию множественного выравнивания последовательностей (MSA), вывод при совместном фолдинге, обслуживание моделей и масштабирование с использованием нескольких GPU.