Лаборатория · NVIDIA
lab OpenAI News · 29 д назад · 51 просмотр

OpenAI сообщает: чип Jalapeño обеспечивает снижение задержки до 3,6 раза и повышение эффективности в 1,9 раза

OpenAI опубликовала предварительные результаты производительности Jalapeño, своего первого собственного чипа для вывода моделей, демонстрирующие значительное улучшение скорости и энергоэффективности по сравнению с существующими коммерческими системами. Компания заявляет, что новая архитектура позволяет одновременно достигать более высокой пропускной способности и меньшей задержки, решая типичный компромисс в современном аппаратном обеспечении.

lab NVIDIA Research · 9 д назад · 15 просмотров

Nvidia представляет расширенные модели ошибок детекторов для композиции квантовых схемных ошибок

Исследователь Nvidia Н. Хоррокс представляет расширенные модели ошибок детекторов (EDEMs), предназначенные для обработки отказоустойчивых квантовых программ со стабилизаторными схемами и стохастическими ошибками Паули. Эти модели позволяют анализировать ошибки путем последовательной и параллельной композиции, что отражает структуру физических реализаций схем.

lab NVIDIA Research · 11 д назад · 20 просмотров

Onyx обеспечивает снижение стоимости в 1,7–9,9 раза и задержки в 2,3–12,3 раза для disk-oblivious ANN-поиска

Исследователи предлагают Onyx — энергоэффективный подход к disk-oblivious приближенному поиску ближайших соседей (ANN), который балансирует пропускную способность и количество обращений путем инвертирования архитектуры современных систем ORAM-ANN.

lab NVIDIA Research · 11 д назад · 19 просмотров

Privatar обеспечивает масштабируемую приватную многопользовательскую VR за счёт безопасного выноса задач

Исследователи представляют Privatar — фреймворк, который переносит реконструкцию аватара с гарнитур на недоверенные локальные устройства, защищая при этом от перехвата данных. Система использует специфичные для домена знания о реконструкции аватара для достижения доказуемо приватного выноса задач с минимальными потерями производительности.

lab NVIDIA Research · 11 д назад · 21 просмотр

NVIDIA выпускает GPIR для ускорения на GPU конфиденциального поиска информации

Исследователи из NVIDIA представили GPIR, систему, которая ускоряет выполнение Private Information Retrieval (PIR) на графических процессорах за счёт решения проблем с высокой вычислительной нагрузкой и трафиком памяти на стороне сервера, присущих протоколам на основе решёток. Система использует гибридную модель выполнения, учитывающую стадию обработки, которая динамически переключается между ядрами уровня операций и уровня стадий для максимизации повторного использования данных внутри чипа.

lab NVIDIA Research · 11 д назад · 21 просмотр

NVIDIA характеризует производительность и стоимость MPC и FHE для PPML

Новое исследование представляет унифицированную системную характеристику безопасных многосторонних вычислений (MPC) и полностью гомоморфного шифрования (FHE) для машинного обучения с сохранением конфиденциальности. Работа оценивает два варианта MPC — преобразование арифметического/бинарного разделения и секретное разделение функций — наряду с FHE в нескольких моделях CNN и Transformer.

lab NVIDIA Research · 11 д назад · 14 просмотров

NVIDIA предлагает системные защиты от косвенной инъекции промптов в ИИ-агентах

Позиционный документ исследователей NVIDIA описывает видение обеспечения безопасности ИИ-агентов от атак с косвенной инъекцией промптов, где вредоносные инструкции, встроенные в ненадежные данные, вызывают опасные действия. Авторы утверждают, что эффективная защита требует выхода за рамки изолированных исправлений моделей к комплексным системным архитектурам.

arxiv arXiv cs.LG · 20 д назад · 69 просмотров

Модели NVIDIA Nemotron-3 достигли золотого медали и лучших человеческих результатов на IOI 2026

Исследователи разработали конвейер постобучения для больших языковых моделей, позволяющий им показывать результаты уровня золотой медали в соревновательном программировании. Комбинируя контролируемое тонкое обучение (SFT), обучение с подкреплением и новую стратегию, основанную на обратной связи, называемую GenCorrect, система превзошла лучших человеческих участников на наборе задач IOI 2026.

arxiv arXiv cs.CL · 20 д назад · 31 просмотр

Модели NVIDIA Nemotron-3 демонстрируют золотой уровень в олимпиадах по программированию IOI

NVIDIA разработала конвейеры постобучения для своих языковых моделей Nemotron-3-Nano-CC и Nemotron-3-Ultra-CC, чтобы достичь выдающихся результатов в соревновательном программировании. Объединив масштабный отбор задач, синтетические цепочки рассуждений, контролируемое тонкое настраивание и обучение с подкреплением, команда создала специализированные системы, способные к высокоуровневым алгоритмическим рассуждениям.

arxiv arXiv cs.AI · 20 д назад · 36 просмотров

Модели Nemotron-3 от NVIDIA достигают золотого уровня в олимпиадах по программированию IOI

NVIDIA разработала конвейер постобучения для своих языковых моделей Nemotron-3, позволяющий им демонстрировать результаты уровня золотой медали на Международной олимпиаде по информатике (IOI). Подход сочетает масштабный отбор задач, синтетические цепочки рассуждений, контролируемое дообучение и обучение с подкреплением.

media r/LocalLLaMA · 2 д назад · 11 просмотров

Huawei откладывает глобальный запуск ИИ-чипов, так как внутренний спрос в Китае превышает предложение

Huawei приостановила международное расширение рынка чипов для искусственного интеллекта, поскольку внутренний спрос в Китае превышает доступное предложение. Эта стратегическая сдвиг означает, что конкуренты AMD и Nvidia больше не сталкиваются с немедленным давлением со стороны глобального выхода Huawei на рынок.

arxiv arXiv cs.CL · 2 д назад · 13 просмотров

NemotronLabs выпускает VoiceChat — открытую полнодуплексную модель преобразования речи в речь с вызовом инструментов

NemotronLabs представила VoiceChat, открытую полнодуплексную модель преобразования речи в речь с открытыми весами, предназначенную для интеграции прослушивания, транскрипции, рассуждений и генерации речи в рамках единой потоковой архитектуры. Система объединяет потоковый речевой энкодер и декодирующую языковую модель с параллельными специализированными выходными потоками для текста агента и структурированных вызовов функций, а также вспомогательным ветвлением RNN-T для инкрементальной транскрипции пользователя.

arxiv arXiv cs.AI · 2 д назад · 13 просмотров

NemotronLabs выпускает VoiceChat: открытую полнодуплексную модель преобразования речи в речь с вызовом инструментов

NemotronLabs представила NemotronLabs VoiceChat, открытую полнодуплексную модель преобразования речи в речь с весами, которая интегрирует нативные возможности вызова инструментов в единую потоковую архитектуру. Система объединяет потоковый речевой энкодер и языковую модель только для декодирования с параллельными выходными потоками для текста агента и структурированных вызовов функций, а также вспомогательный ветвь RNN-T для инкрементальной транскрипции и потоковый декодер TTS.

media Together AI Blog · 13 д назад · 59 просмотров

Together AI оптимизирует GEMM ThunderKittens для NVIDIA Vera Rubin NVL72

Команда разработчиков ядер Together AI оптимизировала библиотеку ThunderKittens для использования новых функций платформы NVIDIA Vera Rubin NVL72, с особым акцентом на повышение производительности матричных умножений в форматах NVFP4 и FP8.

media r/LocalLLaMA · 14 д назад · 30 просмотров

gtrg55 выпускает INT4-квантованную версию NVIDIA Cosmos3 64B для локальной генерации изображений

Пользователь опубликовал код и веса для локального запуска модели Cosmos3 от NVIDIA с 64 миллиардами параметров с использованием INT4-квантования. Реализация поддерживает задачи Text-to-Image и Image-to-Video на Apple Silicon через MLX, а также CUDA.

media r/LocalLLaMA · 18 д назад · 20 просмотров

NVIDIA запускает PAIR для персональных ИИ-кластеров

NVIDIA представила PAIR, инструмент, предназначенный для помощи пользователям в подключении старого оборудования к персональному ИИ-кластеру. Эта инициатива направлена на использование существующих устройств для локального выполнения ИИ-задач.