Лаборатория · Perplexity
lab OpenAI News · 11 д назад · 38 просмотров

Perplexity использует GPT-6 Astra для управления всей системой

Perplexity внедрила GPT-6 Astra от OpenAI для обработки коммуникаций, изменений в программном обеспечении и мониторинга производства, что позволяет команде проверять состояние реже, чем с более ранними моделями.

media Latent Space · 27 д назад · 70 просмотров

OpenAI сообщает: чип Jalapeño превосходит NVIDIA GB200/GB300 по эффективности и задержкам

На 37-й конференции Hot Chips компания OpenAI представила данные бенчмарков для своего собственного чипа вывода Jalapeño, заявив о превосходной производительности на ватт по сравнению с системами NVIDIA GB200 и GB300. Чип обеспечивает выполнение на 1.5–1.9× больше работы на ватт при пиковой пропускной способности и снижает сквозную задержку на 1.7–3.6×; его внедрение в инфраструктуру OpenAI запланировано до конца года.

media MarkTechPost · 21 д назад · 37 просмотров

Perplexity запускает гибридные вычисления на Mac с блокировкой PII на устройстве

Perplexity выпустила функцию гибридных вычислений для Mac, которая распределяет агентные задачи между облачными моделями переднего края и локальными моделями, используя шлюз конфиденциальности на устройстве для обработки чувствительных данных. Это позволяет пользователям использовать мощное облачное рассуждение, сохраняя приватные файлы, такие как документы сделок или записи клиентов, строго на их оборудовании.

media MarkTechPost · 29 д назад · 44 просмотра

Perplexity выпускает Portable Computer на базе NVIDIA DGX Spark с локальным агентным фреймворком

Perplexity выпустила Portable Computer, локально-ориентированную версию своей агентной платформы, которая запускает агентный фреймворк, оркестратор, планировщик, маршрутизатор инструментов и дообученные модели непосредственно на оборудовании NVIDIA DGX Spark. Эта упакованная система позволяет начинать выполнение каждой задачи на устройстве, не взимая платы за каждый токен за работу, выполняемую локальными моделями, при этом передавая только определенные шаги в облако с использованием более чем 15 моделей после одобрения пользователя.