API & product launches
media Latent Space · только что · 2 просмотра Live

Anthropic запускает Claude Opus 5.5 с улучшенным письмом и сниженными затратами

Anthropic выпустила Claude Opus 5.5, первую модель в своей новой семье Claude 5.5, позиционируя её как более эффективную альтернативу предыдущим поколениям. Модель разработана для выполнения задач на уровне Claude Fable 5.1 при стоимости запуска на 40% ниже, чем у Opus 5.

media TLDR AI · 2 ч назад · 10 просмотров

Anthropic выпустила Claude Projects v2; Google представила семейного агента

Anthropic выпустила Claude Projects v2, переработав функцию из структуры на основе папок в интерфейс, управляемый диалогом, который управляет сборками через делегирование задач и параллельные потоки. Одновременно Google тестирует семейного агента, работающего на выделенном облачном компьютере для координации действий до шести членов семьи.

media MarkTechPost · 8 ч назад · 9 просмотров

Anthropic выпустила Claude Opus 5.5 с производительностью Fable 5.1 при стоимости на 40% ниже

Anthropic выпустила Claude Opus 5.5, первую модель в новой семье Claude 5.5, которая демонстрирует уровень производительности Claude Fable 5.1 в большинстве задач, но обходится на 40% дешевле в обслуживании, чем Opus 5.

lab xAI News · 10 ч назад · 15 просмотров

SpaceXAI использует Grok Bot для обработки роста тикетов на 175% без найма

После приобретения Cursor SpaceXAI интегрировала своего ИИ-агента Grok Bot в объединённую службу поддержки, что позволило команде справиться с ростом количества тикетов на 175% без увеличения штата. Компания избежала найма примерно 200 дополнительных сотрудников и снизила стоимость решения каждого тикета до диапазона от $0.20 до $0.30 благодаря использованию модели ценообразования Grok Bot, зависящей от объёма потребления.

lab OpenAI News · 12 ч назад · 21 просмотр

OpenAI улучшает кэширование промптов GPT-6 с более высокой частотой попаданий и диагностикой

OpenAI запустила улучшенную систему кэширования промптов для семейства GPT-6, которая по умолчанию обеспечивает более высокую частоту попаданий в кэш и предоставляет скидки до 90% на токены входных данных из кэша. Обновление включает новые инструменты для помощи разработчикам в мониторинге производительности, диагностике промахов и оптимизации их интеграций.

lab OpenAI News · 13 ч назад DeepSWE · 68.8% · 17 просмотров

OpenAI выпустила GPT-6 Sol и Luna с более низкой стоимостью и улучшенным кэшированием

OpenAI представила две новые модели, GPT-6 Sol и GPT-6 Luna, предназначенные для распространения преимуществ передового интеллекта за счет повышения экономической эффективности. Эти модели используют схожие методы обучения, что и GPT-6 Astra, но фокусируются на обеспечении более быстрой и доступной производительности для повседневных задач и приложений.

media MarkTechPost · 21 ч назад GDPval-AA (Elo) · 1695.0Elo · 13 просмотров

SpaceXAI выпустила Grok 4.7 с увеличенной базовой моделью и улучшенными результатами в бенчмарках

SpaceXAI выпустила Grok 4.7, новую флагманскую модель для программирования, агентных задач и работы с знаниями, которая использует более крупную базовую модель и расширенный цикл обучения с подкреплением по сравнению с Grok 4.6. Модель сохраняет ту же структуру ценообразования, что и её предшественник, но предлагает улучшенные возможности самопроверки, обработки длинного контекста и безопасности.

media Together AI Blog · 1 д назад · 11 просмотров

Together AI представляет канареечные развертывания для обновления моделей в продакшене без простоев

Together AI представила функцию канареечных развертываний (Canary rollouts), которая поэтапно переносит живой трафик с текущей модели на новый чекпоинт. Эта система автоматизирует механизм безопасности при замене моделей, выполняя проверки работоспособности и опциональные контрольные точки по метрикам перед переключением трафика, что позволяет автоматически приостанавливать процесс или откатывать изменения при ухудшении производительности.

media r/LocalLLaMA · 1 д назад · 11 просмотров

Alibaba планирует ИИ-модель с 5–10 триллионами параметров и представляет новый чип

Alibaba объявила о планах разработки модели искусственного интеллекта, содержащей от 5 до 10 триллионов параметров. В рамках этого плана компания также представила новый собственный чип, разработанный для поддержки её инфраструктурных потребностей.

media MarkTechPost · 2 д назад DeepSWE · 67.7% · 15 просмотров

StepFun запускает Step 5 Preview: модель MoE на 600B параметров с контекстом в 1M токенов для агентных задач

StepFun выпустила Step 5 Preview, свою новую флагманскую разреженную модель Mixture-of-Experts (MoE), предназначенную для программной инженерии, профессиональной работы с знаниями и финансов. Модель имеет 600 миллиардов общих параметров, из которых 27 миллиардов активны на каждый токен, контекстное окно на 1M токенов и поддержку ввода текста, изображений и видео.

media MarkTechPost · 3 д назад · 18 просмотров

Команда Alibaba Qwen выпустила Qwen3.8-LiveTranslate с архитектурой Interleave

Команда Alibaba Qwen выпустила Qwen3.8-LiveTranslate, модель синхронного перевода в реальном времени нового поколения, которая слушает живую речь и возвращает переведённый текст и аудио, пока говорящий ещё не закончил. В релизе представлена новая архитектура Interleave, предназначенная для снижения задержки и повышения качества перевода.

media MarkTechPost · 3 д назад · 23 просмотра

TypeSafe AI выпустила Jev: систему с одной моделью, возвращающую типизированные решения

TypeSafe AI выпустила Jev, трансформерную модель "System One", которая возвращает типизированные решения с вероятностями, а не генерирует текст. Система принимает состояние и типизированные вопросы через единую конечную точку API, поддерживая примитивы Choice, Score и Noul для обеспечения ветвления кода на основе калиброванной уверенности.

github AutoGPT · 4 д назад · 23 просмотра

Платформа AutoGPT v0.8.0 добавляет поддержку GPT-6 Astra, Opus 5 и Gemini 3.8 Flash

Платформа AutoGPT v0.8.0 вводит поддержку нескольких новых моделей ИИ, включая GPT-6 Astra, Claude Opus 5, продвинутые обновления Anthropic, Claude Fable 5.1 и Google Gemini 3.8 Flash. В выпуске также добавлен режим голоса AutoPilot, позволяющий работать без рук, и позволяет экспертам выполнять задачи с общедоступными данными при пропуске подключений.

media MarkTechPost · 4 д назад · 14 просмотров

SpaceXAI выпустила API Grok Voice Transcribe 2.0 с заявленной точностью в 2 раза выше

SpaceXAI выпустила модель распознавания речи в текст Grok Voice Transcribe 2.0, доступную через хостинговый API, которая, по утверждению компании, обеспечивает вдвое большую точность по сравнению с версией 1.0 при той же стоимости. Модель предназначена для сложных условий записи, таких как зашумленные телефонные линии и перекрывающиеся голоса, и работает как в пакетном режиме, так и в режиме потоковой передачи в реальном времени.

media MarkTechPost · 4 д назад · 19 просмотров

Meta выпустила бесплатную версию Muse для Mac, способную работать с локальными файлами и приложениями

Meta выпустила Muse для Mac, первую версию своего персонального ИИ-агента, способного выполнять задачи непосредственно на компьютере пользователя. Это приложение для macOS расширяет агента, запущенного ранее в сентябре для iOS, Android, веб-версии и WhatsApp, добавляя уровень взаимодействия с нативными приложениями на рабочем столе.

lab Claude Code Releases · 4 д назад · 17 просмотров

Claude Code v2.1.278 устанавливает режим auto по умолчанию на серверный классификатор

Версия Claude Code 2.1.278 изменяет поведение по умолчанию для пользователей Claude API, Enterprise, Bedrock, Vertex, Foundry и шлюзов: теперь в режиме auto используется серверный классификатор. Это устраняет плату за накладные расходы классификатора; при возникновении платного резервного варианта отображается предупреждение.

lab xAI News · 5 д назад · 24 просмотра

xAI выпустила Grok Voice Transcribe 2.0 с двукратной точностью по сравнению с v1

xAI выпустила Grok Voice Transcribe 2.0, модель преобразования речи в текст, которая вдвое точнее версии 1.0 при сохранении той же цены. Модель построена на аудио-фундаментальной модели, лежащей в основе Grok Voice, и использует уникальный набор данных живого зашумленного многоязычного аудио для обработки сложных реальных условий, таких как нестабильные телефонные линии и конкурирующие голоса.