Тема · Code generation
lab xAI News · 11 д назад · 13 просмотров

xAI сделала Grok 4.5 доступной в GitHub Copilot

xAI предоставила свою модель программирования Grok 4.5 в GitHub Copilot для миллионов разработчиков, использующих VSCode и другие продукты GitHub. Пользователи могут выбрать модель напрямую из списка выбора моделей, тогда как некоторым корпоративным пользователям может потребоваться включить её через настройки Copilot.

lab Anthropic News · 16 д назад · 16 просмотров

Anthropic выпустила Claude Opus 5 для программирования и долгоживущих агентов

Anthropic выпустила Claude Opus 5, новую модель, предназначенную для обеспечения работы долгоживущих агентов при значительном улучшении возможностей в области программирования и профессиональной деятельности. Она позиционируется как качественный скачок для уровня Opus, предлагая производительность, близкую к Claude Fable 5, но за половину стоимости.

lab Google DeepMind Blog · 19 д назад OSWorld · 83.0% · 10 просмотров

Google выпустила Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber

Google представила три новые модели в своей серии Gemini: Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber, предназначенные для повышения эффективности использования токенов, снижения задержек и повышения надежности для производственных ИИ-агентов.

lab xAI News · 12 д назад · 8 просмотров

xAI представляет режим Build Mode для создания приложений и игр

xAI представила режим Build Mode, новую функцию в ранней бета-версии для подписчиков SuperGrok Heavy, которая позволяет пользователям создавать веб-сайты, приложения, игры и интерактивные дашборды непосредственно в интерфейсе чата Grok.

lab Google — The Keyword (AI) · 4 д назад · 7 просмотров

Google и Kaggle провели курс по кодингу с помощью AI-агентов для 353 тысяч человек

Google и Kaggle совместно организовали «5-дневный интенсив по AI-агентам: курс по кодингу в стиле vibe», который привлек более 353 000 зарегистрированных участников. Бесплатный мультимодальный курс был направлен на обучение разработчиков программированию с помощью естественного языка и развертыванию готовых к продакшену AI-агентов в облаке.

lab OpenAI News · 12 д назад · 4 просмотра

Ученые используют ИИ-агентов для программирования с целью модернизации научных вычислений

Новый полевой отчет исследует, как исследователи используют ИИ-агентов для программирования с целью модернизации рабочих процессов в области научных вычислений.

lab Claude Code Releases · 16 д назад · 6 просмотров

Claude Code v2.1.219 добавляет Claude Opus 5 и поддержку вложенных субагентов

Claude Code v2.1.219 представляет Claude Opus 5 в качестве новой модели Opus по умолчанию, с контекстным окном на 1M и ценой быстрого режима $10/$50 за Mtok. Обновление также включает пересылку вложенных субагентов в stream-json и увеличивает максимальную глубину вложения до 3 по умолчанию.

lab OpenAI News · 24 д назад · 1 просмотр

Cars24 масштабирует диалоги и ускоряет процессы с помощью OpenAI

Cars24 использует агентов на базе OpenAI для обработки более 1 миллиона минут разговоров в месяц, возвращая 12% ранее потерянных лидов от продавцов и повышая уровень разрешения обращений в службе поддержки клиентов на 50%. Компания также развернула ChatGPT Enterprise и Codex в своей центральной организации, что позволило сотрудникам из отделов инженерии, финансов, юриспруденции, маркетинга и операций самостоятельно создавать рабочие процессы с ИИ.

lab Claude Code Releases · 1 д назад · 8 просмотров

Claude Code v2.1.225 добавляет предупреждения о лимите расходов шлюза и запросы доверия к рабочей области

Anthropic выпустила Claude Code версии 2.1.225, внедрив новые предупреждения об использовании для лимитов расходов шлюза и запрос доверия к рабочей области для недоверенных директорий. Обновление также решает несколько проблем аутентификации, включая преходящие ошибки 401 в безголовых сессиях и периодические сбои при чтении из связки ключей macOS.

media Together AI Blog · 2 д назад DeepSWE · 67.2% · 7 просмотров

DeepSeek-V4 Flash 0731 против GPT-5.6 Luna на DeepSWE: стоимость и программирование

Сравнение моделей DeepSeek-V4 Flash 0731 и GPT-5.6 Luna на бенчмарке DeepSWE показывает, что, хотя GPT-5.6 Luna является более сильным инженером, каскадная стратегия с использованием обеих моделей обеспечивает более высокую точность при меньшей стоимости.

lab Claude Code Releases · 2 д назад · 1 просмотр

Claude Code v2.1.224 добавляет поддержку self-hosted runners и межсессионного обмена сообщениями

Компания Anthropic выпустила версию Claude Code 2.1.224, которая приносит значительные новые возможности для развертывания и управления сессиями наряду с различными исправлениями ошибок.

github CrewAI · 3 д назад · 7 просмотров

crewAI 1.15.12 добавляет URLReadTool и унифицирует создание структуры проекта

Команда crewAI выпустила версию 1.15.12, внедрив новые возможности для использования инструментов и инициализации проектов. Это обновление включает новый инструмент для чтения произвольных URL-адресов и объединяет процесс создания структуры проекта под единой командой CLI.

lab Claude Code Releases · 3 д назад · 7 просмотров

Claude Code v2.1.223 добавляет wildcard-фильтры для организаций в маркетплейсе и устраняет обход безопасности

Claude Code v2.1.223 вводит новые управляемые настройки для контроля доступа к маркетплейсу на уровне организации GitHub и устраняет несколько уязвимостей, связанных с проверкой прав.

media MarkTechPost · 3 д назад Terminal-Bench 2 · 80.0% · 8 просмотров

Meta выпустила бета-версию терминального агента Muse Code на базе модели Muse Spark 1.2

Meta AI выпустила Muse Code, бета-версию терминального кодингового агента для macOS и Linux, работающего на основе новой модели Muse Spark 1.2. Система предназначена для решения сложных задач программной инженерии в крупных репозиториях за счёт планирования изменений, написания кода и проверки результатов через непрерывный цикл работы агента.

lab Claude Code Releases · 4 д назад · 14 просмотров

Claude Code v2.1.222 исправляет изоляцию сессий, подключение через прокси и атрибуцию использования

Claude Code v2.1.222 устраняет несколько критических проблем, касающихся безопасности сессий, стабильности подключения и точности выставления счетов. Основные обновления включают принудительное разделение worktree для деструктивных git-команд и исправление хуков PreToolUse, которые ранее обходили ограничения инструментов в фоновых задачах.

media Latent Space · 5 д назад · 2 просмотра

Alibaba анонсировала Qwen 3.8 Max — модель с 2,4 трлн параметров и открытыми весами, которая выйдет на следующей неделе

Команда Qwen от Alibaba объявила о выпуске Qwen 3.8 Max, новой флагманской модели с 2,4 трлн параметров, ориентированной на программирование, долгосрочную автономную работу агентов и мультимодальное рассуждение. Компания подтвердила, что на следующей неделе будут выпущены версии с открытыми весами как для Qwen 3.8 Max, так и для более компактной модели Qwen 3.8-27B.

github OpenAI Agents SDK · 5 д назад · 5 просмотров

OpenAI Agents Python v0.19.3 исправляет коллизии имён инструментов и отчётность о защитных барьерах

OpenAI выпустила версию 0.19.3 SDK openai-agents-python, устраняющую несколько ошибок, связанных с инструментами агентов, управлением сеансами и обработкой аудио в реальном времени.