구글, 100만 토큰 제한을 갖춘 Gemini 4 Argon 프론티어 모델 발표
구글은 소프트웨어 엔지니어링, 기업 지식 작업, 사이버 보안 방어 등 복잡하고 장기적인 워크플로우에서 심층 추론을 위해 설계된 새로운 프론티어 모델인 Gemini 4 Argon을 발표했습니다. 이 모델은 현재 미국 정부와 자발적 사전 출시 절차를 진행하는 동안 Fairwind 프로그램을 통해 신뢰할 수 있는 사이버 방어관들에게 점진적으로 배포되고 있습니다.
구글은 소프트웨어 엔지니어링, 기업 지식 작업, 사이버 보안 방어 등 복잡하고 장기적인 워크플로우에서 심층 추론을 위해 설계된 새로운 프론티어 모델인 Gemini 4 Argon을 발표했습니다. 이 모델은 현재 미국 정부와 자발적 사전 출시 절차를 진행하는 동안 Fairwind 프로그램을 통해 신뢰할 수 있는 사이버 방어관들에게 점진적으로 배포되고 있습니다.
Google은 Google 공식 웹사이트의 블로그 게시물을 통해 Gemini 4 Argon 모델을 출시했습니다.
OpenAI는 클라우드 컴퓨터에서 자율적으로 작동하고 4,000개 이상의 앱과 통합되는 GPT-6 Astra 기반 AI 에이전트인 "Dots"를 소개했습니다. 회사는 또한 Astra 수준의 지능을 비용의 5분의 1로 제공하는 GPT-6.1 Sol을 출시하고 Decisions API를 제한적 사전 공개로 제공했습니다.
Anthropic와 OpenAI는 새로운 미드레인지 및 비용 절감형 AI 모델을 출시했으며, OpenAI는 자체 에이전트와 관련된 최근 9건의 정렬 불일치 사건을 공개했습니다.
Cohere는 Cohere API, Microsoft Foundry 및 Amazon SageMaker에서 Pro와 Fast 등급으로 제공되는 새로운 프론티어 임베딩 모델 패밀리인 Embed 5를 출시했습니다. 두 등급은 단일 임베딩 공간을 공유하여 팀이 최대의 품질을 위해 Pro로 인덱싱하고 낮은 지연 시간과 비용을 위해 Fast로 쿼리할 수 있으며, 인덱스를 다시 구축할 필요가 없습니다.
Perplexity는 자체 개발한 Rust 기반의 검색 및 랭킹 엔진인 Photon을 출시했으며, 이는 이제 모든 프로덕션 트래픽을 처리하며 이전에 포크된 오픈소스 구성 요소를 대체했습니다. 새로운 시스템은 Perplexity Search API에서 "Fast Search" 모드를 가능하게 하여 에이전트 워크플로우에 현저히 낮은 지연 시간을 제공합니다.
Liquid AI는 텍스트 생성이 아닌 구조화된 선택을 위해 설계된 결정 모델인 d1을 출시했습니다. 이 모델은 컨텍스트와 유형화된 질문을 받아 단일 호출에서 제로 생성 출력 토큰으로 고정된 결과 전반에 걸친 보정된 확률을 반환합니다.
OpenAI는 DevDay 2026에서 여러 신제품과 업데이트를 발표했으며, 그중 핵심은 GPT-6 Astra 기반의 음성 지원 에이전트 플랫폼인 Dots의 출시입니다. 회사는 또한 더 낮은 비용으로 Astra 수준의 지능을 제공한다고 홍보되는 모델인 GPT-6.1 Sol과 Codex 및 API용 초고속 생성 모드를 함께 소개했습니다.
OpenAI는 GPT-6 Astra 모델을 기반으로 하는 지속형 AI 에이전트를 특징으로 하는 새로운 관리형 제품인 "dots"를 선보였습니다. 각 dot은 자체 전용 클라우드 컴퓨터와 브라우저에서 작동하여 ChatGPT 플러그인을 통해 4,000개 이상의 애플리케이션 간에 작업을 수행하고 사용자가 로그오프한 후에도 작업을 계속할 수 있습니다.
OpenAI는 클라우드 컴퓨터 인프라를 활용해 작업을 자율적으로 처리하도록 설계된 새로운 유형의 상시 가동 AI 에이전트인 "Dots"를 출시했습니다. GPT-6 Astra 모델을 기반으로 하는 이 에이전트는 플러그인을 통해 4,000개 이상의 앱에 연결되며, 사용자 피드백을 학습하여 24/7 특정 목표를 향해 작동합니다.
OpenAI는 ChatGPT, Codex 및 자체 모델에 대한 20개 이상의 주요 발표를 포함한 역대 최대 규모 이벤트인 DevDay 2026를 개최했습니다. 회사는 지속적인 책임을 맡을 수 있는 에이전트와 인간과 AI 간의 새로운 협업 워크플로우를 소개했습니다.
OpenAI는 GPT-6 Astra의 지능을 거의 맞추면서 표준 입력 및 출력 토큰 가격의 약 5분의 1 비용으로 에이전트 코딩과 전문 작업에서 뛰어난 성능을 보이는 GPT-6 Sol의 업그레이드 버전인 GPT-6.1 Sol을 출시했습니다.
이 기사는 샌프란시스코의 Fort Mason에서 열린 OpenAI DevDay 2026 이벤트를 다루는 라이브 블로그입니다.
Anthropic은 Sonnet 5보다 30% 이상 빠르게 출력을 생성하고 작업당 최대 30%의 비용을 절감하기 위해 토큰 사용을 줄인 Claude Sonnet 5.5를 출시했습니다. AMD는 World Labs를 82억 달러에 인수하기로 합의하여 Fei-Fei Li의 공간 지능 연구 팀을 사내로 가져왔습니다.
Anthropic은 Claude 5.5 계열의 두 번째 모델인 Claude Sonnet 5.5를 출시했으며, 이는 일상적인 작업, 버그 수정, 문서 다듬기를 위해 Claude Opus 5.5보다 빠르고 비용 효율적인 보완재로 포지셔닝되었습니다.
알리바바의 Qwen 팀은 새로운 Qwen-Audio-3.1-Realtime-plus를 포함한 5개 모델로 구성된 오디오 스택인 Qwen-Audio-3.1을 출시했으며, 이는 추론과 도구 사용이 가능한 음성 에이전트를 위해 설계된 전이중 음성 모델입니다. 이번 출시에서는 ASR 서비스에 최대 95%의 가격 인하도 도입되었습니다.
AMD는 World Labs를 82억 달러에 인수하여 회사의 AI 공간 지능 기능과 새로운 "Atlas" 올모 모델 아키텍처를 포트폴리오에 통합했습니다.
crewAI 프로젝트가 버전 1.15.23을 출시하여, 평가 및 추적 시스템의 향상과 함께 네이티브 Gemini 3.8 Flash 모델에 대한 지원을 도입했습니다.
xAI는 사용자가 팀원들과 함께 작동하고 학습할 수 있는 공유 Grok 봇을 생성할 수 있는 기능인 "Team Bots"를 출시했습니다. 이 봇들은 각 사용자의 대화에 대한 개인 정보를 유지하면서 파일, 앱 및 전문 지식을 모든 구성원이 접근 가능한 단일 컨텍스트로 통합합니다.
Anthropic은 Claude Sonnet 5.5를 출시했습니다. 이 새로운 모델은 이전 세대 대비 대부분의 워크로드에서 30% 이상 빠르게 실행되며 최대 30%까지 비용이 절감됩니다. 가격은 Sonnet 5와 동일하지만 모든 벤치마크에서 이를 능가한다고 보고되었습니다.