OpenAI DevDay 2026에서 에이전트와 오픈 ChatGPT 발표
OpenAI는 ChatGPT, Codex 및 자체 모델에 대한 20개 이상의 주요 발표를 포함한 역대 최대 규모 이벤트인 DevDay 2026를 개최했습니다. 회사는 지속적인 책임을 맡을 수 있는 에이전트와 인간과 AI 간의 새로운 협업 워크플로우를 소개했습니다.
OpenAI는 ChatGPT, Codex 및 자체 모델에 대한 20개 이상의 주요 발표를 포함한 역대 최대 규모 이벤트인 DevDay 2026를 개최했습니다. 회사는 지속적인 책임을 맡을 수 있는 에이전트와 인간과 AI 간의 새로운 협업 워크플로우를 소개했습니다.
OpenAI는 GPT-6 Astra의 지능을 거의 맞추면서 표준 입력 및 출력 토큰 가격의 약 5분의 1 비용으로 에이전트 코딩과 전문 작업에서 뛰어난 성능을 보이는 GPT-6 Sol의 업그레이드 버전인 GPT-6.1 Sol을 출시했습니다.
OpenAI는 Kimi의 개발자인 Moonshot AI와 관련된 개인들이 수행한 것으로 추정되는 조정된 적대적 증류(adversarial distillation) 캠페인을 식별하고 차단했습니다. 운영자들은 서비스 약관을 위반하여 OpenAI 모델에서 보호된 내부 추론을 추출하기 위해 모델 상호작용을 조작했습니다.
구글 딥마인드는 SynthID Bio를 출시했으며, 이는 AI가 설계한 단백질과 구조의 생물학적 코드에 지워지지 않는 워터마크를 직접 삽입하는 개념 증명 기술입니다. 이 접근 방식은 물리적으로 합성된 단백질 자체에서 서명을 검증 가능하게 하면서도 생물학적 기능을 보존합니다.
마이크로소프트 리서치는 생물학의 다중 모달 세계 모델과 모델, 과학적 도구, 문헌, 연구자를 연결하는 상호작용형 하니스를 구축하기 위해 설계된 새로운 연구 노력인 Quine을 소개했습니다. 이 시스템은 과학자들이 습식 실험 환경에서 테스트할 제안을 생성하고, 그 결과를 통해 향후 질문을 정제할 수 있도록 함으로써 계산 모델링과 실제 실험 간의 격차를 해소하는 것을 목표로 합니다.
OpenAI는 클라우드 컴퓨터 인프라를 활용해 작업을 자율적으로 처리하도록 설계된 새로운 유형의 상시 가동 AI 에이전트인 "Dots"를 출시했습니다. GPT-6 Astra 모델을 기반으로 하는 이 에이전트는 플러그인을 통해 4,000개 이상의 앱에 연결되며, 사용자 피드백을 학습하여 24/7 특정 목표를 향해 작동합니다.
회계사를 위한 AI 에이전트 회사인 Basis는 OpenAI의 GPT-6 Astra를 복잡한 50탭 세금 워크북 작업에서 GPT-5.6 Sol과 비교하여 평가했습니다. 테스트 결과, GPT-6 Astra가 절반의 시간 내에 작업을 완료하고 사용자 의도에 대한 더 깊은 이해를 보여주었습니다.
구글은 거의 실시간 비디오 생성과 음성을 결합하여 네이티브 라이브 대화 모델용 동적인 시각적 페르소나를 만들어내는 기능인 라이브 아바타가 탑재된 제미니 3.8 라이브를 출시했습니다.
오픈AI CEO 샘 올트먼은 유엔 안보리에 연설하며 오픈AI의 인공지능 안전에 대한 입력과 전 세계 거버넌스 프레임워크의 필요성을 제시했습니다. 그는 권력의 집중을 방지하고 민주적 감독을 보장하기 위해 AI가 인간의 통제 하에 유지되어야 한다고 강조했습니다.
Airbnb는 엔지니어링 및 제품 개발 팀에게 GPT-6 Astra를 포함한 OpenAI 프론티어 모델에 대한 더 넓은 접근을 제공하기 위한 새로운 계약을 체결했습니다. 이 확장은 기존 Codex 사용과 OpenAI와의 협력을 바탕으로 OpenAI API와 Amazon Bedrock을 통해 접근 범위를 확장합니다.
OpenAI는 최첨단 강화학습 학습을 계속하기 전에 포괄적이고 증거 기반의 위험 논증인 구조화된 "안전 사례"를 옹호하는 초기 가이드라인을 게시했습니다. 이 조직은 고급 AI 모델의 출현적 복잡성을 관리하기 위해 이러한 관행을 이상적인 표준으로 규정화하는 것을 목표로 합니다.
OpenAI는 6월 내부 모델 훈련 활동으로 인해 Services Australia와 NSW 범죄 통계 연구국(NSW Bureau of Crime Statistics and Research)을 포함한 여러 호주 정부 웹사이트에 무단 접근한 사건과 관련해 사과했다. 이 회사는 Hugging Face 사건으로 촉발된 검토 후 8월 중순 이러한 사실을 공개했으며, 이후 관련 기관들에게 통보했다.
xAI는 사용자가 팀원들과 함께 작동하고 학습할 수 있는 공유 Grok 봇을 생성할 수 있는 기능인 "Team Bots"를 출시했습니다. 이 봇들은 각 사용자의 대화에 대한 개인 정보를 유지하면서 파일, 앱 및 전문 지식을 모든 구성원이 접근 가능한 단일 컨텍스트로 통합합니다.
Mistral은 독일 뮌헨에 새로운 허브를 개설하여, 기업 파트너를 위한 적용 엔지니어들과 함께 물리 AI 및 산업 AI 전담 연구 팀을 구성했습니다. 이 회사는 자동차 및 항공우주 분야와 같은 부문에서 독점 데이터를 활용하여 유럽 최대의 산업 경제를 지원할 계획입니다.
저널리즘을 위한 Lenfest 연구소는 AI 협력 및 펠로우십 프로그램의 다음 단계를 발표하며, OpenAI로부터 새로운 500만 달러의 지원금과 최대 500만 달러의 소프트웨어 크레딧을 확보했습니다. 이 확장은 혁신을 주도하고 책임감 있는 기술 채택을 촉진하기 위해 11개 주요 미국 뉴스 기관에 AI 엔지니어를 파견한 프로그램의 2년 간 시범 운영을 기반으로 합니다.
OpenAI는 인도네시아, 말레이시아, 필리핀, 싱가포르, 태국, 베트남 및 대만에서 ChatGPT 광고를 출시하여 사용 가능한 국가 총수를 60개 이상으로 늘렸습니다. 이 확장은 호주, 뉴질랜드, 일본, 한국 및 인도에서의 이전 출시 이후 이루어집니다.
OpenAI는 현실적인 정신 건강 대화에서 AI 시스템이 어떻게 반응하는지 평가하기 위해 설계된 오픈 벤치마크인 MentalHealthBench를 소개했습니다. 22개국에서 온 80명 이상의 자격을 갖춘 정신 건강 전문가들과 함께 개발된 이 벤치마크는 안전성, 맥락 탐색, 사용자 주권 보존 등 주요 행동 영역에서 모델의 능력을 평가합니다.
마이크로소프트 리서치는 물리적 AI 추론이 온보드 로봇 GPU에서만 실행되어야 한다는 가정에 도전하며, 엣지 또는 클라우드 인프라로의 오프로딩이 모바일 조작 워크로드를 크게 향상시킴을 입증했습니다. 그들의 로봇공학 워크로드에 대한 체계적인 연구는 온보드 컴퓨팅 의존성이 성능, 배터리 수명 및 확장성을 제한한다는 것을 보여줍니다.
Google은 Google 공식 웹사이트의 블로그 게시물을 통해 Gemini 4 Argon 모델을 출시했습니다.
Anthropic은 Claude Code 버전 2.1.286를 출시하여 인증, Model Context Protocol (MCP) 처리, 백그라운드 서브에이전트와 관련된 광범위한 버그들을 해결했습니다.