xAI, GitHub Copilot에 Grok 4.6 코딩 모델 출시
xAI는 VS Code 및 기타 플랫폼을 사용하는 개발자를 위해 최신 코딩 모델인 Grok 4.6을 GitHub Copilot 내에서 사용할 수 있도록 했습니다. 사용자는 모델 피커를 통해 새 모델을 선택할 수 있으며, 기업 고객은 Copilot 설정을 통해 활성화해야 할 수 있습니다.
xAI는 VS Code 및 기타 플랫폼을 사용하는 개발자를 위해 최신 코딩 모델인 Grok 4.6을 GitHub Copilot 내에서 사용할 수 있도록 했습니다. 사용자는 모델 피커를 통해 새 모델을 선택할 수 있으며, 기업 고객은 Copilot 설정을 통해 활성화해야 할 수 있습니다.
구글은 코딩, 에이전트 워크플로우, 지식 작업 기능을 강화하기 위해 설계된 업데이트된 모델인 Gemini 3.7 Flash를 출시했습니다. 이번 릴리스는 이전 버전으로부터 3주 후에 나왔으며, 개발자 피드백과 알고리즘 혁신을 반영했습니다.
OpenAI는 추론 노력 최적화와 새로운 API 제어 기능을 도입하여 훨씬 낮은 비용으로 최전선 수준의 에이전트 성능을 제공하도록 설계된 GPT-5.6 모델 패밀리를 출시했습니다. 이 업데이트를 통해 스타트업은 대용량 작업에는 Luna와 Terra와 같은 작은 모델을 사용하고 복잡한 판단에는 더 큰 모델을 예약함으로써 더 빠르고 능력 있는 에이전트를 구축할 수 있습니다.
DeepSeek-V4-Pro의 일반 제공이 APP, Web 및 API 플랫폼에 출시되었습니다. 이 업데이트는 OpenAI Responses API 형식에 대한 네이티브 지원을 도입하면서 프로덕션 환경에서 에이전트 성능을 크게 향상시킵니다.
xAI가 장기 실행 에이전트와 복잡한 상호작용 작업에 중점을 둔 모델 업데이트인 Grok 4.6을 출시했습니다. 새 버전은 Artificial Analysis Intelligence Index에서 GPT-5.6 Sol과 동등하며, Cursor, Grok Build 및 API를 통해 사용할 수 있습니다.
xAI는 새로운 Quality Mode와 iOS, Android 앱을 통해 Imagine Image 2.0을 일반 공개했습니다. 이번 업데이트는 전문적인 크리에이티브 워크플로우를 위한 정밀한 이미지 생성 및 편집에 중점을 둡니다.
OpenAI는 표준 처리보다 최대 14배 빠른 GPT-5.6 Sol 모델을 실행하는 새로운 서비스 계층인 Ultrafast의 미리 버전을 출시하고 있습니다. Cerebras 하드웨어로 구동되는 이 모드는 초당 최대 750개의 출력 토큰을 생성하며, 초기에는 OpenAI API를 통해 제공됩니다.
Google DeepMind와 Android는 수화 AI를 소비자 제품에 최초로 도입하는 대규모 다국어 수화-텍스트(SL2T) 번역 모델인 SL2T를 선보였습니다. 이 기술은 Pixel 11의 Gboard 및 Live Transcribe에서 수화-텍스트 음성 입력을 지원하며, 미국 수화(ASL)에서 영어로의 번역으로 시작됩니다.
OpenAI와 AWS는 Amazon Bedrock를 통해 Daybreak 기능을 사용할 수 있게 하여 자격 있는 고객이 기존 AWS 환경 내에서 최전선 사이버 모델을 접근할 수 있도록 했습니다. 이 통합은 기업이 익숙한 보안, 거버넌스 및 운영 워크플로우를 사용하여 고급 AI를 적용할 수 있는 경로를 제공합니다.
구글 리서치와 구글 딥마인드는 의료 AI 연구 시스템인 AMIE를 발전시켜 최초의 연구에서 실시간 임상 비디오 상담 기능을 시연했습니다. Gemini와 Project Astra를 기반으로 멀티 에이전트 아키텍처를 사용하여 구축된 이 시스템은 시각적 및 청각적 단서를 해석하고 가상 신체 검사를 안내하며 실시간으로 진단적 추론을 수행합니다.
xAI가 베타 버전으로 Grok Bot을 출시하여 자체 클라우드 컴퓨터에서 작동하고 작업을 끝까지 처리하는 상시 활성 AI 에이전트 시스템을 소개했습니다. SuperGrok Heavy, Cursor Ultra 및 Cursor Teams Premium 구독자를 위해 오늘 데스크톱과 iOS에서 사용 가능하며, 봇은 수동 워크플로우 설정 없이 앱과 도구 간에 작동합니다.
OpenAI는 새로 도입된 GPT-5.6-Cyber 모델을 사용하여 승인된 방어자에게 고급 사이버보안 기능을 제공하기 위해 OpenAI Daybreak 프로그램을 두 가지 새로운 접근 계층—Daybreak Blue와 Daybreak Red—으로 확장하고 있습니다.
Anthropic은 EU AI법 및 AI 생성 콘텐츠 투명성에 관한 행동 강령을 준수하기 위해 향후 Claude 모델에 텍스트 워터마킹을 구현할 예정입니다. 동사는 Google DeepMind가 발표한 SynthID-Text 방식을 사용하며, 이는 출력 품질이나 토큰 추가 없이 생성된 텍스트에 탐지 가능한 패턴을 삽입합니다.
연구원들은 작업을 시간 조건부 잠재 도메인 번역으로 재구성하여 장시간 비디오 리라이트의 시간적 불연속성을 해결합니다. 이 프레임워크는 경계를 통해 대상 도메인 잠재 변수를 전파하여 청크 간 연속성을 강제하고, 마스크된 대상 도메인 자기 조건화를 사용하여 이 동작을 학습 가능하게 만듭니다.
엔비디아 연구진은 물리적으로 타당한 조명 전달과 정체성 보존, 그리고 컴팩트한 실시간 추론을 결합하는 초상화 재조명 방법인 FusionRelight를 소개했습니다. 이 접근 방식은 합성 데이터, One-Light-at-a-Time (OLAT) 데이터 및 자연 환경(in-the-wild) 데이터에서 물리, 반사율, 현실감 사전 지식을 학생 모델로 증류하는 학습 프레임워크인 하이브리드 도메인 지식 융합(HDKF)을 활용합니다.
구글이 제미니(Gemini)를 기반으로 하는 새로운 기능인 Sheets Canvas를 출시했습니다. 이 기능은 자연어 프롬프트를 사용하여 Google Sheets 스프레드시트를 사용자 정의형 인터랙티브 미니 앱으로 변환합니다.
마이크로소프트 리서치는 연결성, 포위, 순서, 분리 및 매듭에 대한 위상적 직관을 다중 모달 대규모 언어 모델이 갖추고 있는지 평가하기 위해 설계된 새로운 벤치마크인 MindTopo를 선보였습니다.
두 가지 새로운 OpenAI 연구에 따르면, 최첨단 기업(월간 AI 사용량 상위 10%에 해당하는 기업)은 일반 기업보다 활성 사용자당 생성하는 출력 토큰이 2.6배에서 8.3배로 증가했으며, 이는 격차가 확대되고 있음을 보여줍니다. 이러한 격차 확대는 기업들이 AI를 보조 수단으로 사용하는 것에서 Codex와 ChatGPT Work와 같은 에이전트 도구에 실질적인 작업을 위임하는 방향으로 채택 방식이 전환되었음을 반영합니다.
새로운 논문은 제한된 예산 설정에서 일반적으로 수동 접근 방식에 의존하는 프로세스인 하이퍼파라미터 최적화(HPO)를 자동화하기 위해 기초 대규모 언어 모델(LLM)을 사용하는 것을 탐구합니다. 저자들은 데이터셋 및 모델 설명에 기반하여 LLM이 하이퍼파라미터 구성을 제안하고, 이를 모델 성능에 따라 반복적으로 정제하는 방법론을 개발했습니다.
연구자들은 영향 함수의 계산 효율성과 언롤링 기반 접근법의 정확성을 결합한 새로운 훈련 데이터 속성 추정(TDA) 방법인 Source를 소개합니다. 영향 함수와 유사한 공식을 사용하여 언롤링 미분을 근사함으로써, Source는 최적화 편향이나 다단계 파이프라인을 고려하지 않는다는 암시적 미분 방법의 한계를 해결합니다.