OpenAI, GPT-5.6 Sol의 Ultrafast 모드 미리보기; Google, Gemini 3.7 Flash 출시
OpenAI는 초당 최대 750개의 출력 토큰을 생성하고 표준 처리 속도의 최대 14배로 작동할 수 있는 GPT-5.6 Sol 모드인 Ultrafast를 미리 선보였습니다. 이 접근 방식은 더 작은 모델로 전환하지 않고 실시간 성능을 제공하는 것을 목표로 합니다.
OpenAI는 초당 최대 750개의 출력 토큰을 생성하고 표준 처리 속도의 최대 14배로 작동할 수 있는 GPT-5.6 Sol 모드인 Ultrafast를 미리 선보였습니다. 이 접근 방식은 더 작은 모델로 전환하지 않고 실시간 성능을 제공하는 것을 목표로 합니다.
구글은 사이클론 예측 정확도를 향상시키기 위해 WeatherNext 2 및 WeatherNext Cyclones AI 모델을 오픈소스로 공개했습니다. 이 모델들은 경로, 강도 및 바람 구조 예측에서 state-of-the-art 결과를 달성하며, 현재 방법 대비 예보관에게 평균적으로 하루 더 긴 예측 정확도를 제공합니다.
OpenAI는 미출시 모델을 평가하는 동안 발견된 10가지 결과를 공유했으며, 이는 수학 및 이론 컴퓨터 과학 분야에서 오랜 기간 열린 문제를 해결하거나 상당한 진전을 이루었습니다. 동시에 2.4조 개의 파라미터를 가진 Qwen 3.8-Max 모델이 출시되어 코딩, 업무, 연구 및 장기 작업 전반에 걸쳐 개선 사항을 제공했습니다.
Anthropic은 Claude Fable 5의 성능에 근접하면서도 가격이 절반인 더 효율적인 모델인 Claude Opus 5를 출시했으며, 이는 Claude Max의 기본 모델이 되었습니다. 동시에 NVIDIA는 혁신을 장려하고 미국이 해당 부문에서 주도권을 강화할 수 있도록 오픈 가중치 AI 모델을 지원하는 미국 정부 정책을 촉구하고 있습니다.
구글은 효율적인 범용 에이전트 워크로드를 위한 Gemini 3.6 Flash, 낮은 지연 시간 애플리케이션을 위한 3.5 Flash-Lite, 그리고 CodeMender와 통합된 사이버 전문 3.5 Flash 모델을 포함한 세 가지 새로운 모델을 출시했습니다.
Anthropic이 Claude Chrome 확장 프로그램을 업그레이드하여 사이드 패널에서 완전한 Claude Cowork 세션을 실행할 수 있게 되었습니다. 이 업데이트를 통해 대화는 사용자의 Claude 계정에 직접 저장되며 데스크톱, 웹 또는 모바일 기기 간에 끊김 없이 계속할 수 있습니다.
이번 TLDR AI 에디션에서는 세 가지 주요 개발 사항을 다룹니다: Anthropic의 Claude 모델이 리만 가설을 만족하는 영점(lower bound)에 대한 하한선을 크게 개선했으며, Meta는 오픈 가중치를 가진 Muse Glimmer 모델을 출시했고, OpenAI는 특수 목적 사이버보안 모델을 선보였습니다.
Meta는 복잡한 저장소 수준 엔지니어링 작업을 처리하도록 설계된 Muse Spark 1.2 기반 터미널 코딩 에이전트인 Muse Code를 출시했습니다. 동시에 Google DeepMind는 Demis Hassabis가 Google DeepMind 의장 및 Alphabet 수석 과학자로 이동하고, Jeff Dean이 27년 만에 퇴사하는 등 중요한 리더십 변경을 발표했습니다.
전직 OpenAI 임원인 Fidji Simo가 설립한 ChronicleBio는 AI와 153TB의 혈액 데이터를 활용하여 기립성 빈맥 증후군(POTS)을 치료하고 있다. 한편, Mind Lab의 Macaron-V1 모델은 지속 학습을 위해 다섯 개의 LoRA 전문가 모듈 간에 동적으로 전환하며 GLM-5.2를 벤치마크에서 앞지르고 있다.
Thinking Machines는 276B 파라미터(12B 활성)를 가진 mixture-of-experts 모델인 Inkling-Small을 출시했습니다. 이 모델은 멀티모달 추론과 1M 토큰 컨텍스트 창을 유지하면서 더 적은 컴퓨팅 자원을 사용합니다.
xAI는 SuperGrok Heavy 구독자를 위해 "빌드 모드"를 출시하여, 사용자가 설정 없이 채팅에서 직접 웹사이트, 앱, 게임, 대시보드를 생성하고 편집하며 미리 보고 게시할 수 있도록 했습니다. 동시에 선진 AI 기업들의 천 명 이상의 직원들이 자동화된 AI 개발의 최전선을 의도적으로 조절하기 위한 도구를 개발하는 데 대한 국제적 노력을 미국 정부가 지원해 줄 것을 요청하는 성명에 서명했습니다.
Moonshot은 네이티브 비주얼 이해와 100만 토큰 컨텍스트 윈도우를 갖춘 2.8T Mixture-of-Experts 모델인 Kimi K3의 모델 가중치와 기술 보고서를 출시했습니다. 이번 출시에는 고성능 어텐션 커널, MoE 통신 라이브러리, 대규모로 에이전트 환경을 실행하기 위한 인프라가 포함되어 있습니다.
AMD와 Anthropic은 AI 서버에 수십억 달러 규모의 주요 계약을 체결했으며, Anthropic은 내년 상반기부터 AMD의 Instinct MI450 칩을 최대 2기가와트분 구매합니다. 동시에 특정 배포 마일스톤이 달성됨에 따라 AMD는 Anthropic에 최대 50억 달러를 투자하며, 양사는 하드웨어에 적합한 데이터 센터 위치를 함께 식별하기 위해 협력합니다.
이 TLDR AI 뉴스레터는 새로운 하드웨어, 소프트웨어 에이전트 및 라우팅 최적화를 포함하여 AI 산업의 여러 발전을 다룹니다.
알리바바는 2.4조 파라미터를 가진 Qwen3.8의 오픈 가중치 출시를 발표했으며, 엔비디아 CUDA 생태계 의존도를 줄이기 위해 Zhenwu AI 칩 소프트웨어 스택도 오픈소스로 공개했다.
Moonshot은 2.8조 개의 파라미터와 100만 토큰 컨텍스트 창을 가진 다중 모달 모델인 Kimi K3를 출시했으며, Schema harness는 프론티어 모델이 ARC-AGI-3 벤치마크에서 99%의 성능을 달성할 수 있게 합니다.
싱킹 머신스는 975B 파라미터의 mixture-of-experts 모델로 41B의 활성 파라미터와 다중 모달 추론을 갖춘 잉클링(Inkling)을 출시했습니다. 동시에 앤트로픽은 9650억 달러의 기업 가치로 650억 달러의 자금 조달 라운드 이후 올해 말 잠재적 IPO를 준비하고 있습니다. 오픈AI도 GPT-5.6 Sol에서 프롬프트 인젝션 벤치마크에서의 실패를 6배 줄이기 위해 적대적 프롬프트를 반복적으로 생성하는 GPT-Red를 학습했습니다.