GPT-5.5 Instant은 더 강력한 추론, 개선된 컨텍스트 처리, 명확한 의사소통, 그리고 의사가 참여한 평가를 통해 ChatGPT의 건강 및 웰빙 응답을 개선합니다.
GPT-5.5 Instant이 ChatGPT의 건강 응답을 향상시킵니다
버디 시스템: 계층적 LLM 추론을 위한 NER-게이트 불확실성과 함께 Rust 엔트로피 모니터
버디 시스템은 로컬 Gemma 3 4B 추론에서 토큰별 불확실성을 감지하기 위해 Rust 엔트로피 모니터를 사용하며, NER-게이트드 스팬 추출 및 시맨틱 검색을 통해 불확실한 토큰만 Sonnet으로 라우팅합니다. 벤치마크 결과 $0.21로 71.4%의 정확도를 달성하여 7개의 Hugging Face 데이터셋에서 Anthropic 어드바이저 패턴($0.44에 62.9%)을 능가했으며, SQuAD v2에서는 소스 패시지 청크를 클라우드 모델로 라우팅하여 주요 개선을 이루었습니다.
Anthropic, 하이브리드 추론 기능을 갖춘 Claude Opus 4와 Sonnet 4 출시
Anthropic은 빠른 응답과 확장된 단계별 사고를 결합하는 "하이브리드 추론" 기능을 도입한 두 가지 새로운 대규모 언어 모델인 Claude Opus 4와 Claude Sonnet 4를 출시했습니다. 이 모델들은 Claude 3.x 세대를 계승하며 200,000토큰의 컨텍스트 창을 유지하고 향상된 안전성과 에이전트 능력을 제공합니다.
구글, 100만 토큰 컨텍스트를 지원하는 실험용 Gemini 2.5 Pro 추론 모델 출시
구글은 Gemini 2.5 패밀리 최초의 모델이자 지금까지 가장 강력한 추론 모델인 Gemini 2.5 Pro를 출시했습니다. 이 모델은 최대 100만 토큰의 입력 컨텍스트 윈도우(확장 계획 있음)를 특징으로 하며, 텍스트, 이미지, 오디오, 비디오를 포함한 멀티모달 입력을 지원하며, 현재 Gemini Advanced 플랜과 Google AI Studio를 통해 사용할 수 있습니다.
xAI, 추론 능력 향상 및 128K 컨텍스트를 갖춘 Grok-1.5 출시
xAI는 향상된 추론 기능과 최대 128,000개의 토큰을 지원하는 컨텍스트 창을 갖춘 새로운 모델인 Grok-1.5를 발표했습니다. 이 모델은 향후 며칠 내에 𝕏 플랫폼에서 초기 테스터 및 기존 사용자에게 제공될 예정입니다.
TelecomGPT-R1: 이종 Telecom 작업 전반의 추론을 위한 통합 사후 학습
연구자들은 표준, 구성 및 로그에 대한 추론을 통해 엔지니어링 작업을 자동화하도록 설계된 오픈소스 통합 telecom 추론 모델 패밀리인 TelecomGPT-R1을 소개합니다. 이 모델은 프로토콜, 지식, 모델링, 결함 축을 아우르는 구조화된 접근 방식을 통해 기존 범용 및 전문 LLM의 한계를 극복합니다.