Nvidia는 자체 신규 하네스인 AVO를 사용하여 ARC AGI-3 벤치마크에서 100%의 완벽한 점수를 달성했습니다. 기사는 OpenAI가 동일한 벤치마크 결과에 대해 이 표준 하네스를 사용하지 않았다고 지적합니다.
- Nvidia는 AVO 하네스를 사용하여 ARC AGI-3에서 100%를 달성했습니다.
- OpenAI는 ARC AGI-3 평가에 다른 비표준 하네스를 사용했습니다.
Nvidia는 자체 신규 하네스인 AVO를 사용하여 ARC AGI-3 벤치마크에서 100%의 완벽한 점수를 달성했습니다. 기사는 OpenAI가 동일한 벤치마크 결과에 대해 이 표준 하네스를 사용하지 않았다고 지적합니다.
| 벤치마크 | 모델 | 점수 |
|---|---|---|
| ARC-AGI 3 | Nvidia AVO | 100% |
NVIDIA는 ARC-AGI-3 벤치마크에서 완벽한 점수를 기록한 AVO 아키텍처를 출시했습니다. 이 시스템은 컨텍스트 관리, 도구 사용 및 상태 복구를 통해 장기 자율 에이전트를 지원하도록 설계되었습니다.
OpenAI는 Luna, Terra, Sol로 구성된 새로운 모델 사다리와 Max 및 Ultra 모드의 별도 노력 수준을 도입한 GPT-5.6을 출시했습니다. 이번 릴리스는 ChatGPT Work 및 Codex 인터페이스에 상당한 변화를 가져왔지만, 직관적이지 않은 탐색과 빠른 사용량 고갈에 대한 초기 사용자 반발을 겪었습니다.
OpenAI는 GPT-4.5 이후 최초의 완전히 재학습된 베이스 모델인 GPT-5.5를 출시했으며, 텍스트, 이미지, 오디오, 비디오를 위한 통합 아키텍처를 갖추고 있습니다. 이 모델은 증가된 성능에도 불구하고 낮은 지연 시간을 유지하기 위해 NVIDIA의 GB200 및 GB300 NVL72 시스템과 공동 설계되었습니다.
OpenAI는 공식적으로 GPT-6 Astra를 출시했으며, 이를 지금까지 가장 지능적이고 정렬된 모델로 포지셔닝했습니다. 롤아웃은 컴퓨터 사용, 소프트웨어 엔지니어링, 수학 및 과학, 사무 작업, 사이버 보안을 대상으로 합니다.
OpenAI는 채팅 모델이 아닌 컴퓨터 사용 시스템으로 주로 포지셔닝된 폐쇄형 호스팅 모델인 GPT-6 Astra를 출시했습니다. 이 모델은 브라우저, 스프레드시트, 터미널에서 소프트웨어를 작동하여 다단계 작업을 완료하며, 105만 토큰의 컨텍스트 윈도우와 2026년 4월 30일을 지식 컷오프로 지원합니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침