Anthropic's Claude는 Lean을 사용하여 11일 만에 페르마의 마지막 정리에 대한 첫 번째 완전한 컴퓨터 검증 증명을 성공적으로 생성했으며, OpenAI는 2028년 3월까지 자동화된 AI 연구자를 개발할 계획을 발표했습니다.

  • 클로드는 29,500개의 중간 정리를 증명하고 형식적 검증을 위해 1300만 줄의 코드를 생성했습니다.
  • OpenAI는 정렬과 보안을 보장하기 위해 인간의 감독으로 연구 효율성을 향상시키기를 목표로 합니다.
  • GPT-6 Astra는 로봇 조작 능력을 시연하여 20번의 시도 중 19번에서 그릇 작업을 완료했습니다.
  • Grok Imagine Video 1.5 agent는 Image 2.0을 사용하여 더 높은 품질의 스토리텔링을 제공합니다.

이러한 발전은 복잡한 수학 공식화와 자율 연구 워크플로우에서 AI의 증가하는 역할을 강조합니다.