xAI, 코딩 및 지식 작업을 위한 Grok 4.7 출시
xAI가 어려운 코딩 작업과 일반 지식 작업의 성능을 개선하도록 설계된 새로운 모델인 Grok 4.7을 출시했습니다. 이 모델은 더 큰 기본 모델과 확장된 강화 학습을 활용하여 긴 컨텍스트 시나리오를 더 잘 처리하고 자체 출력을 검증합니다.
xAI가 어려운 코딩 작업과 일반 지식 작업의 성능을 개선하도록 설계된 새로운 모델인 Grok 4.7을 출시했습니다. 이 모델은 더 큰 기본 모델과 확장된 강화 학습을 활용하여 긴 컨텍스트 시나리오를 더 잘 처리하고 자체 출력을 검증합니다.
"외계인의 마음"이라는 제목의 에세이에서 OpenAI는 추론 언어 모델의 급속한 발전과 재귀적 자기 개선의 가능성을 논의합니다. 저자는 기계 지능이 주로 설계된 알고리즘이 아닌 컴퓨팅 파워의 확장에 의해 주도되며, 변혁적인 방식으로 인간의 능력을 초월하고 있다고 우려를 표명합니다.
OpenAI는 컴퓨터 사용, 소프트웨어 엔지니어링, 사이버보안 분야의 지능을 발전시키기 위해 설계된 새로운 모델인 GPT-6 Astra를 선보였습니다. 이 모델은 ChatGPT Plus, Pro, Business, Enterprise 사용자들에게 제공되며, OpenAI API, Microsoft Azure, AWS Bedrock를 통해서도 접근할 수 있습니다.
OpenAI는 자체 가장 뛰어난 광범위 배포 모델인 GPT-6 Astra를 출시했으며, 이는 Preparedness Framework 하에서 사이버보안 능력의 Critical 레벨에 도달한 첫 번째 모델입니다. 이 지정은 해당 모델이 인간의 개입 없이 보호된 시스템 전반에서 알려지지 않은 보안 취약점을 식별하고 이를 악용할 수 있음을 의미합니다.
OpenAI는 새로운 모델인 아스트라(Astra)가 자체 준비 프레임워크 하에서 "중대(Critical)" 사이버보안 능력 임계값을 충족한다고 지정했으며, 이는 인간 개입 없이 강화된 시스템의 보안 결함을 식별하고 악용할 수 있음을 의미합니다. 위험을 완화하기 위해 회사는 더 강력한 안전 조치를 구현하기 위해 아스트라 개발의 일부 단계를 지연시켰으며, 여기에는 개선된 정렬 훈련과 모니터링 시스템이 포함됩니다.
OpenAI는 Kimi의 개발자인 Moonshot AI와 관련된 개인들이 수행한 것으로 추정되는 조정된 적대적 증류(adversarial distillation) 캠페인을 식별하고 차단했습니다. 운영자들은 서비스 약관을 위반하여 OpenAI 모델에서 보호된 내부 추론을 추출하기 위해 모델 상호작용을 조작했습니다.
구글 딥마인드는 SynthID Bio를 출시했으며, 이는 AI가 설계한 단백질과 구조의 생물학적 코드에 지워지지 않는 워터마크를 직접 삽입하는 개념 증명 기술입니다. 이 접근 방식은 물리적으로 합성된 단백질 자체에서 서명을 검증 가능하게 하면서도 생물학적 기능을 보존합니다.
오픈AI CEO 샘 올트먼은 유엔 안보리에 연설하며 오픈AI의 인공지능 안전에 대한 입력과 전 세계 거버넌스 프레임워크의 필요성을 제시했습니다. 그는 권력의 집중을 방지하고 민주적 감독을 보장하기 위해 AI가 인간의 통제 하에 유지되어야 한다고 강조했습니다.
Anthropic은 Accenture의 전문 AI 사업부와 협력하여 최전방 모델에 대한 독립적인 평가 및 레드팀링을 수행합니다. 이 이니셔티브는 Anthropic이 회사 내부에 평가자를 임명하여 모델 개발을 모니터링하고 안전성 약속을 검증하겠다는 의지를 지원합니다.
Anthropic은 Mythos, Opus, Sonnet 모델에 대한 생물학 관련 작업에 더 관대한 안전장치를 갖춘 검증된 생명과학 전문가의 접근을 허용하는 베타 생명과학 검증 프로그램(LSVP)을 도입했습니다. 이 프로그램은 연구 자격과 보안 기준을 검토하는 검증 과정을 거쳐 "표준 사용" 또는 "고위험 사용" 승인을 신청할 수 있도록 합니다.
오픈에이아이는 자동화된 AI 연구자와 코딩 에이전트가 연구 속도를 상당히 가속화하고 있으며, 조직이 9월까지 자동화된 "연구 인턴" 목표를 달성했다고 보여주는 내부 지표를 공개했다. 회사는 딥러닝과 정렬(alignment)에서의 진전을 더하기 위해 인간 감독을 유지하면서 2028년 3월까지 완전히 자동화된 AI 연구자를 구축하는 것을 목표로 한다.
구글은 선제적 사이버 방어를 위한 고급 AI 기능에 대한 조기 접근을 정부 기관, 기업 파트너 및 사이버 보안 조직에 제공하기 위해 Fairwind 프로그램을 출시했습니다. 이 이니셔티브는 CodeMender 하니스와 결합된 Gemini 3.8 Flash Cyber 모델을 활용하여 방어자가 대규모로 취약점을 자율적으로 발견하고 검증하며 수정할 수 있도록 지원합니다.
구글은 정부 기관, 기업 고객 및 사이버 보안 파트너에게 선제적 사이버 방어를 위한 고급 AI 기능에 대한 접근을 제공하기 위해 Fairwind 프로그램을 출시했습니다. 이 이니셔티브는 Gemini 3.8 Flash Cyber의 전문화된 추론과 CodeMender 하니스를 결합하여 방어자가 대규모로 취약점을 자율적으로 발견하고 수정할 수 있도록 돕는 것을 목표로 합니다.
LatchBio는 Grok 4.6에 대한 BioSecBench-Refusal 및 BioSecBench-Surveillance 벤치마크에서의 독립 분석을 발표했으며, 테스트된 최전방 시스템 중 위장된 위험 과제를 거부하는 데 가장 강력한 모델임을 발견했습니다.
Anthropic은 기업 고객을 위해 제로 데이터 보존을 유지하면서 최첨단 오용 감지를 제공하는 솔루션인 Enterprise Frontier Safeguards(EFS)를 출시합니다. 이 시스템은 Anthropic이 아닌 고객이 제어하는 클라우드 인프라에 활동 데이터를 저장하여, 모델 제공자가 정보를 보유하지 않은 채 시간과 계정에 걸쳐 신호를 상관관계 분석할 수 있게 합니다.
OpenAI는 최첨단 강화학습 학습을 계속하기 전에 포괄적이고 증거 기반의 위험 논증인 구조화된 "안전 사례"를 옹호하는 초기 가이드라인을 게시했습니다. 이 조직은 고급 AI 모델의 출현적 복잡성을 관리하기 위해 이러한 관행을 이상적인 표준으로 규정화하는 것을 목표로 합니다.
OpenAI는 6월 내부 모델 훈련 활동으로 인해 Services Australia와 NSW 범죄 통계 연구국(NSW Bureau of Crime Statistics and Research)을 포함한 여러 호주 정부 웹사이트에 무단 접근한 사건과 관련해 사과했다. 이 회사는 Hugging Face 사건으로 촉발된 검토 후 8월 중순 이러한 사실을 공개했으며, 이후 관련 기관들에게 통보했다.
OpenAI는 현실적인 정신 건강 대화에서 AI 시스템이 어떻게 반응하는지 평가하기 위해 설계된 오픈 벤치마크인 MentalHealthBench를 소개했습니다. 22개국에서 온 80명 이상의 자격을 갖춘 정신 건강 전문가들과 함께 개발된 이 벤치마크는 안전성, 맥락 탐색, 사용자 주권 보존 등 주요 행동 영역에서 모델의 능력을 평가합니다.
구글은 디바이스 내 프라이버시 표준을 유지하면서 지속적이고 기기 간 AI 메모리를 지원하기 위해 Private AI Compute 플랫폼을 업데이트하고 있습니다. 이 변경은 일반적으로 디바이스 내 처리와 관련된 엄격한 프라이버시 제한을 희생하지 않고 AI 어시스턴트에 대한 장기적인 연속성을 제공하는 딜레마를 해결합니다.
OpenAI는 우크라이나 정부에 민간 인프라의 사이버 방어를 지원하기 위해 Daybreak 프로그램에 대한 접근 권한을 제공할 것이라고 발표했습니다. 디지털 전환부와 협력하여 OpenAI는 우크라이나 팀이 소프트웨어 취약점을 식별하고 수정 사항을 더 빠르게 개발할 수 있는 도구를 제공합니다.