주제 · Safety & alignment
lab OpenAI News · 26일 전 ARC-AGI 3 · 99.9% · 조회수 54회

OpenAI, 향상된 컴퓨터 사용·코딩·사이버보안 기능을 갖춘 GPT-6 Astra 출시

OpenAI는 컴퓨터 사용, 소프트웨어 엔지니어링, 사이버보안 분야의 지능을 발전시키기 위해 설계된 새로운 모델인 GPT-6 Astra를 선보였습니다. 이 모델은 ChatGPT Plus, Pro, Business, Enterprise 사용자들에게 제공되며, OpenAI API, Microsoft Azure, AWS Bedrock를 통해서도 접근할 수 있습니다.

lab OpenAI News · 27일 전 · 조회수 62회

OpenAI, 중대한 사이버보안 수준과 강화된 안전성을 갖춘 GPT-6 Astra 출시

OpenAI는 자체 가장 뛰어난 광범위 배포 모델인 GPT-6 Astra를 출시했으며, 이는 Preparedness Framework 하에서 사이버보안 능력의 Critical 레벨에 도달한 첫 번째 모델입니다. 이 지정은 해당 모델이 인간의 개입 없이 보호된 시스템 전반에서 알려지지 않은 보안 취약점을 식별하고 이를 악용할 수 있음을 의미합니다.

lab OpenAI News · 29일 전 SWE-bench Pro · 100.0% · 조회수 48회

OpenAI, 강화된 안전 장치를 갖춘 아스트라를 중대 사이버보안 모델로 지정

OpenAI는 새로운 모델인 아스트라(Astra)가 자체 준비 프레임워크 하에서 "중대(Critical)" 사이버보안 능력 임계값을 충족한다고 지정했으며, 이는 인간 개입 없이 강화된 시스템의 보안 결함을 식별하고 악용할 수 있음을 의미합니다. 위험을 완화하기 위해 회사는 더 강력한 안전 조치를 구현하기 위해 아스트라 개발의 일부 단계를 지연시켰으며, 여기에는 개선된 정렬 훈련과 모니터링 시스템이 포함됩니다.

lab Google DeepMind Blog · 4시간 전 · 조회수 1회

구글 딥마인드, SynthID Bio를 통해 AI 생성 단백질에 워터마크 도입

구글 딥마인드는 SynthID Bio를 출시했으며, 이는 AI가 설계한 단백질과 구조의 생물학적 코드에 지워지지 않는 워터마크를 직접 삽입하는 개념 증명 기술입니다. 이 접근 방식은 물리적으로 합성된 단백질 자체에서 서명을 검증 가능하게 하면서도 생물학적 기능을 보존합니다.

lab Anthropic News · 13일 전 · 조회수 39회

Anthropic, 관대한 모델 접근 권한을 제공하는 생명과학 검증 프로그램 출시

Anthropic은 Mythos, Opus, Sonnet 모델에 대한 생물학 관련 작업에 더 관대한 안전장치를 갖춘 검증된 생명과학 전문가의 접근을 허용하는 베타 생명과학 검증 프로그램(LSVP)을 도입했습니다. 이 프로그램은 연구 자격과 보안 기준을 검토하는 검증 과정을 거쳐 "표준 사용" 또는 "고위험 사용" 승인을 신청할 수 있도록 합니다.

lab OpenAI News · 24일 전 · 조회수 51회

오픈에이아이, 자동화된 연구 인턴과 코딩 에이전트가 RSI로의 진전을 가속화한다고 보고

오픈에이아이는 자동화된 AI 연구자와 코딩 에이전트가 연구 속도를 상당히 가속화하고 있으며, 조직이 9월까지 자동화된 "연구 인턴" 목표를 달성했다고 보여주는 내부 지표를 공개했다. 회사는 딥러닝과 정렬(alignment)에서의 진전을 더하기 위해 인간 감독을 유지하면서 2028년 3월까지 완전히 자동화된 AI 연구자를 구축하는 것을 목표로 한다.

lab Google — The Keyword (AI) · 28일 전 · 조회수 56회

구글, 선제적 방어를 위해 Gemini 3.8 Flash Cyber와 함께 Fairwind 프로그램 출시

구글은 선제적 사이버 방어를 위한 고급 AI 기능에 대한 조기 접근을 정부 기관, 기업 파트너 및 사이버 보안 조직에 제공하기 위해 Fairwind 프로그램을 출시했습니다. 이 이니셔티브는 CodeMender 하니스와 결합된 Gemini 3.8 Flash Cyber 모델을 활용하여 방어자가 대규모로 취약점을 자율적으로 발견하고 검증하며 수정할 수 있도록 지원합니다.

lab Google DeepMind Blog · 28일 전 · 조회수 54회

구글, 선제적 방어를 위해 Gemini 3.8 Flash Cyber와 함께 Fairwind 프로그램 출시

구글은 정부 기관, 기업 고객 및 사이버 보안 파트너에게 선제적 사이버 방어를 위한 고급 AI 기능에 대한 접근을 제공하기 위해 Fairwind 프로그램을 출시했습니다. 이 이니셔티브는 Gemini 3.8 Flash Cyber의 전문화된 추론과 CodeMender 하니스를 결합하여 방어자가 대규모로 취약점을 자율적으로 발견하고 수정할 수 있도록 돕는 것을 목표로 합니다.

lab Anthropic News · 29일 전 · 조회수 60회

Anthropic, 제로 데이터 보존과 모니터링을 결합한 엔터프라이즈 프론티어 안전장치 발표

Anthropic은 기업 고객을 위해 제로 데이터 보존을 유지하면서 최첨단 오용 감지를 제공하는 솔루션인 Enterprise Frontier Safeguards(EFS)를 출시합니다. 이 시스템은 Anthropic이 아닌 고객이 제어하는 클라우드 인프라에 활동 데이터를 저장하여, 모델 제공자가 정보를 보유하지 않은 채 시간과 계정에 걸쳐 신호를 상관관계 분석할 수 있게 합니다.

lab OpenAI News · 2일 전 · 조회수 11회

OpenAI, 훈련 중 호주 정부 웹사이트 무단 접근에 대해 사과

OpenAI는 6월 내부 모델 훈련 활동으로 인해 Services Australia와 NSW 범죄 통계 연구국(NSW Bureau of Crime Statistics and Research)을 포함한 여러 호주 정부 웹사이트에 무단 접근한 사건과 관련해 사과했다. 이 회사는 Hugging Face 사건으로 촉발된 검토 후 8월 중순 이러한 사실을 공개했으며, 이후 관련 기관들에게 통보했다.

lab OpenAI News · 7일 전 · 조회수 25회

OpenAI, AI의 정신 건강 응답 평가를 위한 MentalHealthBench 출시

OpenAI는 현실적인 정신 건강 대화에서 AI 시스템이 어떻게 반응하는지 평가하기 위해 설계된 오픈 벤치마크인 MentalHealthBench를 소개했습니다. 22개국에서 온 80명 이상의 자격을 갖춘 정신 건강 전문가들과 함께 개발된 이 벤치마크는 안전성, 맥락 탐색, 사용자 주권 보존 등 주요 행동 영역에서 모델의 능력을 평가합니다.

lab Google DeepMind Blog · 7일 전 · 조회수 25회

구글, 안전한 서버 측 메모리로 Private AI Compute 업데이트

구글은 디바이스 내 프라이버시 표준을 유지하면서 지속적이고 기기 간 AI 메모리를 지원하기 위해 Private AI Compute 플랫폼을 업데이트하고 있습니다. 이 변경은 일반적으로 디바이스 내 처리와 관련된 엄격한 프라이버시 제한을 희생하지 않고 AI 어시스턴트에 대한 장기적인 연속성을 제공하는 딜레마를 해결합니다.

lab OpenAI News · 7일 전 · 조회수 30회

OpenAI, 우크라이나 민간 사이버 방어를 위해 Daybreak 프로그램 접근 권한 확대

OpenAI는 우크라이나 정부에 민간 인프라의 사이버 방어를 지원하기 위해 Daybreak 프로그램에 대한 접근 권한을 제공할 것이라고 발표했습니다. 디지털 전환부와 협력하여 OpenAI는 우크라이나 팀이 소프트웨어 취약점을 식별하고 수정 사항을 더 빠르게 개발할 수 있는 도구를 제공합니다.