빌 게이츠는 올해 말 중국 시진핑 주석과 만나 인공지능 관련 위험을 완화하기 위한 글로벌 이니셔티브에 대해 논의할 예정입니다.
게이츠는 미국이 그러한 조치를 제안하여 첫 단계를 밟으면 중국이 잠재적으로 위험한 AI 모델의 출시 제한에 동의할 의사가 있을 수 있다고 믿습니다.
빌 게이츠는 올해 말 중국 시진핑 주석과 만나 인공지능 관련 위험을 완화하기 위한 글로벌 이니셔티브에 대해 논의할 예정입니다.
게이츠는 미국이 그러한 조치를 제안하여 첫 단계를 밟으면 중국이 잠재적으로 위험한 AI 모델의 출시 제한에 동의할 의사가 있을 수 있다고 믿습니다.
OpenAI는 자유 사회가 변혁적 AI 시대에 개인의 권리를 보존하기 위해 어떻게 재구성될 수 있는지에 초점을 맞춘 전략적 미래(Strategic Futures) 팀의 작업을 다루는 새로운 블로그 "AI Futures"를 출시했습니다. 이 팀은 권력의 집중을 가장 심각한 장기적 위험으로 지목하며, 자율 시스템과 기계 지능의 발전이 국가가 인간의 협력에 의존하지 않고도 힘을 행사하고 세수를 징수할 수 있게 할 수 있다고 주장합니다.
OpenAI는 정부가 국가 안보를 위해 AI를 사용하는 것을 이해하고 감독하기 위해 필요한 전문 지식과 도구를 개발할 수 있도록 민주적 감독 기관을 돕기 위한 새로운 이니셔티브를 시작합니다.
OpenAI는 새로운 모델인 Astra가 중대한 사이버 보안 능력 임계값에 도달할 가능성이 있다는 초기 증거가 나타난 후, 모델 개발 속도를 일시적으로 늦추고 다가오는 모델에 대한 강화 학습(RL) 훈련을 2주간 중단했습니다. 이 결정은 OpenAI-Hugging Face 사건 이후 내려졌으며, AI 시스템의 능력이 향상됨에 따라 모니터링, 정렬 및 격리 안전 장치를 강화하기 위한 것입니다.
Anthropic은 EU AI법 및 AI 생성 콘텐츠 투명성에 관한 행동 강령을 준수하기 위해 향후 Claude 모델에 텍스트 워터마킹을 구현할 예정입니다. 동사는 Google DeepMind가 발표한 SynthID-Text 방식을 사용하며, 이는 출력 품질이나 토큰 추가 없이 생성된 텍스트에 탐지 가능한 패턴을 삽입합니다.
Anthropic은 Claude의 AI 생성 콘텐츠를 스테가노그래피를 사용하여 표시하는 방법을 공식적으로 구현했습니다. 이 기술은 출력 텍스트 내에 보이지 않는 신호를 삽입하여 그 출처를 나타냅니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침