AI 평가 포럼(AI Evaluator Forum)이 접근성, 이해상충, 자금 관계, 기피, 투명성을 아우르는 독립적인 제3자 AI 평가를 위한 제안된 기준선인 AEF-1을 발표했습니다. 이 표준은 Dario Amodei가 프론티어 AI 기업들에게 임베디드 제3자 평가자들이 직원과 유사한 지속적인 접근 권한을 갖도록 약속할 것을 요구하는 제안과 함께 등장했습니다.
- AEF-1은 이해상충 및 자금 관련 규칙을 포함한 독립성에 대한 요구사항을 수립합니다.
- Anthropic은 사무실 책상과 내부 도구 포함, 안전 팀에 unparalleled(비할 데 없는) 접근성을 제공하기로 단방적으로 약속했습니다.
- 광범위한 논의에는 진전 속도 조절 versus 통제와 봉쇄에 집중하라는 주장이 포함됩니다.
- GitHub는 Copilot/Codex 워크플로우에 자동 모델 선택 계층을 추가했습니다.
- Cline은 오픈 가중치 모델을 작업하기 위한 네이티브 데스크톱 앱을 출시했습니다.
AEF-1의 발표는 업계 내에서 공식화된 자기 규제와 독립적 검증을 향한 움직임을 시사합니다.