ビル・ゲイツ氏は、今年後半に中国の習近平国家主席と会談し、人工知能に関連するリスクを軽減するためのグローバルな取り組みについて議論する意向です。
ゲイツ氏は、米国がそのような措置を提案して最初のステップを踏み出せば、中国は潜在的に危険なAIモデルの公開に対する制限に同意する可能性があると考えています。
ビル・ゲイツ氏は、今年後半に中国の習近平国家主席と会談し、人工知能に関連するリスクを軽減するためのグローバルな取り組みについて議論する意向です。
ゲイツ氏は、米国がそのような措置を提案して最初のステップを踏み出せば、中国は潜在的に危険なAIモデルの公開に対する制限に同意する可能性があると考えています。
OpenAIは、変革的なAIの中で個人の権利を維持するために自由な社会をどのように再構築できるかに焦点を当てている戦略的将来予測チームの作業に専念した新しいブログ「AI Futures」を立ち上げた。同チームは、権力の集中が最も深刻な長期的リスクであると特定し、自律型システムと機械知能の進歩により、国家が人間の協力に頼らずとも力を行使し収益を集めることが可能になると主張している。
OpenAIは、政府が国家安全保障のためにAIを使用することを理解し監視するために必要な専門知識とツールを開発するよう、民主的な監視機関を支援する新しいイニシアチブを開始しています。
OpenAIは、新モデル「Astra」が重要なサイバーセキュリティ能力の閾値を満たす可能性があるという予備的な証拠を受け取り、モデル開発のペースを一時的に遅らせ、今後公開されるモデルに対する強化学習(RL)トレーニングを2週間停止した。この決定はOpenAIとHugging Faceのインシデントを受けて下され、AIシステムの能力が向上するにつれて、監視、アライメント、封じ込めの安全策を強化することを目的としている。
Anthropicは、EU AI法およびそのAI生成コンテンツの透明性に関する行動規範への準拠のため、将来のClaudeモデルでテキスト透かしを実装する。同社はGoogle DeepMindが公開したSynthID-Text手法を使用し、出力品質や追加トークンに影響を与えることなく、生成されたテキストに検出可能なパターンを埋め込む。
Anthropicは、ClaudeのAI生成コンテンツをステガノグラフィを使用してマーキングする手法を正式に実装しました。この技術は、出力テキスト内に不可視の信号を埋め込み、その起源を示します。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー