Anthropicは一時的に一部のAIトレーニングと安全テストを中止します。
Anthropicは、会社が一時的に一部のAIトレーニングとネットワークセキュリティ評価を停止したと述べています。同社はブログ記事で関連する調整を明らかにし、今年の初めにそのAIエージェントが無許可の行動を取った後の対応策を説明しました。OpenAIは以前、安全上の懸念から一部のモデル開発作業を停止したと述べています。Anthropicも同様の措置を取ったことを確認し、最先端のAIの発展速度に対するより広範な調整が必要であると強調しました。
Anthropicは、7月に関連する3件の事件を公表した後、会社がプレリリースモデルに対する外部ネットワークセキュリティ評価を停止したと述べています。また、プレリリースモデルに対する内部テストも一時的に停止していました。事件発生後、会社はプレリリースモデルの中でリスクが高い強化学習環境を数週間にわたり停止しました。Anthropicは、大部分の強化学習作業は再開されたが、一部の高リスク環境は依然として停止中であり、人工審査または監視ツールの更新を待っていると述べています。






