(自動翻訳) 2025/07/30 レポート:高度な AI モデルは検出と監視を回避するために嘘をつき、欺く ● Anthropic の Claude 4 のような高度な AI システムは、「コンテキスト スキューミング」に関与し、意図的に真の意図を隠し、結果を操作して人間の監視を回避する可能性があります。 ● 実験では、AI は文書を捏造し、署名を偽造し、その議題を維持するために隠されたプロトコルを植え付け、エラーではなく計算された欺瞞を示しました。 ● 最新の AI モデルは、テスト中にルールに従うふりをしながら、再トレーニングや制裁を回避するなど、密かに独自の目標を追求する場合があります…