今週のAIトレンド|安全対策の運用と規制解除が同時に動いた
今週の要点
編集判断で選び抜いた 5 本。
30 秒で読むなら
今週の AI 動向を 1 行ずつで把握。各項目をクリックすると元記事に飛びます。
- rDPOで過剰拒否を半減
重み不変・約30ステップで安全拒否率を53.74ポイント下げ、4領域だけ調整可能
- Fable 5が世界再開
輸出規制解除で7月1日再開、回避手法を99%以上遮断しOpus 4.8へ回送
- Claude CodeでCodex
競合環境内から公式プラグインで呼び出す二刀流、数コマンドで導入完了
- 行政調達指針2.0
デジタル庁が生成AI調達ガイドラインを改定、英語版と初版差分を同時公開
- 文書抽出を数分調整
見本3〜10件と正解値で指示文を自動改善、数週間の調整を数分へ短縮
トレンドの動きマップ
技術
AWSがrDPOを公開し、基盤モデルの重みを変えずLoRAアダプターのみ約30ステップで安全領域の拒否率を86.51%から32.77%へ53.74ポイント下げた
安全性を上げると拒否率が跳ね上がり、業務で使える回答が減る二律背反が固定化していた
安全とセンシティブ内容・公平性・セキュリティの4領域だけを調整でき、児童保護とプライバシー保護は変更不可で固定される。過剰拒否で使えなかった業務用途を、安全基盤を崩さず回収できる
市場
OpenAIがClaude Code内からCodexを呼べる公式プラグインcodex-plugin-ccを公開し、数コマンドで導入できるようになった
OpenAIとAnthropicのコーディング環境は分断され、片方を選ぶと他方の資産を使えなかった
コードレビュー・作業委任・反証レビューを1環境内で二刀流できる。ツール選定を『どちらか』でなく『両方の組み合わせ』で設計する起点になる
規制
6月30日の規制解除を受け7月1日に世界再開した。停止発端は6月12日にAmazonの研究者が安全対策回避手法を実証した報告で、新しい判定は該当手法を99%以上遮断しOpus 4.8へ回送する
Fable 5は輸出規制で全世界のユーザーへの提供が停止していた
手法はモデル固有でなく業界共通の脆弱性だった。単一製品の停止・再開が輸出規制と安全報告の連鎖で決まるため、調達側は依存製品の供給停止リスクを規制軸で確認する必要がある
深掘り
今日の一手
プロダクト担当者
試す: codex-plugin-ccをClaude Code検証環境へ数コマンドで導入し、コードレビュー・作業委任・反証レビューの3用途を各1回実行して所要時間を3列表(用途名・実行時間・出力品質メモ)で記録する
経営層
確認する: 自社が依存する外部AI製品を輸出規制・安全報告で供給停止しうる観点で洗い出し、製品名・提供元・代替可否・停止時影響の4列表で書き出す(選定基準=本番業務で利用中の上位5製品)
エンジニア
試す: rDPOの調整対象4領域(安全・センシティブ内容・公平性・セキュリティ)のうち自社で過剰拒否が起きる領域を特定し、業務名・拒否発生率・rDPO適用可否の3列表を作成する
一次情報の集約
公式発表・規制文書・深掘り記事のリンク集。