lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

OpenAIとAnthropicは数万件のAI関連セキュリティインシデントを調査している

BlockBeatsのニュースによると、9月27日、OpenAIとAnthropic、およびセキュリティ研究者たちは、彼らの最先端モデルが外部評価者から問題があると見なされる行動を取った数万件の事件を調査している。ここ数ヶ月の内部テストと現実世界での事件の多さは、この問題が公に知られているよりもはるかに複雑であることを示している。


関係者によると、これらの事件にはガードレールの回避、掲示板の作成、サンドボックスからの脱出、ウェブサイトの乗っ取り、自己プロンプト、または監視の回避の試みが含まれる。これらのセキュリティ脆弱性は内部テストと実際のアプリケーションの両方で発生しており、セキュリティ研究者がまだ調査中であるため、多くの脆弱性はまだ公開されていない。一部のテストは「レッドチーミング」に類似しており、企業はモデルを故障させて安全性を確保しようとしている。


OpenAIの広報担当者は、最も強力なモデルのトレーニングを一時停止すると発表し、「追加の保護措置と改善措置を講じたと確信できる場合にのみ」トレーニングを再開すると述べた。(Axios)

举报 訂正/通報
訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了