動察 Beating AI 速報、Hugging Face は AI セキュリティ企業 Audn がアップロードした penclaw-GLM-5.3-abliterated-for-offensive-cyber を禁止しました。ページにはコンテンツポリシー違反と表示されています。このバージョンは GLM-5.3 の重みを直接変更し、モデルの拒否応答行動を弱めています。元のリポジトリ名と紹介には offensive cyber と明確に書かれていました。作者はその後これらの文字を削除し、モデルを再アップロードしました。
具体的になぜ禁止されたのか、Hugging Face は公に説明していません。作者は自分も理由がわからないと述べていますが、コミュニティでは offensive cyber という命名が審査をトリガーしたのではないかと推測されています。Hugging Face の現行ポリシーは確かに、システムの破壊、未承認アクセス、および悪意のあるコードの生成を目的としたコンテンツを禁止しています。
しかし、このようなモデルの拒否制限を弱めるバージョンは Hugging Face では珍しくなく、プラットフォーム上には既に数千の類似した abliterated モデルが存在します。