動察 Beating AI 速報、Anthropic CEO Dario Amodei は最近、METR のような第三者評価機関を長期的に最先端 AI 企業に常駐させ、従業員レベルの権限を取得して、安全対策、事故、モデル訓練プロセスを検査させるよう主張した。しかし『ニューヨーク・ポスト』の調査により、METR と Anthropic が属する AI 安全サークルの関係は、通常の「外部監査」よりもはるかに密接であることが判明した。
METR は当初 ARC Evals と呼ばれ、Paul Christiano が設立した Alignment Research Center から孵化した。Christiano は Amodei と OpenAI で同僚だっただけでなく、『ニューヨーク・ポスト』によれば二人はルームメイトだったこともある。彼は後に Anthropic Long-Term Benefit Trust の最初の5名の受託者の一人となった。METR の現技術者 Ajeya Cotra は Christiano の妻であり、以前は Coefficient Giving の AI 安全助成を担当していた。
より直接的な問題は METR 自身から来ている。今年、Anthropic、OpenAI、Google、Meta を評価した際、当時は適用される人員利益相反ポリシーがなく、正式な回避プロセスも行われていなかった。METR は、プロジェクトに直接参加した従業員と協力者の中で、少なくとも6人が AI 企業の従業員と密接な私的関係があることを開示した。
もちろん、これは METR が Anthropic に支配されていることを証明するものではない。METR は最先端 AI 企業およびその従業員からの資金を受け入れず、リスク評価も無料で行うと明言しているが、これらの企業は大量のモデル Token を無償で提供している。