アントロピックが先駆的な安全誓約を放棄: 何が変わったのか、そしてなぜそれが重要なのか?

まとめ

  • アントロピックは安全性に関する誓約を緩和した。
  • 同社はこれまで開発を厳しく凍結してきたが、今後は透明性を高めるという約束に取って代わられる。
  • この動きにより、業界の安全基準が低下する可能性がある。

AIエージェントClaude( 私たちのお気に入りの生産性ツールその主な特徴の 1 つは、安全性に対する揺るぎない取り組みです。 ブログ投稿同社は、責任ある拡大方針 (RSP) とバージョン 3.0 に含まれる変更点を概説しました。

アントロピックが先駆的な安全誓約を放棄: 何が変わったのか、そしてなぜそれが重要なのか?

Anthropic の以前の安全ポリシーは何でしたか?

同社は安全性の保証に関する業界標準を確立した。

Anthropicが行っている変更を理解するには、同社の当初のResponsible Scaling Policy(RSP)を理解する必要があります。2023年、Anthropicは、AIモデルの能力が安全性を実証できる能力を超えた場合、AIモデルのトレーニングを停止することを誓約しました。この停止のきっかけとなる可能性のある安全性に関する危険信号には、以下が含まれます。

  • 化学兵器、生物兵器、核兵器の作成または配備に役立つ可能性のあるモデル。
  • 自分を過剰に向上させることができるモデル。
  • サイバー攻撃に役立つモデル。
  • シャットダウンを回避するために環境から「脱出」するなど、人間の介入なしに特定の方法で動作できるモデル。

責任ある拡大方針(RSP)は、これらのモデルに厳しい上限を課しました。アントロピックは、たとえ競合他社に追い抜かれても開発を中止しました。誰もが猛スピードで競争しているように見える業界において、これは大胆な姿勢でした。

アントロピックの新しい責任ある拡大方針(RSP)

バージョン3.0ではルールが大幅に緩和されました。

アンスロピックは依然として責任ある拡張の方針を維持していますが、バージョン3.0では、競合他社に対して既に大きな優位性があると判断した場合にのみ開発を中止します。開発中止の拘束力のある約束は、安全目標を達成し、競合他社の安全性と同等かそれ以上の安全性を実現しているかどうかに関する透明性の約束に置き換えられました。言い換えれば、実質的には安全性に関する誓約を交わしたと言えるでしょう。

これらの変更のきっかけは何だったのでしょうか?アントロピック社は、当初の安全誓約(RSP)は期待した効果を上げなかったと述べています。RSPは、他社が追随すべき安全の模範となることを目的としていました。しかし残念ながら、競合他社はこのシグナルに耳を傾けませんでした。同社は、自社の取り組みを制限することで、安全意識の低い競合他社が市場を独占し、開発のペースを左右することを許していると考えています。

これは業界にとって何を意味するのでしょうか?

大きな後退

残念ながら、これらの変更は人工知能分野において悪い前例となる可能性があります。アントロピックは安全対策のゴールドスタンダードでしたが、今回の変更によりハードルが大幅に引き下げられました。これは、安全性よりもイノベーションが優先されるというメッセージを競合他社に送ることになります。これはクロードにとって役立つかもしれませんが、 ChatGPTの最新情報しかし、それはまだ間違った方向への一歩のように思えます。

結局のところ、AI悲観論者の懸念を払拭するには、一企業による安全性の誓約だけでは不十分です。業界全体が団結し、明確な一線を画す必要があります。しかし、現段階では、それが実現する可能性はますます低くなっています。

トップボタンに移動