Z.aiは8月14日、新型モデル「GLM-5.3」を、当初の予定通りオープンウェイトとして公開しないことを発表しました。同社は、安全性のレビューを行う間、あと2週間はモデルをAPIとサブスクリプションサービス経由でのみ提供し、一般公開(ダウンロード)を8月28日頃まで延期します。Z.aiによれば、この遅延は、モデルが予想以上に強力な攻撃的セキュリティ(offensive-security)能力を備えていたことに起因しており、モデルが自由にダウンロード可能になった場合、そのスキルが悪用される可能性があるとのことです。

なぜこの延期が重要なのか

GLM-5.3は、コーディング、長期的なエージェントタスク、およびサイバーセキュリティのスペシャリストとして位置づけられています。これまでのリリースでは、Z.aiはモデルのウェイトを即座に公開しており、自前のハードウェアで大規模言語モデル(LLM)を運用する開発者を引きつけてきました。しかし今回は、ダウンロードページの「Coming Soon」ボタンが即時アクセス用のリンクに取って代わっており、オープンな姿勢から慎重な姿勢への転換を物語っています。

内部テストの結果、モデルが予想よりも速いスピードで攻撃的セキュリティスキルを習得したことが判明し、安全チームが警告を発しました。Z.aiは、この公開保留を責任ある措置として説明しています。つまり、ウェイトがコピーされ、モデルがオフラインで実行可能になる前に、悪用のリスクを評価するための2週間のレビュー期間を設けるということです。

慎重なリリースへと向かう業界全体の潮流

最も有能なエージェントへのアクセスを制限する動きは、Z.aiに限ったことではありません。他の主要な3つの研究機関による最近の動向は、強力なツール利用型モデルを無制限に配布することには現実的なリスクが伴うという、業界内の共通認識の高まりを示しています。

  • OpenAIは現在、サイバーセキュリティに特化したモデルを使用するために本人確認を要求しており、クエリを実行できるユーザーを制限しています。
  • Anthropicは、最新の高性能モデルを社内に留め、管理されたインターフェースを通じてのみ提供しています。

これらの動きは、業界の焦点が、注目を集めるベンチマークスコアから、モデルが多段階の計画を実行し、外部ツールを操作し、エラーから回復する能力へとシフトしていることを示しています。こうした能力は、悪意のある攻撃者にとっても魅力的なものだからです。

何が懸かっているのか

もしウェイトが最終的にMITのような寛容なライセンスの下で公開されれば、セキュリティ研究者はモデルの手法を研究し、対抗策を開発し、その技術を防御ツールに組み込むことが可能になります。オープンソースでのリリースは、「透明性がコミュニティの脅威への対抗力を高める」という原則を強化することになるでしょう。

逆に、より制限的なライセンスが採用された場合、たとえオープンウェイトの熱烈な支持者であっても、モデルの実行権限を制限する必要があると考えているというシグナルになります。これは一つの前例となり、この分野を「API経由のアクセス」経済へと向かわせる可能性があります。

根本的なジレンマは解消されません。モデルファイルが一度公開されてしまえば、発行者はその後の悪用を止める手段を失うからです。2週間の安全レビューによってこのトレードオフが解消されるわけではありませんが、ガイドラインの策定や使用制限の組み込み、あるいはライセンスの調整を行うための時間は稼げます。

8月28日に注目すべき点

GLM-5.3の次なる展開を左右する、2つの具体的な論点があります。

  1. ウェイトは予定通り公開されるのか? もし期限が守られなければ、より深刻な技術的またはポリシー上の障壁があることを示唆しており、Z.aiがレビュー期間を延長する可能性があります。
  2. どのようなライセンスで公開されるのか? MITライセンスが維持されればオープンさの勝利となりますが、より制限的なライセンスへと移行すれば、エージェント型モデルに対する業界の締め付けが強まっていることが裏付けられることになります。

セキュリティ関連の研究を計画している開発者は、ウェイトが公開された際、実際の攻撃的なタスクでモデルをテストできるよう準備しておくべきでしょう。それによって、今回の遅延が単なる予防措置に過ぎなかったのか、あるいはモデルの能力が現在の防御ツールを真に凌駕しているというシグナルだったのかが明らかになります。

結論

GLM-5.3のウェイト公開を保留するというZ.aiの決定は、一つの転換点となります。強力なツール利用型言語モデルは、もはや会話の流暢さだけでなく、自動化できるアクションの幅広さによって評価されるようになっています。より多くの研究機関がエージェントとしての性能を優先するようになるにつれ、それらの能力が防御側に対して牙を剥くリスクが高まっています。今後数週間で、コミュニティがオープンな研究と悪用防止の必要性とのバランスを保てるのか、そして「オープンウェイト」が資産であると同時にリスクにもなり得る世界において、寛容なライセンスが存続できるのかが試されることになるでしょう。