中国の人工知能(AI)開発企業、北京智譜華章科技(
02513)は14日、大規模モデル最新版の「GLM-5.3」を発表した。前世代のGLM-5.2と比べ、基盤モデルは変更していないものの、複雑なコーディングや長期間にわたるタスクの処理能力が向上。コーディング能力では、GLM-5.3が現在最も高性能なオープンソースモデルだとした。同社の「Z.ai Code Bench」テストでは、性能がGLM-5.2比で50%向上した。『信報』が同日伝えた。
また、「Terminal Bench 3.0」や「Agents' Last Exam」などの公開ベンチマークテストでも、オープンソースモデルの中で最高水準の成績を達成した。うち、コーディングとAIエージェントの能力は米アンソロピックの最上位モデル「Claude Fable 5」に迫り、プログラミングの実用面での体感性能は他の中国製モデルを上回るとしている。
サイバーセキュリティー能力については、ポストトレーニング(事後学習)の規模拡大に伴い、想定を上回るスピードで能力が向上したと説明した。GLM-5.3は、リスク度を測定する「CyberGym」のテストでほかのモデルを上回る成績を示したほか、攻撃の初期段階で対処する能力の向上が特に顕著だった。攻撃に関するベンチマークテストでは、GLM-5.2の2倍以上の性能を示したとしている。
同社は発表から2週間後にGLM-5.3のモデル重み(モデルの学習済みパラメーター)を公開する計画を明らかにした。それまでに安全評価とモデル強化を完了する。