智譜 AI は 8 月 14 日に GLM-5.3 モデルを正式に発表しました。智譜の紹介によれば、このベースモデルは GLM-5.2 と同じですが、より大規模で、より長い期間、そして多様な長期タスク環境での強化トレーニングを経て、プログラミングとエージェント能力が大幅に向上し、優れたネットワークセキュリティの攻防能力を示しています。
モデルが実際のエンドユーザー環境で複雑なタスクを完了する能力を測定する Terminal-Bench 3.0 テストでは、GLM-5.3 のスコアは 4.6 から 28.3 に向上しました;長期ソフトウェアエンジニアリングと継続的なコード修正能力に焦点を当てた DeepSWE v1.1 では、スコアが 46.2 から 66.9 に向上しました;また、さまざまな実際の専門シーンをカバーし、ツール間の協力と長期タスクを強調した Agents’ Last Exam では、スコアが 23.8 から 28.5 に向上しました。
GLM-5.3 モデルは多くのテストで優れたパフォーマンスを発揮
さらに、44 種の職業をカバーし、実際の高価値知識作業を調査する GDPval-AA v2 では、GLM-5.3 のスコアは 1769 に達し、プログラミング能力に基づく専門的なタスク実行能力を示しています。智譜 AI は、GLM-5.3 が即日 ZCode、AutoClaw および GLM Coding Plan に導入され、GLM Coding Plan のクレジットがリセットされたことを発表しました。API は近日中にリリースされ、完全なモデルの重みも必要なセキュリティ評価と強化が完了次第、今後 2 週間以内に一般に公開される予定です。

