最新動向

Z.aiがGLM-5.3 Flashを公開 MITライセンスのオープン重み

Z.aiがGLM-5.3 Flashを公開 MITライセンスのオープン重み

この記事の要点

Z.aiが2026年8月26日にGLM-5.3 Flashを公開した。3200億パラメータのうち1トークンあたり180億だけを使う設計で、重みはMITライセンス。API料金は100万トークンあたり0.15ドルからと安い。

結論

中国のZ.aiが、2026年8月26日にオープンなAIモデル「GLM-5.3 Flash」を公開した。3200億パラメータのうち1トークンあたり180億だけを使う設計で、重みはMITライセンスでHugging Faceに置かれている。API料金は100万トークンあたり入力0.15ドル、出力0.50ドルと安い。文脈は約104万トークンまで扱える。安く動く強いオープンモデルが、また1つ選択肢に加わった。

何が公開されたのか

GLM-5.3 Flashは、全体では大きいが1回の処理で使う部分を絞る作りだ。総パラメータは3200億で、1トークンごとに動くのは180億にとどまる。これにより、規模の割に動作の負荷を抑えられる。標準でFP8という軽い精度で動き、扱える文脈は1,048,576トークンに達する。重みはMITライセンスで公開され、条件の範囲で自社利用や改変ができる。

Z.aiが示したベンチマークでは、コードやエージェント系の指標が前世代のGLM-5.2から伸びたとされる。開発課題を解くDeepSWE v1.1は46.2から63.4へ、自動化を測るAutomationBenchは26.2から48.8へ、Terminal-Bench 3.0は4.6から28.3へ上がったという。長い手順を要するエージェント作業ではClaude Opus 4.8に近づくとされ、価格は競合の10分の1程度と主張している。ただしこれらの数値はすべてZ.aiが自ら公表したもので、第三者が同じ条件で再検証したものではない。開発元の最良ケースとして扱い、最新は公式で確認してほしい。オープンモデル全体の流れはオープンソースLLMの動向と企業利用のポイントにまとめている。

現場の実務にどう効くか

安いオープンモデルが増えることは、AIの費用を下げたい企業に直接効く。すべての処理を高価な商用モデルに投げる必要はない。分類、要約、抽出、下書きのような処理は、安いモデルでも品質が保てる場面が多い。GLM-5.3 Flashのような選択肢が増えるほど、処理ごとに最適なモデルを割り当てる余地が広がる。

長い文脈を扱える点も実務では効く。約104万トークンまで一度に読めるなら、長い契約書や複数の社内文書をまとめて渡し、横断して要約や照合をさせやすい。分割して何度も投げる手間が減り、文書間の矛盾も見つけやすくなる。ただし、扱える文脈が長いことと、長文で精度が保たれることは別の話だ。重要な用途では、自社の文書で実際に試して確かめる必要がある。

ただしオープンモデルは、自前で動かすなら相応のGPU資源が要る。重みが公開されていても、そのまま安く動かせるとは限らない。自社運用と外部APIのどちらが得かは、処理量と運用体制で変わる。判断の型はSLM自前運用 vs クラウドAPI:コスト比較の考え方で整理している。料金全体の下がり方は生成AIのコスト低下と普及の流れ 企業への影響、費用が高いと感じたときの見直し方は生成AIのコストが高いと感じたときの見直し方を参照してほしい。

出典

よくある質問

GLM-5.3 Flashは自社で使えるのか

重みがMITライセンスでHugging Faceに公開されており、条件の範囲で自社利用や改変が可能です。ただし実行には相応のGPU資源が要ります。

公開された性能値は信頼してよいのか

ベンチマークの数値はZ.aiが自ら公表したもので、第三者機関が同条件で再検証したものではありません。あくまで開発元の主張として扱うのが安全です。