大規模言語モデル研究開発センター(LLMC)は2026年8月18日、約332億パラメータのDense型モデル「LLM-jp-4 33B」シリーズを公開した。ベースモデルと事後学習済みモデルの2種類を提供する。
LLMCはオープンで日本語に強い大規模言語モデルの開発を進めている。2026年4月に公開していた8Bおよび32B-A3Bモデルに続き、今回33Bクラスの新モデルを発表した。
公開されるのは事前学習と中間学習を終えたベースモデル「llm-jp-4-33b-base」と、教師ありファインチューニングや直接選好最適化による事後学習済みモデル「llm-jp-4-33b-thinking」の2種だ。同時にDPOに使用したデータセットも公開された。
評価フレームワーク「llm-jp-judge」による検証では、日本語MT-Benchや英語MT-Benchなど4つのベンチマークで、既存のLLM-jp-4 Thinkingモデルを上回るスコアを記録している。
詳細はリリース元のリンクから確認できる。
