タグ: 大規模言語モデル
- AI
国立情報学研究所、国産LLM「LLM-jp-4.1」を公開 約332億パラメータまで3モデル 外部ツールの呼び出しに新対応、学習量は前シリーズの約3倍
国立情報学研究所の大規模言語モデル研究開発センター(LLMC)は9月28日、日本語に強い大規模言語モデル「LLM-jp-4.1」シリーズを公開した。約86億パラメータ、約320億パラメータ、約332億パラメータの3モデルで、いずれもApache License 2.0で配布する。2026年4月から順次公開している「LLM-jp-4」シリーズの事後学習を作り直したもので、改良点はSTEM分野の性能向上、外部のプログラムやAPIを呼び出す「ツール呼び出し」への新規対応、回答の簡潔化の3点。事後学習の総学習量は約350億トークンで、前シリーズの約3倍に増えた。APIとチャットサービスは東京大学が運用する「mdx-MaaS」を通じて10月中旬頃から段階的に募集を始める。