JetBrainsは10月8日、コーディングエージェント向けのMellum2.1をHugging Faceで公開した。ライセンスはApache 2.0。総パラメータ120億、推論時に計算へ入るのは25億のMoEで、アーキテクチャは6月に公開したMellum2のままである。同社は、Mellum2は速かったがリポジトリの中で求めたい水準まで働けなかったと説明している。
今回の差分はほぼ学習後にある。強化学習を短い仕上げから学習の本体へ移し、数学、競技プログラミング、科学、ツール使用、ソフトウェア工学の課題を足した。壊れたテストや検証できない答えは学習前に除いている。社内では数千の環境で、学習を通じて数百万のサンドボックスを起動した。
同じ条件でMellum2、Qwen3.5-9B、Gemma 4 E4Bと比べ、伸びが最も大きいのはエージェント的なコーディングだという。高負荷では比較した中で最も速く、Qwen3.5-9Bのほぼ2倍のトークンを出せる。単一リクエストではマルチトークン予測で約1.6倍になる。重みはHugging Faceにある。llama.cpp、Ollama、LM Studio向けのGGUFと、vLLMの投機的デコード用ヘッドはこれからである。大きいモデルの代わりに、手元で原因調査と修正確認を分けるサブエージェントとして使う判断材料になる。