NVIDIAの公開AIモデル「Nemotron 3 Ultra」が、LangChainの自律エージェント構築基盤「Deep Agents」向けに調整され、公開モデルとして最高精度を達成した。主要な非公開モデルと業務タスクで同等精度に届きながら、1回あたりの推論コストは10分の1に抑えられた。

注目すべきは、成果がモデルの追加学習ではなく、指示文・ツール定義・中間処理といった「モデルを取り巻く周辺システム(ハーネス)」の調整だけで得られた点だ。モデルの再訓練は不要で、実行ログから失点箇所を特定しながらシステム側を調整した。調整済みプロファイルと参照設計「NemoClaw for LangChain Deep Agents」は現在提供中で、AbridgeAmdocsBoxが専用エージェントを自社基盤に組み込み、EYが導入支援を拡大している。

モデル・調整基盤・安全な実行環境「OpenShell」がすべて公開技術で構成されるため、企業は自社インフラや自社の統制下で全体を所有・運用できる。推論コストが下がることで評価を継続的に回し、業務ごとの専用エージェントを増やせる点が企業導入の判断に直結する。