MODELS / TRACKED TOPIC

Nemotron

NVIDIA Nemotronモデルとエージェント実行に関する記事。

08 STORIES

MODELS

Nemotronの新着記事

モデル一覧

RESEARCH / 04

Aleph Alpha、中国オープンウェイトLLMの政治的偏りを検証 — 967問ベンチマークで「バランスの取れた回答」は17〜41%

Aleph Alphaが2026年9月28日に公開した研究記事「Training on the Party Line」を一次情報に基づき整理。中国モデル6件の967プロンプト評価(17〜41%がバランス回答)、Nemotron Cascade 2の17%フラグとSFTデータ約930万行中の約3,500行の問題指摘、3つの対策提言を扱う。自社ベンチマークという留保付きの解説である。

AGENTS / 02

Hが汎用コンピュータ利用エージェント「Holo4」を公開 — 27Bと35B-A3B、OSWorld 2.0で27Bが61.7%と主張

Hcompanyが2026年9月28日に公開した汎用コンピュータ利用エージェントHolo4を一次情報(Hugging Face Blog)に基づき整理。27Bと35B-A3Bの2サイズ、OSWorld 2.0やAutomationBenchでのベンダー公表性能、Agentic Task Factoryによる約1万タスクでの学習、重み公開とH Models APIでの提供、Holotron4 Nanoを扱う。

COMPUTE / 06

llama.cpp v0.4.0公開 — Qwen3.8-Flash-Nextの初期対応と遅延テンソル読み込み、ggml 0.23.0へ更新

ローカルLLM推論エンジンllama.cppが2026年9月4日に安定版v0.4.0を公開。Qwen3.8-Flash-Next(qwen4exp)の初期アーキテクチャ対応、NVIDIA Nemotron-3-Puzzle-75B-A9BとNemotron 3.5のDSpark対応、遅延テンソル読み込み、スロット別コンテキスト上限、動画入力オプション、ggml v0.23.0(スパースflash attention・Apple RDMA)への更新を含む。

MODELS / 01

NVIDIA、エージェント実行層向けオープンモデル「Nemotron 3.5 Lightning」を公開 — 30B MoE・3Bアクティブで最大4倍の出力速度

NVIDIAが2026年8月11日、エージェントの実行層に特化したオープンモデル「Nemotron 3.5 Lightning(30B-A3B)」を公開した。アーキテクチャ、速度と精度の両立手法、公表されたベンチマーク、ライセンス、提供形態を一次情報に基づいて整理する。