COMPANIES / TRACKED TOPIC

NVIDIA

AIモデル、GPU、推論基盤と開発環境に関する記事。

29 STORIES

COMPANIES

NVIDIAの新着記事

企業一覧

MODELS / 01

Liquid AI、エッジ向けオープンウェイト決定モデル「d1-3B」「d1-omni-600M」を公開 — トークン生成なしの単一フォワードパスで回答

Liquid AIが2026年10月7日に公開したオープンウェイト決定モデルd1-3Bとd1-omni-600Mを公式ブログ・Hugging Faceの一次情報から整理。単一フォワードパス回答の設計、Decision Indexや7種テキストベンチマークの公称値、NVIDIA・AMD・Apple・Jetsonでのレイテンシ、llama.cpp対応とライセンス上の注意を扱う。

RESEARCH / 04

Aleph Alpha、中国オープンウェイトLLMの政治的偏りを検証 — 967問ベンチマークで「バランスの取れた回答」は17〜41%

Aleph Alphaが2026年9月28日に公開した研究記事「Training on the Party Line」を一次情報に基づき整理。中国モデル6件の967プロンプト評価(17〜41%がバランス回答)、Nemotron Cascade 2の17%フラグとSFTデータ約930万行中の約3,500行の問題指摘、3つの対策提言を扱う。自社ベンチマークという留保付きの解説である。

MODELS / 01

NVIDIA、表データ特化の基盤モデル「Kumo Tabular」を公開 — 学習不要で分類・回帰を予測

NVIDIAが表データ向けオープンファウンデーションモデルKumo TabularをHugging Faceで公開。学習・調整・特徴量エンジニアリングなしに分類と回帰を予測し、TabArena、BeyondArena、TALENT、ScoringBenchで1位を報告。3サイズ、合成データ事前学習、OpenMDW-1.1ライセンス、制約を一次情報に基づき整理する。

COMPUTE / 06

NVIDIAが「Open Agent Safety Platform」を発表 — OpenShellとSentryでエージェントにフルスタックの安全境界

NVIDIAが2026年9月28日に発表したOpen Agent Safety Platformを一次情報(公式プレスリリース)に基づき整理。オープンソースのOpenShell実行時境界、BlueField-4上のSentryによるミリ秒単位の隔離、Vera CPUとの組み合わせ、参画企業、AnthropicのManaged Agentsとの連携を扱う。

RESEARCH / 04

NVIDIA・MITら、コーディングエージェントのトークン消費を半減させるハーネス「SoL-Pi」を公開 — 自動研究ループで発見

NVIDIA・NTU・MITが2026年9月17日にarXivで公開したSoL-Pi(arXiv:2609.20519)を一次情報に基づき整理。再帰的自己改善に着想を得たハーネス層の自動研究、選抜された4機構、51タスクEdgeBenchでの評価結果、NVlabsの公開コードを扱う。査読前のプレプリントである点に注意。

COMPUTE / 06

Cisco、SplunkのAI新機能群を発表 — エージェント可観測性×Tokenomics、NVIDIA連携のオンプレAI、AWSと共同開発

CiscoはSplunk年次イベント.conf26でSplunk AIの新機能群を発表した。エージェント性能とトークン支出を可視化するAgent Observability+Tokenomics、NVIDIAと組んだオンプレ向けAI基盤、自社モデル持ち込み対応、エージェント型SOC拡張、AWSとの共同開発契約が柱。Ciscoニュースルームのプレスリリースに基づく。

AGENTS / 02

Agility Roboticsが人型ロボット「Digit 5」を発表 — 安全柵なしの協働作業へ、早期アクセスは2027年前半

Agility Roboticsが2026年9月15日に人型ロボット「Digit 5」を発表。安全柵への依存を減らす安全アーキテクチャ、NVIDIA IGX ThorとHalos for Roboticsとの連携、可搬・充電・到達性のハード改善、6.5万時間超の稼働実績、3億ドル超の受注、2027年の提供計画を一次情報に基づき整理する。

MODELS / 01

Alibaba・Qwen、自動運転向け視覚言語基盤モデル「Qwen-Drive-1.0」を公開 — 3D知覚・対話・軌道計画を単一モデルに統合、Apache 2.0

AlibabaのQwenチームと華中科技大学が公開した自動運転向け視覚言語基盤モデルQwen-Drive-1.0を一次情報(GitHub・Hugging Face・技術レポート)に基づき整理。BEV知覚ヘッドと計画エキスパートの構成、NAVSIM・Waymo・NVIDIA PhysicalAIでの計画性能、運転VQAと汎用VQAの評価値を扱う。

COMPUTE / 06

llama.cpp v0.4.0公開 — Qwen3.8-Flash-Nextの初期対応と遅延テンソル読み込み、ggml 0.23.0へ更新

ローカルLLM推論エンジンllama.cppが2026年9月4日に安定版v0.4.0を公開。Qwen3.8-Flash-Next(qwen4exp)の初期アーキテクチャ対応、NVIDIA Nemotron-3-Puzzle-75B-A9BとNemotron 3.5のDSpark対応、遅延テンソル読み込み、スロット別コンテキスト上限、動画入力オプション、ggml v0.23.0(スパースflash attention・Apple RDMA)への更新を含む。

COMPUTE / 06

NVIDIA、無料のローカル推論ルーター「PAIR」ベータを公開 — 自宅のRTX・DGX Spark・Macを束ねて単一エンドポイント化

NVIDIAが2026年9月3日にPersonal AI Router(PAIR)ベータを公開。自宅のRTX PC・DGX Spark・MacをプライベートなローカルAIクラスタとして束ね、OllamaやLM Studioの推論要求を単一エンドポイントで振り分ける無料ツール。要件・仕組み・提供形態を一次情報に基づいて整理する。

COMPUTE / 06

NVIDIA、MediaTekに35億ドル出資 — 転換社債でAIエッジからクラウドまで協業を深化

NVIDIAとMediaTekは2026年8月31日、AIインフラ、ローカルAIコンピューティング、車載の3領域で協業を深化すると発表した。MediaTekはNVIDIA NVLink Fusionを採用し、ハイパースケーラー向けのカスタムXPU開発基盤を提供。NVIDIAはMediaTek発行の転換社債35億ドルを引き受ける。GB10 Grace Blackwell Superchipを搭載するDGX Sparkや、将来のAI定義車両まで含めたエッジからクラウドのAIプラットフォーム構築が狙い。

COMPUTE / 06

中国・清昴智能、AIが自らを最適化する「自進化AI Infra」を展開 — 国産チップ向けの開発・適応を約30〜336倍高速化と公表

清昴智能は2026年8月18日付の量子位(QbitAI)の取材記事で、AIが自らを最適化する「自進化AI Infra」の取り組みを詳報した。複雑なオペレーターの開発・調整を約2週間→約1時間(約336倍)、モデルの国産チップ向け全スタック適応を約30倍に高速化したとする。技術は清華大学・朱文武教授研究室の「自己駆動機械学習(Self-Driven Machine Learning)」が源流で、主力のMLGuiderはNVIDIAに加え昇騰・寒武紀などの国産チップをサポート。北京市の算力センターなどで実績を積み、トークン生産の「工場」を自社運営するビジネスも始めている。

COMPUTE / 06

Groq、3.5億ドルを調達 — 評価額35億ドル、NVIDIA参加予定。AIチップ専業から「ネオクラウド」へ戦略転換を加速

Groqは2026年8月17日、3.5億ドルの資金調達を発表した。リード投資家はDisruptiveで、NVIDIAの参加が予定されている。評価額は35億ドル。6月の6.5億ドル調達と合わせ直近の調達額は10億ドルに達し、13か所のデータセンターでNVIDIA基盤の推論クラウド事業を展開する。LPU(Language Processing Unit)の開発・運用で知られた同社は、NVIDIA Cloud Partnerとしてアクセラレーテッドコンピューティングの設計・運用認証を受け、2027年に54MWから200MW超への拡張を計画している。調達は慣例的なクロージング条件に従うとされる。

COMPUTE / 06

OpenAI、オハイオ州「PORTS-Pike」プロジェクトに正式参加 — 約8 GW-ITのAIデータセンターをSB Energy・NVIDIA・DOEと共同開発

OpenAIが2026年8月17日、オハイオ州パイク郡のPORTS-Pike Technology Campusで約8 GW-ITのAIデータセンター容量を確保する合意を公式発表した。SB Energyが建設・所有・運用しOpenAIへ20年リース、NVIDIAが独占AIコンピュート提供者として初期4.25 GW-ITに信用支援(残り3.75 GW-ITはオプション)を供与。SB Energy/ソフトバンクによる最低10GWの新規発電とAEP Ohioとの最低42億ドルの送電網投資、当初8,000万ドルのコミュニティ基金とOpenAIの追加4,000万ドル拠出など、8月14〜16日に報じられた巨額保証報道の対象とみられた計画が正式な形で発表された内容を一次情報に基づき整理する。

COMPUTE / 06

NVIDIA、OpenAI向けオハイオ州10GWデータセンターで約1,000億ドルの信用保証に合意間近 — 当初の2,500億ドルから縮小(The Information・WSJ報道)

The Informationは2026年8月15〜16日、NVIDIAがOpenAIのオハイオ州データセンター計画に対し約1,000億ドルの信用保証を提供する合意に近づいていると報じた。WSJは8月14日、当初約2,500億ドルとされた保証規模を1,200億ドル未満に縮小する形で取引を再構成したと報道。SB Energy(ソフトバンク傘下)開発の10GW級キャンパスを対象に、NVIDIAは最大30億ドルの出資も協議中とされる。報道記事(The Information・WSJ)と公開済みの一次情報(OpenAI公式発表)に基づき、保証額の変遷とプロジェクト概要を整理する。

BUSINESS / 05

NVIDIA、SEC 13FでSpaceX株を約210億ドル・Intel株を約300億ドル保有と開示 — 株式ポートフォリオが634億ドルに急拡大

NVIDIAは2026年8月14日、SECに四半期の株式保有報告書(13F-HR)を提出した。基準日2026年6月30日時点でSpaceXを約209億7600万ドル、Intelを約299億8900万ドル保有していることが開示された。SEC EDGARに提出された一次情報に基づき、保有銘柄の内訳と前四半期からの変化を整理する。

MODELS / 01

NVIDIA、エージェント実行層向けオープンモデル「Nemotron 3.5 Lightning」を公開 — 30B MoE・3Bアクティブで最大4倍の出力速度

NVIDIAが2026年8月11日、エージェントの実行層に特化したオープンモデル「Nemotron 3.5 Lightning(30B-A3B)」を公開した。アーキテクチャ、速度と精度の両立手法、公表されたベンチマーク、ライセンス、提供形態を一次情報に基づいて整理する。