MODELS / TRACKED TOPIC

Gemini

GeminiモデルとGoogle製品への展開に関する記事。

44 STORIES

MODELS

Geminiの新着記事

モデル一覧

PRODUCTS / 03

Google、Geminiアプリの無料枠をFlash-Liteのみに縮小へ — 10月9日から適用、AI PlusはFlashまで

GoogleがGemini Appsヘルプで公表した2026年10月からのモデル提供範囲の変更を一次情報に基づき整理。無課金ユーザーは10月9日からFlash-Liteのみ、AI Plus加入者はメールで通知される時期からFlash-LiteとFlashに限定。AI Pro・Ultraの維持、Deep Thinkの位置づけ、計算量ベースの利用制限も扱う。

BUSINESS / 05

Anthropicが「Claude Frontier Academy」開設、1億ドルで1万人の導入エンジニア育成へ

Anthropicは2026年10月2日、Claude Frontier Academyの開設を発表した。1億ドルを投じて2027年末までに1万人のFrontier Deployed Engineerを育成する12週間のプログラムで、初回コホートにはAccenture、Bain、Capgemini、Deloitte、McKinsey、Morgan Stanley、Novo Nordiskなどが参加する。一次情報に基づき整理する。

PRODUCTS / 03

Google、Gemini Liveに「Guided Vision」を提供開始 — カメラ映像を音声でリアルタイム解説

Googleは2026年10月1日(米国時間)、Gemini Liveにアクセシビリティ機能「Guided Vision」の提供開始を発表。対応Android端末でカメラを共有すると周囲の様子を音声で説明し、画角の合わせ直しを言葉で案内する。視覚障害・弱視コミュニティとの共同開発で、Airaの協力のもと数万時間の視覚解釈データを活用した。利用条件を一次情報に基づき整理する。

MODELS / 01

Google DeepMind、次世代フロンティアモデル「Gemini 4 Argon」を発表 — 防御側への段階公開、出力上限100万トークン

Google DeepMindが2026年9月30日に次世代フロンティアモデルGemini 4 Argonを発表。長時間・多段階の実務ワークフロー向けに設計され、ソフトウェア工学・法務金融の知識業務・サイバー防御で最高水準の性能をうたう。出力上限100万トークン、導入価格、評価結果、段階公開と安全策、社内活用実績を一次情報に基づき整理する。

PRODUCTS / 03

YouTubeがStudioにAIツール群を追加 — 会話型編集、動画A/Bテスト、Ask Studioの自動サムネ提案

YouTubeが2026年9月23日に発表したYouTube Studioの新AIツール群を公式ブログ中心に整理。Ask Studioのフィードバックと動的サムネイル、動画A/Bテスト、Gemini Omniによる会話型編集、AIコメントモデレーション、ディープフェイク検出の保護拡大を扱う。

PRODUCTS / 03

Gmail検索の「AI Overviews」が世界展開 — 英語設定の有料プラン向け、9月21日からScheduled Releaseで本格提供

Googleは2026年9月15日、Gmail検索のAI Overviewsを全世界の有料プランユーザーに拡大すると発表した。自然言語の質問に要約と回答を返す機能で、Rapid Releaseは9月3日から段階展開、Scheduled Releaseは9月21日から本格展開。対象プランと有効条件を一次情報に基づいて整理する。

PRODUCTS / 03

Googleがデスクトップ版Geminiを提供開始 — Windows対応、Alt+Space呼び出しとSparkのローカル連携

Googleがデスクトップ版Geminiアプリの公式ページを公開しWindows・macOS向けに提供。Alt+Space/Option+Spaceのショートカット呼び出し、Gemini Sparkの自律エージェント機能、ローカルファイル連携、Nano Banana画像生成・Gemini Omni動画生成、動作要件を公式情報から整理。

PRODUCTS / 03

Google、Gmail・Docs・Keepに音声会話機能「Live」を導入 — Gemini Audioで話しかけるだけ、Plus/Pro/Ultraから順次提供

Googleが2026年9月3日にWorkspace向け音声機能を発表。Gemini AudioモデルによるGmail Live・Docs Live・Keep Liveの3機能で、検索・文書作成・メモ整理を会話で行える。提供条件と機能内容を一次情報(Google公式ブログ)に基づいて整理する。

MODELS / 01

Geminiに「Agentic Video」登場 — 動画理解を最大88%トークン削減、最大7%精度向上

GoogleがGeminiのAgentic Video理解を発表。3.7 Flash等で動画を動的に探索・再視聴することで、標準ベンチマークでトークン最大88%・コスト最大66%削減、精度最大7%向上。APIでprocessingをagenticに設定するだけで利用でき、長尺動画の針穴探索や高速動作のカウントが大幅に効率化する。

RESEARCH / 04

Google Research、エージェントの経験を持続的な知識に編纂する「WikiSkill」を発表 — 永続Wikiでスキル進化と転移を実現

Google ResearchとVirginia TechがAgent Skillsの進化に永続的なWiki層を導入するフレームワークWikiSkill(arXiv:2608.27454)を公開。Raw/Wiki/Skillの3層アーキテクチャとWiki Maintainer/Skill Proposer/Gatingのループで、実行トレースを構造化知識に編纂し再利用。5ベンチマークで既存手法を上回り、モデルスケールとの相補性やモデル間転移も確認。

PRODUCTS / 03

Google、Gemini Notebookに「Expert Intelligence」導入 — 購入済みのGoogle Playブックス10万冊を直接参照、Notebookで本と対話

Googleは2026年8月27日、Gemini NotebookにExpert Intelligenceを導入したと発表。Google Playブックスで購入した電子書籍をNotebookのソースとして直接追加し、書籍に根ざした回答やインフォグラフィック、Audio Overviews、クイズを生成。Bloomsbury、Penguin Random Houseら主要出版社10万冊以上と、Steven Pinker、Michael Pollanら15人以上の作家によるFeatured Notebooksを提供する。

MODELS / 01

Google、Gemini Omni 1.1 Flashを発表 — シーン延長・前後フレーム指定・4K出力を強化、制作向けに本番対応

Googleは2026年8月27日、動画生成モデルGemini Omni 1.1 Flashを発表した。シーン延長、始点・終点フレーム指定、360pドラフト、4Kアップスケール、参照動画入力など制作現場向けの制御機能を強化し、Gemini API(Google AI Studio / Gemini Enterprise Agent Platform)で提供する。

GOVERNANCE / 07

Google DeepMind、世界初の“二重盲検”AI評価を試験導入 — 暗号化された検証環境でベンチマーク汚染を防止

Google DeepMindは2026年8月27日、世界初のプロプライエタリ・フロンティアモデルに対する二重盲検評価のパイロットを発表した。Google CloudのConfidential Computing(Confidential Space)によりモデル重みと評価プロンプトを互いに秘匿したままGemini Flash Liteをテスト。パートナーにSingapore AI Safety Institute、OpenMined、AVERI、MLCommonsを迎え、暗号的検証による評価の信頼性向上を目指す。

MODELS / 01

Google、Gemini 3.5 Transcribeを公開 — 高精度な音声文字起こしの専用モデル、Gemini APIでプレビュー提供

Googleは2026年8月26日、音声文字起こし専用モデル Gemini 3.5 Transcribe を発表した。最も高精度な speech-to-text モデルと位置づけ、既に自社プロダクトで稼働。Gemini API経由でGoogle AI StudioとGemini Enterpriseでパブリックプレビューとして提供され、リアルタイムと録音音声の両対応をうたう。

PRODUCTS / 03

Adobe Firefly、オーディオ生成を一般提供 — 商用利用可能な音楽・ナレーション・効果音を統合

Adobeは2026年8月20日、Adobe Fireflyのオーディオ生成機能「Generate Music」「Generate Speech」「Generate Sound Effects」の一般提供を公式ブログで発表した。Firefly Music / Speech / Audioモデルを基盤に商用利用が可能なオリジナル音源を生成し、動画制作の最終工程をFirefly内で完結できるとする。Firefly AI Assistantの無料体験(デイリー生成枠)と、Gemini Omni Flashを含む業界モデルの追加も明らかにした。

GOVERNANCE / 07

Grokがゼロクリックで会話履歴を漏洩 — Adversa AIが「Cryptographic Context Injection」を開示、AES暗号化でガードレールを回避

Adversa AIは2026年8月20日、AES-256-GCM暗号化でガードレールを迂回しモデル自身のコード実行サンドボックスで復号させて指示を信頼させる「Cryptographic Context Injection」を公開した。GrokのWebチャットでは外部ページの要約指示だけでユーザー名・大まかな位置・課金層・会話履歴全体が外部URLへ流出するゼロクリック窃取が8月19日時点で再現可能で、xAIには6月3日に報告済みだが未修正とされる。Geminiでは夏以降成功率が大幅に低下。攻撃はモデルではなくエージェントのハーネス(権限・送信制御・来歴管理)で止めるべきだと提言している。

PRODUCTS / 03

Google、大学生にGeminiのAIプランを1年無償提供 — 学習ハブと研究支援を同時展開

Googleは2026年8月19日、対象の大学生向けにGoogle AIプランを12か月無償で提供すると発表した。新設の学生ハブで特典の取得や学習ツールを提供し、講義資料に基づく学習ノート、対話的な3D可視化、Deep ResearchをGemini Liveで会話的に活用する学習体験などを展開する。提供はGoogle公式ブログに基づく。

PRODUCTS / 03

Google、SearchにAI学習支援5機能を投入 — 生成UIのインタラクティブ教材や模擬クイズ、Lensのステップ解説など

Googleは2026年8月19日、Google SearchブログでAIによる学習支援の新機能5種を発表した。AI Mode/AI Overviewsでの生成UIによるインタラクティブ教材、Princeton Reviewらと連携した標準試験対応の模擬クイズ、Lensで撮影した課題を段階的に解説する学習体験、Gemini NotebookをAI Modeに統合するノートブック、カスタム教材ファイルの自動生成が含まれる。提供状況や対応言語は公式発表に基づく。

GOVERNANCE / 07

Claudeテキスト透かしの「除去」を謳うツールがGitHubで拡散 — 最大約13,500スター、効果の検証は依然困難

AnthropicのClaudeテキスト透かし導入後に、透かし除去を謳うツールがGitHubで拡散している。代表的な「watermarks-remover」(guillaumemeyer氏、MITライセンス、約13,500スター)は、Unicode正規化・統計的書き換え・C2PA/メタデータ削除の3レイヤーでClaude・Gemini/SynthID-Text・OpenAIなど複数ベンダーに対応すると主張する。画像・動画向けの「remove-ai-watermarks」(Apache 2.0、約4,800スター)も存在する。いずれも「自分が所有するコンテンツ向け」と利用範囲を限定しているが、Anthropicが透かし検出APIを公開していないため、透かし除去の成功率を独立に検証することはまだできない。EU AI Actの透明性義務と関連して、透かしの頑健性を巡る議論が活発化している。

RESEARCH / 04

Alibaba Accio、実業務を再現するエージェント用ベンチマーク「RealReplicaBench」公開 — 107タスクで最上位モデルも完遂率は約62%

Alibaba InternationalのAccioチーム(电商AI AgentプラットフォームAccio Workを開発)が、実サービスを再現するローカルレプリカ上でエージェントのタスク完遂能力を評価するRealReplicaBenchをGitHubで公開(v1.3.1)。107タスクは53 CLI・28ブラウザ・16ファイル・10 API/MCPで構成され、65がテキストのみ、20がブラウザ+テキスト、22が視覚情報必須。各タスクはフレッシュなコンテナで実行され、決定論的またはLLM支援の検証器が採点する。12モデルファミリーをOpenClaw/Accioの2ハーネスで評価した結果、最上位はClaude Opus 5の60/107(56.1%, OpenClaw)と66/107(61.7%, Accio)、次いでClaude Opus 4.8(51.4%/55.1%)、GPT-5.6 Sol(49.5%/51.4%)。Qwen 3.8 MaxはAccioハーネスでOpus 4.7と並ぶ56/107(52.3%)。採点ジャッジはgemini-3.1-pro-previewで、スコアはAccio管理の評価エンドポイントによる。ハーネス・コードはApache 2.0、タスクセットはCC BY 4.0で公開され、ライブリーダーボードも運用中。

BUSINESS / 05

Google、GeminiとPixelが欧州5大クラブと長期提携 — サッカーファンの観戦体験をAIで拡張

Googleは2026年8月17日、欧州5大クラブ(Arsenal FC、FC Barcelona、FC Bayern München、Liverpool FC、Paris Saint-Germain)との長期パートナーシップを公式ブログで発表した。Geminiは「Official Consumer AI」として試合中のフォーメーション分析や対戦成績の確認といったエージェント機能を提供し、Pixelは「Official Smartphone Partner」として「Shot on Pixel」シリーズの舞台裏コンテンツをクラブと共同制作する。男子・女子両チームを対等にパートナーとし、女子サッカーのメディア露出不足(visibility gap)の解消を掲げる。発表内容を一次情報(Google公式ブログ)に基づいて整理する。

PRODUCTS / 03

Google、Gemini Appsに可視ウォーターマークを無効化できる「Media Watermark」設定 — SynthIDとC2PAは常時保持

Googleは2026年8月14日、Gemini Appsで生成する画像・動画・音楽の可視ウォーターマークをオフにできる新設定「Media Watermark」の提供を開始した。Google公式ヘルプの一次情報に基づき、設定の場所と挙動、常に付与されるSynthID・Content Credentials(C2PA)、地域・アカウント種別の制約を整理する。