MODELS / 01
Reflectionが501Bオープンモデル「Beam」を発表 — 23BアクティブMoE、推論効率3〜4倍を主張
Reflection AIが2026年10月5日に発表したオープンウェイトモデルBeam(501B総パラメーター・23BアクティブのMoE)を公式ブログの一次情報から整理する。ベンチマーク公称値、100Mロールアウトの強化学習、公開スケジュールを解説。
TAG / TOPIC
「コーディング」に関するAIニュースと解説記事の一覧です。
17 STORIES
LATEST STORIES
MODELS / 01
Reflection AIが2026年10月5日に発表したオープンウェイトモデルBeam(501B総パラメーター・23BアクティブのMoE)を公式ブログの一次情報から整理する。ベンチマーク公称値、100Mロールアウトの強化学習、公開スケジュールを解説。
MODELS / 01
Google DeepMindが2026年9月30日に次世代フロンティアモデルGemini 4 Argonを発表。長時間・多段階の実務ワークフロー向けに設計され、ソフトウェア工学・法務金融の知識業務・サイバー防御で最高水準の性能をうたう。出力上限100万トークン、導入価格、評価結果、段階公開と安全策、社内活用実績を一次情報に基づき整理する。
MODELS / 01
OpenAIが2026年9月29日のDevDay 2026でGPT-6.1 Solを発表。エージェント型コーディング、computer use、専門業務でGPT-6 Astraに迫る性能を標準価格の5分の1で提供する。DeepSWE v1.1、GDP.pdf、AutomationBench、OSWorld 2.0、Terminal-Bench Science 0.1の評価結果、価格、提供形態、安全性評価を一次情報に基づき整理する。
MODELS / 01
Anthropicが2026年9月28日に公開したClaude Sonnet 5.5を一次情報に基づき整理。Sonnet 5比の速度・コスト改善、Terminal-BenchやGDPval-AAなどのベンダー公表評価、初のSonnet向けサイバーセーフガード、GitHub Copilotでの一般提供を含む提供条件を扱う。
MODELS / 01
Anthropicが2026年9月22日に公開したClaude Opus 5.5を一次情報に基づき整理。Fable 5.1級の性能とOpus 5比40%のコスト削減、ベンダー公表ベンチマーク、外部評価と行動監査、Fable 5.1相当のセーフガード、提供条件を扱う。
MODELS / 01
xAIが2026年9月21日にAPI提供を開始したGrok 4.7(grok-4.7)の仕様・価格・推論設定を、xAI公式ドキュメントの一次情報から整理する。50万文脈、画像入力、4段階reasoning effort、200K超の2段階料金を解説。
AGENTS / 02
Anthropicが2026年9月17日にClaude CodeのProjects再設計を発表。コーディネーターが並列スレッドへ作業を委任し、PR作成・テスト実行まで担当。各スレッドは独自ブランチを持つクラウドセッションで、共有メモリとライブラリを備える。ベータはPro・Maxのクラウドセッション利用者から開始し、Team・Enterpriseは後日。
PRODUCTS / 03
Slackは2026年8月20日、AIエージェントとチームが同じチャンネルで計画・実装・レビューを進める「Slack Code」を公開した。エージェントをメンションするとタスク専用のcode channelが自動生成され、コード差分やライブHTMLプレビューをその場で共有、完了後は自動アーカイブされる。Anthropic Claude、Devin、GitHub Copilot、Vercelと連携しChatGPTは近日対応。Slackの権限と管理統制を継承し、高リスク変更はチャンネル内で承認を挟める。社内利用では70%超のcode channelが1日以内に生成からマージまで完結したとする。
BUSINESS / 05
OpenAIは2026年8月18日の公式ブログで、ワークマネジメント企業AsanaによるCodexの導入事例を紹介した。AsanaはCodexを使って古いテストシステムを2週間で置き換え、従来は約5年かかると見積もられていた作業を約1万2,000ドルで完了したとされる。OpenAIの公表によるベンダー事例であり、数値は同社の発表に基づく主張として整理する。AIエージェントによる大規模なレガシーコード刷新の可能性と、その限界の両面が話題になっている。
AGENTS / 02
オープンソースのAI駆動開発エージェント「OpenHands」が2026年8月18日(日本時間)、v1.14.0をリリースした。Canvasのエラー結果表示・LLMプロファイルの事前検証・Git同期ページなどを一次情報(GitHubリリースノート)に基づいて整理する。
AGENTS / 02
GitHubは2026年8月6日、Moonshot AIのオープンウェイトモデル「Kimi K3」をGitHub Copilotで提供開始した。8月13日公開の週次リリースでも全プランへの展開が言及されている。提供範囲、価格、管理者向けの有効化手順を一次情報(GitHub Changelog)に基づいて整理する。
MODELS / 01
Microsoftは2026年8月11日、小型コーディングモデル「MAI-Code-1.1-Flash」をGitHub Copilotで提供開始した。画像理解への対応、性能改善、価格低減、旧モデルMAI-Code-1-Flashの非推奨化スケジュールを一次情報(Microsoft AI・GitHub Changelog)に基づいて整理する。
AGENTS / 02
xAIは2026年8月14日、最新コーディングモデル「Grok 4.6」をGitHub Copilotで提供開始した。エージェント的コーディングと複雑なマルチステップワークフロー向けの設計で、8つの開発サーフェスで段階的に展開される。提供範囲と利用条件を一次情報(xAI公式・GitHub Changelog)に基づいて整理する。
MODELS / 01
Z.ai(Zhipu AI)が2026年8月14日、コーディング特化モデル「GLM-5.3」を公開した。GLM-5.2と同じベースモデルから事後学習のみで性能を引き上げ、コーディングと脆弱性発見の両方で大きな改善を報告している。一次情報(Z.ai公式ブログ・公式ドキュメント)に基づき、公表されたベンチマーク、サイバー能力の扱い、提供形態を整理する。
AGENTS / 02
オープンソースのAI駆動開発エージェント「OpenHands」が2026年8月13日、v1.13.0をリリースした。会話アーカイブ、マークダウンアーティファクトのプレビュー、コンテキストウィンドウ使用量メーターなどの新機能を一次情報(GitHubリリースノート)に基づいて整理する。
AGENTS / 02
Anthropicが2026年8月14日から、Claude CodeのAuto ModeをPro/Max/Teamプランのデフォルト設定にする。分類器の仕組み、Anthropicが公表した安全性テストの結果、クラウド各社への展開予定を一次情報に基づいて整理する。
MODELS / 01
xAIが2026年8月12日、フロンティアモデル「Grok 4.6」を公開した。APIの仕様・料金、長期エージェント向けの設計、Cursor/Grok Buildでの提供状況を一次情報に基づいて整理する。