MCPがOpenAI・Google公式採用——AIエージェント連携の業界標準が事実上決定
リード Anthropicが2024年11月に公開したModel Context Protocol(MCP)を、OpenAIとGoogle DeepMindが2026年7月4日(日本時間)に相次いで公式サポートすると発表した。主要3社が同一規格に乗ることで、AIエージェント連携の標準争いは事実上終結したとみられる。企業システムへのAI組み込みコストが大幅に下がる分岐点になる可能性がある。 何が起き...
リード Anthropicが2024年11月に公開したModel Context Protocol(MCP)を、OpenAIとGoogle DeepMindが2026年7月4日(日本時間)に相次いで公式サポートすると発表した。主要3社が同一規格に乗ることで、AIエージェント連携の標準争いは事実上終結したとみられる。企業システムへのAI組み込みコストが大幅に下がる分岐点になる可能性がある。 何が起き...
リード AnthropicがClaude Sonnet 5を2026年6月30日に正式公開した。「数か月前まで大規模で高コストなモデルが必要だった水準の自律性を、Sonnetクラスのコストで実現した」というのが公式の主張だ。標準API価格は入力$3・出力$15/百万トークン(9月1日以降)。エージェントをプロダクション規模で動かす際のコスト計算が根本から書き換わる可能性がある。 何が起きているのか...
リード Mistral AIが2026年7月3日(現地時間)、新フラッグシップ「Mistral Large 3」を正式公開した。文脈窓128Kトークン・34言語対応に加え、EU AI法「汎用AIモデル(GPAI)」条項に対応した透明性レポートを同日公開。欧州規制環境を競争優位へ転換する戦略を、具体的な仕様とコスト設計で打ち出した。 何が起きているのか Mistral AIは日本時間7月3日22時ご...
リード Cohereが2026年7月1日、エンタープライズ向け新モデル「Command A3」を公開した。128Kトークンの文脈窓とRAG(検索拡張生成)に最適化されたアーキテクチャが特徴で、社内文書検索・契約書分析・医療記録要約といった業務に直接的に効く。推論コストは前世代「Command R+」比で約40%削減されており、大量処理を前提とした企業導入の費用対効果計算が変わる局面に来たとみられる...
リード 「1年前の10分の1で動く」──2026年夏、LLM推論APIの価格破壊が静かに、しかし確実に加速している。OpenAI、Anthropic、Googleが2026年上半期だけで複数回の値下げを実施。入力トークン単価が軒並み0.1ドル/Mトークンを割り込む水準に達し、「コストが高くて本番に載せられない」という声が変わり始めた。 何が起きているのか 2026年6月末時点で、主要プロバイダの代...
リード Perplexity AIは2026年6月30日(米国時間)、法人向け「Sonar Pro API」の価格を入力・出力トークン双方で約75%引き下げると発表した。入力1Mトークンあたり$8→$2、出力は$8→$2となり、リアルタイムWeb検索を内包した推論エンドポイントとしては現時点で最安水準に入る。単なる値下げではなく、RAG(検索拡張生成)構築コストの構造が変わる分岐点とみられる。 何...
リード 「GPT-4クラスが月1万円以内で使い放題になる日が来た」——そんな投稿が今日のXで拡散された。2025年末比でLLM主力モデルのAPI単価が最大90%超下落した2026年上半期、数字は確かに劇的だ。ただ触ってみないとわからない部分も多い。背景と実装上の現実を一次データで整理する。 何が起きているのか 2026年6月時点、OpenAI・Anthropic・Googleが相次いでAPIプラン...
リード xAI は 2026 年 6 月 30 日 午前 2 時(JST)、大規模言語モデル「Grok 3.5」を API および X プレミアム会員向けに正式公開した。前世代 Grok 3 から文脈窓を約 5 倍の 50 万トークンへ拡張し、X のリアルタイムポストを検索・引用する「LiveSearch」機能を標準統合。情報収集型 AI エージェントの設計図が、またひとつ書き換わった。 何が起き...
リード 2026年6月29日深夜(日本時間)、MetaがLlama 4シリーズ最大モデル「Llama 4 Behemoth」のオープンウェイト版をHugging Faceで公開した。総パラメータ数は2兆規模のMoE(Mixture of Experts)構造を採用しながら、商用利用可のライセンスで一般提供される。主要ベンチマークでGPT-5・Claude 4と同等水準に達したとMetaは主張してお...
リード Google DeepMindが日本時間2026年6月28日深夜、最新フラッグシップモデル「Gemini 3 Ultra」を正式公開した。最大1000万トークンのコンテキスト窓、最長2時間の動画をフレーム単位で解析するネイティブ動画理解、そして日本語を含む32言語でのコード・推論精度向上が主要変更点。マルチモーダル評価指標MMEの総合スコアは前世代Gemini 2.5 Pro比で約23%向...
リード Anthropicは2026年6月27日(太平洋時間)、Claude 4系列のエージェントAPIに大規模アップデートを実施した。単一のオーケストレーターエージェントが最大100の並列サブエージェントを自律制御できる新アーキテクチャ「Parallel Agent Mesh」を導入。ツール呼び出しレイテンシを平均40%削減したとも発表しており、エンタープライズの「AIワークフォース」構想が机上...
リード Mistral AIは2026年6月27日(パリ時間)、推論特化モデル「Magistral Ultra」の正式公開を発表した。MATH-500で92.4%、GPQA Diamondで74.1%を記録し、GPT-5・Claude 4 Opus水準の性能に到達。同時に141Bパラメータのオープンウェイト版「Magistral 141B」をApache 2.0ライセンスで公開したことで、クローズ...

2026年6月現在、中国では「中転站(zhongzhuanzhan)」と呼ばれるサービスが、Anthropic社のClaude APIを公式価格の約10%で提供しています。米国政府が最新モデルへのアクセスを制限する中、グレー市場は拡大を続けています。この記事では、その実態と米中AI戦争の最前線をわかりやすく解説します。 この記事でわかること 中国の「中転站」というプロキシサービスが、Claudeを...
リード OpenAIが6月27日23時(日本時間)、推論特化モデル「o4-mini」をAPIおよびChatGPTへ予告なし展開した。前世代「o3-mini」比でトークン単価を約70%圧縮しながら、数学ベンチマークAIME 2025で93.4%、コーディング評価SWE-bench Verifiedで68.7%を記録。"高精度か低コストか"の二択が崩れ、エージェントを数千〜数万並列で走らせる設計が現実...
リード 6月26日、AppleはiOS 19.5・macOS Sonoma 16.5・visionOS 3.5の同時配信とともに、Apple Intelligence 2.0を190カ国・地域へ展開した。前世代との最大の差異は「常時オフライン動作」——搭載する4Bパラメータのオンデバイスモデルが、通信環境を問わずアプリ横断のエージェント操作を実行する点にある。クラウドLLMが競う高スペック競争とは...
リード 「オープンソースLLMって結局、商用には追いつけないよね」——そう思っていたのは1年前の話だ。2026年6月時点で、Llama系の最新モデルはコーディング・数学推論・日本語応答の各ベンチマークで商用トップモデルとの差を10ポイント以内に縮めてきた。オンプレ運用を検討する日本企業にとって、選択肢は静かに、しかし確実に広がっている。 何が起きているのか 2026年6月第4週、X(旧Twitte...
リード AlibabaのクラウドAI部門が2026年6月25日、235Bパラメータの大規模言語モデル「Qwen 3-235B」をApache 2.0ライセンスで公開した。MMLUで91.4点、数学ベンチマークAIME 2025で72.8%、コーディング評価LiveCodeBenchではOpenAIのo3-miniを上回るスコアを計測。OSS陣営から初めて「フロンティアモデル相当」と評価される水準に...
リード OpenAIは2026年6月24日、動画生成モデル「Sora 2」を全世界で正式公開した。初代Soraから約1年半を経て、最大出力長が20秒から2分へ拡張、解像度は4K(3,840×2,160)に対応。さらに開発者向けAPIも同日解禁された。映像制作の「企画〜絵コンテ〜初稿」という前工程が、今日から本格的に機械に渡る局面に入った。 何が起きているのか OpenAIの公式リリースによると、S...
リード xAIが2026年6月24日(米国時間)、第4世代基盤モデル「Grok 4」を正式公開した。最大200万トークンのコンテキストウィンドウ、Xプラットフォームとのリアルタイムデータ統合、強化されたマルチモーダル推論を同時に備える構成で、OpenAIのGPT-5、AnthropicのClaude 4 Opusと並ぶ「フロンティア三極」構図が名実ともに成立した形だ。 何が起きているのか xAIは...
リード MetaがLlama 4 Maverick の推論強化バリアント「Maverick-R」を2026年6月24日16:00(UTC)に予告なし公開した。数学・コーディングの2軸でOpenAI o3、Gemini 2.5 Proに10ポイント以内まで迫り、Apache 2.0ライセンスで商用利用可能という条件が加わった瞬間、OSS推論モデル競争は最終局面に入ったとみられる。 何が起きているのか...
ローカルで動くAIが、今年ついに"使い物になった" これ、地味だけど効くやつだと思っている。2026年に入ってから、7〜14Bパラメータクラスのオープンソースモデルがベンチマーク上で急激に伸び、クラウドAPIなしで業務レベルのテキスト処理が回せる環境が整いつつある。今日のXでも「Ollama入れたら会社のPCだけで完結した」という声が複数流れていた。 「Qwen3-8B、手元のゲーミングPCで動か...
リード GoogleがGemini 2.5 NanoをAndroid OSレベルで統合し、クラウド送信なしに端末内で推論を完結させる機能を2026年6月23日(現地時間)に発表した。対象はAndroid 14以降を搭載する全デバイス——世界約14億台、国内約6,200万台が即時アップデートの対象となる。「クラウドに送れない」という規制障壁を、アーキテクチャで丸ごと取り除く一手だ。 何が起きているの...
リード 「ローカルで動かすには精度が足りない」——その前提が、2026年前半に静かに書き換えられた。7〜30Bパラメータ規模の小型言語モデル(SLM)が、特定タスクにおいてGPT-4o相当の精度に到達しつつあり、X上では「APIを捨てた」「オンプレに戻した」という投稿が増え始めている。触ってみないとわからない、とずっと言ってきたが、今回ばかりは数字が先に語りかけてくる。 何が起きているのか 202...
リード Mistral AIが2026年6月21日(UTC)、新モデル「Mistral Medium 3」をApache 2.0ライセンスのもと完全公開した。商用利用・改変・再配布に制限がなく、自社サーバーへのホスティングも無条件で可能。同社が公表したベンチマークでは、MMLU 85.2点・HumanEval 82.7点を記録し、「同推論コスト帯においてGPT-4o miniを上回る」と明示してい...
リード Anthropicは2026年6月21日(米国時間)、Claude 4 APIに「Persistent Memory Layer(永続メモリ層)」をGAリリースした。これにより、複数のAIエージェントと複数セッションをまたいで記憶・コンテキストを共有する仕組みが公式APIとして標準化される。「毎回コンテキストウィンドウにドキュメントを詰め込む」という2024〜2025年型の実装アーキテクチ...
リード Appleが2026年6月19日(現地時間)、WWDC 2026基調講演でApple Intelligence 2.0の全言語一斉ロールアウトを発表した。日本語を含む40言語がフルサポートに加わり、翻訳・要約・メール生成・通話リアルタイム文字起こしがiPhone・Mac上でクラウドを経由せずに動作する。全世界22億台超のAppleデバイスに「標準搭載AI」が着地した日として記録されるだろう...
リード GPT-5.5 Instantの医療回答評価で、正確さ(accuracy)と明瞭さ(clarity)の双方において、医師が執筆した回答を上回ったとする報告が2026年6月18日時点で拡散している。「AIが専門家レベルに近づいた」という従来の言い方ではなく、今回は測定可能な2指標で人間の専門家を超えた点が構造的に新しい。 何が起きているのか X上では複数のAI研究観測アカウントがこの知見を引...

この記事でわかること フィジカルAI(Physical AI)とは何か、なぜ注目されているのか Tesla、Waymo、NVIDIAがそれぞれ目指すフィジカルAIの方向性 各社の技術的アプローチと戦略の違い 2026年の最新動向と日本市場への影響 フィジカルAIとは?AIが現実世界で動く時代へ フィジカルAI(Physical AI)とは、現実の物理世界を認識し、状況に応じて自律的に行動を選択でき...
リード GPT-4クラスの大規模言語モデルを動かすコストが、2023年から2年余りで約100分の1まで圧縮された。単価が限界費用に近づいたことで、企業の問いは「使うかどうか」から「何を任せるか」に移行した。AIが特別プロジェクトからインフラに変わる転換点が、静かに通過しつつある。 何が起きているのか 2023年3月のGPT-4リリース時点で、入力1Mトークンの処理コストはOpenAI公式レートで約...
リード GPT-4が2023年にMMLUで86%を記録したとき、多くの研究者が「すごい」と感じた。2026年6月現在、複数のモデルがその指標で95%超を叩き出している。ベンチマークの「天井」に達したとき、私たちはAIの進化をどう測ればいいのか——静かだが重要な問い直しが始まっている。 何が起きているのか AI性能の「通信簿」として長年使われてきたMMLU(Massive Multitask Lan...