「オープンウェイト」の検索結果: ユーザー 0件・記事 30件
リード Mistral AIは2026年8月29日、最新フラッグシップモデル「Mistral Large 3」を正式公開した。コンテキスト長128Kトークン、対応言語32言語の多言語推論強化が最大の変更点だ。ベンチマーク上ではGPT-5 TurboやClaude Sonnet 4系と競合する水準に到達したと同社は主張しており、EU AI法完全施行後の欧州企業にとって、データ主権を担保できる選択肢が...
リード Mistral AIは2026年6月27日(パリ時間)、推論特化モデル「Magistral Ultra」の正式公開を発表した。MATH-500で92.4%、GPQA Diamondで74.1%を記録し、GPT-5・Claude 4 Opus水準の性能に到達。同時に141Bパラメータのオープンウェイト版「Magistral 141B」をApache 2.0ライセンスで公開したことで、クローズ...
リード AlibabaのQwen Teamが2026年7月8日、オープンウェイトシリーズ最大モデル「Qwen 3-235B-A22B」をHugging Faceで一般公開した。Mixture-of-Experts(MoE)構造により推論時の実効パラメータは22Bに絞りながら、数学推論ベンチ「MATH-500」で92.4点、コーディング評価「LiveCodeBench」で63.7点を記録——いずれも...
リード Mistral AIは2026年8月22日、コード専用モデル「Codestral 2.5」を正式公開した。SWE-bench Verifiedスコアは62.4%で、32Bパラメータクラスのオープンウェイトモデルとしては現時点での最高水準とされる。APIとオープンウェイトの両形式で提供され、データセンター内クローズド環境での運用も可能なため、プロプライエタリ一択だった企業の調達構造に揺さぶり...
リード Microsoftが14Bパラメータの小型言語モデル(SLM)「Phi-4 Ultra」を2026年7月11日に公式公開した。HumanEvalおよびMATH-500ベンチマークで、それぞれ92.4%・88.7%を記録——GPT-4o(91.8%・87.2%)を上回る数値だ。クラウドAPIが前提だったLLM競争に、「ローカル推論で足りる」という新たな軸が加わった。 何が起きているのか Mi...
リード Mistral AIが2026年7月3日(現地時間)、新フラッグシップ「Mistral Large 3」を正式公開した。文脈窓128Kトークン・34言語対応に加え、EU AI法「汎用AIモデル(GPAI)」条項に対応した透明性レポートを同日公開。欧州規制環境を競争優位へ転換する戦略を、具体的な仕様とコスト設計で打ち出した。 何が起きているのか Mistral AIは日本時間7月3日22時ご...
リード MetaがオープンウェイトLLM「Llama 4.1」を2026年7月5日に公式公開した。主要ベンチマークでGPT-4oを上回ると主張し、同時に商用利用条件を緩和。「オープンは追いかける側」という構図が、少なくとも数値上は終わりを告げた格好だ。 何が起きているのか MetaはHugging FaceおよびMeta AI公式サイトを通じてLlama 4.1の重みを公開した。パラメータ規模は4...
リード Mistral AIが2026年7月9日(現地時間)、最新フラッグシップモデル「Mistral Large 3」をHugging Faceおよび自社APIで同時公開した。コンテキストウィンドウを前作比2倍の128Kトークンに拡張し、日本語・韓国語・アラビア語精度を大幅強化。APIコストはGPT-4o比約52%安に設定され、「欧州発・オープンウェイト路線」が多言語競争の主戦場に踏み込んだ局面...
リード Meta は 2026 年 8 月 28 日、マルチモーダル対応のオープンウェイトモデル「Llama 4.1 Scout」を正式公開した。アクティブパラメータ 17B・MoE(Mixture of Experts)アーキテクチャにより、視覚推論ベンチマーク MMBench で 82.4 点を記録——GPT-4o(83.1 点)との差は 0.7 ポイントまで縮まった。「クローズドトップとの等...
リード MetaがLlama 4シリーズの最新版「Llama 4 Maverick 2」を2026年9月3日に公開した。従来モデルで設けていた月間アクティブユーザー7億人超の事業者向け商用ライセンス条件を完全撤廃。HuggingFaceで即日ダウンロード可能となり、公開後3時間で10万件を超えるダウンロードが記録されたと見られる。「APIを買う」から「モデルを持つ」への移行が、本格的に射程に入った...
リード Metaが日本時間2026年7月12日未明、「Llama 4 Maverick」のフル精度オープンウェイトをHugging Faceで一般公開した。パラメータ数は400B(MoEアーキテクチャ、アクティブ17B)、画像・動画・テキストを単一モデルで処理するマルチモーダル設計で、主要ベンチマーク複数でGPT-4oと同等以上のスコアを記録している。商用利用が許諾された事実は、LLM調達の選択肢...
リード Mistral AIが2026年9月3日、フラッグシップモデル「Mistral Large 3」を正式公開した。コーディング・数学・多段階推論の主要ベンチマークでGPT-5比97%前後のスコアを出しながら、入力単価は$1.8/Mトークンと主要競合の半値以下。欧州発モデルが「性能で妥協する選択肢」から「コスト効率で選ぶ最前線」へ地位を塗り替えた。 何が起きているのか Mistral AIは日...
ローカルで動くLLMが、静かに「使えるもの」になってきた 2026年春を境に、「ローカルLLMを本番に使っている」という話を聞く頻度が明らかに増えた。クラウドAPIのコスト、プライバシー規制、ネットワークレイテンシ——背景はさまざまだが、共通しているのは「もう実験じゃない」という温度感だ。触ってみないとわからない性格なので、M2 ProにOllamaを入れて実測した。 何が起きているのか オープン...
リード 2026年6月29日深夜(日本時間)、MetaがLlama 4シリーズ最大モデル「Llama 4 Behemoth」のオープンウェイト版をHugging Faceで公開した。総パラメータ数は2兆規模のMoE(Mixture of Experts)構造を採用しながら、商用利用可のライセンスで一般提供される。主要ベンチマークでGPT-5・Claude 4と同等水準に達したとMetaは主張してお...
「70Bが動いた」より「何トークン/秒か」を問う時代へ もはや「ローカルで70Bが動いた」では話題にならない。問われるのは「どれだけ速いか」だ。 2026年8月後半、llama.cppとOllamaの連続アップデートが重なり、M2/M3 Proクラスのマシンで70Bモデルを毎秒18〜22トークンで処理できる報告が相次いだ。触ってみないとわからない——そう思って手元の環境で動かしてみたら、本当に変わ...