「RAG」の検索結果: ユーザー 0件・記事 10件
リード Perplexity AIは2026年6月30日(米国時間)、法人向け「Sonar Pro API」の価格を入力・出力トークン双方で約75%引き下げると発表した。入力1Mトークンあたり$8→$2、出力は$8→$2となり、リアルタイムWeb検索を内包した推論エンドポイントとしては現時点で最安水準に入る。単なる値下げではなく、RAG(検索拡張生成)構築コストの構造が変わる分岐点とみられる。 何...
リード Perplexity AIが2026年8月8日(太平洋時間)、リアルタイムWeb検索と多段推論を一体化した「Sonar Reasoning Pro」を正式公開した。推論ステップ中に検索を並列実行する構造で、SimpleQAベンチマークにおいて前バージョン比38%の精度向上を記録。APIは即日提供開始され、企業向け調査・分析ワークフローへの実装が動き出している。 何が起きているのか Perp...
リード Perplexity AI が「Sonar Pro 2」を2026年7月19日(太平洋標準時)に正式公開した。検索連動型LLMとしての第2世代にあたる本モデルは、内部評価で検索精度スコアが旧Sonar Proの約3倍、引用エラー率が42%減少したと発表されている。企業が自社でRAGシステムを構築する理由を問い直す一手になる。 何が起きているのか Perplexity AIは公式ブログおよび...
リード Cohereは2026年8月3日、エンタープライズRAG特化モデル「Command Rv3」を正式公開した。社内文書向け検索精度(F1スコア)が前バージョン比41%向上し、コンテキスト長は128Kから512Kトークンへ拡張。対応言語も29言語から47言語に広がった。API価格は据え置きのまま、設計の選択肢が一段広がった。 何が起きているのか 公式発表によると、Command Rv3の主な変...
リード 「もうRAGいらなくない?」——社内Slackでそう呟くエンジニアが増えている。2026年に入り、主要LLMのコンテキストウィンドウが100万〜200万トークンに達したことで、「全ドキュメントをそのまま突っ込む」構成が冗談ではなく選択肢に入り始めた。ただし、触ってみないとわかることがある。数字と実装の両面から現状を整理する。 何が起きているのか 2026年前半、複数のLLMプロバイダーがコ...
リード Cohereが2026年7月1日、エンタープライズ向け新モデル「Command A3」を公開した。128Kトークンの文脈窓とRAG(検索拡張生成)に最適化されたアーキテクチャが特徴で、社内文書検索・契約書分析・医療記録要約といった業務に直接的に効く。推論コストは前世代「Command R+」比で約40%削減されており、大量処理を前提とした企業導入の費用対効果計算が変わる局面に来たとみられる...