トピック

RAGと知識システム

個人向けRAG、本番環境の検索、チャンク分割、権限、取り込み、情報源の境界。

23件のコンテンツ (記事11件 · 動画12件)

ここから開始

一覧を見る前に、まずおすすめのコンテンツをいくつかご覧ください。

このトピックの他の記事

9 分の読書
記事

溜め込まず、必要なときに取り出せる個人ナレッジシステム

明確な用途、取り出しテスト、見直し日、削除ルールに加え、機微なメモ、他人のデータ、プロバイダーが管理するアカウントへの注意点を備えた、範囲を限定した記録・取り出しシステムです。

中級者
20 分
動画

RAGの権限とアクセス制御:詳細チュートリアル

Paragon. 本番RAGの権限問題を順を追って説明し、ツール呼び出し、名前空間、ACLテーブル、関係ベースの権限を比較します。これは、検索で返してよいのは現在のユーザーに閲覧権限がある情報源だけであり、情報源となるシステムの権限を後付けにしてはならない、という記事の中核原則を直接支えます。

上級者
7 分
動画

DoclingでRAGとAIエージェントを高度化する

IBM Technology. RAGとエージェントの取り込み側、すなわちPDFなどのファイルを準備し、文書構造、表、レイアウトを後続の検索処理まで維持する方法を説明します。複雑な業務文書を解析する場合は特に、RAGの品質と安全性は埋め込み処理より前に決まるという記事の警告を裏付けます。

上級者
11 分の読書
記事

RAG向け文書を安全に取り込む:PDF、OCR、メタデータ、保持

RAGの品質は検索の前から始まります。PDF、OCR、メタデータ、権限、情報源の鮮度、削除、マルウェアリスク、運用上の所有を扱う、安全な取り込みの手引きです。

上級者
11 分の読書
記事

AIカスタマーサポートエージェントの設計:選別、ナレッジ、アクション、エスカレーション

サポートの選別、検索、回答案、制御されたアクション、人へのエスカレーションを、キューで評価するための参照設計です。安全な試行に必要なポリシーと測定の境界も示します。

中級者
11 分の読書
記事

チャンク分割、リランキング、ハイブリッド検索:RAGを実用レベルにする

多くのRAG実装がうまく機能しない原因は、3つの点を誤っていることです。検索エンジニアにならなくても実践できる、文書のチャンク分割、結果のリランキング、キーワード検索とセマンティック検索の組み合わせ方を解説します。

中級者
12 分の読書
記事

コンテキストエンジニアリング:コンテキスト劣化を避けて100万トークンのウィンドウを管理する

100万トークンのコンテキストウィンドウは実現していますが、品質は上限に達するはるか前から低下します。コンテキストエンジニアリングとは、何を含め、何を要約し、何を新たに検索するかを決め、コンテキストが増えても高い品質を維持するパターンを適用することで、コンテキストウィンドウを効果的に使うための規律です。

上級者
11 分の読書
記事

n8nで初めてのAIエージェントを構築する:リード振り分けの全工程

公式ドキュメントに基づくn8nのリード振り分け設計です。入力を検証し、エージェントのツールを制限し、構造化出力を検証して、提案を原子的に保存します。顧客に影響する操作は、すべて承認後に限ります。

中級者
12 分の読書
記事

プロンプティング、RAG、ファインチューニングの選び方(および組み合わせるべき場面)

プロンプティング、RAG、ファインチューニングは、LLMを課題に適応させるための3つの大きな手段です。それぞれに適した課題と適さない課題があります。選択のためのフレームワーク、各手法の現実的なコスト、そして組み合わせることで効果を発揮する本番パターンを解説します。

上級者
12 分の読書
記事

チャンクを超えるRAG:グラフRAG、エージェント型RAG、ロングコンテキストRAG

従来のチャンクベースRAGには限界があります。グラフRAG、エージェント型RAG、ロングコンテキストRAGは、それぞれ異なる方法でその限界を打ち破ります。各手法が適する状況、実際の仕組み、本番環境で重要なトレードオフを解説します。

上級者
11 分
動画

2024年版NotebookLMの使い方(初心者向けチュートリアル)

TheAIGRID. 収録時の画面で、複数形式の情報源のアップロード、単一情報源への絞り込み、ブリーフィング文書、Audio Overviewを紹介する、以前の機能中心のツアーです。ワークフロー要素を把握するには有用ですが、現在のGemini Notebookの画面や機能提供を確認する資料にはなりません。

中級者
26 分
動画

NotebookLMの使い方(GoogleのAI「理解支援ツール」)

Tiago Forte. 『Building a Second Brain』の著者Tiago Forteが、当時NotebookLMと呼ばれていた製品をノート、PDF、切り抜きで実演します。有用なパターンは、対象を限定した情報源群の選択、文書への質問、リンクされた箇所の確認、生成物を既存の知識ワークフローにどう組み込むかの判断です。

中級者
69 分
動画

検索のためのテキスト分割:5つのレベル

Greg Kamradt. 記事ではチャンク分割を詳しく扱っています。この動画は、文字単位の再帰的分割から、文書構造を考慮した分割、セマンティック分割、エージェント型分割まで、それぞれの戦略が実際に何をしているのかを最も長く丁寧に説明しています。調整を始める前に、Gregが無料で提供するChunkVizツールと組み合わせて、直感的な理解を深めてください。

中級者
24 分
動画

手元の知識でLlama 3の性能を10倍に:ローカル・エージェント型RAG

AI Jason. 記事で推奨しているクエリ変換、ハイブリッド検索、リランキング、修正型RAGのループという構成を、1つの実行可能な実装で扱います。「チャンク化 → リランキング → 回答」のパイプラインが適切に機能するとどのようになるのか、実践的なメンタルモデルを得られます。

中級者
17 分
動画

本番環境のRAGエージェントから得た10の教訓-RAG考案者Douwe Kiela

AI Engineer. Douwe KielaはFAIRでRAG原論文を率い、現在は規制対象の企業へRAGを提供しています。講演の中心は、大規模化すると機能しなくなる要素です。100k文書では通用しないチャンキング戦略、「精度は最低条件であり、真の問題は不正確さである」という考え方、埋め込みモデルよりも帰属情報と可観測性が重要な理由を説明します。記事の評価と監視に関する節を読み直す前に、判断基準を整えるために役立ちます。

上級者
19 分
動画

本番対応RAGアプリケーションの構築:Jerry Liu

AI Engineer. LlamaIndexのCEOが、「素朴なRAGデモ」と実際のパイプラインの隔たりを説明します。small-to-big検索、サブクエリのルーティング、ハイブリッド検索、評価を扱います。スライドの構成は記事のパイプラインに関する各節とほぼ直接対応しています。先に動画を見て、その図を思い浮かべながら記事を読み直してください。

上級者
9 分
動画

RAGとファインチューニングの比較

IBM Technology. チームが最も混同しやすい2つの手法に、より焦点を絞っています。データの鮮度、出典の帰属、ファインチューニングによる推論時の速度向上を詳しく説明します。不要なファインチューニングのプロジェクトに反対する根拠を示したい場合に、視聴する価値があります。

上級者
13 分
動画

RAG・ファインチューニング・プロンプト技術:AIモデルを最適化する

IBM Technology. 3つの手法と、それぞれのコストをホワイトボードで明快に説明します。検索のレイテンシー、学習の計算コストと破滅的忘却、プロンプトだけによる解決策の限界に加え、本番環境で実際に有効な組み合わせを扱います。最後に紹介される3つすべてを使用した法務AIシステムの例は、記事の「組み合わせるタイミング」という主張とほぼ完全に一致します。

上級者
39 分
動画

RAG 2.0入門:エージェント型RAGとナレッジグラフ(無料テンプレート)

Cole Medin. エージェント型RAGとナレッジグラフを組み合わせた実際に動く実装です。エージェントがベクトル検索を行うタイミング、Neo4jへ問い合わせるタイミング、その両方を行うタイミングを判断します。記事で説明する「検索プランナーとしてのエージェント」パターンを、実際にダウンロードして実行できるコードで示す、YouTube上で最も明快なデモです。

上級者
16 分
動画

Graph RAG:ナレッジグラフでRAGを改善する

Prompt Engineering. MicrosoftのGraphRAGに焦点を絞った解説です。エンティティ抽出、コミュニティ要約、クエリ指向の要約を扱い、コストに関する注意事項とともにローカルマシンへセットアップします。特に記事のグラフRAGに関する節のために視聴してください。多くの解説で省略されているコストの議論が重要です。

上級者