AIセキュリティ
プロンプトインジェクション、情報漏えい、安全でないツールアクセス、権限、本番環境の障害パターン。
19件のコンテンツ (記事12件 · 動画7件)
ここから開始
一覧を見る前に、まずおすすめのコンテンツをいくつかご覧ください。
14 分の読書プロンプトインジェクションとLLMセキュリティ:脅威モデルと多層防御
プロンプトインジェクションは恒久的に存在するLLMセキュリティ上の脅威であり、プロンプトの書き方の誤りではありません。脅威モデル、データ境界、ツール権限、回帰テスト、監視、インシデント対応について解説する本番環境向けガイドです。
上級者
10 分の読書社内ナレッジRAG:権限、漏えい、情報源の境界
社内ナレッジアシスタントの安全性は、検索が権限を尊重する場合にのみ確保されます。RAGの情報源の境界、ACLフィルタリング、文書のオーナーシップ、ログ記録、古い情報源の処理、回答拒否の挙動を設計する方法を説明します。
上級者
11 分の読書RAG向け文書を安全に取り込む:PDF、OCR、メタデータ、保持
RAGの品質は検索の前から始まります。PDF、OCR、メタデータ、権限、情報源の鮮度、削除、マルウェアリスク、運用上の所有を扱う、安全な取り込みの手引きです。
上級者このトピックの他の記事
7 分の読書Hermesのwebhook:巨大な万能プロンプトを使わないイベント駆動エージェント
送信元に適した認証、ポート8644のヘルスチェック、小さな名前付きルートでHermes Agentのwebhookを設定し、イベントを配信先が明確なエージェント実行へ変えます。
中級者
10 分の読書DGX Spark上のNemoClaw:導入・セキュリティ計画
DGX Spark上のNVIDIA OpenShell内でOpenClaw、Hermes、またはDeep Agents Codeを評価するための計画です。現行のオンボーディング、ポリシー層、推論ルーティング、必要な受け入れ証拠を扱います。
上級者
8 分の読書OpenClawの許可リスト、ペアリング、グループメンションのセキュリティ
OpenClawの本当のセキュリティ境界は、チャネルの許可リスト、DMのペアリング、グループでのメンション規則です。ツールにはシェル、ファイル、ブラウザが含まれる可能性があるからです。実務で使えるロックダウン用チェックリストを紹介します。
中級者
9 分の読書OpenClawパーソナルゲートウェイの設定:インストール、初期設定、ダッシュボード
OpenClawの概要、セルフホスト型マルチチャネルゲートウェイのインストールと初期設定、ポート18789でのControl UIの開き方、セキュリティー基準を省略せずに使えるNodeバージョンを説明します。
中級者
10 分の読書OpenClawのスキル、heartbeatによる自律動作、承認ゲート
OpenClawがスキルを読み込む仕組み、heartbeatの定期ターン、ホストのシェル実行を制限する方法、ブラウザー自動化を厳しいポリシーとレビュー済みワークフローの確認下に置く方法を説明します。
中級者
20 分RAGの権限とアクセス制御:詳細チュートリアル
Paragon. 本番RAGの権限問題を順を追って説明し、ツール呼び出し、名前空間、ACLテーブル、関係ベースの権限を比較します。これは、検索で返してよいのは現在のユーザーに閲覧権限がある情報源だけであり、情報源となるシステムの権限を後付けにしてはならない、という記事の中核原則を直接支えます。
上級者
69 分AIエージェントの現状:本番導入から得た教訓
MLOps.community. ProsusのAI担当VPとAIエンジニアが、グループの投資先企業にエージェントを導入した際、実際に何が壊れたかを報告します。本番前のプロンプトインジェクション侵入テスト、人間特有の略記をJiraエージェントが処理できずに発生した危険な書き込み、エージェント自身に前提を明示させて対処した古いコンテキスト、認知負荷を増やすエージェントを統合または停止するフォールバック設計を扱います。記事の障害モード台帳を、実際の事後検証として再現したような内容です。
上級者
7 分DoclingでRAGとAIエージェントを高度化する
IBM Technology. RAGとエージェントの取り込み側、すなわちPDFなどのファイルを準備し、文書構造、表、レイアウトを後続の検索処理まで維持する方法を説明します。複雑な業務文書を解析する場合は特に、RAGの品質と安全性は埋め込み処理より前に決まるという記事の警告を裏付けます。
上級者
10 分の読書本番AIの失敗モード:デモの後に何が壊れるのか
AIシステムの失敗には、ハルシネーション、古いコンテキスト、過度な迎合、プロンプトインジェクション、危険なツール実行、スキーマドリフト、弱いフォールバックなど、予測可能なパターンがあります。実運用のワークフローを提供するチームのための失敗モード台帳です。
上級者
10 分の読書プライベートAIの導入パターン:ローカル、VPC、自社運用、ハイブリッド
プライベートAIは一つのアーキテクチャではありません。プライバシーと制御を重視する中小企業向けに、ローカルモデル、法人向けSaaS、VPCへの導入、自社運用の推論、ハイブリッド構成を実践的に比較します。
上級者
10 分の読書メール、カレンダー、CRMにAIを安全に接続する
権限範囲の最小化、承認ゲート、保護された監査証跡、不正・失敗時のテスト、復旧手順を使い、AIをメール、カレンダー、CRMへ接続するための、リスクに基づくガイドです。
中級者
8 分の読書職場でAIを使う際のプライバシーとデータ衛生
職場でAIを使う際のプライバシーと機密保持のリスクを抑えるための実践ガイドです。貼り付ける前に、具体的な製品、プラン、設定、データ、適用される規則を確認してください。
初心者
25 分OWASPが示すLLMへの攻撃トップ10:AIの脆弱性を解説
IBM Technology. プロンプトインジェクションから視野を広げ、LLMに関するOWASP Top 10全般を扱っています。安全でない出力処理、機密情報の漏えい、過剰なエージェンシーなど、あらゆるものにGmailやHubSpotのスコープを付与する前に理解しておきたい、まさに失敗モードの一覧です。
中級者
11 分プロンプトインジェクション攻撃とは?
IBM Technology. Jeff Crumeによる「SUVを1ドルで買う」という例は、直接プロンプトインジェクションと間接プロンプトインジェクションが異なる問題である理由と、フィルタリングではどちらも完全には解決できない理由を、10分で説明する最も明快な解説です。取り消せない操作には、より巧妙なシステムプロンプトではなく、最小権限のスコープ、専用エージェントアカウント、人の介在が必要だという記事の主張と直接対応しています。
中級者
13 分LLMへの攻撃:プロンプトインジェクション
LiveOverflow. プロンプトインジェクションを、命令と信頼できないデータを混在させるシステムに対する典型的なインジェクション攻撃として捉えます。攻撃者が無実のユーザーを陥れる、具体的なコンテンツモデレーションの例も紹介します。「モデルが標的」ではなく「アプリケーションが標的」だと見方を変えることは、記事が冒頭で示す考え方そのものです。
上級者
17 分LLMを守る:プロンプトインジェクション対策
LiveOverflow. 実際の多層防御の手順を解説します。LLM出力の汚染解析、想定する出力形式の制限、ユーザーの分離、few-shotによる足場作り、ファインチューニング、決定性を得るためのtemperature 0、重要な処理経路での冗長化を扱います。記事の防御スタックに関するセクションと、ほぼ項目ごとに一致しています。
上級者