コンテンツ検索
コンテンツ検索プラグインは、ローカルドキュメントの本文を検索し、バックグラウンドでインデックスを作成します。Lertaro の通常のファイル名検索と並行して利用できます。
はじめに
設定 → プラグイン → コンテンツ検索 → 設定を開き、少なくとも 1 つの監視フォルダーを指定して保存します。既定のトリガーキーワードは cs です。
text
cs プロジェクト計画キーワードの後にはスペースが必要です。cs が使いにくい場合は、プラグイン設定で別のキーワードに変更できます。
インデックス対象
- 監視フォルダー:設定したローカルフォルダーをホストのインデックスサービスに登録します。初回および増分の検出は、SDK のインデックス済みディレクトリ列挙とデバウンスされたディレクトリ変更通知で行われます。各フォルダーはホストのローカルドライブインデックスまたはフォルダーインデックスの対象になっている必要があり、対象外の場合は列挙結果が空になります。
%USERPROFILE%などの環境変数と、実フォルダーに解決できるshell:Downloadsなどのシェル仮想パスにも対応します。 - ファイル拡張子:既定では
txt、md、pdf、docx、docm、pptx、pptm、xlsx、xlsm、csvが対象です。カンマ区切りの一覧は変更できます。 - PDF ファイル:抽出可能なページ本文に加え、保存された入力可能 PDF フォームのフィールド値も検索します。
- ファイルサイズ:ファイルごとの上限を超えるファイルはスキップされます。コンテンツインデックスには別のサイズ上限があり、
0で無制限になります。 - 除外パス:セミコロン区切りの正規表現で完全パスを除外できます。フォルダーが一致すると、その内容も除外されます。
本文の抽出に成功したファイルだけが検索対象になります。対応するドキュメント抽出器のないバイナリファイルは、読めない文字列として登録せずスキップされます。
検索方法
クイック検索ウィンドウで cs、スペース、キーワードの順に入力します。結果には一致したファイルの本文スニペットとフォルダーが表示され、Enter で選択したファイルを開けます。結果がある場合、種類フィルターを選択していなければフル検索ウィンドウにも同じファイル結果が表示されます。
初回インデックス作成中は、cs のプレースホルダーにインデックス済みファイル数と残りの作業数が表示されます。ホストの監視機能が新規または変更されたディレクトリを通知すると、プラグインはその中のファイルをバックグラウンドで処理するため、通常のファイル名検索はそのまま利用できます。インデックスが安定した後にファイルシステムを繰り返しスキャンすることはありません。
クリアと再構築
コンテンツ検索の設定には、次の 2 つの操作があります。
- インデックスをクリア:コンテンツインデックスだけを削除し、監視フォルダーを再スキャンしません。
- インデックスを再構築:コンテンツインデックスを削除し、すべての監視フォルダーを再スキャンします。
どちらの操作もコンテンツ検索インデックスだけに影響し、Lertaro の通常のファイル名インデックスは削除しません。
ヒント
- ファイルが結果に出ない場合は、フォルダー、拡張子、除外パターン、サイズ上限を確認してください。
- 監視フォルダーやインデックスルールを変更した後は、設定を保存してバックグラウンドスキャンの完了を待ってください。
- ルール変更後に既存ファイルを再抽出したい場合は、インデックスを再構築を使用してください。