Skip to main content
設定 → パイプラインで各段階のモデルを選びます。前処理とオプションはモデルが担当し、処理の流れは共通です。

検出

Koharu Layout RF-DETR Seg 2XL が文字、吹き出し、コマを検出し、後続段階向けのセグメンテーション情報を作ります。 文字、吹き出し、コマの閾値は、各クラスに必要な確信度を調整します。下げると不確かな領域も残り、誤検出が増える場合があります。複数の代表的なページで比較してから変更してください。

OCR

OCR は検出された文字領域を読みます。文字が欠ける場合は検出を先に確認してください。渡されていない領域を認識モデルの変更だけで復元することはできません。

インペイント

既定は LaMa です。AOT Inpainting も直接型の再構成モデルです。通常の文字除去ではここから試します。

プロファイルと初回実行

対応モデルは独立した設定プロファイルを持ちます。生成モデルへ戻すと、そのモデルのプロンプトが復元されます。 モデルは必要時にロードされます。初回の取得・ロード時間を除き、同じページでウォームアップ後に比較して、プロジェクトの既定を選んでください。