> ## Documentation Index
> Fetch the complete documentation index at: https://koharu.rs/llms.txt
> Use this file to discover all available pages before exploring further.

# 视觉与图像修复模型

> 选择检测、OCR 和画面重建处理器。

打开**设置 → 流水线**，为每个阶段选择模型。预处理与选项由各模型负责，[工作流](/zh/guides/processing)保持一致。

## 检测

**Koharu Layout RF-DETR Seg 2XL** 检测文字、气泡和分格，并为后续阶段提供分割数据。

文字、气泡、分格阈值决定各类别需要的置信度。较低阈值保留更多不确定区域，也可能增加误检。更改前请比较多张代表性页面。

## OCR

| 模型               | 用途              |
| ---------------- | --------------- |
| PaddleOCR-VL 1.6 | 默认通用视觉语言 OCR    |
| Manga OCR        | 日语漫画文字          |
| Baberu OCR       | 另一种漫画识别模型       |
| Hayai OCR        | 中文、韩文、日文、英文漫画文字 |

<Note>
  OCR 读取已检测到的文字区域。文字缺失时先检查检测结果：更换识别器无法恢复从未传入的区域。
</Note>

## 图像修复

<Tabs>
  <Tab title="直接修复">
    **LaMa** 是默认模型，**AOT Inpainting** 是另一种直接重建选择。常规文字移除可从这里开始。
  </Tab>

  <Tab title="生成式修复">
    **FLUX.2 Klein** 接受重建提示词；面向漫画的 **RORem Mixed** 提供正向与负向提示词。

    通常需要更多运行时数据、内存和时间。提示词应描述恢复周围画面、排除文字；译文排版使用文字图层完成。
  </Tab>
</Tabs>

## 配置与首次运行

受支持的处理器分别保存自己的配置。切回生成模型会恢复其提示词，而不会沿用另一模型的字段。

模型按需加载。首次运行含下载和加载成本，请在预热后用相同页面比较，再决定项目默认模型。
