> ## Documentation Index
> Fetch the complete documentation index at: https://doc.howen.ink/llms.txt
> Use this file to discover all available pages before exploring further.

# 圖片辨識

> 上傳或貼上截圖，擷取其中的日語文字，再進行解析。

圖片辨識可以從截圖、照片或漫畫中擷取日語文字，並填入輸入框。確認文字無誤後，再點選**解析**。

## 擷取圖片中的文字

<Tabs>
  <Tab title="上傳圖片">
    1. 點選輸入框旁的**上傳圖片擷取文字**按鈕。
    2. 選擇一個圖片檔案。
    3. 等待辨識完成，擷取出的文字會填入輸入框。
  </Tab>

  <Tab title="貼上截圖">
    1. 擷取螢幕畫面或複製一張圖片。
    2. 在輸入框中按下 <kbd>Ctrl</kbd> + <kbd>V</kbd>（macOS 為 <kbd>⌘</kbd> + <kbd>V</kbd>）。
    3. 應用程式偵測到圖片後會自動開始辨識。
  </Tab>
</Tabs>

應用程式只擷取文字，不會翻譯或解讀圖片內容。圖片中的換行會替換為空格，原文順序保持不變。

辨識完成後，頁面會提示「文字擷取成功！請確認後點選「解析」。」檢查並修正辨識結果，然後點選**解析**。

<Tip>
  開啟串流輸出時，辨識出的文字會逐步顯示在輸入框中。
</Tip>

## 使用哪個模型

圖片辨識會使用你在**設定**中選擇的文字模型：

| 模型服務     | 辨識模型                                                         |
| -------- | ------------------------------------------------------------ |
| DeepSeek | `deepseek-flash`                                             |
| Gemini   | 與所選模型版本相同，`gemini-flash-latest` 或 `gemini-flash-lite-latest` |

## 圖片處理與限制

* 上傳前，應用程式會在瀏覽器中壓縮圖片：長邊超過 1600 像素時等比例縮小，並以 70% 品質重新編碼。
* 壓縮後的圖片資料不能超過 8 MB。
* 只接受圖片檔案。選擇其他類型的檔案時，頁面會提示「請上傳圖片檔案！」。

## 辨識失敗時

| 提示              | 處理方式                                   |
| --------------- | -------------------------------------- |
| 未辨識到圖片中的文字      | 圖片中沒有可辨識的文字，或文字太小。請換一張更清晰的圖片。          |
| 圖片載入失敗 / 無法讀取檔案 | 圖片檔案已損壞，或格式不受瀏覽器支援。請改用 PNG 或 JPEG。     |
| 未提供 API 金鑰      | 目前的服務商沒有可用的 Key。請在**設定**中填入，或聯絡管理員。    |
| 圖片資料太大，請壓縮後再試一次 | 壓縮後的圖片仍超過 8 MB。請裁切出含文字的部分，或換一張尺寸較小的圖片。 |

<Note>
  圖片只會在辨識時經由應用程式伺服器傳送給模型服務商，應用程式不會保存圖片。Umami 統計也不會記錄圖片或擷取結果。詳見[金鑰與隱私](/zh-Hant/privacy)。
</Note>
