Skip to main content
图片识别可以从截图、照片或漫画中提取日语文字,并填入输入框。你确认文字无误后,再点击解析。

提取图片中的文字

  1. 点击输入框旁的上传图片提取文字按钮。
  2. 选择一张图片文件。
  3. 等待识别完成,提取的文字会填入输入框。
应用只做文字提取,不翻译或解读图片内容。图片中的换行会被替换为空格,原文顺序保持不变。 识别完成后,页面提示「文字提取成功!请确认后点击”解析”。」检查并修改识别结果,然后点击解析。
开启流式输出时,识别出的文字会逐步显示在输入框中。

使用哪个模型

图片识别使用你在设置中选择的文本模型:

图片处理与限制

  • 上传前,应用会在浏览器中压缩图片:长边超过 1600 像素时等比缩小,并以 70% 质量重新编码。
  • 压缩后的图片数据不能超过 8 MB。
  • 只接受图片文件。选择其他类型的文件时,页面会提示「请上传图片文件!」。

识别失败时

图片只在识别时经应用服务端发送给模型服务商,应用不会保存图片。Umami 统计也不会记录图片或提取结果。详见密钥与隐私。