如何用Python提取图片文字 | PIL识别图片文字教程

要使用 Python 识别图片中的文字,推荐使用 Pillow (PIL) 配合 Tesseract OCR 引擎(通过 pytesseract 库),以下是详细步骤:

pil识别图片文字


步骤 1:安装依赖

  1. 安装 Tesseract OCR(核心引擎):

    • Windows:下载安装包 UB-Mannheim/tesseract
    • MacOSbrew install tesseract
    • Linux (Debian/Ubuntu)sudo apt install tesseract-ocr
    • 语言包(如需要中文):
      sudo apt install tesseract-ocr-chi-sim(简体中文)
      sudo apt install tesseract-ocr-chi-tra(繁体中文)
  2. 安装 Python 库

    pip install pillow pytesseract

步骤 2:Python 示例代码

from PIL import Image
import pytesseract
# 设置 Tesseract 路径(Windows 需要指定安装路径)
# pytesseract.pytesseract.tesseract_cmd = r'C:Program FilesTesseract-OCRtesseract.exe'
# 打开图片
image = Image.open('your_image.jpg')  # 替换为你的图片路径
# 识别文字(默认英文)
text = pytesseract.image_to_string(image)
# 识别中文(简体)
# text = pytesseract.image_to_string(image, lang='chi_sim')
print("识别结果:")
print(text)

常见问题解决

  1. 中文识别不准确

    pil识别图片文字

    • 确保安装了中文语言包(如 tesseract-ocr-chi-sim)。
    • 使用 lang='chi_sim' 参数。
    • 优化图片质量(清晰、无反光、正对拍摄)。
  2. 报错 tesseract is not installed

    • 检查 tesseract 是否在系统路径中。
    • Windows 需手动设置路径(取消注释代码中的 tesseract_cmd)。
  3. 提高识别精度

    • 预处理图片:转为灰度、二值化、降噪。
    • 调整图片:使用图像处理库(如 OpenCV)增强对比度。
    • 指定区域识别:通过 image.crop((x, y, width, height)) 裁剪局部区域。

预处理增强示例

from PIL import Image, ImageFilter
# 打开图片并预处理
image = Image.open('your_image.jpg')
image = image.convert('L')  # 转为灰度
image = image.filter(ImageFilter.SHARPEN)  # 锐化
image = image.point(lambda x: 0 if x < 140 else 255)  # 二值化
# 识别文字
text = pytesseract.image_to_string(image, lang='chi_sim')
print(text)

替代方案:第三方 API

如果本地识别效果不佳,可使用在线 OCR API:

pil识别图片文字

  1. 百度 OCR:高精度中文识别(有免费额度)
  2. Google Vision:英文识别效果好
  3. 腾讯 OCR:支持多语言

提示:在线 API 需处理网络请求和隐私问题。

图片来源于AI模型,如侵权请联系管理员。作者:酷小编,如若转载,请注明出处:https://www.kufanyun.com/ask/294241.html

(0)
上一篇 2026年2月12日 15:20
下一篇 2026年2月12日 15:26

相关推荐

  • 酷番云云服务器怎样设置DNS?

    云服务器如何设置dns?因为需要在Internet上分辨出访问者是真实IP还是机器,因此使用者想通过浏览器输入域名(Domain Name)后,浏览器需先在一台拥有ip以及域名(D…

    2022年3月3日
    01.0K0
  • PHP如何获取用户隐私,PHP获取真实IP地址的方法

    PHP获取隐私数据是Web开发中常见的需求,例如获取用户IP地址、设备信息等,用于统计分析或安全验证,核心结论在于:在PHP中获取隐私数据必须严格遵循“最小权限原则”与“安全合规优先”的策略,开发者不仅要掌握技术实现,更要建立完善的数据过滤、加密存储及法律合规机制,防止数据泄露带来的法律风险与安全隐患,本文将从……

    2026年2月22日
    01922
    • 服务器间歇性无响应是什么原因?如何排查解决?

      根源分析、排查逻辑与解决方案服务器间歇性无响应是IT运维中常见的复杂问题,指服务器在特定场景下(如高并发时段、特定操作触发时)出现短暂无响应、延迟或服务中断,而非持续性的宕机,这类问题对业务连续性、用户体验和系统稳定性构成直接威胁,需结合多维度因素深入排查与解决,常见原因分析:从硬件到软件的多维溯源服务器间歇性……

      2026年1月10日
      020
  • 塔科夫pve在bsg服务器上有什么用,游戏模式有何区别,值得玩吗

    塔科夫PVE模式跑在BSG官方服务器上,核心作用就是让玩家在官方联网环境中体验纯粹的人机对战,彻底摆脱延迟、外挂和匹配折磨,这套架构不等同于本地离线,而是把战斗数据、战利品和进度全部托管在官方服务器,既保留了联机的紧张感,又隔绝了真人对手带来的不确定性,为什么BSG要专门为PVE搭服务器从“本地离线”到“官方托……

    2026年8月11日
    0310
  • CF为什么登陆连接服务器失败?,CF连接服务器失败怎么办

    开篇直接给答案CF登录连接服务器失败通常由本地网络波动、服务器维护或客户端文件损坏导致,优先检查网络连接、重启路由器并验证游戏完整性,若无效则查询官方服务器状态,核心原因与解决方案分层解析网络环境问题:最常见触发源本地网络波动排查测试延迟与丢包:在CMD运行ping 110.43.42.152 -t(CF官方I……

    2026年7月24日
    0595

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

评论列表(5条)

  • smart220的头像
    smart220 2026年2月14日 21:46

    这篇教程太及时了!跟着步骤试了下用Pillow+Tesseract识别发票文字,省去了手动输入的麻烦。不过中文识别偶尔会串行,感觉加个图像预处理会更准,期待作者后续优化技巧~

    • kind199fan的头像
      kind199fan 2026年2月14日 21:59

      @smart220对啊,跟着教程试了确实省时!中文识别串行我也遇到过,感觉加个图像预处理像去噪或调亮度会好很多,我自己试过裁剪多余部分也有帮助。期待作者的新技巧~

  • 茶bot920的头像
    茶bot920 2026年2月14日 22:13

    这篇教程太实用了!我之前一直手动敲图片里的文字,效率低还容易出错。原来用Python+OCR这么简单就能搞定,步骤讲得也清晰,Pillow和Tesseract的组合确实方便。这下处理扫描文档或者截图里的文字就省心多了,收藏起来下次直接抄作业!

  • 山山8246的头像
    山山8246 2026年2月14日 22:26

    这个教程真实用!我之前也用PIL和Tesseract提取过图片文字,组合起来识别效果挺准的,特别适合处理文档扫描。步骤写得简单清晰,新手照着做肯定能上手,不过复杂图片有时需要多调整参数。

  • 树鹰9519的头像
    树鹰9519 2026年2月14日 22:48

    这篇文章太实用了!我刚用PIL和pytesseract试了下,提取图片文字又快又准,以前手动打字累死人,现在省了好多时间。教程步骤很清楚,新手也能轻松上手,真心感谢分享!