应群友要求,要做一个图片转文字的格式,因为有些人的简历中只有一张图片要提取他里面的文字就不好办了。

于是就有了下面这个小工具:

功能:选择要识别的图片后,识别出来后存到.txt文本中。

实现原理,基于百度“文字识别”通用版的api接口调用。

有一点需要说明的是可能无法识别百分百准确的,格式排版还是要人为去处理一下。



代码如下:

from aip import AipOcr

from PIL import Image as PImage

from PIL import ImageTk

from tkinter import *

from tkinter import filedialog

将图片内容翻译为文字,显示在文本框内

def trans():

# """ 你的 APPID AK SK """

APP_ID = ''

API_KEY = '
'

SECRET_KEY = '
*************'

client = AipOcr(APP_ID, API_KEY, SECRET_KEY)

contents.delete('1.0', END)
transTxt = client.basicGeneral(open(filePath.get(), 'rb').read())
# 对transTxt进行处理 去空格,换行符去重
transTxt=transTxt['words_result']
# transTxt=[{'words': '每个人总在仰望和'}, {'words': '羡慕着别人的幸福'}, {'words': '一回头'}, {'words': '却发现自己正被别'}, {'words': '人仰望和羡慕着'}]
words_content=''
for words in transTxt:
values =words['words']
words_content +=values+'\n'
print(words_content)
contents.insert(INSERT,words_content)
# 将文字保存到TXT文件
with open(filePath.get()+'_to_word.txt', 'w') as f:
f.write(words_content)

打开图片文件,显示路径,并将图片展现

def openfile():

filename.delete('1.0', END)

filePath.set(filedialog.askopenfilename())

filename.insert(1.0, filePath.get())

org_img = PImage.open(filePath.get())

# 调整图片显示大小 600*800

w, h = org_img.size

if w > 600:

h = int(h * 600 / w)

w = 600

if h > 800:

w = int(w * 800 / h)

h = 800

img = ImageTk.PhotoImage(org_img.resize((w, h)))

showPic.config(image=img)

showPic.image = img # 保持一个引用才能显示图片,tkinter的BUG

设置主窗口

top = Tk()

top.title("图片转文字 引擎:百度云API文字识别 Made by: Running")

top.iconbitmap("./pic/y1.ico")

top.geometry("800x600")

filePath = StringVar()

第一个窗体

frame1 = Frame(top, relief=RAISED, borderwidth=2)

frame1.pack(side=TOP, fill=BOTH, ipady=5, expand=0)

Label(frame1, height=1, text="图片路径:").pack(side=LEFT)

filename = Text(frame1, height=2)

filename.pack(side=LEFT, padx=1, pady=0, expand=True, fill=X)

Button(frame1, text="打开文件", image='', command=openfile).pack(side=LEFT, padx=5, pady=0)

Button(frame1, text="识别图片", image='', command=trans).pack(side=LEFT, padx=5, pady=0)

第二个窗体

frame2 = Frame(top, relief=RAISED, borderwidth=2)

frame2.pack(side=LEFT, fill=BOTH, expand=1)

Label(frame2, text='待识别的图片:', borderwidth=5).pack(side=TOP, padx=20, pady=5)

showPic = Label(frame2, text='图片显示区')

showPic.pack(side=BOTTOM, expand=1, fill=BOTH)

第三个窗体

frame3 = Frame(top)

frame3.pack(side=RIGHT, fill=BOTH, expand=1)

contents = ScrolledText(frame3)

Label(frame3, text='图片识别结果:', borderwidth=5).pack(side=TOP, padx=20, pady=10)

contents = Text(frame3, font=('Arial', 15))

contents.pack(side=TOP, expand=1, fill=BOTH)

Label(frame3, text='Copyright 2024 baidu.com ALL Rights Reserved', borderwidth=5).pack(side=BOTTOM, padx=20, pady=10)

top.mainloop()

python 图片转文字小工具的更多相关文章

  1. InkImageDataSetGenerator-开源一个可用于机器学习的书写轨迹图片生成的小工具

    这是一个简单易用的图片数据集生成小工具,基于OpenCV和UWP Ink API,它可以根据指定的手写轨迹生成一系列各个角度的图片.每张图片的尺寸和总体数量都是可以指定的,均存放在统一的生成目录中.h ...

  2. python开发目录合并小工具 PathMerge

    前言 这个程序陆陆续续开发了几天,正好我在学Python,就一边做一边学,倒是学到不少东西. 不得不说python是快速开发的好工具. 程序做了一些改进,这两天又忙着毕设,现在才想起来发到博客上.想想 ...

  3. python 3.6 MJ小工具

    2017.07.14 update 做了个界面,不需要使用cmd命令行+文件路径的方式来使用了: 链接如下: http://www.cnblogs.com/chenyuebai/p/7150382.h ...

  4. 语音转文字小工具开发Python

    # -*- coding: utf- -*- import requests import re import os import time from aip import AipSpeech fro ...

  5. 目不识丁的我使用Python编写汉字注音小工具

    一万点暴击伤害 人懒起来太可怕了,放了个十一充分激发了我的惰性.然后公众号就这么停了半个月,好惭愧- 新学期儿子的幼儿园上线了APP,每天作业通过app布置后,家长需要陪着孩子学习,并上传视频才算完成 ...

  6. python转exe的小工具

    其实只是在cxfreeze的基础上加了个壳,做成窗口软件了 使用了pyqt做的界面,软件发布在了开源中国上,可以直接去下面的地址查看 http://git.oschina.net/robocky/py ...

  7. python之字符聊天小工具

    server side: # coding: gb2312#socket server端#获取socket构造及常量from socket import *#''代表服务器为localhostmyHo ...

  8. Python: tkinter实例改名小工具

    #!/usr/bin/env python #coding=utf-8 # # 版权所有 2014 yao_yu (http://blog.csdn.net/yao_yu_126) # 本代码以MIT ...

  9. 入坑python 自己写的小工具,纪念一下

    这个程序的功能是可以从表格中读取某一列数据,传到IDs 这一个参数里,然后在url中获取相应的请求值,并打印 import urllib.request import json import xlrd ...

  10. python一些实用的小工具

    1  搭一个简易的本地局域网  python -m http.server 2 获取当前目录下的所有文件名 3 进度条效果 import sys,time for i in range(50): sy ...

随机推荐

  1. NC15291 幸运数字Ⅱ

    题目链接 题目 题目描述 定义一个数字为幸运数字当且仅当它的所有数位都是4或者7. 比如说,47.744.4都是幸运数字而5.17.467都不是. 定义next(x)为大于等于x的第一个幸运数字.给定 ...

  2. NC14526 购物

    题目链接 题目 题目描述 在遥远的东方,有一家糖果专卖店. 这家糖果店将会在每天出售一些糖果,它每天都会生产出 \(m\) 个糖果,第i天的第j个糖果价格为 \(C[i][j]\) 元. 现在的你想要 ...

  3. DOM和BOM的区别

    DOM和BOM的区别 在浏览器中运行的JavaScript可以认为由三部分组成:ECMAScript描述了该语言的语法和基本对象,DOM文档对象模型描述了处理网页内容的方法和接口,BOM浏览器对象模型 ...

  4. Java中的Try with Resources语句介绍

    1.介绍 从Java7诞生了try-with-resources,这家伙可以在资源使用完后实现自动关闭回收.想想我们之前打开一个文件或流对象用完咋整的,是不是finally语句块中手动close的. ...

  5. Java集合框架学习(十一) Hashtable详解

    Hashtable介绍 1. 继承自Dictionary; 2. 线程安全: 3. 支持Iterator和Enumeration: 4. key和value都不可为null; 5. 一般用于多线程环境 ...

  6. 《系列二》-- 3、FactoryBean 的使用

    目录 FactoryBean 解决的问题 FactoryBean 接口初识 改造结果 最后的补充 回顾下 FactoryBean 的应用 factory-method 和 factory-bean 的 ...

  7. win32 - 将原始音频样本转换为wav文件

    需要先从麦克风中采样,代码样本可以参考官方示例: WASAPI Capture Shared Event Driven 官方示例采样10s, 我们需要在WriteWaveFile函数下添加生成原始音频 ...

  8. 【Android逆向】破解看雪9月算法破解第三题

    这题的目标是算法还原,并写出注册机 1. 9月份算法第一题.apk 安装到手机 2. 随意输入账号密码,提示错误 3. apk拖入到jadx中 public native boolean regist ...

  9. 【Azure APIM】解决APIM Self-hosted Gateway在AKS上,最开始访问时候遇见的404问题

    问题描述 根据APIM官方文档,创建Self-hosted 网关在AKS中( 使用 YAML 将自承载网关部署到 Kubernetes :https://docs.azure.cn/zh-cn/api ...

  10. 【Azure Redis】Redis服务负载达到100%后的影响及有何优化方法

    问题描述 Redis服务负载达到100%后的影响及有何优化方法 问题解答 Redis的负载达到100% 意味着 Redis 服务器繁忙,无法跟上请求,导致客户端发送出来的请求超时. 常规情况下有一下几 ...