我的图像之路之CAPTCHA 和 break CAPTCHA

我的图像之路之CAPTCHA 和 break CAPTCHA

CAPTCHA 和 break CAPTCHA,这永远是一个turing test的命题。 
CAPTCHA 和 break CAPTCHA双方都在竞赛,

Captcha方:

•Captcha项目: http://www.captcha.net/

•jCaptcha项目:http://jcaptcha.sourceforge.net/

Break Captcha方

http://www.cs.sfu.ca/~mori/research/gimpy/

http://sam.zoy.org/pwntcha/

http://www.brains-n-brawn.com/default.aspx?vDir=aicaptcha

http://homepages.cs.ncl.ac.uk/jeff.yan/

感觉就是一场拳击赛,很刺激。

张老师在他的图像课上布置了验证码识别的大作业。使得我有幸接触这些。作为我们小组的主要成员之一,我挑起了完成这个作业的重担。

当然,我并不愿意卷入这场无休止hard AI 战争,正如《Recognizing Objects in Adversarial Clutter: Breaking a Visual CAPTCHA 》中所说,验证码识别的意义在于它对Object Recognition很有帮助: 
1、对于一些图片的word extraction来说,验证码的背景噪声要比苛刻,要提高识别率并非易事; 
2、CAPTCHA的验证码产生是开源的,能通过它来产生infinit的testset。这样的数据集很充分。扩展了原来在MNIST上做实验。

读《Recognizing Objects in Adversarial Clutter: Breaking a Visual CAPTCHA》这篇论文并非易事,特别是像我这种图像处理领域的初涉者。作者G.Mori 的宣称他们在EZ-gimpy里的识别率为92%,在gimpy里的识别率为33%。里边提出了shape context 的概念,这是UCBerkely 的eecs里的一个研究成果(http://www.eecs.berkeley.edu/Research/Projects/CS/vision/shape/ )。 
我还得从shape context开始啊~呵呵,图像路漫漫其修远兮,吾将上下而求索:)

于此同时,工程上我找到了一个开源软件pwntcha ,作者是sam Hocevar 称看到现在市面上那么多卖验证码破解程序的,他改变初衷,把代码全部公布出来。虽然是三年前技术,但是还有很有意义,因为他超强的识别能力了(好多项都是 100%)。你可以在官网是用svn下载,但是下的代码不能直接使用的,而且作者的README写的很不详细,安装后更需要一些设置。 
这里我也提供下载本站的下载pwntcha ,经本人测试通过。

Linux下安装 : 
1、安装一些库(都是./configure && make && make install) 
1.1、安装imlib2-version.tar.gz 
1.2、安装SDL-version.tar.gz 
1.3、安装SDL_image-version.tar.gz 
1.4、安装opencv-version.tar.gz 
2、编译pwntcha 
2.1、产生configure脚本和Makefile (cd trunk/ && ./bootstrap) 
2.2、编译,安装 (./configure && make && make install)

此时,就会在trunk/src/目录下产生可执行文件 pwntcha,但是,程序还不能做验证码识别。你还需要做以下设置: 
在可执行文件pwntcha所在目录(默认是trunk/src/)下建立share目录。 
把 trunk/src/下的站点文件夹 (xanga,vbulletin,tickets,ticketmaster,slashdot,scode,phpbb,paypal....),移到share里边。即:share下每个文件夹下都有一个站点文件夹,这些文件夹使得pwntcha能打开这些站点的验证码图片文件。

这两大步骤之后,就能使用pwntcha了。命令是: 
Usage: ./pwntcha [OPTION]... IMAGE... 
-m, --mode <mode> force operating mode 
-s, --share <dir> specify shared dir 
-q, --quiet do not print information messages 
-h, --help display this help and exit 
-v, --version output version information and exit 
识别 
输出结果(点击见大图)

最后列出与验证码识别图像界几位值得关注的教授:


作者: 水木    
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
机器学习是一种人工智能(AI)的子领域,致力于研究如何利用数据和算法让计算机系统具备学习能力,从而能够自动地完成特定任务或者改进自身性能。机器学习的核心思想是让计算机系统通过学习数据中的模式和规律来实现目标,而不需要显式地编程。 机器学习应用非常广泛,包括但不限于以下领域: 图像识别和计算机视觉: 机器学习在图像识别、目标检测、人脸识别、图像分割等方面有着广泛的应用。例如,通过深度学习技术,可以训练神经网络来识别图像中的对象、人脸或者场景,用于智能监控、自动驾驶、医学影像分析等领域。 自然语言处理: 机器学习在自然语言处理领域有着重要的应用,包括文本分类、情感分析、机器翻译、语音识别等。例如,通过深度学习模型,可以训练神经网络来理解和生成自然语言,用于智能客服、智能助手、机器翻译等场景。 推荐系统: 推荐系统利用机器学习算法分析用户的行为和偏好,为用户推荐个性化的产品或服务。例如,电商网站可以利用机器学习算法分析用户的购买历史和浏览行为,向用户推荐感兴趣的商品。 预测和预测分析: 机器学习可以用于预测未来事件的发生概率或者趋势。例如,金融领域可以利用机器学习算法进行股票价格预测、信用评分、欺诈检测等。 医疗诊断和生物信息学: 机器学习在医疗诊断、药物研发、基因组学等领域有着重要的应用。例如,可以利用机器学习算法分析医学影像数据进行疾病诊断,或者利用机器学习算法分析基因数据进行疾病风险预测。 智能交通和物联网: 机器学习可以应用于智能交通系统、智能城市管理和物联网等领域。例如,可以利用机器学习算法分析交通数据优化交通流量,或者利用机器学习算法分析传感器数据监测设备状态。 以上仅是机器学习应用的一部分,随着机器学习技术的不断发展和应用场景的不断拓展,机器学习在各个领域都有着重要的应用价值,并且正在改变我们的生活和工作方式。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值