C#使用Tesseract OCR 解析验证码
生活随笔
收集整理的這篇文章主要介紹了
C#使用Tesseract OCR 解析验证码
小編覺得挺不錯的,現在分享給大家,幫大家做個參考.
下面介紹一個開源的OCR引擎Tesseract2。值得慶幸的是雖然是開源的但是它的識別率較高,并不比其他引擎差勁。網上介紹Tessnet2也是當時時間排名第三的識別引擎,只是后來慢慢不維護了,目前是Google在維護,大家都知道Google 在搞電子圖書館,每天都有不同類目的書被掃描成電子版。所以有G老大維護,識別率差不到哪里去。呵呵。。別鄙視我。。。
Tessnet2 是用vc ++ 開發的,其中是生成Tessnet2.dll ,我們可以通過.net 來調用內部具體類庫實現識別。
Tessnet2的使用:
1、點擊http://files.cnblogs.com/zhuxiangyu/tessnet2_32.rar鏈接下載Tessnet2.dll ,
?? Tessnet2是支持多國語的。語言包下載鏈接:http://code.google.com/p/tesseract-ocr/downloads/list
2、將Tessnet2.dll 添加到vs 引用中,和添加.net程序集一樣。
3、用Tessnet2進行識別
| 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 | WebRequest request = WebRequest.Create("http://sz.2zf.cn/js/code2.asp"); ????????????WebResponse response = request.GetResponse(); ????????????Stream st = response.GetResponseStream(); ????????????Bitmap bitmap = (Bitmap)Bitmap.FromStream(st); ?UnCodebase ud = new?UnCodebase(bitmap ); ????????????bitmap = ud.GrayByPixels(); ????????????ud.ClearNoise(128, 2); ????????????pictureBox1.Image = bitmap ; tessnet2.Tesseract ocr = new?tessnet2.Tesseract();//聲明一個OCR類 ????????????ocr.SetVariable("tessedit_char_whitelist", "0123456789"); //設置識別變量,當前只能識別數字。 ????????????ocr.Init(Application.StartupPath + @"\\tmpe", "eng", true); //應用當前語言包。注,Tessnet2是支持多國語的。語言包下載鏈接:http://code.google.com/p/tesseract-ocr/downloads/list ????????????List<tessnet2.Word> result = ocr.DoOCR(bitmap , Rectangle.Empty);//執行識別操作 ????????????string?code = result[0].Text; ????????????textBox1.Text = code; |
識別效果:
代碼下載:CSharp簡單數字驗證碼解析.rar
https://www.cnblogs.com/ppcompany/articles/2708960.html
總結
以上是生活随笔為你收集整理的C#使用Tesseract OCR 解析验证码的全部內容,希望文章能夠幫你解決所遇到的問題。
- 上一篇: .Net软件UI界面测试自动化--UIA
- 下一篇: C# Bitmap类型与Byte[]类型