把基于概率的自动化叫做AI是否有些可笑? — David 9
原文:An Intuitive Explanation of Connectionist Temporal Classification
聊到CTC(Connectionist Temporal Classification),很多人的第一反应是ctc擅长单行验证码识别:
是的,ctc可以提高单行文本识别鲁棒性(不同长度不同位置 )。今天David 9分享的这篇文章用几个重点直观的见解把ctc讲的简洁易懂,所以在这里就和大家一起补一补ctc 。
首先ctc算不上一个框架,更像是连接在神经网络后的一个归纳字符连接性的操作:
cnn提取图像像素特征,rnn提取图像时序特征,而ctc归纳字符间的连接特性。
那么CTC有什么好处?
因手写字符的随机性,人工可以标注字符出现的像素范围,但是太过麻烦,ctc可以告诉我们哪些像素范围对应的字符:
如上图标注“t”的位置出现t字符,标注o的区域出现o字符。 继续阅读CTC的直观理解(Connectionist Temporal Classification连接时序分类),单行文本时序分类识别的端到端方法