自然语言处理主要有两大方向。一是以乔姆斯基为代表的语言认知学派,主张机器应具备理解并解析自然语言的能力,特别注重语法分析。乔姆斯基是当代被引用最多的学者之一,他对政治议题也十分关注,其政治观点常反映在他的时事评论中。乔姆斯基酷似他的偶像罗素,在因《句法结构》一书成名后,他逐渐从学术界转向成为社会活动家和公共知识分子。甚至因为他的政治立场,他还曾获得麻省理工学院的安保措施保护。
另一个方向则是统计学派,它始于维诺格拉德创造的对话机器人ELIZA,到如今的谷歌和Facebook所使用的神经网络算法均属此列。该学派认为翻译过程并不需要深入理解,而是纯粹的数据处理任务,而非语义分析。
这两种方法的不同之处可以通过一个典型例子来说明。比如,在人类尚未完全掌握力学原理之前,就已经能制作出弹弓。因此,乔姆斯基学派就像是那些追求彻底理解原理再动手实践的科学家,而统计学派则像是那些专注于实用工具制造而不深究原理的工程师。然而,在计算机科学领域,科学家和工程师的角色常常相互转换,许多先驱者兼具两者的身份,例如图灵和冯·诺依曼。
在中国,自然语言处理领域的佼佼者是科大讯飞,该公司同样采用了神经网络的方法。
以上内容是对自然语言处理发展历程的一个简要概述,有兴趣的读者可以进一步查阅相关资料。