Les racines du traitement du langage naturel peuvent être retracées jusqu'aux années 1950. L'article d'Alan Turing "Computing Machinery and Intelligence", publié en 1950, proposait le test de Turing comme moyen d'évaluer l'intelligence. Le test comportait une tâche nécessitant l'interprétation et la génération automatiques du langage naturel, bien qu'à cette époque, il ne s'agissait pas encore d'un problème distinct de l'intelligence artificielle.
Le traitement du langage naturel (Natural Language Processing, NLP) est un domaine interdisciplinaire qui englobe la linguistique, l'informatique et l'intelligence artificielle. L'accent est mis sur le développement de programmes informatiques capables de traiter et d'analyser de grandes quantités de données en langage naturel afin de saisir avec précision le contexte des documents. De cette manière, ils peuvent extraire des informations et des connaissances précieuses des documents et organiser et catégoriser les documents eux-mêmes.
Les défis posés par le traitement du langage naturel concernent souvent la reconnaissance vocale, la compréhension du langage naturel et la génération du langage naturel.