Джонс, Карен Спарк


Карен Спарк Джонс (член британской академии[⇨]; 26 августа 1935 — 4 апреля 2007) британский учёный в области информатики.

Спарк внесла значительный вклад в две отдельные области: информационный поиск (ИП) и обработка естественного языка (ОЕЯ). В последние годы своей жизни она занималась интеграцией этих направлений в основные блок-схемы ИИ. Её наиболее важным вкладом является создание концепции учёта весов слов обратной частоты документа (IDF), которую она описала в статье в 1972-м году[⇨]. На сегодняшний день IDF используется во многих поисковых системах, как правило, в составе схемы TF-IDF.

Карен Спарк Джонс[2][3] родилась в городе Хаддерсфилде графства Йоркшир в Англии. Её отцом был Оуэн Джонс — преподаватель химии, а матерью — норвежка Ида Спарк, которая переехала в Великобританию во время Второй мировой войны. Оуэн и Ида покинули Норвегию на одном из последних кораблей после немецкого вторжения в 1940 году.[4]

Карен Спарк Джонс обучалась в гимназии Хаддерсфилд, а затем в Кембриджском колледже с 1953 по 1956 года. Там изучала историю, но на последнем году обучения увлеклась философией (тогда она называлась Моральные науки (англ. Moral Sciences)) и после окончания обучения приняла приглашение Маргарет Мастерман  (англ.)[5] на вступление в языковой исследовательский отдел Кембриджского университета (ЯИОКУ). Прежде чем перейти к исследовательской работе в области информатики, она недолго проработала учителем в школе.

Статья, написанная Спарк совместно с Мастерман и Нидхемом, и опубликованная в 1958 году, называется «Аналогия между машинным переводом и поиском в библиотеке»[6]. В 1968 году Спарк перевели из ЯИОКУ в компьютерную лабораторию при Кембриджском университете  (англ.), к тому времени она уже 3 года была сотрудником Ньюнхем-колледжа  (англ.), а затем стала членом Лондонского королевского общества. Там она начала свою карьеру в области ИП, в которой она стала мировым авторитетом.