Для обучения искусственного интеллекта однажды хватило 304 спичечных коробков и разноцветных бусин.
Для обучения искусственного интеллекта однажды хватило 304 спичечных коробков и разноцветных бусин. Электричество вообще не понадобилось.
В начале 1960-х исследователь Дональд Мичи собрал из них MENACE — машину, которая училась играть в крестики-нолики. С каждой серией партий она могла улучшать свою игру: опыт буквально накапливался внутри коробков.
Каждый коробок соответствовал определённой позиции на поле, а цвет бусины обозначал возможный ход. Из нужного коробка наугад вытаскивали бусину и делали ход.
Если машина выигрывала, в использованные коробки добавляли бусины выбранных цветов. Если проигрывала — убирали сыгранные бусины.
Удачные ходы выпадали всё чаще, неудачные — всё реже. Так выглядело обучение с подкреплением, которое можно потрогать руками.
Правда, коробки сами не открывались: человек находил нужный, вытаскивал бусину и менял их количество после партии. Он выполнял механическую работу, а выбор хода определялся содержимым коробка и случайностью.
MENACE наглядно показывала, как система может улучшать стратегию без готового списка правильных ходов.
Больше историй об ИИ — в «сбежавшей нейросети»: https://t.me/ai_exee