Для обучения искусственного интеллекта однажды хватило 304 спичечных коробков и разноцветных бусин.

Для обучения искусственного интеллекта однажды хватило 304 спичечных коробков и разноцветных бусин. Электричество вообще не понадобилось.

В начале 1960-х исследователь Дональд Мичи собрал из них MENACE — машину, которая училась играть в крестики-нолики. С каждой серией партий она могла улучшать свою игру: опыт буквально накапливался внутри коробков.

Каждый коробок соответствовал определённой позиции на поле, а цвет бусины обозначал возможный ход. Из нужного коробка наугад вытаскивали бусину и делали ход.

Если машина выигрывала, в использованные коробки добавляли бусины выбранных цветов. Если проигрывала — убирали сыгранные бусины.

Удачные ходы выпадали всё чаще, неудачные — всё реже. Так выглядело обучение с подкреплением, которое можно потрогать руками.

Правда, коробки сами не открывались: человек находил нужный, вытаскивал бусину и менял их количество после партии. Он выполнял механическую работу, а выбор хода определялся содержимым коробка и случайностью.

MENACE наглядно показывала, как система может улучшать стратегию без готового списка правильных ходов.

Больше историй об ИИ — в «сбежавшей нейросети»: https://t.me/ai_exee

Источник