Люди соревнуются друг с другом, забыв, что они никогда не обыграют программу

В 2014 году эксперт пишет: прогноз о том, что через десять лет машина победит человека в го, кажется оптимистичным. Сами игроки считают, что это не машинная задача. При этом в начале 2014 года британская компания Deep Mind, купленная Google, начала работу над проектом AlphaGo. Пока эксперт предсказывал будущее, они его строили.

6

В 2015 году, когда AlphaGo уже на равных играл с европейскими чемпионами, другой эксперт написал, что игра в го по-прежнему не поддаётся компьютерам, ведь в ней нужна интуиция и другие исключительно человеческие качества.

Через несколько месяцев после этого, в начале 2016 года, прошёл матч между AlphaGo и профессиональным игроком в го Ли Седолем. В матче из пяти партий Седоль выиграл одну, AlphaGo — четыре. После этого Всемирная федерация го решила запретить использование смартфонов на чемпионатах по го.

Одновременно появилось огромное количество статей и заявлений о том, что Ли Седоль выиграл одну партию в условиях стресса, поэтому у человечества остаётся надежда. В конце 2017 года в Москве пройдет фестиваль научно-популярного кино «360», его проводит Политехнический музей. В рамках программы будет представлен документальный фильм под названием AlphaGo.

Я смотрел его и остался недоволен. Это фильм про то, как Ли Седоль отстаивает честь человечества в го, а создатели AlphaGo выглядят как толпа программистов, тычущих пальцами в экран. Уверен, со стороны команды AlphaGo было вложено не меньше умственных усилий, чем со стороны Ли Седоля.

После Седоля китаец Ки Цзе, признанный лучшим в мире игроком в го, пообещал победить AlphaGo. Сыграв в мае 2017 года одну партию, он проиграл всухую.

Надо понимать, что алгоритмы, которые обыгрывают человека в го, учатся, играя сами с собой. Они не знают никаких стратегий, в них не заложено ничего, кроме формальных правил игры. Они играют сами с собой и поэтому совершенствуются непрерывно. Они набирают такой опыт, который никогда не получит ни один человек.

После победы над Ли Седолем AlphaGo играла с Ки Цзе, но также сыграла ещё несколько миллионов партий сама с собой. Ки Цзе просто не осознавал, что у него нет шансов. После победы программы над Цзе создатели AlphaGo объявили, что закрывают проект, потому что дальше уже неинтересно. Они опубликовали лучшие партии из сыгранных AlphaGo с самой собой, чтобы все могли увидеть игру нечеловеческого уровня. Пара моих знакомых фанатов го говорят, что это действительно нечто невозможное.

После этого игроки и учёные заговорили про покер — это ещё одна игра, которая считается недоступной машинам, потому что там надо хитрить и жульничать. Итог понятен. Машине не показывали лучшие партии в покер, а просто дали правила и сказали: «Поиграй сама с собой, а потом — с лучшими игроками мира».

В августе 2017 года бот — то есть очередная программа с машинным интеллектом — обыграл живого игрока в Dota 2. Многие говорили, что он победил, потому что игра была один на один. Dota — это командная игра. Считается, что машины никогда не победят команду людей. Возможно, но следующее, чему будет учиться команда ботов, — играть друг с другом, команда на команду.

Машины быстро вырабатывают качества, которые считаются исключительно человеческими: умение договариваться, полагаться на интуицию и прочие. «Вырабатывают» — это значит, что их никто не программирует. На этом моменте начинается непонимание.

В «Яндексе» мы решили пойти другим путем и не экспериментировать с играми. Мы посмотрели, могут ли современные способы машинного обучения решать творческие задачи, которые считаются сугубо человеческой прерогативой. Оказалось, что могут.

Создание музыки при помощи алгоритмов

Самое ценное для меня в этом ролике — мнение Маши Черновой. Легко написать нейронной сеткой то, что понравится нам самим. Но что скажут эксперты? Примут за своего или нет? Приняли. Конечно, есть и другая точка зрения. Есть люди, которые по-прежнему говорят: нет, я чувствую, что это писал не человек. Возможно.

Мы убедились, что во всяком случае у нас есть шанс на интересное творческое партнёрство. Можно прийти в музей Скрябина с композицией, написанной нейросетью под руководством Вани (Иван Ямщиков, консультант «Яндекса» — vc.ru) и Леши (Алексей Тихонов, ведущий аналитик «Яндекс.Дзена» — vc.ru), а сотрудники музея найдут композиторов, пригласят Петра Термена — правнука Льва Термена, создателя терменвокса.

Все они очень вдохновлены и ради выступления на конференции «Яндекса» собираются, репетируют и играют эту музыку. Это хорошая иллюстрация того, как люди и машины работают вместе, решая творческую задачу.

В процессе работы Ивану и Алексею пришлось написать научную статью, в которой они описали изобретённый ими автоматический механизм преобразования. Во введении к этой работе есть любопытная фраза о том, что задачи, которые считались сугубо человеческими из-за интуитивной или творческой направленности, становятся доступны алгоритмическим решениям. Музыка — лишь один пример из множества.

7