Искусственный интеллект научили собирать кубик Рубика
Раньше ИИ могли самостоятельно обучаться игре в шахматы и в Го. Однако система обучения с подкреплением, которая использовалась в этих случаях, не подходила для решения 3D-головоломок вроде кубика Рубика, пишет Хроника.инфо со ссылкой на Буквы
В случае с шахматами или Го ИИ достаточно легко оценить свой ход как удачный или неудачный и, исходя из этого, сделать выводы для дальнейшей игры. Но в случае с кубиком Рубика ИИ не мог быстро определить последствия принятого решения, не получал условной "награды", которая стимулирует обучение, и, соответственно, не обучался.
При создании DeepCube команда программистов во главе со Стивеном Макалиром использовали специальную систему установок. Благодаря ей после каждого хода ИИ "перепрыгивает" к уже собранному кубику и таким образом определяет "силу" ходов. Когда система собирает достаточно данных, она использует классический метод "дерева решений", проверяя каждое движение чтобы узнать, благодаря какому можно быстрее всего решить головоломку.
Программа «Молодая семья» 2026: как получить субсидию на жилье
Производственный календарь на февраль 2026: рабочие дни и отдых
Как встать на биржу труда в 2026 году: пошаговая инструкция
Банкротство физических лиц в 2026 году: новые правила, процедуры и ключевые особенности
Что такое ретроградный Меркурий и как он может повлиять на вашу жизнь
Вывод из запоя: клиника или на дому
Как правильно направить претензию контрагенту и подтвердить ее получение