Теория самообучающейся программы - Форум «Всё о Паскале»

Сайт «Всё о Паскале»

Помощь Пользователи Поиск

Форум «Всё о Паскале» > Разработка ПО, алгоритмы, общие вопросы > Алгоритмы

Теория самообучающейся программы, на примере монополии

Опции

RathaR	1.08.2009 13:30 Сообщение #1
Знаток Группа: Пользователи Сообщений: 346 Пол: Мужской Реальное имя: Иван Репутация: 7	Вот, меня весьма заинтересовала идея Lappa , о написании кокой нибуть вариации монополии, с самообучающимся ИИ. Погуглил я на эту тему, но единственное что нашёл, это описание принципа роботы с крестиками-ноликами и много бредней про то что машины зохавают мир Поэтому и решил создать тему здесь, об самообучении ИИ в общем, и об монополии в частности. Так вот, как я это представляю: допустим в игре участтвуэт самообучающийся ИИ, и человек/жёстко заданый ИИ. Весь процес самообучения происходит следующим образом (поправте или скоординируйте меня если неправ): Человек/жёстко заданый ИИ делает ход, попадая на определённый участок(правила монополии я думаю всем известны ему нужно определить что делать дальше - либо купить его либо пустить на аукцион. Этот выбор он делает исходя их жёстких формул, определяя степень "необходимости" для него этого участка, он учитывает его стоимость, наличие у него участков такогоже цвета, арендную плату, суму денег в наличии а также степень нужности этого участка для противника, а если противнику он некчему, то может сдать этот участок на аукцион(!) чтобы попробывать купить его подешевле. В это время самообучающийся ИИ следит за действиями человека/жёстко заданого ИИ, и у себя в памяти записывает ситуацию и решение опонента(допустим у него в памяти есть ячейка для каждого участка, и в соответствующую ячейку он записывает: суму денег которая была у опонента, кол-во участков, как других так и такогоже цвета, рентабельность участка, и т.д, ну и наконец решение которое принял его опонент) дальше если в игре самообучающийся ИИ попадёт на етот участок, он сравнит ту ситуацию что сейчас у него (суму денег друг участки, рентабельность), и те ситуации что были у его противника, что у него записаны, и выберет то решение которое противник принял в наиболее похожей ситуации (тоесть под ситуацией я подразумеваю економ состояние игрока). Вот так и будет продолжаться игра, кроме того, самообучающийся ИИ будет записывать каждый раз когда его опонент заложит какой либо участок, или возьмёт зсуду в банке, и в случае возникновения похожей ситуации, будет поступать также, брать похожую зсуду, закладывать примерно равноценный участок. Ставить дома и отели на своих участках он тоже будет только после того как "научиться " этого у опонента. Хух, теперь о следуюющем После всего этого у меня возник ряд вопросов: 1) Всётаки монополия - это не крестики нолики, и каждая игра займёт время, такчто обучаться он будет медленно, в связи с этим появляеться необходимость сделать "автоматический режим " в игре, когда она будет играть сама з собой опр кол-во партий, чтобы достигнуть того или иного уровня знаний? 2) А вообще реально ли это зделать?, я имею в виду, не будет ли это всё занимать огромные обьёмы памяти, и не будет ли ИИ думать по 10 мин? ( прошу дать хоть приблизительную оценку, по даному алгоритму, потомучто мне самому очень тяжело об этом судить) 3) Правильно я уразумел алгоритм хотябы в общих чертах? Очень прошу поправить меня там где неправ И с удовольствием выслушаю другие идеи по поводу этой же темы, или алгоритма. И вообще мне кажеться что всё это не очень сложно в реализации, сложности могут возникнуть лишь с интерфейсом, графикой, а в общих чертах алгоритм сравнительно прост, или я не прав? З.Ы. Lappу +1 за идею (уж очень она мне понравилась ) Сообщение отредактировано: RathaR - 1.08.2009 17:15 -------------------- Считающий себя единственым здравомыслящим человеком сумасшедший? Если да, возможно я псих... Пусть умолкнет всякий критик! Я - системный аналитик!

Ответов

andriano	14.09.2009 12:26 Сообщение #2
Гуру Группа: Пользователи Сообщений: 1 168 Пол: Мужской Реальное имя: Сергей Андрианов Репутация: 28	1. Под обучением обычно понимается совсем не тот процесс, что описан в первом сообщении. Там было "Запомнить, как поступил оппонент, и делать так же, как он". На самом деле обучение состоит примерно в следующем: - на основе некоторой функц с настраиваемыми коэффициентами осуществляем выбор хода. - ходим. - ждем некоторое время (обычно не ранее окончания ответного хода оппонента и не позднее конца игры), когда будет ясно, "хорош" или "плох" оказался сделанный ход. - вносим изменения в настроечные коэффициенты нашей функции таким образом, чтобы увеличить вероятность выбора "хороших" ходов и уменьшить "плохих" в дальнейшем. 2. Процесс обучения - весьма длителен по времени, поэтому в подавляющем большинстве случаев человеку надоест играть раньше, чем ИИ завершит хотя бы первый цикл обучения. Поэтому IMHO реализация обучения непосредственно в процесссе игры утопична (кроме небольшого числа частных случаев игр, где по самому характеру игры возможно провести процесс обучения быстро), а обучение ИИ может быть целесообразно лишь на стадии тестирования и балансировки игры.

Сообщений в этой теме

RathaR Теория самообучающейся программы 1.08.2009 13:30

Lapp +1 за идею (уж очень она мне понравилась :) )bltzИ... 2.08.2009 9:02

RathaR эм...я,не сильно розбираюсь в теории графов, скаж... 2.08.2009 13:29

Lapp эм...я,не сильно розбираюсь в теории графов, ... 8.08.2009 1:28

RathaR Я обещал "покумекать и написать" - вот,... 8.08.2009 23:19

Гость > признателен что эта тема не канула в небытие ... 9.08.2009 3:16

Lapp Предыдущий пост мой. Странно, вроде я входил... 9.08.2009 3:24

RathaR Я так понял что речь идёт о приоритетах при срав... 9.08.2009 12:17

andriano 1. Под обучением обычно понимается совсем не тот п... 14.09.2009 12:26

Lapp 1. Под обучением обычно понимается совсем не тот п... 15.09.2009 0:52

andriano ...ходы ... победителя считаются хорошими, и их ве... 15.09.2009 17:36

Lapp Ну, в частном случае может быть и так.Я и не говор... 16.09.2009 1:44

RathaR [b]RathaR, ты следишь за темой? И как дела с тво... 16.09.2009 19:03

andriano Я не спец в этой терминологии, но трудно согласить... 17.09.2009 17:30

Shuruper Я представляю решение этой задачи путем анализа ош... 20.09.2009 19:35

Lapp (гипотеза!)Гипотезы - это хорошо, но ты не ука... 21.09.2009 10:10

Shuruper - вот с этого места, пожалуйста, поподробнее.. И... 21.09.2009 14:51

Lapp файл может содержать все что угодно, начиная прост... 22.09.2009 0:54

andriano Гипотезы - это хорошо, но ты не указал ни механиз... 21.09.2009 22:15

RathaR По поводу самого алгоритма "300 коробков... 30.10.2009 15:34

Lapp может существуют другие самообучающиеся алгоритмы,... 31.10.2009 1:13

andriano Самообучение подразумевает обязательное наличие об... 31.10.2009 10:03

Lapp пришло в голову любопытное соображение: в технике ... 3.11.2009 8:42

« Предыдущая тема · Алгоритмы · Следующая тема »

2 чел. читают эту тему (гостей: 2, скрытых пользователей: 0)

Пользователей: 0

Режим отображения: Переключить на: Стандартный · Переключить на: Линейный · Древовидный

Подписка на тему · Сообщить другу · Версия для печати · Подписка на этот форум

Текстовая версия

18.07.2026 15:48

Хостинг предоставлен компанией "Веб Сервис Центр" при поддержке компании "ДокЛаб"