{"id":2648,"date":"2024-10-20T22:32:26","date_gmt":"2024-10-20T20:32:26","guid":{"rendered":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/?p=2648"},"modified":"2024-10-20T22:55:31","modified_gmt":"2024-10-20T20:55:31","slug":"reinforcement-learning-in-verschiedenen-anwendungssituationen","status":"publish","type":"post","link":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/2024\/10\/20\/reinforcement-learning-in-verschiedenen-anwendungssituationen\/","title":{"rendered":"Reinforcement Learning in verschiedenen Anwendungssituationen"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Ziel des Projekts ist es, eine KI mit der Programmiersprache \u201eScratch\u201c zu programmieren, die durch Reinforcement Learning die beste L\u00f6sung in einer gegebenen Situation finden soll. Das Grundkonzept der KI soll dabei ohne gro\u00dfe Ver\u00e4nderungen auf verschiedene Situationen anwendbar sein. Zun\u00e4chst haben wir der KI die Aufgabe gestellt, in einem selbst programmierten Spiel gegen einen Boss anzutreten und dessen durch verschiedene Attacken ausgesendete Projektile auszuweichen. <br>Daf\u00fcr benutzt der KI-Agent Raycasting und sendet in alle Richtungen Strahlen aus, durch die ungef\u00e4hr bestimmt werden kann, in welche Richtung und wie weit entfernt sich die anderen Objekte \u2013 also der Gegner und die Projektile \u2013 sowie der Bildschirmrand befinden. Diese Daten werden dann in einer Tabelle mit einer Bewegung des Spielers, also der KI, verbunden, um auf den zuvor festgestellten Zustand zu reagieren. Zun\u00e4chst sind diese Aktionen zuf\u00e4llig, und nachdem gepr\u00fcft wird, ob diese Aktion zielf\u00fchrend war, wird die Aktion entweder gespeichert oder erneut durch eine zuf\u00e4llige Bewegung ersetzt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das gleiche Konzept haben wir auch beim Gegner implementiert, sodass wir zwei KIs hatten, die einander trainieren konnten. Als weitere Anwendung des KI-Modells haben wir vor, Blackjack nachzuprogrammieren, um die KI das Spiel spielen zu lassen. Dabei wollen wir ebenfalls Reinforcement Learning nutzen, um die KI abh\u00e4ngig von ihren Karten verschiedene Spielz\u00fcge machen zu lassen.<\/p>\n\n\n\n<figure class=\"wp-block-image size-large\"><a href=\"\/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-scaled.jpg\" rel=\"lightbox[2648]\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"683\" src=\"\/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-1024x683.jpg\" alt=\"\" class=\"wp-image-2565\" srcset=\"\/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-1024x683.jpg 1024w, \/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-300x200.jpg 300w, \/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-768x512.jpg 768w, \/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-1536x1024.jpg 1536w, \/esfzweb\/esfz\/uploads\/2024\/09\/P1000447-2048x1365.jpg 2048w\" sizes=\"auto, (max-width: 1024px) 100vw, 1024px\" \/><\/a><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Anton Frommberger<\/strong> (Willst\u00e4tter-Gymnasium, N\u00fcrnberg)<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Igor Pis<\/strong> (Willst\u00e4tter-Gymnasium, N\u00fcrnberg)<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Ziel des Projekts ist es, eine KI mit der Programmiersprache \u201eScratch\u201c zu programmieren, die durch Reinforcement Learning die beste L\u00f6sung in einer gegebenen Situation finden soll. Das Grundkonzept der KI soll dabei ohne gro\u00dfe Ver\u00e4nderungen auf verschiedene Situationen anwendbar sein.&hellip; <\/p>\n","protected":false},"author":11,"featured_media":0,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[53],"tags":[],"class_list":["post-2648","post","type-post","status-publish","format-standard","hentry","category-forschungscamp-sommer-2024"],"_links":{"self":[{"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/posts\/2648","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/users\/11"}],"replies":[{"embeddable":true,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/comments?post=2648"}],"version-history":[{"count":6,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/posts\/2648\/revisions"}],"predecessor-version":[{"id":2695,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/posts\/2648\/revisions\/2695"}],"wp:attachment":[{"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/media?parent=2648"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/categories?post=2648"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.esfz.nat.uni-erlangen.de\/esfzweb\/wp-json\/wp\/v2\/tags?post=2648"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}