zurück zur Suche
Du lernst Methoden des Approximate Dynamic Programming (ADP) und Reinforcement Learning (RL) zur Lösung sequentieller Entscheidungsprobleme. Am Ende kannst du grundlegende Modelle und Algorithmen beschreiben, Ableitungen nachvollziehen sowie einfache ADP/RL-Methoden implementieren und auf einfache (z. B. robotische) Aufgaben anwenden.
Aus dem laufenden Semester, unverbindlich. Von mehreren Gruppen besucht man eine; der Stundenplan schlägt automatisch die mit den wenigsten Überschneidungen vor.
Noch keine Bewertungen für dieses Modul.
Fülle nur die Kategorien aus, die du beurteilen kannst – je Kategorie entweder Sterne und Text zusammen oder gar nichts.
Bewertungen werden vor der Veröffentlichung automatisch geprüft.
Offizielle Seite in TUMonline · Angaben unverbindlich.