Programação dinâmica simbólica aproximada e assíncrona para processos de decisão markovianos com variáveis contínuas

Vianna, Luis Gustavo Rocha

doi:10.11606/D.45.2015.tde-20230727-113351

Home

Facilities

Master's Dissertation

DOI

https://doi.org/10.11606/D.45.2015.tde-20230727-113351

Document

Master's Dissertation

Author

Vianna, Luis Gustavo Rocha (Catálogo USP)

Full name

Luis Gustavo Rocha Vianna

Institute/School/College

Instituto de Matemática e Estatística

Knowledge Area

Computer Science

Date of Defense

2015-05-18

Published

São Paulo, 2015

Supervisor

Barros, Leliane Nunes de (Catálogo USP)

Title in Portuguese

Programação dinâmica simbólica aproximada e assíncrona para processos de decisão markovianos com variáveis contínuas

Keywords in Portuguese

Inteligência Artificial
Programação Dinâmica

Abstract in Portuguese

Este trabalho trata o problema de planejamento em inteligência artificial, mais especificamente, planejamento probabilístico com variáveis contínuas. Aplicações de planejamento em inteligência artificial, em geral, envolvem recursos contínuos, portanto é necessário que os agentes raciocinem com modelos que representem variáveis contínuas. Uma solução exata, recentemente proposta, para uma classe de problemas de planejamento probabilístico é a programação dinâmica simbólica - PDS, que é capaz de resolver de maneira eficiente problemas com variáveis discretas e contínuas, utilizando manipulação simbólica. Essa técnica resolve problemas com variáveis contínuas manipulando expressões definidas por casos que envolvem essas variáveis para obter a expressão da solução exata. No entanto, a manipulação envolve um aumento no número de casos usados na expressão, de forma que a representação exata das soluções pode se tornar intratavelmente custosa. Neste trabalho, pretendemos adaptar a PDS com uma técnica de aproximação que permite controlar o crescimento da complexidade das expressões em troca de um pequeno erro em seus valores. A maneira como pretendemos simplificar as expressões é baseada em reduzir o número de casos numa expressão simbólica, o que é feito unindo regiões de casos diferentes que apresentam valores próximos. Além disso, a eficiência da PDS pode ser melhorada modificando qual o cálculo usado para obter a expressão da solução. Uma forma de evitar cálculos desnecessários é utilizar a informação do estado inicial e fazer uma busca heurística a partir dele, restringindo a região de valores para os quais precisamos da solução ótima. Assim, pretendemos criar dois novos algoritmos que usam a manipulação simbólica das expressões com variáveis contínuas, adicionando componentes de técnicas recentes para planejamento probabilístico discreto.

Title in English

Approximate and asynchronous symbolic dynamic programming for Markov decision processes in continuous spaces

Abstract in English

This work is a study on the planning problem in artificial intelligence, specifically probabilis- tic planning in continuous spaces. The efficient solution of planning problems is a major goal in artificial intelligence and can be applied extensively in autonomous agents. In many applications, the modelled problem contains continuous resources, so that an optimal planner must reason over continuos quantities to obtain appropriate actions. A recent and exact solution is Symbolic Dyna- mic Programming, which extends discrete probabilistic planning solutions to continuous problems by using a symbolic representation of state variables. This solution is interesting because it can find optimal solutions, however it is limited in efficiency because it relies on standard dynamic pro- gramming and doesn2019t use initial state information or heuristic search. On this work, I will extend Symbolic Dynamic Programming to use more efficient dynamic programming approaches, based on recent solutions for discrete probabilistic planning. A novel planner using symbolic representation and heuristic search is proposed and compared to previous works on relevant continuos scenarios.

WARNING - Viewing this document is conditioned on your acceptance of the following terms of use:
This document is only for private use for research and teaching activities. Reproduction for commercial use is forbidden. This rights cover the whole data about this document as well as its contents. Any uses or copies of this document in whole or in part must include the author's name.

ViannaLuisGustavoRocha.pdf (3.59 Mbytes)

Publishing Date

2023-07-27

Derived works

WARNING: Learn what derived works are clicking here.