Deep Reinforcement Learning

4 items

RESEARCHDEV.to AI·11/04/2026

End-to-End Deep Reinforcement Learning for Lane Keeping Assist

Este conteúdo foca na aplicação de Aprendizagem por Reforço Profunda de ponta a ponta para o desenvolvimento de sistemas de assistência à manutenção de faixa. A pesquisa explora o uso de IA avançada para aprimorar a segurança e autonomia veicular.

Deep Reinforcement Learning machine learning autonomous driving Lane Keeping Assist

RESEARCHarXiv CS.AI·13/04/2026

RAMP: Hybrid DRL for Online Learning of Numeric Action Models

RAMP propõe uma nova estratégia para aprender modelos de ação de planejamento numérico online através de interações ambientais, integrando DRL, aprendizado de modelo de ação e planejamento. Isso cria um loop de feedback positivo onde a política de RL coleta dados para refinar o modelo de ação, enquanto o planejador gera planos para continuar treinando a política de RL.

Deep Reinforcement Learning Action Model Learning Numeric Planning reinforcement learning

RESEARCHarXiv CS.AI·06/04/2026

Interpretable Deep Reinforcement Learning for Element-level Bridge Life-cycle Optimization

O artigo aborda a aplicação de Aprendizado por Reforço Profundo interpretável para a otimização do ciclo de vida de pontes em nível de elemento. Ele busca oferecer transparência e eficiência na gestão da infraestrutura.

Deep Reinforcement Learning Optimization interpretable AI Civil Engineering

RESEARCHarXiv CS.AI·07/04/2026

When Adaptive Rewards Hurt: Causal Probing and the Switching-Stability Dilemma in LLM-Guided LEO Satellite Scheduling

Este artigo de pesquisa explora o design adaptativo de recompensas para DRL no agendamento de satélites LEO, revelando um dilema de estabilidade onde pesos de recompensa estáticos superam os dinâmicos devido à necessidade de um sinal quase estacionário para o PPO. O estudo introduz um método de sondagem causal para identificar a alavancagem de termos de recompensa específicos, descobrindo que um aumento na penalidade de switching melhora significativamente a taxa de dados.

Deep Reinforcement Learning satellite scheduling Reward Design