← Últimos artigos
🤖 machine learning

The Sample Complexity of Policy Learning with Mu-Resets

Este artigo resolve o papel da realizabilidade de política na complexidade de amostra do aprendizado de política sob o protocolo de μ\mu-resets ao demonstrar que a dependência em relação ao horizonte HH é exponencialmente grande (exp(Ω(H))\exp(\Omega(H))) sob concentrabilidade de todas as políticas limitada, mas significativamente reduzida para exp(Θ(H))\exp(\Theta(\sqrt H)) sob concentrabilidade de pushforward limitada.

Autores originais: Gene Li

Publicado 2026-08-11
📖 1 min de leitura☕ Leitura rápida

Autores originais: Gene Li

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Ainda não há explicação disponível neste idioma.

Tente: AR, DE, EN, ES, FR, HI, IT, JA, KO, NL, PT, ZH

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →