← Últimos artigos
💻 computer science

RubriQ: Rubric-Guided Group Relative Policy Optimization for Constraint-Aware Quantum Circuit Synthesis

O RubriQ é um framework escalável, impulsionado por HPC, que aproveita a Otimização de Política Relativa de Grupo (GRPO) guiada por rubricas para automatizar a síntese de circuitos quânticos que satisfazem simultaneamente a correção algorítmica, a minimização de custo de código de superfície e as restrições de hardware de curto prazo.

Autores originais: Ziqing Guo, Ziwen Pan

Publicado 2026-08-03
📖 7 min de leitura🧠 Leitura aprofundada

Autores originais: Ziqing Guo, Ziwen Pan

Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você esteja tentando construir uma máquina capaz de resolver problemas impossíveis para qualquer computador que temos hoje. Esta máquina é um computador quântico, um dispositivo que utiliza as regras estranhas de partículas minúsculas para fazer matemática em uma velocidade vertiginosa. Mas aqui está o problema: essas máquinas são incrivelmente frágeis. Para fazê-las funcionar, precisamos traduzir nossas ideias grandes e complexas para uma linguagem de "portas" (como interruptores) muito específica e de baixo nível que a máquina entenda.

O problema é que essa tradução é um pesadelo. Se você apenas pedir a um computador padrão para fazê-la, a matemática se torna tão grande que ele trava. Se você tentar construir a máquina com a tecnologia de hoje, ela é muito ruidosa e propensa a erros. Assim, os cientistas estão presos em um meio termo: eles precisam projetar circuitos que sejam perfeitos o suficiente para as supermáquinas do futuro, mas simples o suficiente para serem executados nos protótipos instáveis de hoje. É como tentar escrever uma receita para um banquete de cinco estrelas que uma criança possa cozinhar sem queimar a cozinha.

Apresentamos o RubriQ, uma nova ferramenta que atua como um editor superinteligente e incansável para essas receitas quânticas. Em vez de apenas adivinhar e testar, o RubriQ usa uma IA gigante que aprende ao tentar milhares de variações ao mesmo tempo, guiada por uma "rubrica" rigorosa (uma folha de notas) que lhe diz exatamente como melhorar. Ele não busca apenas o "bom o suficiente"; ele caça o equilíbrio perfeito entre ser matematicamente impecável e ser prático o suficiente para rodar em hardware real agora mesmo.


A História do RubriQ: Ensinando uma IA a Ser uma Arquiteta Quântica

Pense em projetar um circuito quântico como pedir a um aluno que escreva uma história. No passado, se você pedisse a um computador para escrever um programa quântico, era como dar a um aluno um comando vago como "Escreva algo legal" e esperar que ele não inventasse bobagens. Se ele errasse, você apenas dizia: "Não, tente de novo", sem ter ideia do porquê estava errado. Isso é o que os métodos antigos faziam: eles forneciam uma "recompensa esparsa", o que significa que a IA só ganhava um ponto se a resposta fosse 100% perfeita, e zero pontos para todo o resto. Isso tornava o aprendizado incrivelmente lento e frustrante, como tentar aprender a andar de bicicleta no escuro.

O RubriQ muda o jogo ao atuar como um professor rigoroso, porém prestativo, com uma rubrica de avaliação detalhada. Em vez de apenas dizer "Passou" ou "Falhou", ele divide a nota em cinco categorias específicas:

  1. Funcionou? (A história faz sentido).
  2. É eficiente? (Usou palavras demais? Em termos quânticos, isso é sobre minimizar as "portas T", que são as partes caras e famintas por recursos do código).
  3. É carregado de Clifford? (Existem muitos movimentos sofisticados e difíceis de fazer, ou a maioria é simples?).
  4. Rodará nas máquinas de hoje? (Ele se ajusta ao formato específico do hardware, como encaixar um pino quadrado em um buraco redondo?).
  5. É rápido? (Quantos passos ele leva?).

O artigo apresenta um método chamado Otimização de Política Relativa de Grupo (GRPO). Imagine que a IA é um chef tentando inventar um novo prato. Em vez de cozinhar uma refeição e esperar por uma crítica, o RubriQ pede ao chef para cozinhar oito versões diferentes do prato ao mesmo tempo. Então, ele as compara entre si. Se uma versão for ligeiramente melhor que as outras, a IA aprende a fazer mais daquela. Se uma for um desastre, ela aprende a evitar esse caminho. Essa comparação em "grupo" é muito mais rápida e estável do que esperar por uma única resposta perfeita.

Como Eles Construíram a Máquina

Para fazer isso funcionar, os pesquisadores tiveram que construir um motor massivo. Eles não podiam simplesmente rodar isso em um laptop; precisavam do poder do NERSC Perlmutter, um cluster de supercomputação no Lawrence Berkeley National Laboratory. Eles usaram 8 GPUs NVIDIA A100 (as placas de vídeo de alto desempenho usadas para IA) para rodar a simulação.

Aqui está a parte inteligente: a IA não apenas adivinha. Ela usa uma rubrica programática. Isso significa que o "professor" não é uma rede neural de caixa-preta que pode ficar confusa; é um conjunto de regras codificadas que verificam a matemática, o custo e os limites do hardware instantaneamente. Se a IA gerar um circuito que pareça legal, mas falhe na matemática, a rubrica lhe dá zero imediatamente. Se ela gerar um circuito que funciona, mas usa muitas "portas T" caras, a rubrica dá uma pontuação menor, incentivando-a a ser mais eficiente.

Eles também resolveram um gargalo importante: a velocidade de simulação. Verificar se um circuito quântico funciona geralmente exige simular tudo, o que se torna exponencialmente mais difícil à medida que você adiciona mais qubits (bits quânticos). O RubriQ integra o CUDA-Q, uma ferramenta que permite que eles executem essas simulações diretamente nas GPUs, tornando o processo milhares de vezes mais rápido do que rodar em uma CPU padrão.

O Que Eles Descobriram

Os resultados são promissores, embora os autores tenham o cuidado de apresentá-los como um passo significativo à frente, e não como uma solução mágica.

  • Funciona melhor que os métodos antigos: Ao ser testado em 1.500 tarefas quânticas diferentes, o RubriQ alcançou uma taxa de aprovação de 96% de correção. Isso significa que quase todas as vezes que tentou, produziu um circuito que realizou a matemática corretamente.
  • É muito mais eficiente: A métrica mais importante para computadores quânticos é a "contagem T" (o número de portas caras). O RubriQ conseguiu comprimir o número dessas portas em uma média de 3,31 vezes em comparação com circuitos que eram apenas "corretos", mas não otimizados. Isso é um grande avanço, pois menos portas T significam que o computador precisa de menos recursos e menos tempo para rodar.
  • Aprende mais rápido: Por usar essas rubricas detalhadas em vez de esperar por uma pontuação perfeita, o RubriQ convergiu (aprendeu a tarefa) de 2 a 3 vezes mais rápido do que outros métodos de aprendizado por reforço que dependem de recompensas esparsas.
  • Está pronto para o hardware real: A equipe não parou apenas nas simulações. Eles pegaram os melhores circuitos gerados pelo RubriQ e os executaram em computadores quânticos reais da IBM e da IonQ. Eles descobriram que os circuitos eram compatíveis com essas máquinas, com menos de 1% de violação das restrições de hardware.

O Que Isso Significa

O artigo sugere que, ao tratar a síntese de circuitos quânticos como uma tarefa de geração de código guiada por uma rubrica rigorosa e multidimensional, podemos automatizar a criação de programas quânticos de alta qualidade. Ele argumenta contra a ideia de que precisamos de redes "críticas" complexas e aprendidas para julgar o trabalho da IA; em vez disso, um sistema de pontuação claro e baseado em regras funciona melhor e é mais barato de executar.

Embora o artigo não afirme ter resolvido todos os problemas da computação quântica, ele demonstra um caminho viável a seguir. Ao combinar o poder criativo dos Modelos de Linguagem de Grande Escala (LLMs) com a disciplina rigorosa de uma rubrica programática, o RubriQ oferece uma maneira de projetar circuitos que não são apenas matematicamente sólidos, mas também práticos o suficiente para rodar nas máquinas ruidosas e imperfeitas que temos hoje, enquanto nos prepara para os gigantes tolerantes a falhas do futuro. É uma ponte entre a realidade caótica do hardware atual e o mundo prístino da futura computação quântica.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →