Usage, Effects and Requirements for AI Coding Assistants in the Enterprise: An Empirical Study
Este artigo apresenta um estudo empírico que pesquisa 57 desenvolvedores e analisa 35 levantamentos existentes para avaliar a prontidão, o impacto e os requisitos de assistentes de codificação de IA e CodeLLMs para a engenharia de software empresarial.
Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo
Imagine que você é um chef em uma cozinha enorme e de alto risco (a empresa). Durante anos, você teve que picar cada vegetal, medir cada tempero e escrever cada receita do zero. Então, um novo assistente de cozinha chega: um Assistente de Codificação de IA. É como um sous-chef superinteligente que pode sugerir receitas instantaneamente, picar vegetais em uma velocidade incrível e até escrever o menu para você.
Este artigo é um boletim de notas sobre o quão bem esse novo sous-chef está realmente trabalhando nas cozinhas corporativas do mundo real. Os autores (pesquisadores da IBM) não apenas observaram o assistente trabalhar; eles perguntaram a 57 chefs reais (desenvolvedores) de diferentes departamentos (finanças, pesquisa, vendas) como eles se sentem em relação a isso. Eles também analisaram outros 35 relatórios de todo o mundo para ver o panorama geral.
Aqui está o detalhamento de suas descobertas, usando analogias simples:
1. O Equilíbrio entre "Velocidade vs. Qualidade"
A Alegação: A maioria dos chefs se sente mais rápida. Cerca de 88% dos desenvolvedores disseram que a IA os tornou mais produtivos. Alguns disseram que eram duas vezes mais rápidos.
A Analogia: É como ter uma furadeira elétrica em vez de uma chave de fenda manual. Você pode montar prateleiras na metade do tempo. No entanto, só porque você consegue fazer um furo rápido, não significa que a prateleira esteja perfeitamente nivelada. O artigo observa que, embora a velocidade tenha aumentado, há preocupações sobre se o código (a prateleira) é seguro e fácil de consertar depois. Alguns chefs estão tão confiantes na furadeira que esquecem de verificar se a parede é sólida.
2. Um Tamanho Não Serve para Todos
A Alegação: O artigo descobriu que diferentes departamentos usam a IA para razões totalmente diferentes.
A Analogia:
- Os Pesquisadores usam a IA como um catálogo de biblioteca. Eles a utilizam para encontrar informações obscuras ou gerar conjuntos de dados complexos para testar novas teorias.
- A Equipe de Vendas usa a IA como um redator de marketing. Eles querem que ela ajude a "vender um produto" ou gerar dados sintéticos para mostrar aos clientes.
- Os Engenheiros de Software usam a IA como um corretor ortográfico e preenchimento automático. Eles querem que ela escreva códigos chatos e repetitivos para que possam focar no design criativo do aplicativo.
- A Conclusão: Você não pode dar a mesma configuração de ferramenta para todos. Uma abordagem de "tamanho único" não funciona; a IA precisa ser adaptada ao trabalho específico.
3. O Problema do "Confie, mas Verifique"
A Alegação: Os desenvolvedores mantêm cerca de 25% a 50% do código que a IA escreve. Eles não apenas copiam e colam tudo.
A Analogia: Pense na IA como um estagiário júnior. O estagiário é ótimo para redigir um relatório, mas pode inventar fatos ou usar o tom errado. O desenvolvedor sênior (o humano) tem que ler cada palavra, corrigir os erros e garantir que o texto esteja correto.
- Se a IA escrever um código que parece perfeito, mas possui uma falha de segurança oculta (como uma fechadura que parece bonita, mas não tranca de fato), o humano tem que detectá-la.
- O artigo descobriu que, se a IA cometer erros demais, ou se o humano tiver que gastar mais tempo corrigindo o trabalho da IA do que escrevendo o código por conta própria, a ferramenta se torna um fardo, não uma ajuda.
4. O Que os Chefs Querem a Seguir (A Lista de Desejos)
Os desenvolvedores disseram aos pesquisadores exatamente o que precisam que o "super sous-chef" faça a seguir. Eles dividiram esses pedidos em duas categorias:
Pedidos de Curto Prazo (A lista "Corrigir as Falhas"):
- Melhor Memória: A IA precisa conhecer a cozinha inteira, não apenas o balcão onde está parada. Ela precisa entender todo o código-fonte (o histórico de todo o restaurante) sem se confundir.
- Integração Fluida: Pare de nos fazer alternar janelas. A IA deve estar dentro da ferramenta que usamos, como um timer de forno embutido, e não um aplicativo separado que temos que abrir.
- Honestidade: Se a IA não tiver certeza, ela deve dizer: "Não tenho 100% de certeza sobre isso", em vez de dar uma resposta errada com confiança.
Pedidos de Longo Prazo (A lista "Sonho de Ficção Científica"):
- O Arquiteto: Em vez de apenas picar vegetais, a IA deve ser capaz de projetar todo o layout da cozinha do zero, baseando-se em uma ideia vaga.
- O Agente Autônomo: A IA deve ser capaz de gerenciar todo o turno. Ela deve ser capaz de encontrar um erro, corrigi-lo, testá-lo e enviar o trabalho sem que o humano precise tocar nele.
- O Especialista: Ela precisa conhecer as regras específicas do edifício (conformidade, leis de segurança) para não quebrar a lei acidentalmente enquanto cozinha.
5. A Lacuna do "Dever de Casa"
A Alegação: A maioria dos estudos existentes focou apenas em estudantes ou tarefas muito específicas. Este estudo olhou para profissionais reais e experientes em grandes empresas.
A Analogia: Estudos anteriores foram como testar um carro novo em uma pista de corrida silenciosa e vazia com pilotos de teste. Este estudo dirigiu esse carro no trânsito de hora do rush com passageiros reais. Eles descobriram que, embora o carro seja rápido, o trânsito (regras complexas de empresas, segurança, diferentes linguagens) torna o uso mais difícil do que os testes na pista de corrida sugeriam.
Resumo
O artigo conclui que os assistentes de codificação de IA são um poderoso impulsionador de produtividade, mas não são mágicos. Eles são como um parceiro júnior muito rápido, muito conhecedor, mas ocasionalmente alucinante.
- Bom: Eles economizam tempo em tarefas chatas e ajudam as pessoas a aprender novas linguagens.
- Ruim: Podem introduzir brechas de segurança e nem sempre entendem o contexto específico das regras únicas de uma empresa.
- Futuro: Para serem verdadeiramente úteis, eles precisam deixar de ser apenas um "preenchimento automático" e começar a se tornar "arquitetos autônomos" que entendem todo o projeto, não apenas a linha de código que estão digitando no momento.
Os autores enfatizam que precisamos parar de tratar essas ferramentas como uma solução de "configurar e esquecer" e começar a tratá-las como um parceiro colaborativo que exige supervisão humana, customização e construção de confiança.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.