Blog · Metodologia

Sistemas de IA que permanecem funcionando

A maioria dos projetos de IA em empresas de médio porte não fracassa com estrondo. Impressiona todo mundo na demonstração e depois morre em silêncio, dentro de um trimestre. O que separa um piloto de um sistema que permanece funcionando não é um modelo melhor. É disciplina de engenharia – e disciplina se ensina.

O piloto que impressionou todo mundo

Você provavelmente já viu um morrer. Aquele que iluminou a sala na demonstração – o redator de propostas, a caixa de entrada que fazia a própria triagem – já não importava para ninguém três meses depois. O estagiário que o construiu foi contratado em outro lugar. O prompt foi ficando desatualizado. Ninguém confiava o bastante na saída para parar de conferir à mão; a conferência continuou, e a certa altura virou o trabalho inteiro. Ninguém anunciou um fracasso. Não havia fracasso a anunciar. A equipe simplesmente voltou ao jeito antigo e, depois de um tempo, ninguém se lembrou de cancelar a assinatura.

Quando audito as tentativas anteriores de IA de uma empresa, esse é o padrão que encontro com mais frequência. O modelo quase nunca era o problema. A engenharia em volta do modelo era. Manter IA funcionando em uma empresa de médio porte não é um problema de pesquisa; é um problema de responsabilidade, e responsabilidade é coisa que se projeta.

Seis maneiras de um sistema morrer

Na minha experiência, projetos de IA em empresas de médio porte morrem de formas previsíveis.

Repare que nenhum desses seis pontos diz respeito à inteligência do modelo.

Um sistema que falha em silêncio perde a confiança exatamente uma vez. Depois disso, ninguém mais para de conferir à mão.”

O padrão de entrega

A disciplina que evita isso não tem nada de exótico. Uma implantação de IA funcionando merece a mesma engenharia que qualquer software sério recebe – a mesma que costumam vender às empresas de médio porte sem nunca entregar. Todo sistema que coloco no ar sai com esta lista completa, sem exceção, antes de eu considerar o trabalho pronto:

Nada disso é um argumento para construir tudo do zero. Às vezes o sistema certo se compra, em vez de se construir – expliquei como faço essa escolha em construir ou comprar IA para empresas de médio porte. Mas sistemas comprados morrem das mesmas seis mortes quando ninguém é dono deles. O padrão vale nos dois casos.

O teste

Há um teste que importa, e ele é direto: o sistema continua rodando quando quem o construiu sai da cadeira. Tudo na lista acima existe para passar nele. O dono nomeado, o runbook e o treinamento respondem quem o mantém rodando. O monitoramento e a suíte de avaliação respondem como você sabe que ainda funciona. O kill switch e o plano de contingência respondem o que acontece quando não funciona. Remova qualquer um deles e você volta ao ponto de partida: um piloto que impressionou todo mundo, morto em um trimestre.

Qualquer um consegue entregar uma demonstração. A disciplina é o que ainda roda um ano depois.

Como isso se traduz em noventa dias

Em um projeto Jovadan, esse padrão não é uma aspiração; é a definição de entregue. Ao longo de cerca de noventa dias, coloco em torno de três sistemas funcionando, um por mês, e nenhum conta antes de sair com a lista completa. Responder por IA funcionando, e não por IA em demonstração, é boa parte do que separa o papel de um fornecedor de pilotos, como expliquei em o que faz um Head de IA & Automação (um diretor de IA em regime fracionado).

É também o que torna os resultados duráveis. Os números que aparecem numa revisão de 90 dias – cerca de vinte horas por semana recuperadas, a capacidade de uma contratação em tempo integral liberada, um ganho de 15–25% na margem – só significam alguma coisa se os sistemas ainda estiverem rodando no sexto mês, com a mão do fundador no interruptor e a equipe operando sem mim. O primeiro projeto documentado, Carol Coelho Náutica, foi conduzido exatamente nesse padrão e está publicado de ponta a ponta, para você conferir em vez de acreditar.

Perguntas frequentes

Por que a maioria dos projetos de IA em empresas de médio porte fracassa?

Raramente porque o modelo não era bom o suficiente. Fracassam na operação: nenhum dono nomeado depois que quem construiu vai embora, nenhum monitoramento que faça as falhas aparecerem, nenhuma suíte de avaliação que capture regressões de qualidade e nenhuma integração ao fluxo de trabalho real. O sistema morre em silêncio e a equipe passa a contorná-lo.

O que é preciso para manter um sistema de IA funcionando?

A mesma disciplina de qualquer software funcionando: implantação na infraestrutura da própria empresa, versionada e reproduzível; monitoramento e registro para que as falhas apareçam; uma suíte de avaliação para que mudanças não regridam a qualidade em silêncio; um kill switch sob controle do dono; um runbook de uma página; e uma equipe treinada para operá-lo.

O que é uma suíte de avaliação?

Um conjunto fixo de casos de teste pelos quais o sistema precisa passar antes de qualquer mudança entrar no ar. Quando um prompt ou o modelo subjacente muda, a suíte roda com entradas conhecidas e saídas esperadas, e a queda de qualidade aparece antes de chegar a um cliente, em vez de ser descoberta semanas depois.

Click to switch to English