///
Uma equipe de planejamento da SEPLAG está preparando um conjunto de dados para análise em Python, usando Pandas. O DataFrame df contém informações sobre projetos estratégicos, incluindo colunas como projeto , responsavel , orcamento , prazo_dias e cpf_responsavel . Durante a análise exploratória, foram identificados valores ausentes em prazo_dias , duplicatas em projeto e valores extremos em orçamento. Além disso, os dados serão compartilhados com parceiros externos. Em condições ideais, uma prática que se adequa a este cenário é