Este repositório contém uma coleção de scripts Python para automatizar tarefas comuns com arquivos PDF e DOCX, como compressão, conversão e divisão de documentos.
- Python 3.x: Todos os scripts foram desenvolvidos em Python. Se você não o tiver instalado, pode baixá-lo em python.org.
- pip: O gerenciador de pacotes do Python, que geralmente já vem instalado com o Python.
Este script utiliza o Ghostscript para reduzir o tamanho de um arquivo PDF. É ideal para otimizar PDFs para envio por e-mail ou para publicação na web.
- Ghostscript: Uma ferramenta externa essencial para o funcionamento do script.
- Faça o download no site oficial do Ghostscript.
- Instale o programa em seu computador.
- Após a instalação, localize o caminho para o executável. Em sistemas Windows, geralmente é algo como:
C:\Program Files\gs\gs10.03.1\bin\gswin64c.exe
-
Abra o script (
comprimir_pdf.py) em um editor de texto. -
Configure o caminho do Ghostscript: Na linha
gs_path, substitua"definir o caminho do Ghostgenius"pelo caminho completo do executável que você localizou no passo anterior. Lembre-se de manter orantes das aspas para evitar problemas com as barras invertidas no Windows.# Exemplo para Windows gs_path = r"C:\Program Files\gs\gs10.03.1\bin\gswin64c.exe"
-
Defina os arquivos:
input_pdf: Coloque o nome do seu arquivo de entrada. Por padrão, é"entrada.pdf".output_pdf: Defina o nome do arquivo comprimido que será gerado.
-
Escolha o nível de compressão (opcional):
- A linha
-dPDFSETTINGS=/ebookdefine a qualidade. Você pode alterar para:/screen: Menor qualidade e menor tamanho (ótimo para visualização em tela)./ebook: Qualidade média, bom equilíbrio (padrão no script)./printer: Alta qualidade, para impressão./prepress: Qualidade máxima, para impressão profissional.
- A linha
-
Execute o script: Salve o arquivo e, no terminal, navegue até a pasta onde ele está e execute o comando:
python comprimir_pdf.py
O arquivo
saida_comprimida.pdfserá criado na mesma pasta.
Este script abre uma interface gráfica para que você selecione uma pasta de entrada (com arquivos .docx) e uma pasta de saída, convertendo todos os documentos para o formato .pdf.
- Biblioteca
docx2pdf: Instale a biblioteca necessária através do pip.pip install docx2pdf
- Microsoft Word (para Windows) ou Pages (para macOS): A biblioteca
docx2pdfutiliza o software de edição de texto instalado no seu sistema para realizar a conversão. Portanto, é obrigatório ter o Microsoft Word (em sistemas Windows) ou o Pages (em macOS) instalado.
-
Não é necessário editar o script para o uso básico.
-
Execute o script a partir do terminal:
python converter_docx_para_pdf.py
-
Selecione a pasta de entrada: Uma janela do explorador de arquivos será aberta. Navegue e selecione a pasta que contém todos os arquivos
.docxque você deseja converter. -
Selecione a pasta de saída: Uma segunda janela será aberta. Navegue e selecione a pasta onde os novos arquivos
.pdfdeverão ser salvos. -
Aguarde a conclusão: Ao final do processo, uma mensagem de sucesso ou de erro será exibida.
Este script divide um único arquivo PDF em vários arquivos menores, um para cada capítulo. Em seguida, ele agrupa todos os capítulos gerados em um único arquivo .zip.
- Biblioteca
PyPDF2: Instale a biblioteca para manipulação de PDFs via pip.pip install PyPDF2
-
Abra o script (
separar_pdf.py) em um editor de texto. -
Configure o arquivo de entrada: Na linha
pdf_path, altere"exemplo.pdf"para o nome do seu arquivo PDF.pdf_path = "meu_documento_completo.pdf"
-
Defina os capítulos: A parte mais importante é configurar a lista
chapters.- Cada item na lista é uma tupla no formato
("Nome do Capítulo", pagina_inicial). pagina_inicial: Importante! O número da página aqui deve ser o número que você vê no seu leitor de PDF menos 1. Por exemplo, se um capítulo começa na página 6 do leitor, você deve inserir o número 5 no script.
Exemplo de configuração:
# Supondo que o PDF tenha a seguinte estrutura: # - Introdução: começa na página 3 # - Desenvolvimento: começa na página 15 # - Conclusão: começa na página 40 chapters = [ ("Introdução", 2), # Página 3 - 1 = 2 ("Desenvolvimento", 14), # Página 15 - 1 = 14 ("Conclusão", 39), # Página 40 - 1 = 39 ]
O script calcula automaticamente a página final de cada capítulo.
- Cada item na lista é uma tupla no formato
-
Execute o script: Salve suas alterações e execute o comando no terminal:
python separar_pdf.py
-
Verifique os resultados:
- Uma nova pasta chamada
capitulos_pdfserá criada, contendo os PDFs de cada capítulo. - Um arquivo
exemplo.zip(ou o nome que você definiu na variávelzip_filename) será criado com todos os capítulos compactados.
- Uma nova pasta chamada