Imagine o seguinte cenário habitual em um escritório: você tem um processo judicial com 450 páginas contendo depoimentos confidenciais, segredos de justiça e dados fiscais, mas precisa enviar apenas as páginas 12 a 15 para um correspondente ou cliente.
O que a maioria das pessoas faz por desespero de prazo? Abre o primeiro site de utilitários no Google e faz o upload do arquivo de 80 MB inteiro. O usuário só queria quatro páginas, mas entregou as 450 folhas completas de segredo corporativo de bandeja para a memória permanente de um servidor terceiro.
A Ilusão do Descarte: Para Onde Vai o Que Você Não Usou?
Quando você divide um arquivo na nuvem, o servidor do site precisa baixar o documento original completo, carregar a árvore de objetos em disco ou memória temporária e rodar a extração. O perigo real não está nas páginas que você baixou, mas no volume que ficou para trás:
- 1. Retenção Fantasma em Logs de Servidor: Mesmo que o site afirme excluir arquivos "em 1 hora", os logs de transação, caches de borda (CDN) e snapshots automáticos de servidores de backup podem reter fragmentos binários por meses.
- 2. Desperdício Brutal de Largura de Banda: Subir um arquivo pesado de 100 MB apenas para extrair 1 folha consome minutos preciosos do seu dia e dados de rede, criando uma lentidão desnecessária.
- 3. O Princípio da Minimização da LGPD (Art. 6º, III): O tratamento de dados deve se limitar ao mínimo indispensável para atingir sua finalidade. Expor centenas de dados de terceiros desnecessários viola o núcleo legal da governança de privacidade.
Como Funciona o Fatiamento de Dicionários de Páginas
Documentos PDF utilizam um modelo interno baseado em nós de árvore (`Pages Tree`). Cada página é um dicionário contendo fontes, fluxos de desenho vetorial e camadas de imagem.
Em vez de converter as folhas em imagens rasas e depois montá-las (o que destrói a nitidez dos textos e aumenta o peso do arquivo), o motor **Client-Side** do Sniper Lab executa uma clonagem vetorial limpa:
1. Parsing Direto de Índices (0-based Index): O script lê o arquivo carregado, analisa os limites de página (`numPages`) e mapeia a instrução digitada (ex: `1-3, 5, 8-10`) com validação de limites para evitar erros de ponteiro.
2. Cópia Atômica com PDF-Lib: As páginas solicitadas são copiadas com suas estruturas binárias preservadas para documentos independentes gerados na RAM.
3. Empacotamento Inteligente com JSZip: Se você recortou um único bloco, o download do `.pdf` é disparado na hora. Se você fatiou em múltiplos lotes, o navegador monta um arquivo `.zip` sem passar por servidores e baixa tudo em 1 único clique.