Remover metadados de um ficheiro Word ou PDF antes da IA
· Escrito e mantido por Nonimo
Remover metadados é o passo que falta a quem já limpou o texto. Um Word ou um PDF guarda, fora da página, quem o escreveu, quem o guardou por último, o nome do escritório, as datas, o modelo de onde nasceu e, nas fotografias coladas, a câmara e o sítio onde foram tiradas. Nada disso aparece no ecrã, e tudo segue com o ficheiro quando ele é carregado numa IA.
Este guia mostra o que um documento de teste deixa ler por dentro, depois de o texto já estar tapado, onde se veem esses campos no Word e no Acrobat, e como se apagam com as ferramentas que já tem. No fim, uma lista curta para confirmar antes de enviar.
Serve a quem trabalha com papel de clientes: o escritório de advogados, o gabinete de contabilidade, os recursos humanos, a clínica. Se o ficheiro é um PDF com partes tapadas a preto, o problema do texto debaixo da tarja tem um guia próprio sobre ocultar dados num PDF.
Remover metadados: o que o ficheiro diz de si sem aparecer na página
Metadados são dados sobre o documento, e não do documento. A Microsoft chama-lhes propriedades e explica que incluem o título, o nome do autor, o assunto e as palavras-chave, mais as que os programas mantêm sozinhos, como a data de criação e o nome de quem guardou o ficheiro pela última vez.
Uma parte é escrita por alguém, no dia em que preencheu um campo. Outra parte escreve-se sem ninguém dar por isso: o Word regista quem guardou por último, o relógio do computador marca as datas e a câmara do telemóvel pode gravar a posição, até na fotografia da carta de condução.
O nome sai de onde menos se espera
O caso mais comum não é um documento escrito do zero. É o parecer feito a partir de um modelo do escritório, a minuta herdada de um colega, a nota que passou por três pessoas antes de chegar à última. Cada uma destas passagens pode deixar o seu nome num campo diferente.
Por isso, um documento de onde já se tiraram os nomes do texto pode continuar a dizer quem é o cliente, quem trabalhou nele e em que casa. Num guia sobre o que tirar de uma peça processual antes da IA, o texto é o assunto; aqui, é o que fica à volta dele.
Uma nota interna de teste, lida por dentro
Para não falar de cor, fizemos um documento. Uma nota interna inventada, de um escritório de advogados também inventado, sobre a resposta de uma trabalhadora a uma nota de culpa. O texto já estava tapado: nome, NIF, email e telemóvel trocados por etiquetas. As propriedades ficaram como um escritório as deixaria.
Depois lemos o ficheiro com bibliotecas livres, sem abrir o Word: o formato .docx é um ficheiro ZIP com o texto de um lado e as propriedades noutro, e qualquer programa o abre.
O texto estava limpo; as propriedades não
A leitura devolveu o nome completo da trabalhadora, no título. Devolveu o nome da empresa cliente, no assunto; o da advogada que escreveu, no autor; o do colega que guardou por último; o do escritório e o do sócio gestor. E devolveu um número de processo interno, TV-2026-0413, numa propriedade personalizada que ninguém vê sem ir à procura.
Sobraram ainda dados de contexto que ajudam a situar o documento: 17 revisões, 212 minutos de edição, a data de criação a 10 de setembro e a última gravação a 14 de setembro, às 23h48. Ninguém escreveu nenhum destes números na nota.
Seis nomes, contando pessoas e empresas, num documento em que o texto não tinha nenhum. É o género de coisa que um gabinete que já trabalha com IA não costuma ter na lista.
A mesma leitura, sem programas
Não é preciso saber programar para ver isto. Numa cópia do ficheiro, troque a extensão .docx por .zip e abra-a como qualquer pasta comprimida. Dentro da pasta docProps há um ficheiro chamado core.xml, que se abre com o Bloco de Notas ou o TextEdit: o nome do autor e o de quem guardou por último estão lá, entre etiquetas, legíveis. Ao lado, o app.xml traz a empresa e o modelo.
É uma forma rápida de perceber que as propriedades não são um pormenor da janela do Word. São texto dentro do ficheiro, e qualquer programa que abra o ficheiro as encontra. Com um documento do LibreOffice passa-se o mesmo: também é um ZIP, e o que um .odt do Writer guarda fora da página vai do autor aos comentários.
Autor, empresa e modelo: as propriedades de um Word
No Word, a maior parte destes campos está à vista para quem souber onde olhar. Em Ficheiro e Informações, o painel da direita mostra autor, datas e quem guardou por último; a ligação Mostrar Todas as Propriedades abre o resto. Em Propriedades e depois Propriedades Avançadas, o separador Resumo reúne título, assunto, autor, gestor, empresa, categoria, palavras-chave e comentários.
| campo | onde se vê no Word | no teste |
|---|---|---|
| Autor | Informações, e Resumo | a advogada que escreveu |
| Guardado por último | Informações | um colega |
| Título e Assunto | Resumo | a trabalhadora e a empresa cliente |
| Empresa e Gestor | Resumo | o escritório e um sócio |
| Propriedade personalizada | separador Personalizar | um número de processo |
| Modelo | Inspetor de Documentos | o modelo com o nome da advogada |
Nomes dos separadores segundo a Microsoft em português de Portugal. A coluna da direita resume a leitura do ficheiro de teste.
O modelo e o escritório
O modelo merece uma linha à parte. Muitos escritórios têm os seus modelos com o nome da casa ou de quem os criou, e o documento guarda o nome do modelo de onde nasceu. No teste, esse nome trazia o do escritório e o da advogada. A Microsoft inclui o nome do modelo entre o que o Inspetor de Documentos procura, com as propriedades.
No teste, a empresa e o gestor estavam preenchidos sem aparecerem em lado nenhum da página: são campos que se enchem uma vez e raramente se voltam a abrir. Em Informações, a Microsoft indica que o autor se tira com o botão direito do rato, em Remover. É um dado que um notário atento ao sigilo não quereria ver seguir num ficheiro de escritura.
A pasta e o servidor por onde o ficheiro passou
Um documento que viveu numa biblioteca do SharePoint, ou noutro servidor de gestão de documentos, pode trazer propriedades dessa localização, avisa a Microsoft, e o Inspetor tem um grupo próprio para elas. Nos livros do Excel e nas apresentações do PowerPoint, a mesma página junta o caminho do ficheiro para publicar páginas Web e, no Excel, o caminho da impressora.
Nenhum destes campos diz, sozinho, quem é o cliente. Mas o nome de uma pasta costuma ser o nome de um processo, e o de uma impressora, o de um piso ou de um serviço. Juntos com uma data, contam uma parte da história do ficheiro que ninguém tencionava contar à IA.
Os nomes que o Outlook acrescenta
Há ainda um caminho menos conhecido. Segundo a Microsoft, quando se anexa a um email um ficheiro do Word, Excel ou PowerPoint, o Outlook clássico pode acrescentar informações pessoais às propriedades do anexo, como o nome ou o endereço de email, para a função de registar alterações. Quem não a usa pode desligar a opção Adicionar propriedades a anexos, nas Definições do Centro de Confiança.
As alterações registadas e os comentários, que também guardam nomes, são outra conversa: vivem dentro do documento e não nas propriedades, e ficam para o guia sobre o Word.
O PDF guarda o autor em dois sítios
Um PDF tem, em geral, dois lugares para metadados. Um é o dicionário de informações, com autor, título, assunto, palavras-chave, o programa que o criou e as datas; é o que o Acrobat mostra em Propriedades do Documento. O outro é um bloco XMP, um formato de metadados da Adobe que desde 2012 é também norma ISO, e que pode repetir os mesmos campos.
Fizemos o PDF da mesma nota, com o texto já tapado, e demos-lhe o autor e o título nos dois sítios. A leitura com a pypdf e com a PyMuPDF devolveu, nos dois lugares, a advogada, a trabalhadora no título, o escritório no programa de origem e as datas.
O programa de origem e as horas
Os campos que parecem técnicos também falam. No teste, as datas do XMP diziam que a nota foi criada numa manhã e guardada pela última vez perto da meia-noite, quatro dias depois. Para quem conhece o caso, uma hora destas situa o documento num momento concreto do processo.
Num PDF feito por digitalização, estes campos podem dizer outras coisas: o modelo do digitalizador, o programa de reconhecimento de texto, a data da digitalização. Não identificam o cliente, mas podem identificar o serviço e o dia.
Apagar só as propriedades deixa o XMP
Depois, esvaziámos só o dicionário de informações e deixámos o XMP como estava. A segunda leitura devolveu o dicionário vazio e o XMP intacto: o nome da advogada, o título com o nome da trabalhadora e as duas datas.
O dicionário de informações sai vazio. O XMP continua com a autora, o título com o nome da trabalhadora, o escritório e as duas datas.
As duas leituras voltam vazias. O texto da nota, já tapado, continua igual e legível.
Não testámos o Acrobat, e não dizemos o que ele faz com o XMP. Dizemos o que o teste mostra: um ficheiro pode parecer limpo numa janela e não o estar noutra, e a única forma de saber é ler outra vez depois de limpar. E o que acontece ao PDF depois de carregado depende do assistente: há guias sobre o Claude e sobre o Gemini.
Fotografias no documento: câmara, data e GPS
Uma fotografia tirada com o telemóvel, como a da cópia do Cartão de Cidadão, guarda dados EXIF, um formato normalizado pela associação japonesa de fabricantes de câmaras, a CIPA, hoje na versão 3.1. Entre os campos previstos estão o fabricante e o modelo da câmara, a data e hora e, se a localização estiver ligada, a latitude e a longitude.
Quando se cola uma fotografia num Word, o ficheiro de imagem entra no documento, e os dados vão com ele. A fotografia de teste, gerada por nós, levava uma câmara fictícia, uma data e as coordenadas da Praça do Comércio. Lidas de dentro do .docx, as três saíram inteiras.
Uma fotografia de uma obra, de um acidente, de uma ferida
Nos papéis de escritório, as fotografias não são decoração. São o dano no carro que vai para a seguradora, a humidade na casa arrendada, a lesão que acompanha um relatório. A coordenada diz onde foi tirada a imagem, e isso é muitas vezes a morada de alguém. Para papéis que trazem categorias especiais, a fotografia é mais um canal.
A correção mais simples é antes de colar: desligar a localização da câmara nos telemóveis com que se fotografam documentos de trabalho, da fatura à carta de condução, e confirmar se a fotografia a colar ainda traz coordenadas. Depois de colada, a fotografia leva esses dados para dentro do documento. Carregada sozinha numa IA, leva-os também, e nenhum dos quatro grandes assistentes diz se os tira ao recebê-la, como se mostra no guia sobre o que as IA guardam das fotos.
Porque contam quando o ficheiro inteiro vai para uma IA
Carregar um ficheiro numa IA não é o mesmo que colar texto. Quem cola, entrega o que selecionou. Quem carrega, entrega o ficheiro, com tudo o que traz dentro, e o fornecedor decide o que lê. Numa apresentação, isso inclui as notas de quem apresenta e os diapositivos que ninguém projetou.
A ajuda da OpenAI sobre ficheiros carregados é clara quanto ao que o ChatGPT consegue fazer com eles. Entre os exemplos de extração, a página indica «Extract metadata (author, creation date, etc.) from a document», ou seja, tirar os metadados de um documento, como o autor e a data de criação. É dado como utilização normal, não como exceção.
Um ficheiro lido por código
A mesma empresa explica, na página sobre análise de dados, que «For some data-analysis tasks, ChatGPT writes and runs Python code…»: para algumas análises, o ChatGPT escreve e corre código Python sobre o ficheiro. Foi isso, em pequeno, que fizemos no teste, com três bibliotecas livres. Um ficheiro lido por código entrega as propriedades a quem as pedir. Num livro de Excel, entrega também as folhas e as linhas que o ecrã não mostra.
Não quer dizer que cada conversa as leia. Quer dizer que estão ao alcance, e que o fornecedor as recebe. Retenção, treino e acesso humano às conversas mudam conforme o produto: veja o caso do ChatGPT e o do Copilot.
Colar o texto não leva as propriedades
A consequência prática é simples. Se a IA precisa de uma cláusula, de um parágrafo ou de uma tabela, colar esse excerto deixa as propriedades no computador. Se precisa do ficheiro, porque a formatação conta ou porque são cinquenta páginas, então os metadados têm de sair antes. Nos dois casos, o texto ainda precisa de ser revisto.
Remover metadados no Word com o Inspetor de Documentos
O Word tem uma ferramenta para isto, o Inspetor de Documentos. A Microsoft recomenda usá-lo numa cópia do documento original, porque nem sempre é possível recuperar o que ele remove. Em português de Portugal, o caminho é este:
- Em Ficheiro, escolha Guardar Como e grave uma cópia com outro nome.
- Na cópia, vá a Ficheiro, Informações, Verificar Existência de Problemas e Inspecionar Documento.
- Deixe marcadas as caixas que interessam, em especial Propriedades do Documento e Informações Pessoais, e escolha Inspecionar.
- Nos resultados, escolha Remover Tudo em cada grupo que quer limpar, e depois Reinspecionar.
A Microsoft avisa que, depois de remover conteúdo oculto, o Anular pode não o repor. É mais uma razão para trabalhar na cópia. As alterações registadas, essas, convém decidi-las antes no próprio Word, aceitando ou rejeitando cada uma, e os comentários eliminam-se à parte, como mostra o guia para remover alterações controladas no Word.
O que o Inspetor remove nas propriedades
Segundo a mesma página, o grupo Propriedades do Documento e Informações Pessoais trata os separadores Sumário, Estatísticas e Personalizar, os cabeçalhos de correio eletrónico, as listas de distribuição, o nome de utilizador e o nome do modelo. Pela descrição, é o grupo que cobre quase tudo o que o teste encontrou nas propriedades.
| grupo do Inspetor | o que remove, segundo a Microsoft |
|---|---|
| Propriedades do Documento e Informações Pessoais | separadores Sumário, Estatísticas e Personalizar, nome de utilizador, nome do modelo |
| Comentários, Revisões, Versões e Anotações | comentários, alterações registadas, versões |
| Dados XML Personalizados | dados XML guardados no documento |
Resumo de três dos grupos descritos pelo Microsoft Support em português de Portugal, na versão consultada para este guia.
Onde o Inspetor não chega
A própria Microsoft diz que há informação que o Inspetor não consegue remover, e dá exemplos: não deteta texto branco sobre fundo branco nem objetos tapados por outros objetos. E a fotografia colada é outro caso: o Inspetor não é descrito como limpando os dados EXIF das imagens, por isso a localização trata-se na origem, antes de colar.
Nos escritórios com muitos modelos, este passo cabe bem numa regra escrita. Se ainda não há uma, as regras de utilização de IA de um gabinete são um bom ponto de partida.
Propriedades do Documento no Acrobat, e a confirmação
A Adobe tem uma página em português sobre como remover metadados de um PDF em quatro passos: abrir o PDF, abrir o menu (no canto superior esquerdo, no Windows, ou na barra de menus, no macOS) e escolher Propriedades do Documento, editar ou eliminar os campos, e clicar em OK e guardar. A mesma página aponta o menu Metadados Adicionais, para ver outros campos.
A Adobe acrescenta dois avisos que valem para qualquer método. Depois de guardar, os metadados apagados não se recuperam, por isso trabalha-se numa cópia. E certas permissões de um PDF partilhado podem impedir a eliminação.
Imprimir para PDF, a alternativa da própria Adobe
Nas perguntas da mesma página, a Adobe indica outra via: imprimir para PDF, para guardar uma cópia simplificada do documento sem metadados. É uma saída prática para quem não tem o Acrobat Pro. Quem ocultou partes do PDF deve ligar também a opção de remover informações ocultas ao aplicar a ocultação, como explica o guia sobre ocultar dados num PDF.
Confirmar com uma segunda leitura
O teste do XMP deixa uma regra: depois de remover metadados, confirme. No Acrobat, abra outra vez Propriedades do Documento e Metadados Adicionais e veja se ainda aparece um nome. No Word, volte a Propriedades Avançadas e percorra os separadores. Se algum campo mantém um nome, o ficheiro ainda não está pronto.
Para quem recebe muito papel em PDF, como as câmaras municipais, esta confirmação é o que separa um procedimento de um hábito.
Um nome numa propriedade, à luz do RGPD
O RGPD não tem um artigo sobre metadados, nem precisa. O artigo 4.º define dado pessoal como informação relativa a uma pessoa singular identificada ou identificável, e dá como exemplos de identificadores o nome, um número de identificação e os dados de localização. O autor de um ficheiro é um nome; a coordenada de uma fotografia é um dado de localização.
A partir daí, aplicam-se as regras de sempre. O princípio da minimização, no artigo 5.º do RGPD, manda tratar só os dados de que a finalidade precisa. Uma IA a quem se pede que reveja uma cláusula não precisa de saber quem a escreveu, nem em que escritório, nem onde foi tirada a fotografia do anexo.
Os nomes da casa também contam
Os metadados não falam só do cliente. O autor, quem guardou por último e o gestor são, quase sempre, pessoas do próprio escritório: a advogada, o colega, o sócio. Também são titulares de dados, e também têm direito a que o seu nome não siga para um fornecedor sem necessidade.
É um ponto que as regras internas costumam esquecer, porque pensam no cliente. Uma política que diga «sem nomes de clientes» e deixe passar o autor do documento está a proteger metade das pessoas que o ficheiro nomeia.
A proteção por defeito começa no modelo
O artigo 25.º, n.º 2, pede medidas que assegurem que, por defeito, só são tratados os dados necessários. Num escritório, uma parte disso decide-se uma vez: modelos sem o nome de ninguém, a opção do Outlook desligada, a localização da câmara dos telemóveis de serviço desligada. O resto decide-se documento a documento.
Trocar os nomes por etiquetas não faz desaparecer o carácter pessoal dos dados, e o guia sobre pseudonimização explica porquê. Se um ficheiro destes já foi parar a uma IA, veja quando se comunica à CNPD.
O Nonimo com um Word ou um PDF
A app do Nonimo corre no computador de quem a usa, em Mac e em Windows. Recebe o documento na sua janela e devolve duas coisas: o texto com etiquetas no lugar dos dados, para colar na IA, e uma versão tapada do próprio documento. Foi assim que tratou o texto da nota de teste, antes de o pormos no Word:
ANTES (o texto da nota)
Trabalhadora: Joana Freixo Lemos
NIF: 999999990
Email: joana.lemos@example.com
Telemóvel: 000 000 002
A Sr.ª Joana Freixo Lemos apresentou resposta à nota de culpa no dia 12 de setembro.
Pede-se uma proposta de decisão até ao fim do mês. Responsável: Dra. Rita Carvalhais Monteiro.
DEPOIS (saída real do Nonimo · exemplo inventado)
Trabalhadora: [PESSOA_1]
NIF: [REFERENCIA_1]
Email: [E-MAIL_1]
Telemóvel: [TELEFONE_1]
A Sr.ª [PESSOA_1] apresentou resposta à nota de culpa no dia 12 de setembro.
Pede-se uma proposta de decisão até ao fim do mês. Responsável: Dra. [PESSOA_2].
Nomes e email inventados. O NIF e o telemóvel não pertencem a ninguém.
Na cópia tapada que a app faz de um Word, o autor, quem guardou por último, a empresa e o gestor ficam vazios; o título, o assunto, a descrição, as palavras-chave, a categoria e as propriedades personalizadas saem tapados; as imagens seguem sem os seus metadados.
Um PDF volta como um PDF novo, sem os metadados do original. A página de segurança explica como a app trabalha no seu computador.
Antes de enviar o ficheiro: o que confirmar nas propriedades
Seis perguntas para fazer antes de carregar um Word ou um PDF numa IA, da mais rápida à mais demorada:
- Chega um excerto, em vez do ficheiro? Se chega, cole o excerto e as propriedades ficam no computador.
- Quem aparece como autor? Veja em Informações e em Propriedades Avançadas, no Word, ou em Propriedades do Documento, no Acrobat.
- O título e o assunto dizem de quem é o caso? São os campos que mais vezes trazem o nome do cliente.
- De que modelo nasceu? Um modelo com o nome do escritório ou de alguém leva esse nome consigo.
- Há fotografias coladas? Se foram tiradas com a localização ligada, trazem as coordenadas.
- A segunda leitura saiu vazia? Depois de limpar, abra as propriedades outra vez.
Quando o documento veio de fora
Nem todos os metadados são da casa. Um contrato recebido da outra parte, um relatório enviado por um perito ou uma declaração que o cliente mandou por email trazem as propriedades de quem os fez: o nome do advogado contrário, a empresa do perito, o nome de quem o preparou do lado do cliente. Carregar esse ficheiro numa IA é entregar também esses nomes, que não são seus para entregar.
A regra prática é a mesma para tudo o que entra: antes de o dar a uma IA, trate-o como se tivesse sido escrito por si, e abra as propriedades.
Remover metadados leva dois ou três minutos, e é o que impede que um documento limpo na página continue a dizer, nas propriedades, de quem é. Nas páginas para escritórios de advogados e para contabilistas certificados há exemplos do texto que pode seguir.
Fontes
Verificadas a 28 de setembro de 2026.
- Microsoft Support, Remover dados ocultos e informações pessoais através da inspeção de documentos, apresentações ou livros, em português de Portugal. O caminho Ficheiro, Informações, Verificar Existência de Problemas, Inspecionar Documento; usar numa cópia; Remover Tudo; Anular pode não repor; o que o grupo Propriedades do Documento e Informações Pessoais remove, incluindo o nome do modelo; o que o Inspetor não deteta.
- Microsoft Support, Ver ou alterar as propriedades de um ficheiro do Office, em português de Portugal. Propriedades, ou metadados; Mostrar Todas as Propriedades; Propriedades Avançadas e o separador Resumo com título, assunto, autor, gestor, empresa, categoria, palavras-chave e comentários.
- Microsoft Support, Evitar a inclusão de informações pessoais ao enviar documentos do Office, em português de Portugal. O Outlook clássico pode acrescentar o nome ou o email às propriedades de um anexo; a opção Adicionar propriedades a anexos.
- Adobe, Remova metadados de um PDF em quatro passos, em português. Os quatro passos em Propriedades do Documento; o menu Metadados Adicionais; não se recuperam depois de guardar; permissões que impedem a eliminação; imprimir para PDF para uma cópia sem metadados.
- Adobe, XMP, documentação para programadores. O XMP é norma ISO (16684-1) desde 2012.
- CIPA, normas da associação de fabricantes de câmaras. Exif, versão 3.1 (CIPA DC-008), o formato de metadados das fotografias.
- OpenAI, File Uploads FAQ, centro de ajuda. Entre os exemplos de extração: «Extract metadata (author, creation date, etc.) from a document».
- OpenAI, Data analysis with ChatGPT, centro de ajuda. «For some data-analysis tasks, ChatGPT writes and runs Python code…»
- Regulamento (UE) 2016/679, versão portuguesa, na Procuradoria-Geral Regional de Lisboa. Artigo 4.º, ponto 1, definição de dados pessoais e exemplos de identificadores; artigo 5.º, n.º 1, alínea c), minimização; artigo 25.º, n.º 2, proteção de dados por defeito.
- Teste próprio, 28 de setembro de 2026: .docx gerado com a python-docx 1.2.0 e fotografia com EXIF gerada com a Pillow 11.3.0; PDF gerado com a reportlab 4.5.0 e XMP acrescentado com a pypdf 6.10.2; leitura com zipfile, lxml, Pillow, pypdf e PyMuPDF 1.26.5. Dados inventados.
O Nonimo é o software que faz isto no seu próprio computador: oculta nomes de clientes e números de identificação antes de o texto chegar ao ChatGPT. Sem conta, e com a app os dados dos seus clientes não saem do seu computador.
Perguntas frequentes
Como remover metadados de um documento Word?
Para remover metadados de um Word, trabalhe numa cópia e use o Inspetor de Documentos: Ficheiro, Informações, Verificar Existência de Problemas, Inspecionar Documento, e depois Remover Tudo nas propriedades. A Microsoft avisa que o que se remove pode não voltar com Anular. Confirme a seguir em Propriedades Avançadas. A app do Nonimo trata as propriedades principais na cópia tapada de um Word.
Que metadados tem um PDF e onde se veem?
Um PDF costuma trazer autor, título, assunto, palavras-chave, o programa que o criou e as datas. No Acrobat, veem-se em Propriedades do Documento, e a Adobe aponta ainda o menu Metadados Adicionais. No nosso teste, o autor estava em dois sítios, e apagar só as propriedades deixou o nome no segundo. A cópia que o Nonimo devolve de um PDF é um ficheiro novo, sem os metadados do original.
Copiar o texto para o chat também leva as propriedades do ficheiro?
Não. O que se copia e cola é o texto que está na página, e as propriedades ficam no ficheiro. É por isso que colar só o excerto necessário é mais seguro do que carregar o documento inteiro. O texto colado continua a precisar de revisão, porque os nomes e os números que lá estão seguem com ele. O Nonimo devolve esse texto já com etiquetas, pronto a colar.
Uma IA consegue ler o autor e as datas de um ficheiro?
Pode. A ajuda da OpenAI dá como exemplo de extração num ficheiro carregado tirar os metadados de um documento, como o autor e a data de criação. E para certas análises o ChatGPT escreve e corre código Python sobre o ficheiro. Não há razão para contar que o fornecedor ignore as propriedades. O Nonimo trata o texto e, na cópia de um Word feita pela app, as propriedades principais.
Uma fotografia dentro de um documento pode revelar onde foi tirada?
Pode. As fotografias guardam dados EXIF, que podem incluir a câmara, a data e, se o telemóvel tiver a localização ligada, as coordenadas GPS. Numa fotografia de teste colada num Word, uma biblioteca livre leu as três coisas de dentro do ficheiro. Retire a localização antes de colar a imagem. A app do Nonimo, na cópia tapada de um Word, devolve as imagens sem os seus metadados.
O autor gravado nas propriedades conta como dado pessoal?
Conta, em regra. O RGPD define dado pessoal como informação relativa a uma pessoa identificada ou identificável, e dá o nome como primeiro exemplo de identificador. O nome de quem escreveu, de quem guardou por último ou do gestor é isso mesmo. Se a IA não precisa dele, o artigo 5.º pede que não siga. A app do Nonimo esvazia o autor e quem guardou na cópia de um Word.
O Inspetor de Documentos do Word remove tudo?
Não, e a própria Microsoft o diz: há informação que o Inspetor não consegue remover, e ele não deteta texto branco sobre fundo branco nem objetos tapados por outros. Nas propriedades, remove o autor, as datas, os separadores Sumário, Estatísticas e Personalizar e o nome do modelo. Depois, confirme em Propriedades Avançadas.
Que propriedades de um Word trata a cópia tapada do Nonimo?
Na cópia tapada que a app devolve de um Word, ficam vazios o autor, a última pessoa que guardou, a empresa e o gestor. O título, o assunto, a descrição, as palavras-chave, a categoria e as propriedades personalizadas saem tapados, e as imagens seguem sem os seus metadados.