Na era digital, onde o Print Screen é mais rápido que o clique do mouse, proteger dados sensíveis vai muito além de bloquear uploads ou controlar aplicativos. E se eu te dissesse que até aquela imagem inocente, colada num e-mail ou num chat, pode carregar dados confidenciais que ninguém percebe… exceto o Microsoft Purview?
Bem-vindo à Parte 8 da nossa série sobre prevenção contra vazamento de dados com Microsoft Purview – Data Loss Prevention (DLP). Depois de desbravarmos desde políticas básicas até bloqueios em apps como WhatsApp Desktop e Telegram Desktop (confere lá a Parte 7), agora vamos elevar o jogo.
Neste artigo, vamos mostrar como o reconhecimento óptico de caracteres (OCR) pode ser usado para identificar informações sensíveis escondidas dentro de imagens — sim, até prints de tela com CPF, cartão de crédito ou dados de saúde podem ser detectados e bloqueados em tempo real. Tudo isso com a inteligência nativa do Microsoft Purview.
Então prepara o café, ajeita a cadeira e vem comigo descobrir como impedir que até mesmo prints traiçoeiros vazem aquilo que deveria estar protegido.
O que você irá precisar para isso:
Para usar a digitalização de OCR, o administrador global de sua organização precisa verificar se há uma assinatura paga do Azure em vigor. Caso contrário, ele precisa configurá-la, seguindo as instruções em Criar suas assinaturas iniciais do Azure.
Quando você ativa o OCR, todos os tipos de informações confidenciais e classificadores treináveis podem detectar caracteres que estão em imagens.
Por ser um recurso opcional, o administrador global deve configurar o faturamento por assinatura para ativar o OCR. Consulte as instruções e preços em Configurar o faturamento do Microsoft Syntex no Azure para adicionar uma assinatura para OCR.
Observação: Depois que as informações de faturamento são inseridas no Microsoft Syntex, o administrador de conformidade pode configurar o OCR no Microsoft Purview, sem nenhuma configuração adicional ou requisitos de licenciamento.
Permissões:
- Compliance data administrator
- Global administrator
- Information Protection
- Information Protection Admin
Atenção: As implementações apresentadas em nossos artigos foram desenvolvidas com base em documentações oficiais e nas boas práticas recomendadas pela Microsoft. Entretanto, enfatizamos que qualquer implementação deve ser previamente testada em ambientes de homologação ou testes para garantir a segurança e a estabilidade do ambiente de produção.
Passo a passo – Hands On
1. Vamos acessar o portal do Purview.
2. No menu lateral esquerdo, clique em “Settings” e, em seguida, em “Optical character recognition”. Em seguida vamos clicar em “Try for free”, e na tela que se abrir, vamos deixar todas as opções selecionadas para fazer o scan e a detecção e podemos clicar em “Start estimation”.

Atenção: Leva no mínimo 24 horas para que os resultados comecem a aparecer. Você poderá visualizar os resultados depois disso. Quando começarmos a detectar imagens, você verá o custo associado no painel.
Após o tempo estimado pela Microsoft estiver concluido, conseguimos verificar os custos que iremos ter com as imagens que foram detectadas no ambiente.

Observação: Estamos usando o modo de testes gratuitos por 30 dias para precificarmos o custo, e realizarmos testes. Após esse período e necessário configurar faturamento do Microsoft Syntex pay-as-you-go. (Não é necessário configurar o Microsoft Syntex em si.) você encontra o link no começo do artigo para essa configuração.
Tipos de arquivos suportados: JPEG, JPG, PNG, BMP, TIFF e PDF (somente imagem) Tamanhos de arquivo: Os arquivos de imagem não podem ter mais de 20 MB para Exchange e Teams. Para SharePoint, OneDrive e pontos de extremidade Windows e macOS, o tamanho máximo do arquivo de imagem é 50 MB.
Resolução da imagem: A resolução da imagem deve ser de pelo menos 50 x 50 pixels e não maior que 16.000 x 16.000 px.
DOCX, PPTX, XLSX, PDFs (contendo texto e imagens pesquisáveis), RAR, TAR, ZIP, 7z: As imagens incorporadas nesses tipos de arquivo são extraídas e digitalizadas somente no Exchange.
Observação: A configuração do OCR ocorre no nível de tenant, portanto, uma vez configurado, o OCR estará disponível para toda a stack do Microsoft Purview.
Não é necessário criar classificadores de dados separados para o OCR. Depois que o OCR é configurado, os tipos de informações confidenciais existentes, os tipos de informações confidenciais baseados em correspondência exata de dados, os classificadores treináveis e os SITs de impressões digitais digitalizam imagens, bem como documentos e e-mails.
Então como vimos na informação acima, não precisamos criar nenhuma politica, pois como ja temos varias criadas em Data Loss Prevention, o OCR ira se utilizar delas automaticamente.
Então ao tentarmos fazer um teste de envio de uma imagem pelo Microsoft Teams que contenha por exemplo o numero de um cartão de credito, iremos receber a mensagem.

E assim, chegamos ao final de mais uma jornada do conhecimento, na qual aprendemos juntos como habilitar o Optical character recognition (OCR) no Microsoft Purview, garantindo a proteção das informações sensíveis e reforçando a segurança dos dados da empresa.
💬 Me conte nos comentários: você já implementou o Microsoft Purview usando o Optical character recognition (OCR) no seu ambiente?
Compartilhe sua experiência e faça parte também desta jornada de proteção e governança de dados. ☁️🔐