30:00:00
Só Hoje
50% OFF
Guias

O que aquele removedor de marca d'água de código aberto viral realmente remove

Guias de limpeza e reescrita de marcas d'água de texto por IA.

7 min read
O que aquele removedor de marca d'água de código aberto viral realmente remove

Na semana passada, a Anthropic explicou publicamente a marca d'água de texto do Claude: nada é injetado na cadeia de caracteres. O sinal está nas palavras que são escolhidas. Alguns dias depois, a mídia de tecnologia chinesa publicou uma manchete mais chamativa: a marca d'água do Claude havia virado papel sem valor da noite para o dia.

O artigo apontava para um projeto no GitHub, watermarks-remover. A republicação da 36Kr em 17 de agosto de 2026 (da conta do WeChat 新智元) dizia que ele havia acumulado cerca de 11.000 estrelas em poucos dias, lançado sob licença MIT, e que conseguia limpar dados do Claude, do SynthID-Text do Google e dados C2PA presentes em arquivos. Parecia uma arma definitiva.

O que você realmente precisa é algo menor e mais útil: entender qual camada ele remove. Assim, você pode decidir se o seu rascunho precisa de uma limpeza de caracteres, de uma reescrita completa ou se deve ser deixado como está.

A manchete diz "papel sem valor". O autor, não.

A história na mídia fala de uma barreira sendo destruída. O repositório não foi escrito dessa forma.

Guillaume Meyer é explícito. A limpeza de Unicode é contável e verificável. A etapa que atua sobre marcas d'água de amostragem estatística funciona na base do melhor esforço. Até que os provedores publiquem detectores e chaves, nenhuma ferramenta pode certificar honestamente que uma verificação oficial falhará.

Isso é um limite técnico, não modéstia. A API de verificação da Anthropic ainda não está aberta para terceiros. Sem essa chave, dizer "verificamos a remoção" é mera suposição.

A parte útil da repercussão viral não é a palavra "quebrado". É o fato de o projeto finalmente separar tarefas que as pessoas insistem em misturar.

São três tarefas, não apenas uma marca d'água

Se você encarar o repositório como um único botão de "remover marca d'água", usará a camada errada.

Camada um: remover caracteres invisíveis. Espaços de largura zero, espaços incomuns, controles bidirecionais, caracteres de tag. Estes são pontos de código reais na cadeia de caracteres. Exclua-os e eles somem; o significado não muda. O espaço estreito sem quebra U+202F, que frequentemente vem junto ao copiar da interface web do ChatGPT, pertence a esta camada. É resíduo de colagem, não a marca d'água oficial do Claude. Detalhamos esse caminho no artigo sobre colagem do ChatGPT.

Camada dois: reescrever com outro modelo. A Anthropic disse a mesma coisa que o repositório enfatiza: edições superficiais geralmente mantêm o rastro estatístico. É necessário alterar uma grande parte da redação, frase por frase — e não apenas reorganizar seções ou renomear títulos. A estratégia do projeto é passar o texto por um modelo de outra origem (um Llama local, não o Claude novamente) e dizer a mesma coisa com palavras diferentes. Isso quebra o padrão de amostragem original. Também substitui o estilo e a voz do texto.

Camada três: remover metadados de arquivos. C2PA, EXIF e propriedades de documentos em PNG, JPEG, PDF e Word. Esses são rótulos no arquivo recipiente, não uma marca d'água estatística nas frases. Marcas em imagens no domínio dos pixels (sinal integrado à imagem) são outro problema diferente; o repositório mantém isso em backends opcionais e pesados.

Pense em lavar roupa. A camada um tira moedas do bolso — você consegue vê-las e contá-las. A camada dois desmancha a peça e tece outra que ainda se parece com uma camisa; os fios são novos. A camada três corta a etiqueta da gola. Todas as três podem ser chamadas de "remover uma marca". Você não pode tratar um fio tecido na peça como se fosse trocado no bolso.

O que fazer com o texto à sua frente

Não instale um serviço Python logo de início. Decida em qual camada você está.

O que você realmente temCamada do repositórioO que fazer na webUma verificação gratuita ajuda?
Espaços estranhos, busca com falhas, CMS alertando sobre caracteres ocultos após colar do ChatGPT / navegadorLimpeza de UnicodeFerramenta de caracteres invisíveis — cerca de 60 pontos de código, localSim. Encontre-os e exclua-os.
Restos de **bold** e cerquilhas de títulosNão é marca d'água — é MarkdownAba de Markdown na página inicialSim
Um rascunho longo do Claude posterior a agosto de 2026, marca d'água estatística oficialReescrita em nível de frasePro Text Watermark Remover — outro modelo reconstrói o significadoNão. Não há caracteres para encontrar.
Você quer apenas um tom diferenteO prompt de "humanizar" do repositório — não é o fluxo principal de marca d'águaHumanizador de IAIrrelevante
C2PA / EXIF em um PDF ou imagemCamada de arquivoFora do escopo aquiIrrelevante
Passar no Turnitin, GPTZero ou PangramNinguém pode prometer issoNão compre nenhuma ferramenta com essa promessaIrrelevante

Em resumo:

  • A verificação gratuita encontrou caracteres invisíveis → limpe-os primeiro. Essa etapa se resolve na hora.
  • A verificação não encontrou nada e o rascunho é principalmente um texto longo do Claude → ferramentas de caracteres não vão ajudar. O caminho descrito pela Anthropic é uma reescrita completa da redação.
  • A voz do texto importa mais do que a limpeza técnica → permaneça na camada um. Não force uma reescrita.
  • Você vai reescrever de qualquer forma → não passe o texto do Claude novamente pelo Claude. Você pode reinserir o mesmo tipo de sinal.

Já analisamos o mecanismo de amostragem no artigo explicativo sobre a marca d'água oficial. O ponto principal é este: a marca oficial não adiciona nada que você possa excluir; uma verificação gratuita que não encontra nada não significa que a marca esteja ausente, nem que ela tenha sumido. A página do detector lista resíduos de Unicode e de formatação. Não é a verificação com chave da Anthropic e não fornecerá uma pontuação de "porcentagem de IA".

Uma reescrita pode embaralhar as estatísticas. Ela também substitui o texto.

O README traz um parágrafo que os resumos quase nunca citam. As marcas estatísticas estão na escolha das palavras. Quase toda frase carrega um pouco do sinal. Mudar seções de lugar, alterar títulos ou ajustar alguns adjetivos quase não altera isso. Eliminá-lo significa reescrever frase por frase. Depois disso, a voz passa a ser do modelo de reescrita. O autor faz então uma pergunta direta e sincera: se você ia passar o rascunho por um modelo mais barato de qualquer forma, por que pagou pelo modelo premium logo no início?

Essa pergunta também se aplica aqui. A reconstrução Pro segue o mesmo caminho técnico: um modelo diferente escolhe as palavras novamente mantendo o significado. Isso corresponde ao que a Anthropic descreve como uma reescrita completa. Não é um certificado de que um detector oficial falhou. Esse detector não é público. Não emitiremos um selo de "remoção verificada".

Existe um custo real. Termos perdem precisão. O ritmo muda. Frases que você afinou perdem nuances. Use esta opção quando precisar das ideias e dos fatos, e a redação puder ser dita de outra forma. Deixe de lado quando esta frase exata for o produto final.

Não deixe onze mil estrelas escolherem a ferramenta

A contagem de estrelas reflete um momento, não uma prova técnica. As pessoas estão insatisfeitas com o fato de um produto pago marcar a saída globalmente sem opção de desligar. Essa insatisfação é real. Os limites de engenharia também são reais.

O repositório é útil se você trabalha no terminal: scripts locais, uma skill de agente, uma longa lista de formatos de arquivo. Não é um caminho mais curto se você deseja apenas colar um parágrafo no navegador. Você precisaria configurar um serviço Python para um trabalho focado principalmente em PDFs e imagens, não em texto web.

Não estamos integrando esse projeto a este site. A limpeza de caracteres continua gratuita e local. Marcas estatísticas continuam passando por uma reconstrução paga. Mantenha três mecanismos separados: resíduos de colagem do ChatGPT, sobras do próprio Gemini e a marca d'água estatística oficial do Claude. Mecanismos diferentes, ferramentas diferentes.

Da próxima vez que uma manchete disser que a marca d'água acabou da noite para o dia, pergunte qual camada foi eliminada: as moedas no bolso ou o fio no tecido. Se souber responder a isso, você não escolherá a ferramenta errada.


AI Text Watermark Remover é uma ferramenta independente de terceiros. Não possui afiliação com Anthropic, OpenAI ou Google.

Fontes: Anthropic, How Claude’s text watermark works, 14 de agosto de 2026; Guillaume Meyer, watermarks-remover; Republicação da 36Kr de 新智元, 17 de agosto de 2026

Artigos relacionados