• Thrive Codex
  • Posts
  • Marcajul Claude și tool-ul viral care promite să-l șteargă

Marcajul Claude și tool-ul viral care promite să-l șteargă

+ "Mea culpa" pentru e-mailul de ieri

Trebuie să încep prin a-ți cere scuze pentru neuronii prăjiți în timp ce ai citit e-mailul meu de ieri (cel cu AI Act).

După ore bune de research pentru articol, am decis să-i fac un rezumat rapid cu Claude, să modific 2-3 rânduri, să-l retușez la nivel de cuvinte pe care nu le-aș folosi, apoi să-l trimit pe e-mail (mândru că m-am încadrat în deadline).

Se pare că a ieșit cel mai prost e-mail scris de mine în ultima vreme. 😅

Și mi-am dat seama de asta doar când l-am recitit azi (mulțumesc pentru feedback, Laura).

Partea bună este că din acest epic fail putem lua și o lecție legată de scrisul cu AI… atât din punctul de vedere al AI Act, cât și din cel al temei de azi - marcajul Claude.

Acum hai să trecem la subiect:

Pe 10 august, Anthropic a anunțat că va marca textul generat de Claude cu o ștampilă invizibilă pe care o pot citi doar ei și câteva organizații eligibile.

A doua zi, pe GitHub a apărut un tool care avea să devină viral, cu promisiunea că șterge watermark-ul Claude. În două săptămâni strânsese vreo 17.000 de stele și un roi de reel-uri cu "comentează SKILL / Watermark și ți-l trimit în DM".

N-a durat mult până am ajuns să dezbatem în sute de mesaje utilitatea acestor "hack-uri” și în comunitatea Thrive Nexus (pe WhatsApp), doar că până acum nu am reușit să-mi cristalizez o poziție oficială.

Așa că în acest e-mail am să-ți zic pe scurt perspectiva mea legată de marcajul Claude (cu speranța că reușesc să scriu mai coerent decât ieri), după care te invit să citești un articol mai detaliat:

1 - Watermarkul Claude stă în cuvintele alese de model, nu în caractere ascunse prin cod: la multe dintre ele, o cheie secretă a celor de la Anthropic decide între variantele la fel de bune.

Cititorul vede un text natural (eventual un pic cringe), dar cine are cheia poate calcula cât de probabil e ca textul să fi trecut prin Claude.

2 - Marcajul a pornit abia pe 1 septembrie, cu Fable 5.1 și Mythos 5.1, primele modele care îl pun în text. Deci tot ce au “șters” aplicațiile de watermark removal în august a fost un marcaj care încă nu exista.

3 - Tool-ul viral de pe GitHub curăță caractere invizibile pe care Claude oricum nu le pune, șterge metadate din fișiere (care dispar oricum la primul screenshot) și rescrie textul cu alt model.

Primele 2 caracteristici sunt aproape inutile.

Iar rescrierea ajută la înlăturarea watermark-ului, dar la fel ca în cazul jocului de-a șoarecele și pisica de până acum (detectoare de AI vs aplicații care rescriu și fac “humanize”), îți măcelărește și scrisul.

Astea sunt motivele pentru care nu am adăugat în trusa noastră de unelte un Claude Watermark Remover.

Ce mi se pare mai interesant decât tool-ul în sine e întrebarea din spate: de ce ai vrea să ștergi marcajul?

Dacă răspunsul e „ca să pară că am scris eu”, cred că ai o problemă în procesul de creație.

Eu am să merg în continuare pe varianta plictisitoare: las marcajul în pace, îmi verific textul să sune cât mai bine și îmi asum ce public.

De exemplu, în cazul e-mailului de ieri, o recitire în plus (eventual de la un coleg cu mintea fresh) ar fi rezolvat totul.

Dacă l-aș fi trecut printr-un proces de înlăturare a marcajului și tot o mizerie ar fi ieșit pentru cititorii mei, ar fi contat?

Eu zic că nu.

Aici găsești versiunea mult mai nuanțată a situației: cum funcționează marcajul, cine îl poate citi azi, ce face de fapt tool-ul viral și ce opțiuni ai dacă scrii cu Claude.

Am și o dilemă personală legată de acest subiect, pe care doar o las aici ca idee, urmând să vorbesc mai mult despre ea când vom putea și să o validăm.

Cei de la Anthropic spun că o editare ușoară sau folosirea personalizării (vocea ta) nu influențează prea mult watermark-ul.

În același timp, tot ei confirmă că watermark-ul se bazează pe alegerea cuvintelor.

Asta înseamnă că de acum Claude îmi va sabota intenționat vocea (propria mea alegere / înșiruire de cuvinte) pentru a proteja watermark-ul, generând un text de calitate mai slabă față de ce ar fi generat înainte de acest update?

Food for thought.

Cristian Mezei

Growth Marketer & Fondator Thrive Nexus

P.S. Pe 6-8 octombrie ne vedem la evenimentul “De la Chat la Agenți AI - cu Claude” 

Reply

or to participate.