Anthropic підтвердили вчора, що для вотермарки тексту будуть використовувати гуглівську технологію SynthID 2024 року на нових моделях. Тобто будуть по хеш-ключу підбирати ті слова, які на думку моделі не впливають на сенс тексту. Детектити таке можна тільки на відносно великих обсягах тексту, на маленьких не особливо вийде.
Треба почекати, що напишуть реальні експерти з цього приводу, а не seoшники, але загалом можливо зробити декілька протидій: генерувати тексти маленькими обсягами і склеювати, переписувати іншою моделлю, наприклад, трохи натренувати нашу улюблену Gemma 4 2b - тоді можна хоч з телефону це робити. Ще можна дістати дуже-дуже-дуже багато різних текстів усіма можливими мовами, реверс-інженернути цю вотермарку і навчитися її видаляти за паттерном без ключа. Але на це піде пару місяців, купа токенів і взагалі ROI важко порахувати, чи він взагалі буде.
Anthropic пообіцяли надати якусь тулзу, де можна буде перевіряти такі тексти на ймовірність того, що їх торкався Claude. Тому що те, що ми зараз ним перекладаємо і просто редагуємо, теж помічається.
Внесли відповідні зміни в нашу попередню новину.