З’явився публічний інструмент, здатний усувати водяні знаки з контенту, створеного штучним інтелектом. Як це реалізовано?

Зараз доступний інструмент Watermarks Remover, який покликаний усувати з контенту, зокрема текстів, зображень та документів, ознаки генерації чи обробки штучним інтелектом.

Залишити коментар

З'явився публічний інструмент, здатний усувати водяні знаки з контенту, створеного штучним інтелектом. Як це реалізовано? 2

Зараз доступний інструмент Watermarks Remover, який покликаний усувати з контенту, зокрема текстів, зображень та документів, ознаки генерації чи обробки штучним інтелектом.

Цей інструмент був опублікований користувачем Guillaume Meyer.

Найпростіші способи маркування можуть включати неочевидні пробіли або Unicode-символи, які невидимі на екрані, але присутні в тексті. Watermarks Remover їх виявляє та видаляє. Інший вид «слідів» може бути прихований не в самому тексті чи зображенні, а всередині файлу. Наприклад, файли форматів PNG або JPEG можуть містити метадані з інформацією про джерело контенту та його редагування. Watermarks Remover здатен очищати такі дані з файлів PNG, JPEG, WebP, SVG, PDF, DOCX та інших форматів.

Однак, коли водяний знак прихований не в невидимих символах чи метаданих, видалення водяних знаків стає складнішим завданням.

Сьогодні видання dev.ua повідомляло, що компанія Anthropic планує використовувати саме такий метод маркування. Відтак, Claude не вставляє у текст секретний символ чи метадані. Натомість модель дещо змінює вибір слів під час генерації. Для читача текст виглядає цілком звично. Проте, у великому фрагменті виникає статистичний патерн, який спеціальний детектор може розпізнати за допомогою секретного ключа.

Наприклад, Claude може написати: «Сьогодні погода була прохолодною і…». Продовжити можна як словом «похмурою», так і «туманною» — обидва варіанти звучать природно, тому для загального змісту несуттєво, який саме варіант обере модель. Зазвичай, у таких випадках вибір частково визначається випадковістю. Але тепер умовний генератор випадкових чисел починає працювати за правилами, встановленими секретним ключем. Так, у наведеному сценарії, ключ може встановити ймовірність вибору слова «туманною» на рівні 85%. Якщо подібних збігів у тексті буде багато, він буде позначений як «оброблений ШІ».

З огляду на це, Watermarks Remover пропонує переписування тексту за допомогою локальної LLM. Припускається, що якщо маркування полягає у виборі слів початковою моделлю послідовно, то після достатньо суттєвого перефразування ця послідовність зміниться. Це може порушити статистичний патерн. Водночас, розробник не надає гарантій обходу детекторів. Адже без самого детектора та секретного ключа неможливо перевірити, чи маркування дійсно зникло.

Сама компанія Anthropic також зазначає, що їхній водяний знак не є абсолютно невразливим, адже значне редагування може його видалити.

Раніше dev.ua інформувало про запуск OpenAI інструменту для ідентифікації зображень, створених DALL-E 3.

Источник: www.vesti-ua.net

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *