Фрагменти

Модель ШІ Claude наноситиме водяні знаки на згенеровані тексти. Що це означає для користувачів?

Американський стартап у галузі ШІ, який займається розвитком моделі Claude, заявив про нові правил генерації тексту, зокрема водяні знаки. За даними компанії, вони впроваджують ці зміни з метою дотримання Закону ЄС про штучний інтелект.

Що таке водяні знаки?

Великі мовні моделі, такі як Claude, працюють, генеруючи по одному слову за раз. Щоразу, коли модель визначає наступне слово, вона обирає його зі списку потенційних кандидатів, зрештою вибираючи найбільш доречне. Візьмемо речення «Сьогодні була холодна погода і…». Наступним словом навряд чи буде «солодким». Проте цілком імовірно, що це буде прикметники «похмурий» або «сірий». У більшості випадків для читача не має великого значення, яке з цих двох останніх слів модель зрештою обере — зміст речення в обох випадках є практично однаковим. У таких випадках вибір визначається випадковим числом.

Техніка «водяного знака» використовує такі незначні вибори — які трапляються багато разів у генерованому тексті — щоб залишити певний шаблон у відповідях Claude. Цей шаблон є непомітним для читача, але є помітним для будь-кого, хто має ключ, що його кодує. Коли використовується техніка «водяного знака», вибір все ще здійснюється випадково, але джерело випадковості є іншим.

Читайте також: Чому ШІ не варто використовувати для написання змістовних текстів

Замість використання довільного генератора випадкових чисел для вибору наступного слова, технологія водяних знаків використовує ключ та кілька попередніх слів, щоб визначити, яке саме слово має вибрати модель. Тобто слова, які вибирає Claude, як і раніше, є випадковими, але тепер можна перевірити послідовність слів і з’ясувати, чи відповідає вона виборам, які зробив би Claude, якби використовував ключ. Якщо так, можна приписати ймовірність того, що текст був згенерований Claude.

Як водяні знаки впливають на результати роботи Claude?

Водяні знаки не впливають на якість результатів роботи Claude. Для читача відповідь із водяним знаком не відрізняється від відповіді без нього (у цьому сенсі водяні знаки ШІ суттєво відрізняються від своїх тезок на банкнотах, інших фізичних об’єктах та деяких цифрових документах, які є видимими неозброєним оком).

А як щодо випадків, коли Сlaude вичитував або редагував текст, написаний людиною?

Водяний знак застосовується лише до слів, які обирає ШІ. Коли Claude вичитує текст, написаний людиною, результат зазвичай є лише злегка відредагованим; оскільки майже всі слова належать людині, водяному знаку майже немає до чого прикріпитися.

Що це означає для користувачів?

Чи сповільнює це роботу моделі або робить її використання дорожчим?

Ні. Нанесення водяних знаків має незначний вплив на швидкість роботи моделей, а оскільки воно не створює додаткових токенів, вартість обслуговування та використання моделі залишається незмінною.

Чи можна за водяним знаком відстежити мене або мою організацію?

Ні. Водяні знаки застосовуються до Claude та його результатів. Вони не ідентифікують нічого, що стосується окремих користувачів. У водяному знаку або його ключі немає нічого, що дозволило б кому-небудь відновити будь-яку інформацію про користувача, його організацію або його чати з Claude.

ШІ законодавство мовні моделі штучний інтелект єс