ChatGPT намерен применять технологию под названием textGrain.
Сервис ChatGPT начинает снабжать генерируемые тексты невидимыми "водяными знаками" – пока что для только для пользователей из европейских стран. Это связано с новым законодательством ЕС, по которому искусственно созданный контент должен быть "распознаваем и отличаем".
Аналогичную технологию с августа применяет компания "Антропик", задействующая сервис "Клод". Для реализации этого новшества компаниям пришлось потрудиться, и даже искусственный интеллект им не слишком помог.
На данный момент не существует способа закрепить в тексте какую-либо неотъемлемую характеристику. Любой текст сравнительно легко перерабатывается, утрачивая первоначальные признаки.
OpenAI, разработчик ChatGPT, намерен применять технологию под названием textGrain. Когда модель генерирует текст, она подбирает каждое последующее слово на основе вероятностей. TextGrain корректирует эти вероятности, отдавая предпочтение определенным словам или их комбинациям, которые статистически маловероятны для "человеческого" письма, но при этом не нарушают смысл и синтаксис.
Машинный обработчик, знающий эти "веса", сможет проанализировать текст на предмет таких "водяных знаков" и сообщить, что текст, по всей вероятности, сгенерирован конкретной моделью ИИ.
Разумеется, при таком способе вероятность обнаружить скрытую маркировку выше на длинных текстах, чем на коротких отрезках.
Тем, кто поставит себе задачу избавить текст от "машинных" признаков, придется проделывать с ним дополнительные операции. Например, несколько раз прогонять через тот же ИИ с заданием перекомбинировать фразы и выборочно заменять разные слова синонимами.
Но и это может не спасать от конкретных следов "машинного маркера", то есть языковых конструкций, которые будут применяться в качестве "меток" и встречаться в тексте, возможно, по разу каждая, но в совокупности их окажется несколько, что позволит дешифратору сделать уверенный вывод. Особенно непросто будет избавиться от них в длинных текстах типа докладов и курсовых работ.
Разумеется, по мере практического использования компании будут анализировать возникающие способы переработки текстов и адаптировать водяные знаки, чтобы их труднее было "вывести" полностью.
Дешифраторы в OpenAI пока не намерены выкладывать в открытый доступ, но на первом этапе ими снабдят "одобренных исследователей и специализированные организации".
Судя по всему, одними из первых такими детекторами заинтересуются учебные заведения, которые испытывают в последние годы серьезные сложности с проверкой студенческих работ.
комментарии