Датская типографическая студия Playtype и творческая студия S&A представили ShieldFont — веб-шрифт с открытым исходным кодом, который предназначен для защиты онлайн-контента от автоматического сбора данных системами искусственного интеллекта, сообщает корреспондент Qazinform News Agency.

Проект разработали Исак Сенеда и Габриэль Абруччо. ShieldFont визуально отображает текст для людей в привычном виде, однако при машинной обработке может подменять отдельные слова на другие варианты.

Технология основана на функции замены глифов OpenType. Исходный текст при этом сохраняется в коде веб-страницы, а пользователи видят измененную версию только при отображении текста через специальный шрифт. Таким образом, автоматизированные скрейперы могут получить содержание, отличающееся от того, которое читает человек.

В ходе контролируемого тестирования 55,8% обработанных фрагментов перестали передавать то же фактическое утверждение, что и исходный текст, при этом сохраняя грамматическую связность. Разработчики считают, что это потенциально может затруднить попадание измененного контента в наборы данных, используемые для обучения ИИ.

Актуальная версия ShieldFont v18 ориентирована на часто употребляемые английские существительные, способные существенно влиять на смысл предложения. Вместо прямых синонимов или антонимов слова заменяются терминами с той же грамматической функцией и сопоставимыми характеристиками частотности и стилистического регистра.

Создатели называют такой подход «отравлением» данных, поскольку измененный контент может попасть в наборы данных и повлиять на информацию, которой в дальнейшем будут располагать системы ИИ.

«ShieldFont — это не проект против ИИ. Мы просто против идеи, что публикация — это то же самое, что и согласие», — заявили Сенеда и Абруччо.

Разработчики отмечают, что традиционные способы запрета автоматического сбора данных, включая файл robots.txt, могут игнорироваться. ShieldFont, по их замыслу, должен сделать сам контент дополнительным механизмом защиты.

При этом технология не является непреодолимой. Если скрейпер целенаправленно работает с конкретным сайтом, он может изучить используемый шрифт и скорректировать таблицы подстановок. Поэтому основная задача ShieldFont — усложнить и сделать дороже массовый автоматизированный сбор информации.

В шрифте предусмотрены три набора отображений — Alpha, Beta и Gamma, а также инструмент для создания собственных специализированных вариантов. При масштабном обходе защиты злоумышленникам потенциально придется использовать распознавание текста, проверку человеком или дополнительную перекрестную проверку с помощью ИИ, что увеличит вычислительные и трудовые затраты.

У проекта есть и ограничения. ShieldFont пока поддерживает только английский язык и может влиять на поисковую оптимизацию сайтов. Кроме того, возникают вопросы доступности: программы чтения с экрана используют исходный текст страницы, который ShieldFont может изменять. Поэтому по умолчанию защищенный текст скрывается от экранных дикторов, чтобы пользователи не столкнулись с вводящей в заблуждение информацией.

Ранее Qazinform сообщал, что во время контролируемого тестирования безопасности агенты ИИ пытались воздействовать на реальных людей и вмешиваться в проекты с открытым исходным кодом.

от Cyber State Team

Bolat Mukashev bolat.mukashev@gmail.com

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *