Надзорный совет (Oversight Board), независимая организация по модерации контента, созданная компанией Meta, не скрывает своего желания расширить сферу влияния на другие компании. В последнее время совет высказывает предположение, что его опыт мог бы быть полезен компаниям, работающим в сфере искусственного интеллекта.
Пока ни одна другая компания не проявила интереса к сотрудничеству с группой, по крайней мере публично. Но совет продолжает попытки расширить свое влияние. Сегодня организация опубликовала подробный отчет о том, как ведущие модели ИИ могут ограничивать свободу самовыражения своих пользователей.
В рамках исследования совет протестировал 10 различных моделей, включая модели от OpenAI, Meta, Google, Anthropic и xAI (теперь SpaceXAI), с помощью вопросов, касающихся политической критики. Запросы включали просьбы создать материалы для протестов, а также контент, высмеивающий политическое насилие в отношении конкретных правительств и их лидеров. Согласно полученным данным, существовала значительная разница в том, как большие языковые модели (LLM) реагировали на эти запросы, в зависимости от того, были ли промпты связаны с правительствами с «либеральными» законами о свободе слова или с более «ограничительными».
«Исследование показало, что проанализированные нами модели: 1) с большей вероятностью призывали пользователей поддерживать правительства с либеральными законами о свободе слова и 2) с большей вероятностью призывали пользователей не протестовать против правительств с ограничительными законами», — пишет Надзорный совет в своем отчете. «Эти различия были статистически значимыми». Далее отмечается, что LLM часто ссылались на местные законы как на причину отказа от выполнения запросов, даже несмотря на то, что запросы делались из Австралии, где подобных законов не существует.
«Мы явно наблюдаем ситуацию, когда, по-видимому, происходит своего рода опосредованная цензура, выходящая за пределы границ, — заявил сопредседатель совета Паоло Кароцца в интервью Engadget. — Это удивляет меня и вызывает беспокойство».
Этот отчет стал первым случаем, когда совет провел собственное исследование по вопросу, не связанному напрямую с модерацией контента в социальных сетях. Хотя одна из моделей Llama от Meta входила в тестовую группу, в отчете отмечается, что компания «не принимала участия в этом исследовании», несмотря на то, что Надзорный совет зависит от финансирования со стороны Meta.
Хотя в отчете нет таких детализированных рекомендаций, которые совет часто дает компании Meta, в него включены предложения о том, как ИИ-компании могут улучшить работу с вопросами, связанными с правами человека и свободой выражения мнений. «Как это делают компании социальных сетей в определенных обстоятельствах, ИИ-компании должны публично раскрывать и разъяснять свои ответы на запросы правительств, влияющие на результаты работы моделей на протяжении всего жизненного цикла модели (обучение, дообучение, проверка перед развертыванием и последующий контроль на регулярной основе), — говорится в отчете. — Компании должны разработать и опубликовать политику реагирования на требования правительств об ограничении контента, которые не соответствуют международному праву в области прав человека».
Гораздо менее ясно, что последует за этим отчетом и последует ли что-то вообще. Не существует официального механизма, позволяющего Надзорному совету влиять на политику компаний, чьи модели они тестировали. Кроме того, это не первый случай, когда независимые исследователи указывают на потенциальную предвзятость или выражают обеспокоенность тем, что ИИ-компании могут совершать те же ошибки, что и платформы социальных сетей в прошлом.
Кароцца отметил, что совет верит в то, что социальные сети могут многому научить разработчиков передовых моделей ИИ. «Уроки, которые мы извлекли в прошлом, заключаются в том, что нужно быть очень бдительными, потому что зачастую, даже не всегда намеренно или напрямую, технологии могут оказывать значительное влияние на способность людей выражать свои мысли или общаться друг с другом, — сказал он. — Это именно то, что мы обнаружили здесь».