Anthropic 8 октября обновил правила использования систем искусственного интеллекта Claude. В обновлённом документе прямо запрещены целые направления злоупотребления искусственным интеллектом, включая вмешательство в выборы, создание оружейных программ и деятельность по слежке. Правила расширяют прежнюю политику компании и включают ряд новых пунктов.

По данным TechCrunch, обновление было представлено компанией через открытый для общественности пост. Изменения внесены в ответ на случаи злоупотреблений, зафиксированные в ходе использования моделей в публичной и корпоративной среде. Новые правила в равной мере распространяются на всех пользователей, в том числе использующих API в коммерческих целях.

Как сообщается в публикации TechCrunch, перед обновлением политики компания отметила ряд случаев, когда модели использовались в кампаниях обмана и попытках вмешательства в выборы. Поэтому положения, касающиеся демократических процессов, выделены в документе в отдельную главу. Обновление было объявлено 8 октября и вступило в силу с того же дня.

Положения против вмешательства в выборы и кампаний обмана

Отдельные разделы обновлённого документа запрещают широкомасштабные кампании обмана. С помощью Claude нельзя вести поддельные аккаунты или создавать вымышленные источники новостей — такая деятельность прямо противоречит политике. Запрет не ограничивается лишь созданием поддельных аккаунтов: согласно определению в политике, любая широкомасштабная кампания, направленная на введение общественности в заблуждение, относится к этой категории.

Раздел документа под названием «Do Not Undermine Democratic Processes» объединил правила против обмана избирателей и препятствования избирательному процессу. Эти положения открыто запрещают использование искусственного интеллекта с целью воздействия на демократические процессы.

«Do Not Undermine Democratic Processes» — название раздела обновлённых правил использования Anthropic. Раздел содержит правила против обмана избирателей и срыва избирательного процесса. Источник: TechCrunch.

По данным TechCrunch, эти правила не ограничиваются лишь днём голосования — запреты в политике распространяются и на предвыборный период, и вообще на демократические институты. То есть использование модели для распространения недостоверной информации в период избирательных кампаний или для введения избирателей в заблуждение запрещено.

При этом глава документа посвящена не только выборам государственного масштаба, но вообще демократическим процессам. Компания выделила эти положения как одну из важнейших частей политики.

Запрет жестокого обращения с моделью

Самый обсуждаемый пункт обновления — запрет продолжительного словесного насилия в отношении модели. Anthropic заявила, что будет применять это правило лишь в чрезвычайных случаях: если пользователь без какой-либо явной цели неоднократно жестоко обращается с моделью.

При этом политика не распространяется на обычное недовольство пользователей, споры с моделью, мрачные творческие темы или использование модели в целях тестирования и исследований. В посте компании эти границы обозначены чётко — правило направлено лишь на бесцельное повторяющееся жестокое обращение. То есть если пользователь, недовольный ответом модели, критикует её или испытывает её границы, это не считается нарушением правил.

The Verge осветил то же обновление независимо и опубликовал его под заголовком «Anthropic bans 'abusive or cruel behavior' towards Claude». Издание назвало этот пункт самым примечательным изменением в политике. Новость вызвала активное обсуждение и в сообществе Hacker News — тема набрала 88 баллов.

Раскрывая критерии применения этого пункта, компания ограничила его «крайне тяжёлыми случаями». Это означает, что правило почти не затронет повседневное использование — оно направлено лишь на случаи умышленных и повторяющихся оскорблений. Написание творческих текстов на мрачные темы или тестирование ответов модели по-прежнему разрешены.

Общая рамка противодействия злоупотреблениям

Anthropic регулярно обновляет правила использования, и новый документ стал очередным шагом в этой последовательности. Компания подчёркивает, что политика направлена на обеспечение безопасного и ответственного применения моделей.

Обновлённые правила не отменяют запретов предыдущей версии — они дополняют их. В частности, ограничения в отношении оружейных программ и деятельности по слежке сохранили своё место в документе, а новые пункты уточняют сферу их применения. Таким образом, политика объединила в одном документе как техническое, так и социальное направления безопасности.

Полный текст правил опубликован на официальном сайте компании и открыт для всех пользователей. Оба крупных технологических издания — TechCrunch и The Verge — осветили обновление независимо друг от друга в один день, что свидетельствует о широком общественном внимании к изменениям. Правила теперь действуют как обязательный документ для пользователей и разработчиков.