January 16

Как заставить ИИ соблюдать закон

Авторы статьи «Law-Following AI: Designing AI Agents to Obey Human Laws» определяют ИИ-агентов как

«ИИ-системы, которые могут выполнять задачи с использованием компьютера так же хорошо, как эксперты-люди»

и говорят: «Чем ИИ-агенты способнее, тем опаснее, поэтому давайте научим их следовать букве закона». Такие агенты могут, например, оплатить доступ к научному журналу или провести опрос на специальной платформе без участия человека. Таких агентов пока нет, но тот же Anthropic, например, работает в эту сторону.

Отдельно меня зацепило вот что: авторы хотят применять правовые санкции к ИИ-агентам. Здесь возникает сразу несколько вопросов:

  • Преступление характеризуется действием и намерением, а у ИИ намерений нет. Даже если предположить, что ИИ развился до того уровня, когда намерения у него есть, то как мы это проверим?
  • Как наказывать совершившего преступление ИИ-агента?

На первый вопрос авторы отвечают так:

«Если совершённое ИИ-агентом действие считалось бы преступлением для человека, мы будем считать его преступлением и для ИИ».

В первой главе, в разделе «D. Mischief from AI Henchmen» они приводят два вымышленных примера, в которых ИИ-агент совершает преступление. В первом примере ИИ-агент выбирает пользователя, который заработал много денег на инвестициях в криптовалюту, находит контакты его знакомых, генерирует порнографические материалы с участием этого пользователя и шантажирует его, чтобы получить 90% его активов. ИИ-агент работает на преступную группировку и проинструктирован её участниками.

В другом выдуманном примере группа ИИ-агентов по заказу действующего президента устраняет её ближайшего политического конкурента.

Далее авторы пишут:

«Эти зарисовки показывают, что у ИИ-агентов потенциально могут быть причины и возможности нарушить разнообразные законы в разных контекстах и таким образом нанести существенный вред.»

По-моему, не показывают.

По-моему, они всё равно показывают, что у некоторых людей есть дурные намерения, и эти люди могут пользоваться продвинутыми инструментами. ИИ-агенты в их примерах всё равно не обладают собственной волей и следуют инструкциям людей. В главе «II. Legal Duties for AI Agents: A Framework» авторы отвечают на этот и другие контраргументы. Меня они всё равно не убедили, но я предоставлю вам ознакомиться с их позицией самостоятельно, а не через призму моего изложения.

Я согласна с тем, что нужно делать ИИ-инструменты так, чтобы с их помощью было очень сложно что-то нарушить. В идеале, невозможно, но это недостижимо. То есть, если человек хочет получить чьи-то данные, ИИ-агент должен упорно отвечать: «Нельзя получить чужие данные, за это полагается такая-то ответственность,» – и не поддаваться ни на какие уговоры. Тогда большинство людей («обычных пользователей») не сможет ничего случайно нарушить, потому что,

  • во-первых, большинство людей не хотят ничего нарушать;
  • во-вторых, у большинства людей нет специальных навыков, чтобы обойти ограничения.

Но всё равно будут люди, которые захотят и будут обладать навыками, и надо, скорее, целиться на то, чтобы их отловить, скрутить и упечь в места не столь отдалённые на такой срок, чтобы потенциальный куш от нарушения не казался того стоящим.

И ещё на то, чтобы полиция училась их отлавливать, а не за комментарии людей кошмарить, но это уже другой разговор.

Я не согласна с тем, чтобы наделять ИИ-агентов правовыми обязанностями. Авторы пишут:

«Если один человек ткнул другого ножом, ответственность лежит на человеке. Но если нож имеет возможность рассудить, что втыкание его в другого человека незаконно, и что этого можно избежать, сложив лезвие, разумно будет от него требовать сложить лезвие.»

Да неразумно же.

Чтобы «рассудить» и «осознать» и всё в этом духе, нужна свобода воли. Нет свободы – нет ответственности. Нет ножек – нет мультиков. Но, возможно, мой взгляд здесь чересчур чёрно-белый, и я не права. Вы мне скажите.

Авторы говорят:

«У нас уже есть искусственные акторы: например, организации. И есть законы, которые регулируют поведение организаций и возлагают на них ответственность».

Но организации состоят из людей, и за уголовное преступление в тюрьму сядет человек-представитель организации: руководитель или конкретный сотрудник. Само преступление совершает не «организация», а конкретные люди. Если деятельность организации будет прекращена решением суда, конкретные люди потеряют работу и возможность (во всяком случае, временно) заниматься определённым делом.

По-моему, сравнение не вполне корректно.

Что касается наказаний для ИИ-нарушителей закона, на этот вопрос авторы не отвечают.

На самом деле, это очень продуманная работа. Она поднимает непростые вопросы, поэтому нормально ожидать, что какие-то из этих вопросов останутся неотвеченными. Я зацепилась за конкретный аспект – агентность ИИ, – потому что этот аспект входит в область моих интересов. Статья написана хорошим языком и не перегружена специальными терминами, так что рекомендую вам ознакомиться с ней самостоятельно: вы можете найти в ней что-то ещё важное, что я здесь опустила